探索 APIAny 的对话、图像、视频、音频与安全检测模型——查看每个模型的能力、请求类型、价格与参数。
共 17 组

智谱 GLM-5.2 是新一代中英双语大模型,兼具通用对话、代码生成与 Agent 任务执行能力,在中文语境下的推理与工具调用表现出色,适合客服问答、代码辅助与自动化流程搭建,所有请求均可通过 APIAny 的 OpenAI 兼容 API 直接调用,也可在模型详情页在线 Playground 中预览效果。
输入
输出
输入
≈ $1.88-$3.75
输出
≈ $6.25-$12.5
缓存读取
≈ $0.375-$0.75

Google Gemini 3.5 Flash 是速度快、性价比高的多模态对话模型,支持图文混合输入,具备百万级上下文窗口与 6.5 万 token 输出上限,适合高并发的日常问答、内容生成与图像理解任务,所有请求均可通过 APIAny 的 OpenAI 兼容 API 直接调用。
输入
输出
输入
≈ $0.938-$1.88
输出
≈ $6.25-$12.5
缓存读取
≈ $0.0938-$0.188

MiniMax M3 是支持百万级超长上下文的大语言模型,擅长长文档理解、复杂推理与工具调用,最大输出可达 8192 token,适合处理长对话、长文本摘要与知识库问答等场景,所有请求均可通过 APIAny 的 OpenAI 兼容 API 直接调用,也可在模型详情页在线 Playground 中预览效果。
输入
输出
输入
≈ $1.2-$2.4
输出
≈ $5-$10
缓存读取
≈ $1.5-$3

DeepSeek V4 是强化推理能力的大语言模型,具备 12.8 万 token 上下文窗口,在代码生成与复杂逻辑任务上表现出色,以极具竞争力的价格提供高质量推理输出,适合编程助手与逻辑分析场景,所有请求均可通过 APIAny 的 OpenAI 兼容 API 直接调用,并可在线预览效果。
输入
输出
输入
≈ $0.212-$0.425
输出
≈ $0.475-$0.95
缓存读取
≈ $0.025-$0.05

OpenAI GPT-5.5 是旗舰级大模型,擅长复杂推理、代码生成与多步骤指令执行,支持 40 万 token 上下文窗口与 1.6 万 token 输出上限,适合高难度任务与生产级 Agent 应用,所有请求均可通过 APIAny 的 OpenAI 兼容 API 直接调用,并可在线预览效果。
输入
输出
输入
≈ $4.25-$8.5
输出
≈ $25-$50
缓存读取
≈ $0.425-$0.85

OpenAI GPT-5.6 Sol 是 GPT-5.6 系列的高能力版本,适合复杂推理、代码生成、智能体和高要求生产自动化,可通过 APIAny 的 OpenAI 兼容 API 调用。
输入
输出
输入
≈ $6-$12
输出
≈ $40-$80
缓存读取
≈ $0.85-$1.7

xAI Grok 4.5 是面向复杂推理、代码分析、长上下文与工具连接助手的高能力模型,可通过 APIAny 的 OpenAI 兼容接口统一接入。
输入
输出
输入
≈ $0.6-$1.2
输出
≈ $1.2-$2.4
缓存读取
≈ $0.6-$1.2

A premium reasoning route for visual front-end prototyping, repository-scale coding, large evidence sets, long-running agents, and complex knowledge work that benefits from a 1.05M-token working context.
输入
输出
输入
≈ $2-$4
输出
≈ $10-$20
缓存读取
≈ $0.2-$0.4

Google Gemini 2.5 Flash Lite 是超低成本、低延迟的轻量对话模型,具备百万级上下文窗口与 6.5 万 token 输出上限,适合高频次、大规模调用的日常问答、内容摘要与批处理任务,所有请求均可通过 APIAny 的 OpenAI 兼容 API 直接调用。
输入
输出
输入
≈ $0.1-$0.2
输出
≈ $0.15-$0.3
缓存读取
≈ $0.01-$0.02

Google Gemini 3.1 Flash Lite 在 2.5 代基础上升级了推理能力,同时保持经济实惠的调用成本,兼顾速度与质量,适合高频轻量级任务、批量内容生成与轻量级 Agent 调用,所有请求均可通过 APIAny 的 OpenAI 兼容 API 直接调用,并可在线预览效果。
输入
输出
输入
≈ $0.15-$0.3
输出
≈ $1-$2
缓存读取
≈ $0.0125-$0.025

Google Gemini 3.1 Pro 是 Gemini 系列旗舰多模态模型,具备强大的复杂推理与长上下文处理能力,支持图文混合输入,适合高要求的生产级应用、复杂 Agent 编排与深度内容分析,所有请求均可通过 APIAny 的 OpenAI 兼容 API 直接调用,并可在线预览效果。
输入
输出
输入
≈ $1.25-$2.5
输出
≈ $7.5-$15
缓存读取
≈ $0.625-$1.25

OpenAI GPT-4o mini 是快速、经济的多模态对话模型,支持图文输入,响应速度快、调用成本低,适合日常问答、轻量编码辅助、客服机器人等高频、低成本业务场景,所有请求均可通过 APIAny 的 OpenAI 兼容 API 直接调用,也可在模型详情页在线 Playground 中预览效果。
输入
输出
输入
≈ $0.275-$0.55
输出
≈ $0.412-$0.825
缓存读取
≈ $0.0138-$0.0275

OpenAI GPT-5.4 是面向高级推理、代码生成与 Agent 工作流的高能力模型,支持 40 万 token 上下文窗口与 1.6 万 token 输出上限,适合复杂生产任务与多步骤自动化流程,所有请求均可通过 APIAny 的 OpenAI 兼容 API 直接调用,并可在线预览效果。
输入
输出
输入
≈ $2.5-$5
输出
≈ $15-$30
缓存读取
≈ $0.25-$0.5

Anthropic Claude Opus 4.8 是 Claude 系列旗舰模型,面向最具挑战性的复杂推理、代码生成与长文本创作任务,具备出色的长上下文处理能力,适合专业写作、深度代码审查等高要求场景,所有请求均可通过 APIAny 的 OpenAI 兼容 API 直接调用,并可在线预览效果。
输入
输出
输入
≈ $2.5-$5
输出
≈ $12-$24
缓存读取
≈ $0.25-$0.5

Anthropic Claude Opus 5 from APIAny — Anthropic’s newest Opus-tier flagship for the hardest coding, long-running agents, and judgment-heavy review.
输入
输出
输入
≈ $3.75-$7.5
输出
≈ $18.75-$37.5
缓存读取
≈ $0.375-$0.75

Anthropic Claude Sonnet 4.6 是均衡型旗舰模型,在生产环境的响应速度与调用成本之间提供强劲的推理能力,具备良好的长上下文处理能力,适合大规模稳定部署的对话与内容生成业务,所有请求均可通过 APIAny 的 OpenAI 兼容 API 直接调用,并可在线预览效果。
输入
输出
输入
≈ $1.5-$3
输出
≈ $7.5-$15
缓存读取
≈ $1-$2

Anthropic Claude Sonnet 5 面向高能力编程智能体、长时推理、丰富工具调用和大上下文生产应用,在质量、速度与部署成本之间保持均衡,可通过 APIAny 统一调用。
输入
输出
输入
≈ $1.88-$3.75
输出
≈ $10-$20
缓存读取
≈ $1.25-$2.5