共 18 组

智谱 GLM-5.2 是新一代中英双语大模型,兼具通用对话、代码生成与 Agent 任务执行能力,在中文语境下的推理与工具调用表现出色,适合客服问答、代码辅助与自动化流程搭建,所有请求均可通过 APIAny 的 OpenAI 兼容 API 直接调用,也可在模型详情页在线 Playground 中预览效果。
输入
输出
输入
≈ $1.88-$3.75
输出
≈ $6.25-$12.5
缓存读取
≈ $0.375-$0.75

Google Gemini 3.5 Flash 是速度快、性价比高的多模态对话模型,支持图文混合输入,具备百万级上下文窗口与 6.5 万 token 输出上限,适合高并发的日常问答、内容生成与图像理解任务,所有请求均可通过 APIAny 的 OpenAI 兼容 API 直接调用。
输入
输出
输入
≈ $0.938-$1.88
输出
≈ $6.25-$12.5
缓存读取
≈ $0.0938-$0.188

MiniMax M3 是支持百万级超长上下文的大语言模型,擅长长文档理解、复杂推理与工具调用,最大输出可达 8192 token,适合处理长对话、长文本摘要与知识库问答等场景,所有请求均可通过 APIAny 的 OpenAI 兼容 API 直接调用,也可在模型详情页在线 Playground 中预览效果。
输入
输出
输入
≈ $1.2-$2.4
输出
≈ $5-$10
缓存读取
≈ $1.5-$3

DeepSeek V4 是强化推理能力的大语言模型,具备 12.8 万 token 上下文窗口,在代码生成与复杂逻辑任务上表现出色,以极具竞争力的价格提供高质量推理输出,适合编程助手与逻辑分析场景,所有请求均可通过 APIAny 的 OpenAI 兼容 API 直接调用,并可在线预览效果。
输入
输出
输入
≈ $0.212-$0.425
输出
≈ $0.475-$0.95
缓存读取
≈ $0.025-$0.05

OpenAI GPT-5.5 是旗舰级大模型,擅长复杂推理、代码生成与多步骤指令执行,支持 40 万 token 上下文窗口与 1.6 万 token 输出上限,适合高难度任务与生产级 Agent 应用,所有请求均可通过 APIAny 的 OpenAI 兼容 API 直接调用,并可在线预览效果。
输入
输出
输入
≈ $4.25-$8.5
输出
≈ $25-$50
缓存读取
≈ $0.425-$0.85

OpenAI GPT-5.6 Sol 是 GPT-5.6 系列的高能力版本,适合复杂推理、代码生成、智能体和高要求生产自动化,可通过 APIAny 的 OpenAI 兼容 API 调用。
输入
输出
输入
≈ $6-$12
输出
≈ $40-$80
缓存读取
≈ $0.85-$1.7
OpenAI GPT-6 — a flagship model for complex reasoning, code generation, and multi-step instructions, with a 400K-token context window for demanding apps
输入
输出
输入
≈ $3.5-$7
输出
≈ $30-$60
缓存读取
≈ $0.531-$1.06

xAI Grok 4.5 是面向复杂推理、代码分析、长上下文与工具连接助手的高能力模型,可通过 APIAny 的 OpenAI 兼容接口统一接入。
输入
输出
输入
≈ $0.6-$1.2
输出
≈ $1.2-$2.4
缓存读取
≈ $0.6-$1.2
Grok 4.6 is an advanced AI model designed to deliver fast, writing, coding, research, data analysis, and creative problem-solving through natural conversation
输入
输出
输入
≈ $0.6-$1.2
输出
≈ $1.2-$2.4
缓存读取
≈ $0.6-$1.2

A premium reasoning route for visual front-end prototyping, repository-scale coding, large evidence sets, long-running agents, and complex knowledge work that benefits from a 1.05M-token working context.
输入
输出
输入
≈ $2-$4
输出
≈ $10-$20
缓存读取
≈ $0.2-$0.4

Google Gemini 2.5 Flash Lite 是超低成本、低延迟的轻量对话模型,具备百万级上下文窗口与 6.5 万 token 输出上限,适合高频次、大规模调用的日常问答、内容摘要与批处理任务,所有请求均可通过 APIAny 的 OpenAI 兼容 API 直接调用。
输入
输出
输入
≈ $0.1-$0.2
输出
≈ $0.15-$0.3
缓存读取
≈ $0.01-$0.02

Google Gemini 3.1 Flash Lite 在 2.5 代基础上升级了推理能力,同时保持经济实惠的调用成本,兼顾速度与质量,适合高频轻量级任务、批量内容生成与轻量级 Agent 调用,所有请求均可通过 APIAny 的 OpenAI 兼容 API 直接调用,并可在线预览效果。
输入
输出
输入
≈ $0.15-$0.3
输出
≈ $1-$2
缓存读取
≈ $0.0125-$0.025

Google Gemini 3.1 Pro 是 Gemini 系列旗舰多模态模型,具备强大的复杂推理与长上下文处理能力,支持图文混合输入,适合高要求的生产级应用、复杂 Agent 编排与深度内容分析,所有请求均可通过 APIAny 的 OpenAI 兼容 API 直接调用,并可在线预览效果。
输入
输出
输入
≈ $1.25-$2.5
输出
≈ $7.5-$15
缓存读取
≈ $0.625-$1.25

OpenAI GPT-4o mini 是快速、经济的多模态对话模型,支持图文输入,响应速度快、调用成本低,适合日常问答、轻量编码辅助、客服机器人等高频、低成本业务场景,所有请求均可通过 APIAny 的 OpenAI 兼容 API 直接调用,也可在模型详情页在线 Playground 中预览效果。
输入
输出
输入
≈ $0.275-$0.55
输出
≈ $0.412-$0.825
缓存读取
≈ $0.0138-$0.0275

OpenAI GPT-5.4 是面向高级推理、代码生成与 Agent 工作流的高能力模型,支持 40 万 token 上下文窗口与 1.6 万 token 输出上限,适合复杂生产任务与多步骤自动化流程,所有请求均可通过 APIAny 的 OpenAI 兼容 API 直接调用,并可在线预览效果。
输入
输出
输入
≈ $2.5-$5
输出
≈ $15-$30
缓存读取
≈ $0.25-$0.5

Anthropic Claude Opus 4.8 是 Claude 系列旗舰模型,面向最具挑战性的复杂推理、代码生成与长文本创作任务,具备出色的长上下文处理能力,适合专业写作、深度代码审查等高要求场景,所有请求均可通过 APIAny 的 OpenAI 兼容 API 直接调用,并可在线预览效果。
输入
输出
输入
≈ $2.5-$5
输出
≈ $12-$24
缓存读取
≈ $0.25-$0.5

Anthropic Claude Opus 5 from APIAny — Anthropic’s newest Opus-tier flagship for the hardest coding, long-running agents, and judgment-heavy review.
输入
输出
输入
≈ $3.75-$7.5
输出
≈ $18.75-$37.5
缓存读取
≈ $0.375-$0.75

Anthropic Claude Sonnet 4.6 是均衡型旗舰模型,在生产环境的响应速度与调用成本之间提供强劲的推理能力,具备良好的长上下文处理能力,适合大规模稳定部署的对话与内容生成业务,所有请求均可通过 APIAny 的 OpenAI 兼容 API 直接调用,并可在线预览效果。
输入
输出
输入
≈ $1.5-$3
输出
≈ $7.5-$15
缓存读取
≈ $1-$2
APIAny 在同一 OpenAI 兼容端点上列出公开对话与文本模型,每个模型页展示实时积分价格。
作者 APIAny Editorial · 更新
按类型或供应商筛选,比较积分价格,再打开模型页做 Playground 测试并查看请求示例。
来源
以下引文来自 APIAny 对照实现的官方 API 文档。
The Chat Completions API endpoint will generate a model response from a list of messages comprising a conversation.
The Gemini API provides access to Google's most capable generative AI models.
The Images API provides several endpoints that let you generate images from text prompts or create edits of existing images.