DeepSeek V4.1 Flash
DeepSeek V4.1 Flash: multimodal reasoning, coding and tool use with a 1M-token context window. Separate from DeepSeek V4 Flash.
Entrée
Sortie
Entrée
≈ $0.375-$0.75
Sortie
≈ $1.5-$3
Lecture cache
≈ $0.0075-$0.015
20 groupes
DeepSeek V4.1 Flash: multimodal reasoning, coding and tool use with a 1M-token context window. Separate from DeepSeek V4 Flash.
Entrée
Sortie
Entrée
≈ $0.375-$0.75
Sortie
≈ $1.5-$3
Lecture cache
≈ $0.0075-$0.015
DeepSeek V4 Flash, variante à faible latence de V4, garde l'essentiel du raisonnement en réduisant temps de réponse et coût, pour forte charge.
Entrée
Sortie
Entrée
≈ $0.525-$1.05
Sortie
≈ $1.57-$3.15
Lecture cache
≈ $0.0175-$0.035
GLM 5.3 Flash: multimodal reasoning, coding and tool use with a 1M-token context window. Thinking is always enabled with low, high or max effort.
Entrée
Sortie
Entrée
≈ $0.14-$0.28
Sortie
≈ $0.49-$0.98
Lecture cache
≈ $0.0405-$0.081
Gemini 3.5 Flash de Google, modèle conversationnel multimodal rapide et économique, entrée image et texte, contexte d'1 million de tokens, forte charge.
Entrée
Sortie
Entrée
≈ $0.938-$1.88
Sortie
≈ $6.25-$12.5
Lecture cache
≈ $0.0938-$0.188
MiniMax M3, grand modèle de langage à fenêtre de contexte d'1 million de tokens, excelle en compréhension de longs documents, raisonnement et outils.
Entrée
Sortie
Entrée
≈ $1.2-$2.4
Sortie
≈ $5-$10
Lecture cache
≈ $1.5-$3
DeepSeek V4, LLM axé raisonnement avec contexte de 128K tokens, excelle en génération de code et logique complexe, à un tarif très compétitif.
Entrée
Sortie
Entrée
≈ $0.212-$0.425
Sortie
≈ $0.475-$0.95
Lecture cache
≈ $0.025-$0.05
GPT-5.5 d'OpenAI, modèle phare pour raisonnement complexe, génération de code et instructions multi-étapes, contexte de 400K tokens pour apps exigeantes.
Entrée
Sortie
Entrée
≈ $4.25-$8.5
Sortie
≈ $25-$50
Lecture cache
≈ $0.425-$0.85
GPT-5.6 Sol d'OpenAI est la version haute capacité de la famille GPT-5.6 pour le raisonnement complexe, le code, les agents et l'automatisation exigeante.
Entrée
Sortie
Entrée
≈ $6-$12
Sortie
≈ $40-$80
Lecture cache
≈ $0.85-$1.7
OpenAI GPT-6 — a flagship model for complex reasoning, code generation, and multi-step instructions, with a 400K-token context window for demanding apps
Entrée
Sortie
Entrée
≈ $3.5-$7
Sortie
≈ $30-$60
Lecture cache
≈ $0.531-$1.06
Grok 4.5 de xAI est un modèle puissant pour le raisonnement, l'analyse de code, les contextes longs et les assistants connectés aux outils.
Entrée
Sortie
Entrée
≈ $0.6-$1.2
Sortie
≈ $1.2-$2.4
Lecture cache
≈ $0.6-$1.2
Grok 4.6 is an advanced AI model designed to deliver fast, writing, coding, research, data analysis, and creative problem-solving through natural conversation
Entrée
Sortie
Entrée
≈ $0.6-$1.2
Sortie
≈ $1.2-$2.4
Lecture cache
≈ $0.6-$1.2
A premium reasoning route for visual front-end prototyping, repository-scale coding, large evidence sets, long-running agents, and complex knowledge work that benefits from a 1.05M-token working context.
Entrée
Sortie
Entrée
≈ $2-$4
Sortie
≈ $10-$20
Lecture cache
≈ $0.2-$0.4
Gemini 2.5 Flash Lite de Google, modèle conversationnel ultra économique et rapide, contexte d'1 million de tokens, pour tâches quotidiennes fréquentes.
Entrée
Sortie
Entrée
≈ $0.1-$0.2
Sortie
≈ $0.15-$0.3
Lecture cache
≈ $0.01-$0.02
Gemini 3.1 Flash Lite de Google améliore le raisonnement par rapport à la 2.5 tout en restant économique, équilibrant vitesse et qualité au quotidien.
Entrée
Sortie
Entrée
≈ $0.15-$0.3
Sortie
≈ $1-$2
Lecture cache
≈ $0.0125-$0.025
Gemini 3.1 Pro de Google, modèle multimodal phare de Gemini, raisonnement complexe puissant et long contexte pour applications de production exigeantes.
Entrée
Sortie
Entrée
≈ $1.25-$2.5
Sortie
≈ $7.5-$15
Lecture cache
≈ $0.625-$1.25
GPT-4o mini d'OpenAI, modèle conversationnel multimodal rapide et abordable, pour questions quotidiennes et aide au code léger, faible coût.
Entrée
Sortie
Entrée
≈ $0.275-$0.55
Sortie
≈ $0.412-$0.825
Lecture cache
≈ $0.0138-$0.0275
GPT-5.4 d'OpenAI, modèle très performant pour raisonnement avancé, génération de code et workflows d'agents, contexte de 400K tokens en production.
Entrée
Sortie
Entrée
≈ $2.5-$5
Sortie
≈ $15-$30
Lecture cache
≈ $0.25-$0.5
Claude Opus 4.8 d'Anthropic, modèle phare de la gamme pour raisonnement, code et rédaction longue les plus exigeants, excellente gestion du contexte long.
Entrée
Sortie
Entrée
≈ $2.5-$5
Sortie
≈ $12-$24
Lecture cache
≈ $0.25-$0.5
Anthropic Claude Opus 5 from APIAny — Anthropic’s newest Opus-tier flagship for the hardest coding, long-running agents, and judgment-heavy review.
Entrée
Sortie
Entrée
≈ $3.75-$7.5
Sortie
≈ $18.75-$37.5
Lecture cache
≈ $0.375-$0.75
Claude Sonnet 4.6 d'Anthropic, modèle phare équilibré, raisonnement puissant à vitesse et coût adaptés à la production, déploiements stables à grande échelle.
Entrée
Sortie
Entrée
≈ $1.5-$3
Sortie
≈ $7.5-$15
Lecture cache
≈ $1-$2
APIAny liste les modèles publics de chat et de texte sur un endpoint compatible OpenAI, avec des prix en crédits sur chaque fiche.
Par APIAny Editorial · Mis à jour
Filtrez par type ou fournisseur, comparez les crédits, puis ouvrez une page modèle pour le playground et les exemples de requête.
Sources
Les citations ci-dessous proviennent de la documentation API officielle que APIAny implémente.
The Chat Completions API endpoint will generate a model response from a list of messages comprising a conversation.
The Gemini API provides access to Google's most capable generative AI models.
The Images API provides several endpoints that let you generate images from text prompts or create edits of existing images.
Le catalogue de modèles APIAny est la liste live des modèles publics chat, image, vidéo, audio et sécurité appelables avec une seule clé API.