Nouveaux utilisateurs : crédits gratuits, sans carte bancaire Commencer
APIAny logoAPIAny
Modèles IA
TarifsAPI gratuite
Resources
ConnexionCommencer
Type de modèle
Tous les modèles48Génération de texte20Génération d’images10Génération vidéo17Génération audio0Détection de sécurité1
Provider

20 groupes

DeepSeek V4.1 Flash — Illustration de contexte, pas une sortie de ce modèle
LLM
Génération de texteDeepSeek logo

DeepSeek V4.1 Flash

DeepSeek V4.1 Flash: multimodal reasoning, coding and tool use with a 1M-token context window. Separate from DeepSeek V4 Flash.

Entrée

Sortie

Entrée

750 crédits/1M

≈ $0.375-$0.75

Sortie

3,000 crédits/1M

≈ $1.5-$3

Lecture cache

15 crédits/1M

≈ $0.0075-$0.015

DeepSeek V4 Flash — Illustration de contexte, pas une sortie de ce modèle
LLM
Génération de texteDeepSeek logo

DeepSeek V4 Flash

DeepSeek V4 Flash, variante à faible latence de V4, garde l'essentiel du raisonnement en réduisant temps de réponse et coût, pour forte charge.

Entrée

Sortie

Entrée

1,050 crédits/1M

≈ $0.525-$1.05

Sortie

3,150 crédits/1M

≈ $1.57-$3.15

Lecture cache

35 crédits/1M

≈ $0.0175-$0.035

GLM 5.3 Flash — Illustration de contexte, pas une sortie de ce modèle
LLM
Génération de texteGLM logo

GLM 5.3 Flash

GLM 5.3 Flash: multimodal reasoning, coding and tool use with a 1M-token context window. Thinking is always enabled with low, high or max effort.

Entrée

Sortie

Entrée

280 crédits/1M

≈ $0.14-$0.28

Sortie

980 crédits/1M

≈ $0.49-$0.98

Lecture cache

81 crédits/1M

≈ $0.0405-$0.081

Gemini 3.5 Flash — Illustration de contexte, pas une sortie de ce modèle
LLM
Génération de texteGoogle logo

Gemini 3.5 Flash

Gemini 3.5 Flash de Google, modèle conversationnel multimodal rapide et économique, entrée image et texte, contexte d'1 million de tokens, forte charge.

Entrée

Sortie

Entrée

1,875 crédits/1M

≈ $0.938-$1.88

Sortie

12,500 crédits/1M

≈ $6.25-$12.5

Lecture cache

187.5 crédits/1M

≈ $0.0938-$0.188

MiniMax M3 — Illustration de contexte, pas une sortie de ce modèle
LLM
Génération de texteMiniMax logo

MiniMax M3

MiniMax M3, grand modèle de langage à fenêtre de contexte d'1 million de tokens, excelle en compréhension de longs documents, raisonnement et outils.

Entrée

Sortie

Entrée

2,400 crédits/1M

≈ $1.2-$2.4

Sortie

10,000 crédits/1M

≈ $5-$10

Lecture cache

3,000 crédits/1M

≈ $1.5-$3

DeepSeek V4 — Illustration de contexte, pas une sortie de ce modèle
LLM
Génération de texteDeepSeek logo

DeepSeek V4

DeepSeek V4, LLM axé raisonnement avec contexte de 128K tokens, excelle en génération de code et logique complexe, à un tarif très compétitif.

Entrée

Sortie

Entrée

425 crédits/1M

≈ $0.212-$0.425

Sortie

950 crédits/1M

≈ $0.475-$0.95

Lecture cache

50 crédits/1M

≈ $0.025-$0.05

GPT 5.5 — Illustration de contexte, pas une sortie de ce modèle
LLM
Génération de texteOpenAI logo

GPT 5.5

GPT-5.5 d'OpenAI, modèle phare pour raisonnement complexe, génération de code et instructions multi-étapes, contexte de 400K tokens pour apps exigeantes.

Entrée

Sortie

Entrée

8,500 crédits/1M

≈ $4.25-$8.5

Sortie

50,000 crédits/1M

≈ $25-$50

Lecture cache

850 crédits/1M

≈ $0.425-$0.85

GPT 5.6 — Illustration de contexte, pas une sortie de ce modèle
LLM
Génération de texteOpenAI logo2 modèles

GPT 5.6

GPT-5.6 Sol d'OpenAI est la version haute capacité de la famille GPT-5.6 pour le raisonnement complexe, le code, les agents et l'automatisation exigeante.

Entrée

Sortie

Entrée

12,000 crédits/1M

≈ $6-$12

Sortie

80,000 crédits/1M

≈ $40-$80

Lecture cache

1,700 crédits/1M

≈ $0.85-$1.7

GPT 6 — Illustration de contexte, pas une sortie de ce modèle
LLM
Génération de texteOpenAI logo

GPT 6

OpenAI GPT-6 — a flagship model for complex reasoning, code generation, and multi-step instructions, with a 400K-token context window for demanding apps

Entrée

Sortie

Entrée

7,000 crédits/1M

≈ $3.5-$7

Sortie

60,000 crédits/1M

≈ $30-$60

Lecture cache

1,062.47 crédits/1M

≈ $0.531-$1.06

Grok 4.5 — Illustration de contexte, pas une sortie de ce modèle
LLM
Génération de textexAI logo2 modèles

Grok 4.5

Grok 4.5 de xAI est un modèle puissant pour le raisonnement, l'analyse de code, les contextes longs et les assistants connectés aux outils.

Entrée

Sortie

Entrée

1,200 crédits/1M

≈ $0.6-$1.2

Sortie

2,400 crédits/1M

≈ $1.2-$2.4

Lecture cache

1,200 crédits/1M

≈ $0.6-$1.2

Grok 4.6 — Illustration de contexte, pas une sortie de ce modèle
LLM
Génération de textexAI logo

Grok 4.6

Grok 4.6 is an advanced AI model designed to deliver fast, writing, coding, research, data analysis, and creative problem-solving through natural conversation

Entrée

Sortie

Entrée

1,200 crédits/1M

≈ $0.6-$1.2

Sortie

2,400 crédits/1M

≈ $1.2-$2.4

Lecture cache

1,200 crédits/1M

≈ $0.6-$1.2

Kimi K3 — Illustration de contexte, pas une sortie de ce modèle
LLM
Génération de texteKimi logo

Kimi K3

A premium reasoning route for visual front-end prototyping, repository-scale coding, large evidence sets, long-running agents, and complex knowledge work that benefits from a 1.05M-token working context.

Entrée

Sortie

Entrée

4,000 crédits/1M

≈ $2-$4

Sortie

20,000 crédits/1M

≈ $10-$20

Lecture cache

400 crédits/1M

≈ $0.2-$0.4

Gemini 2.5 Flash Lite — Illustration de contexte, pas une sortie de ce modèle
LLM
Génération de texteGoogle logo

Gemini 2.5 Flash Lite

Gemini 2.5 Flash Lite de Google, modèle conversationnel ultra économique et rapide, contexte d'1 million de tokens, pour tâches quotidiennes fréquentes.

Entrée

Sortie

Entrée

200 crédits/1M

≈ $0.1-$0.2

Sortie

300 crédits/1M

≈ $0.15-$0.3

Lecture cache

20 crédits/1M

≈ $0.01-$0.02

Gemini 3.1 Flash Lite — Illustration de contexte, pas une sortie de ce modèle
LLM
Génération de texteGoogle logo

Gemini 3.1 Flash Lite

Gemini 3.1 Flash Lite de Google améliore le raisonnement par rapport à la 2.5 tout en restant économique, équilibrant vitesse et qualité au quotidien.

Entrée

Sortie

Entrée

300 crédits/1M

≈ $0.15-$0.3

Sortie

2,000 crédits/1M

≈ $1-$2

Lecture cache

25 crédits/1M

≈ $0.0125-$0.025

Gemini 3.1 Pro — Illustration de contexte, pas une sortie de ce modèle
LLM
Génération de texteGoogle logo

Gemini 3.1 Pro

Gemini 3.1 Pro de Google, modèle multimodal phare de Gemini, raisonnement complexe puissant et long contexte pour applications de production exigeantes.

Entrée

Sortie

Entrée

2,500 crédits/1M

≈ $1.25-$2.5

Sortie

15,000 crédits/1M

≈ $7.5-$15

Lecture cache

1,250 crédits/1M

≈ $0.625-$1.25

GPT 4o Mini — Illustration de contexte, pas une sortie de ce modèle
LLM
Génération de texteOpenAI logo

GPT 4o Mini

GPT-4o mini d'OpenAI, modèle conversationnel multimodal rapide et abordable, pour questions quotidiennes et aide au code léger, faible coût.

Entrée

Sortie

Entrée

550 crédits/1M

≈ $0.275-$0.55

Sortie

825 crédits/1M

≈ $0.412-$0.825

Lecture cache

27.5 crédits/1M

≈ $0.0138-$0.0275

GPT 5.4 — Illustration de contexte, pas une sortie de ce modèle
LLM
Génération de texteOpenAI logo3 modèles

GPT 5.4

GPT-5.4 d'OpenAI, modèle très performant pour raisonnement avancé, génération de code et workflows d'agents, contexte de 400K tokens en production.

Entrée

Sortie

Entrée

5,000 crédits/1M

≈ $2.5-$5

Sortie

30,000 crédits/1M

≈ $15-$30

Lecture cache

500 crédits/1M

≈ $0.25-$0.5

Claude Opus 4.8 — Illustration de contexte, pas une sortie de ce modèle
LLM
Génération de texteAnthropic logo

Claude Opus 4.8

Claude Opus 4.8 d'Anthropic, modèle phare de la gamme pour raisonnement, code et rédaction longue les plus exigeants, excellente gestion du contexte long.

Entrée

Sortie

Entrée

5,000 crédits/1M

≈ $2.5-$5

Sortie

24,000 crédits/1M

≈ $12-$24

Lecture cache

500 crédits/1M

≈ $0.25-$0.5

Claude Opus 5 — Illustration de contexte, pas une sortie de ce modèle
LLM
Génération de texteAnthropic logo

Claude Opus 5

Anthropic Claude Opus 5 from APIAny — Anthropic’s newest Opus-tier flagship for the hardest coding, long-running agents, and judgment-heavy review.

Entrée

Sortie

Entrée

7,500 crédits/1M

≈ $3.75-$7.5

Sortie

37,500 crédits/1M

≈ $18.75-$37.5

Lecture cache

750 crédits/1M

≈ $0.375-$0.75

Claude Sonnet 4.6 — Illustration de contexte, pas une sortie de ce modèle
LLM
Génération de texteAnthropic logo

Claude Sonnet 4.6

Claude Sonnet 4.6 d'Anthropic, modèle phare équilibré, raisonnement puissant à vitesse et coût adaptés à la production, déploiements stables à grande échelle.

Entrée

Sortie

Entrée

3,000 crédits/1M

≈ $1.5-$3

Sortie

15,000 crédits/1M

≈ $7.5-$15

Lecture cache

2,000 crédits/1M

≈ $1-$2

Quels modèles de génération de texte APIAny expose-t-elle ?

APIAny liste les modèles publics de chat et de texte sur un endpoint compatible OpenAI, avec des prix en crédits sur chaque fiche.

Par APIAny Editorial · Mis à jour 2026-09-01

Comment trouver le bon modèle APIAny ?

Filtrez par type ou fournisseur, comparez les crédits, puis ouvrez une page modèle pour le playground et les exemples de requête.

Quels modèles figurent dans cette vue ?

  1. DeepSeek V4.1 FlashDeepSeek V4.1 Flash: multimodal reasoning, coding and tool use with a 1M-token context window. Separate from DeepSeek V4 Flash.
  2. DeepSeek V4 FlashDeepSeek V4 Flash, variante à faible latence de V4, garde l'essentiel du raisonnement en réduisant temps de réponse et coût, pour forte charge.
  3. GLM 5.3 FlashGLM 5.3 Flash: multimodal reasoning, coding and tool use with a 1M-token context window. Thinking is always enabled with low, high or max effort.
  4. Gemini 3.5 FlashGemini 3.5 Flash de Google, modèle conversationnel multimodal rapide et économique, entrée image et texte, contexte d'1 million de tokens, forte charge.
  5. MiniMax M3MiniMax M3, grand modèle de langage à fenêtre de contexte d'1 million de tokens, excelle en compréhension de longs documents, raisonnement et outils.
  6. DeepSeek V4DeepSeek V4, LLM axé raisonnement avec contexte de 128K tokens, excelle en génération de code et logique complexe, à un tarif très compétitif.
  7. GPT 5.5GPT-5.5 d'OpenAI, modèle phare pour raisonnement complexe, génération de code et instructions multi-étapes, contexte de 400K tokens pour apps exigeantes.
  8. GPT 5.6GPT-5.6 Sol d'OpenAI est la version haute capacité de la famille GPT-5.6 pour le raisonnement complexe, le code, les agents et l'automatisation exigeante.
  9. GPT 6OpenAI GPT-6 — a flagship model for complex reasoning, code generation, and multi-step instructions, with a 400K-token context window for demanding apps
  10. Grok 4.5Grok 4.5 de xAI est un modèle puissant pour le raisonnement, l'analyse de code, les contextes longs et les assistants connectés aux outils.
  11. Grok 4.6Grok 4.6 is an advanced AI model designed to deliver fast, writing, coding, research, data analysis, and creative problem-solving through natural conversation
  12. Kimi K3A premium reasoning route for visual front-end prototyping, repository-scale coding, large evidence sets, long-running agents, and complex knowledge work that benefits from a 1.05M-token working context.
  13. Gemini 2.5 Flash LiteGemini 2.5 Flash Lite de Google, modèle conversationnel ultra économique et rapide, contexte d'1 million de tokens, pour tâches quotidiennes fréquentes.
  14. Gemini 3.1 Flash LiteGemini 3.1 Flash Lite de Google améliore le raisonnement par rapport à la 2.5 tout en restant économique, équilibrant vitesse et qualité au quotidien.
  15. Gemini 3.1 ProGemini 3.1 Pro de Google, modèle multimodal phare de Gemini, raisonnement complexe puissant et long contexte pour applications de production exigeantes.
  16. GPT 4o MiniGPT-4o mini d'OpenAI, modèle conversationnel multimodal rapide et abordable, pour questions quotidiennes et aide au code léger, faible coût.
  17. GPT 5.4GPT-5.4 d'OpenAI, modèle très performant pour raisonnement avancé, génération de code et workflows d'agents, contexte de 400K tokens en production.
  18. Claude Opus 4.8Claude Opus 4.8 d'Anthropic, modèle phare de la gamme pour raisonnement, code et rédaction longue les plus exigeants, excellente gestion du contexte long.
  19. Claude Opus 5Anthropic Claude Opus 5 from APIAny — Anthropic’s newest Opus-tier flagship for the hardest coding, long-running agents, and judgment-heavy review.
  20. Claude Sonnet 4.6Claude Sonnet 4.6 d'Anthropic, modèle phare équilibré, raisonnement puissant à vitesse et coût adaptés à la production, déploiements stables à grande échelle.

Sources

Quelles références officielles cette page cite-t-elle ?

Les citations ci-dessous proviennent de la documentation API officielle que APIAny implémente.

The Chat Completions API endpoint will generate a model response from a list of messages comprising a conversation.

— OpenAI Chat Completions API

The Gemini API provides access to Google's most capable generative AI models.

— Google Gemini API

The Images API provides several endpoints that let you generate images from text prompts or create edits of existing images.

— OpenAI Images API

Quels modèles d’IA APIAny expose-t-elle ?

Le catalogue de modèles APIAny est la liste live des modèles publics chat, image, vidéo, audio et sécurité appelables avec une seule clé API.

Tous les modèlesGénération de texteGénération d’imagesGénération vidéoGénération audioDétection de sécurité

Une passerelle API pour appeler tous vos modèles AI de production.

Modèles populaires

  • Seedance 2.0
  • GPT Image 2
  • Nano Banana 2
  • Z-Image
  • Gemini Omni

Collections de modèles

  • Toutes les collections
  • GPT API Family
  • Seedance API Family
  • Gemini API Family
  • GPT Image API

Types de modèles

  • Génération de texte
  • Génération d’images
  • Génération vidéo
  • Génération audio

Plateforme

  • Modèles
  • Tarifs
  • Documentation
  • À propos
  • Nous contacter

Mentions légales

  • Politique de confidentialité
  • Conditions d’utilisation
  • Politique de remboursement
EnglishFrançaisDeutsch中文日本語한국어Español
APIAny logoAPIAny© 2026 APIAny. Tous droits réservés.
support@apiany.ai