Z-Image
Z-Image d'Alibaba, modèle texte-vers-image léger et économique, multiples formats, parfait pour affiches, visuels e-commerce et contenu en masse.
Entrée
Sortie
dès
8 crédits /img
48 groupes
Z-Image d'Alibaba, modèle texte-vers-image léger et économique, multiples formats, parfait pour affiches, visuels e-commerce et contenu en masse.
Entrée
Sortie
dès
8 crédits /img
GPT-Image 2 d'OpenAI génère et retouche des images jusqu'en 4K (retouche localisée, fusion multi-références), facturé au token, pour design produit soigné.
Entrée
Sortie
dès
30 crédits /img
Nano Banana de Google, modèle d'image multicanal rapide et fiable, texte et image-vers-image, jusqu'à 5 références, pour la création visuelle quotidienne.
Entrée
Sortie
dès
15 crédits /img
Nano Banana 2 Lite de Google (Gemini 3.1 Flash-Lite Image), modèle léger DeepMind pour génération rapide en 1K et édition de prompts à faible latence.
Entrée
Sortie
dès
45 crédits /img
OpenAI GPT Image 2.5 utilise Flare par défaut pour générer et éditer rapidement avec plusieurs références, masques, transparence, six qualités et sorties 1K/2K/4K via APIAny.
Entrée
Sortie
dès
60 crédits /img
OpenAI GPT Image 2.5 Flare cible la génération et l’édition rapides avec références, masques, fond transparent, 1K à 4K et qualité réglable de auto à max.
Entrée
Sortie
dès
60 crédits /img
OpenAI GPT Image 2.5 Sunburst privilégie la précision et l’édition avancée des instructions complexes, du texte et des zones ciblées, avec six qualités, 1K à 4K, références et masques.
Entrée
Sortie
dès
60 crédits /img
Nano Banana 2 de Google, modèle d'image haut de gamme, texte et image-vers-image, jusqu'à 4K et 14 références, pour l'e-commerce et le design exigeant.
Entrée
Sortie
dès
25 crédits /img
Nano Banana Pro de Google, version phare de la gamme pour workflows pro, génère des images 4K haute fidélité à partir de jusqu'à 14 images de référence.
Entrée
Sortie
dès
60 crédits /img
Seedance 5.0 de ByteDance, via le canal officiel Volcengine Ark, génère des images jusqu'en 3K, idéal pour visuels e-commerce et contenu marketing.
Entrée
Sortie
dès
70 crédits /img

Seedance 2.0 de ByteDance, modèle vidéo au rendu cinématographique avec bande-son native, clips de 5 à 15 secondes en 1080p, pour publicités et courts formats.
Entrée
Sortie
dès
720 crédits /video

Seedance 1.0 de ByteDance, modèle image-vers-vidéo léger et rapide, clips de 5 à 10 secondes à faible coût, pour produire en masse des vidéos courtes.
Entrée
Sortie
dès
70 crédits /video

Seedance 1.5 de ByteDance améliore mouvement et détail par rapport à la 1.0, bande-son native, clips image-vers-vidéo jusqu'à 12 secondes, formats soignés.
Entrée
Sortie
dès
150 crédits /video

Veo 3.1 Fast de Google génère vite des vidéos texte ou image-vers-vidéo avec audio synchronisé natif, en 16:9 ou 9:16, pour les formats courts sociaux.
Entrée
Sortie
dès
330 crédits /video
DeepSeek V4.1 Flash: multimodal reasoning, coding and tool use with a 1M-token context window. Separate from DeepSeek V4 Flash.
Entrée
Sortie
Entrée
≈ $0.375-$0.75
Sortie
≈ $1.5-$3
Lecture cache
≈ $0.0075-$0.015
DeepSeek V4 Flash, variante à faible latence de V4, garde l'essentiel du raisonnement en réduisant temps de réponse et coût, pour forte charge.
Entrée
Sortie
Entrée
≈ $0.525-$1.05
Sortie
≈ $1.57-$3.15
Lecture cache
≈ $0.0175-$0.035
NSFW Image Detection classe le risque de contenu adulte dans les images envoyées ou distantes pour automatiser modération, files de contrôle et publication sécurisée.
Entrée
Sortie
dès
0.5 crédits /img

Alibaba Wan 3.0 Prime transforme un prompt en vidéo de 2 à 30 secondes, en 480p, 720p ou 1080p, avec format configurable et audio optionnel.
Entrée
Sortie
dès
786 crédits /video

MiniMax H3 (Hailuo 3) texte-vers-vidéo via EvoLink — 4-15 s en 768p ou 2K, mêmes paramètres que la route officielle, pour pubs et courts formats.
Entrée
Sortie
dès
760 crédits /video

MiniMax H3 (Hailuo 3) image-vers-vidéo via EvoLink — contrôle première/dernière image, 4-15 s en 768p ou 2K.
Entrée
Sortie
dès
760 crédits /video

MiniMax H3 (Hailuo 3) référence-vers-vidéo via EvoLink — jusqu’à 9 images, 3 vidéos et 3 audios, 4-15 s en 768p/2K.
Entrée
Sortie
dès
1,520 crédits /video

ByteDance Seedance 2.5 texte-vers-vidéo via EvoLink — 4-30 s en 480p/720p/1080p avec audio, duration -1 pour la durée auto.
Entrée
Sortie
dès
1,380 crédits /video

ByteDance Seedance 2.5 image-vers-vidéo via EvoLink — première/dernière image, 4-30 s jusqu’en 1080p.
Entrée
Sortie
dès
1,380 crédits /video

ByteDance Seedance 2.5 référence-vers-vidéo via EvoLink — jusqu’à 30 images, 10 vidéos et 10 pistes audio.
Entrée
Sortie
dès
1,680 crédits /video
ByteDance Seedance 2.5 video-edit via EvoLink — réécrire un clip existant par prompt, 4-30 s jusqu’en 1080p.
Entrée
Sortie
dès
1,680 crédits /video
ByteDance Seedance 2.5 video-extend via EvoLink — prolonger un clip existant par prompt, 4-30 s jusqu’en 1080p.
Entrée
Sortie
dès
1,680 crédits /video

ByteDance Seedance 2.0 Mini texte-vers-vidéo via EvoLink — brouillons économiques 4-15 s en 480p/720p pour itérer les prompts.
Entrée
Sortie
dès
192 crédits /video

ByteDance Seedance 2.0 Mini image-vers-vidéo via EvoLink — première/dernière image, 4-15 s en 480p/720p.
Entrée
Sortie
dès
192 crédits /video

ByteDance Seedance 2.0 Mini référence-vers-vidéo via EvoLink — références image/vidéo/audio, 4-15 s en 480p/720p.
Entrée
Sortie
dès
240 crédits /video

Gemini Omni texte-vers-vidéo de Google, via APIPod, génère des clips de 6, 8 ou 10 secondes en 720p ou 1080p à partir de texte, sans image de référence.
Entrée
Sortie
dès
500 crédits /video
GLM 5.3 Flash: multimodal reasoning, coding and tool use with a 1M-token context window. Thinking is always enabled with low, high or max effort.
Entrée
Sortie
Entrée
≈ $0.14-$0.28
Sortie
≈ $0.49-$0.98
Lecture cache
≈ $0.0405-$0.081
Gemini 3.5 Flash de Google, modèle conversationnel multimodal rapide et économique, entrée image et texte, contexte d'1 million de tokens, forte charge.
Entrée
Sortie
Entrée
≈ $0.938-$1.88
Sortie
≈ $6.25-$12.5
Lecture cache
≈ $0.0938-$0.188
MiniMax M3, grand modèle de langage à fenêtre de contexte d'1 million de tokens, excelle en compréhension de longs documents, raisonnement et outils.
Entrée
Sortie
Entrée
≈ $1.2-$2.4
Sortie
≈ $5-$10
Lecture cache
≈ $1.5-$3
DeepSeek V4, LLM axé raisonnement avec contexte de 128K tokens, excelle en génération de code et logique complexe, à un tarif très compétitif.
Entrée
Sortie
Entrée
≈ $0.212-$0.425
Sortie
≈ $0.475-$0.95
Lecture cache
≈ $0.025-$0.05
GPT-5.5 d'OpenAI, modèle phare pour raisonnement complexe, génération de code et instructions multi-étapes, contexte de 400K tokens pour apps exigeantes.
Entrée
Sortie
Entrée
≈ $4.25-$8.5
Sortie
≈ $25-$50
Lecture cache
≈ $0.425-$0.85
GPT-5.6 Sol d'OpenAI est la version haute capacité de la famille GPT-5.6 pour le raisonnement complexe, le code, les agents et l'automatisation exigeante.
Entrée
Sortie
Entrée
≈ $6-$12
Sortie
≈ $40-$80
Lecture cache
≈ $0.85-$1.7
OpenAI GPT-6 — a flagship model for complex reasoning, code generation, and multi-step instructions, with a 400K-token context window for demanding apps
Entrée
Sortie
Entrée
≈ $3.5-$7
Sortie
≈ $30-$60
Lecture cache
≈ $0.531-$1.06
Grok 4.5 de xAI est un modèle puissant pour le raisonnement, l'analyse de code, les contextes longs et les assistants connectés aux outils.
Entrée
Sortie
Entrée
≈ $0.6-$1.2
Sortie
≈ $1.2-$2.4
Lecture cache
≈ $0.6-$1.2
Grok 4.6 is an advanced AI model designed to deliver fast, writing, coding, research, data analysis, and creative problem-solving through natural conversation
Entrée
Sortie
Entrée
≈ $0.6-$1.2
Sortie
≈ $1.2-$2.4
Lecture cache
≈ $0.6-$1.2
A premium reasoning route for visual front-end prototyping, repository-scale coding, large evidence sets, long-running agents, and complex knowledge work that benefits from a 1.05M-token working context.
Entrée
Sortie
Entrée
≈ $2-$4
Sortie
≈ $10-$20
Lecture cache
≈ $0.2-$0.4
Gemini 2.5 Flash Lite de Google, modèle conversationnel ultra économique et rapide, contexte d'1 million de tokens, pour tâches quotidiennes fréquentes.
Entrée
Sortie
Entrée
≈ $0.1-$0.2
Sortie
≈ $0.15-$0.3
Lecture cache
≈ $0.01-$0.02
Gemini 3.1 Flash Lite de Google améliore le raisonnement par rapport à la 2.5 tout en restant économique, équilibrant vitesse et qualité au quotidien.
Entrée
Sortie
Entrée
≈ $0.15-$0.3
Sortie
≈ $1-$2
Lecture cache
≈ $0.0125-$0.025
Gemini 3.1 Pro de Google, modèle multimodal phare de Gemini, raisonnement complexe puissant et long contexte pour applications de production exigeantes.
Entrée
Sortie
Entrée
≈ $1.25-$2.5
Sortie
≈ $7.5-$15
Lecture cache
≈ $0.625-$1.25
GPT-4o mini d'OpenAI, modèle conversationnel multimodal rapide et abordable, pour questions quotidiennes et aide au code léger, faible coût.
Entrée
Sortie
Entrée
≈ $0.275-$0.55
Sortie
≈ $0.412-$0.825
Lecture cache
≈ $0.0138-$0.0275
GPT-5.4 d'OpenAI, modèle très performant pour raisonnement avancé, génération de code et workflows d'agents, contexte de 400K tokens en production.
Entrée
Sortie
Entrée
≈ $2.5-$5
Sortie
≈ $15-$30
Lecture cache
≈ $0.25-$0.5
Claude Opus 4.8 d'Anthropic, modèle phare de la gamme pour raisonnement, code et rédaction longue les plus exigeants, excellente gestion du contexte long.
Entrée
Sortie
Entrée
≈ $2.5-$5
Sortie
≈ $12-$24
Lecture cache
≈ $0.25-$0.5
Anthropic Claude Opus 5 from APIAny — Anthropic’s newest Opus-tier flagship for the hardest coding, long-running agents, and judgment-heavy review.
Entrée
Sortie
Entrée
≈ $3.75-$7.5
Sortie
≈ $18.75-$37.5
Lecture cache
≈ $0.375-$0.75
Claude Sonnet 4.6 d'Anthropic, modèle phare équilibré, raisonnement puissant à vitesse et coût adaptés à la production, déploiements stables à grande échelle.
Entrée
Sortie
Entrée
≈ $1.5-$3
Sortie
≈ $7.5-$15
Lecture cache
≈ $1-$2
APIAny est un catalogue public en direct de modèles chat, image, vidéo, audio et sécurité, appelables avec une clé API compatible OpenAI.
Par APIAny Editorial · Mis à jour
Filtrez par type ou fournisseur, comparez les crédits, puis ouvrez une page modèle pour le playground et les exemples de requête.
Sources
Les citations ci-dessous proviennent de la documentation API officielle que APIAny implémente.
The Chat Completions API endpoint will generate a model response from a list of messages comprising a conversation.
The Gemini API provides access to Google's most capable generative AI models.
The Images API provides several endpoints that let you generate images from text prompts or create edits of existing images.
Le catalogue de modèles APIAny est la liste live des modèles publics chat, image, vidéo, audio et sécurité appelables avec une seule clé API.