Z-Image
Z-Image de Alibaba es un modelo ligero de texto a imagen, rápido y económico, ideal para pósters, imágenes de e-commerce y contenido en gran volumen.
Entrada
Salida
desde
8 créditos /img
48 grupos
Z-Image de Alibaba es un modelo ligero de texto a imagen, rápido y económico, ideal para pósters, imágenes de e-commerce y contenido en gran volumen.
Entrada
Salida
desde
8 créditos /img
GPT-Image 2 de OpenAI genera y edita imágenes, con retoque local y fusión de referencias, hasta 4K y cobro por token, para publicidad y diseño de producto.
Entrada
Salida
desde
30 créditos /img
Nano Banana de Google es un modelo de imagen multicanal, rápido y estable, con texto e imagen a imagen y hasta 5 referencias, ideal para creatividad cotidiana.
Entrada
Salida
desde
15 créditos /img
Nano Banana 2 Lite de Google (Gemini 3.1 Flash-Lite Image) es un modelo ligero de DeepMind para generación rápida en 1K y edición de prompts con baja latencia.
Entrada
Salida
desde
45 créditos /img
OpenAI GPT Image 2.5 usa Flare por defecto para generar y editar imágenes con baja latencia, múltiples referencias, máscaras, transparencia, seis niveles de calidad y salida 1K/2K/4K mediante APIAny.
Entrada
Salida
desde
60 créditos /img
OpenAI GPT Image 2.5 Flare ofrece generación y edición rápidas con referencias múltiples, máscaras, transparencia, 1K–4K y calidad desde auto hasta max para flujos visuales frecuentes.
Entrada
Salida
desde
60 créditos /img
OpenAI GPT Image 2.5 Sunburst prioriza generación precisa y edición avanzada de instrucciones, texto y cambios locales, con seis niveles de calidad, 1K–4K, referencias y máscaras.
Entrada
Salida
desde
60 créditos /img
Nano Banana 2 de Google es un modelo de imagen de alta calidad, con texto e imagen a imagen, hasta 4K y 14 referencias, ideal para e-commerce y diseño.
Entrada
Salida
desde
25 créditos /img
Nano Banana Pro de Google es la versión insignia de la serie, para flujos profesionales, con imágenes en 4K de mayor fidelidad y hasta 14 referencias.
Entrada
Salida
desde
60 créditos /img
Seedance 5.0 de ByteDance, vía el canal oficial Volcengine Ark, genera imágenes desde texto o imagen hasta 3K, ideal para e-commerce y marketing visual.
Entrada
Salida
desde
70 créditos /img

Seedance 2.0 de ByteDance es un modelo de video con calidad cinematográfica, audio, referencias y clips de 5 a 15 segundos hasta 1080p, para anuncios y shorts.
Entrada
Salida
desde
720 créditos /video

Seedance 1.0 de ByteDance es un modelo ligero de imagen a video, genera clips de 5 a 10 segundos a bajo costo, ideal para producir en masa videos cortos.
Entrada
Salida
desde
70 créditos /video

Seedance 1.5 de ByteDance mejora el movimiento y detalle de la 1.0, con audio y clips de imagen a video de hasta 12 segundos, para videos con mejor acabado.
Entrada
Salida
desde
150 créditos /video

Veo 3.1 Fast de Google es un modelo rápido de texto o imagen a video con audio sincronizado nativo en 16:9 o 9:16, ideal para video corto en redes sociales.
Entrada
Salida
desde
330 créditos /video
DeepSeek V4.1 Flash: multimodal reasoning, coding and tool use with a 1M-token context window. Separate from DeepSeek V4 Flash.
Entrada
Salida
Entrada
≈ $0.375-$0.75
Salida
≈ $1.5-$3
Lectura de caché
≈ $0.0075-$0.015
DeepSeek V4 Flash es una variante de baja latencia de DeepSeek V4, conserva el razonamiento y reduce tiempo de respuesta, ideal para alta concurrencia.
Entrada
Salida
Entrada
≈ $0.525-$1.05
Salida
≈ $1.57-$3.15
Lectura de caché
≈ $0.0175-$0.035
NSFW Image Detection clasifica el riesgo de contenido adulto en imágenes subidas o remotas para automatizar moderación, revisión y publicación segura.
Entrada
Salida
desde
0.5 créditos /img

Alibaba Wan 3.0 Prime convierte prompts en vídeos rápidos de 2 a 30 segundos a 480p, 720p o 1080p, con relación de aspecto y audio opcional.
Entrada
Salida
desde
786 créditos /video

MiniMax H3 (Hailuo 3) texto a vídeo vía EvoLink — 4-15 s en 768p o 2K, con los mismos parámetros de la ruta oficial, para anuncios y cortos.
Entrada
Salida
desde
760 créditos /video

MiniMax H3 (Hailuo 3) imagen a vídeo vía EvoLink — control de primer/último fotograma, 4-15 s en 768p o 2K.
Entrada
Salida
desde
760 créditos /video

MiniMax H3 (Hailuo 3) referencia a vídeo vía EvoLink — hasta 9 imágenes, 3 vídeos y 3 audios, 4-15 s en 768p/2K.
Entrada
Salida
desde
1,520 créditos /video

ByteDance Seedance 2.5 texto a vídeo vía EvoLink — 4-30 s en 480p/720p/1080p con audio, o duration -1 para duración automática.
Entrada
Salida
desde
1,380 créditos /video

ByteDance Seedance 2.5 imagen a vídeo vía EvoLink — primer/último fotograma, 4-30 s hasta 1080p.
Entrada
Salida
desde
1,380 créditos /video

ByteDance Seedance 2.5 referencia a vídeo vía EvoLink — hasta 30 imágenes, 10 vídeos y 10 audios.
Entrada
Salida
desde
1,680 créditos /video
ByteDance Seedance 2.5 video-edit vía EvoLink — reescribe un clip existente con un prompt, 4-30 s hasta 1080p.
Entrada
Salida
desde
1,680 créditos /video
ByteDance Seedance 2.5 video-extend vía EvoLink — continúa un clip existente con un prompt, 4-30 s hasta 1080p.
Entrada
Salida
desde
1,680 créditos /video

ByteDance Seedance 2.0 Mini texto a vídeo vía EvoLink — borradores baratos de 4-15 s en 480p/720p para iterar prompts.
Entrada
Salida
desde
192 créditos /video

ByteDance Seedance 2.0 Mini imagen a vídeo vía EvoLink — primer/último fotograma, 4-15 s en 480p/720p.
Entrada
Salida
desde
192 créditos /video

ByteDance Seedance 2.0 Mini referencia a vídeo vía EvoLink — referencias de imagen/vídeo/audio, 4-15 s en 480p/720p.
Entrada
Salida
desde
240 créditos /video

Gemini Omni texto a video de Google, vía el canal APIPod, genera clips de 6, 8 o 10 segundos en 720p o 1080p desde texto, sin necesidad de imagen de referencia.
Entrada
Salida
desde
500 créditos /video
GLM 5.3 Flash: multimodal reasoning, coding and tool use with a 1M-token context window. Thinking is always enabled with low, high or max effort.
Entrada
Salida
Entrada
≈ $0.14-$0.28
Salida
≈ $0.49-$0.98
Lectura de caché
≈ $0.0405-$0.081
Gemini 3.5 Flash de Google es un modelo de chat multimodal rápido y económico, con imagen y texto y contexto de un millón de tokens, para alta concurrencia.
Entrada
Salida
Entrada
≈ $0.938-$1.88
Salida
≈ $6.25-$12.5
Lectura de caché
≈ $0.0938-$0.188
MiniMax M3 es un modelo de lenguaje con contexto de un millón de tokens, destacado en comprensión de documentos extensos, razonamiento y uso de herramientas.
Entrada
Salida
Entrada
≈ $1.2-$2.4
Salida
≈ $5-$10
Lectura de caché
≈ $1.5-$3
DeepSeek V4 es un modelo enfocado en el razonamiento, con contexto de 128K tokens, destacado en generación de código y lógica compleja a precio muy competitivo.
Entrada
Salida
Entrada
≈ $0.212-$0.425
Salida
≈ $0.475-$0.95
Lectura de caché
≈ $0.025-$0.05
GPT-5.5 de OpenAI es el modelo insignia para razonamiento complejo, código e instrucciones de varios pasos, con contexto de 400K tokens para apps exigentes.
Entrada
Salida
Entrada
≈ $4.25-$8.5
Salida
≈ $25-$50
Lectura de caché
≈ $0.425-$0.85
GPT-5.6 Sol de OpenAI es la versión de alta capacidad de GPT-5.6 para razonamiento complejo, código, agentes y automatización de producción exigente.
Entrada
Salida
Entrada
≈ $6-$12
Salida
≈ $40-$80
Lectura de caché
≈ $0.85-$1.7
OpenAI GPT-6 — a flagship model for complex reasoning, code generation, and multi-step instructions, with a 400K-token context window for demanding apps
Entrada
Salida
Entrada
≈ $3.5-$7
Salida
≈ $30-$60
Lectura de caché
≈ $0.531-$1.06
Grok 4.5 de xAI es un modelo de alta capacidad para razonamiento, análisis de código, contexto largo y asistentes conectados a herramientas.
Entrada
Salida
Entrada
≈ $0.6-$1.2
Salida
≈ $1.2-$2.4
Lectura de caché
≈ $0.6-$1.2
Grok 4.6 is an advanced AI model designed to deliver fast, writing, coding, research, data analysis, and creative problem-solving through natural conversation
Entrada
Salida
Entrada
≈ $0.6-$1.2
Salida
≈ $1.2-$2.4
Lectura de caché
≈ $0.6-$1.2
A premium reasoning route for visual front-end prototyping, repository-scale coding, large evidence sets, long-running agents, and complex knowledge work that benefits from a 1.05M-token working context.
Entrada
Salida
Entrada
≈ $2-$4
Salida
≈ $10-$20
Lectura de caché
≈ $0.2-$0.4
Gemini 2.5 Flash Lite de Google es un modelo de chat de costo ultrabajo y baja latencia, con contexto de un millón de tokens, para tareas de alta frecuencia.
Entrada
Salida
Entrada
≈ $0.1-$0.2
Salida
≈ $0.15-$0.3
Lectura de caché
≈ $0.01-$0.02
Gemini 3.1 Flash Lite de Google mejora el razonamiento sobre la 2.5 sin perder economía, equilibrando velocidad y calidad para tareas ligeras diarias.
Entrada
Salida
Entrada
≈ $0.15-$0.3
Salida
≈ $1-$2
Lectura de caché
≈ $0.0125-$0.025
Gemini 3.1 Pro de Google es el modelo multimodal insignia de la serie, con sólido razonamiento complejo y gran capacidad de contexto para producción exigente.
Entrada
Salida
Entrada
≈ $1.25-$2.5
Salida
≈ $7.5-$15
Lectura de caché
≈ $0.625-$1.25
GPT-4o mini de OpenAI es un modelo de chat multimodal rápido y asequible, con respuestas ágiles y bajo costo, para preguntas cotidianas y ayuda con código.
Entrada
Salida
Entrada
≈ $0.275-$0.55
Salida
≈ $0.412-$0.825
Lectura de caché
≈ $0.0138-$0.0275
GPT-5.4 de OpenAI es un modelo de alta capacidad para razonamiento avanzado, código y flujos de agentes, con contexto de 400K tokens para uso en producción.
Entrada
Salida
Entrada
≈ $2.5-$5
Salida
≈ $15-$30
Lectura de caché
≈ $0.25-$0.5
Claude Opus 4.8 de Anthropic es el modelo insignia, para razonamiento, codificación y escritura extensa muy exigentes, con gran manejo de contexto largo.
Entrada
Salida
Entrada
≈ $2.5-$5
Salida
≈ $12-$24
Lectura de caché
≈ $0.25-$0.5
Anthropic Claude Opus 5 from APIAny — Anthropic’s newest Opus-tier flagship for the hardest coding, long-running agents, and judgment-heavy review.
Entrada
Salida
Entrada
≈ $3.75-$7.5
Salida
≈ $18.75-$37.5
Lectura de caché
≈ $0.375-$0.75
Claude Sonnet 4.6 de Anthropic es un modelo insignia equilibrado, con razonamiento sólido a velocidad y costo de producción, para despliegues estables a escala.
Entrada
Salida
Entrada
≈ $1.5-$3
Salida
≈ $7.5-$15
Lectura de caché
≈ $1-$2
APIAny es un catálogo público en vivo de modelos de chat, imagen, vídeo, audio y seguridad que puede llamar con una clave API compatible con OpenAI.
Por APIAny Editorial · Actualizado
Filtre por tipo o proveedor, compare precios en créditos y abra una página de modelo para el playground y ejemplos de solicitud.
Fuentes
Las citas siguientes proceden de la documentación oficial de API que APIAny implementa.
The Chat Completions API endpoint will generate a model response from a list of messages comprising a conversation.
The Gemini API provides access to Google's most capable generative AI models.
The Images API provides several endpoints that let you generate images from text prompts or create edits of existing images.
El catálogo de modelos APIAny es la lista en vivo de modelos públicos de chat, imagen, vídeo, audio y seguridad que puede llamar con una clave API.