DeepSeek V4.1 Flash
DeepSeek V4.1 Flash: multimodal reasoning, coding and tool use with a 1M-token context window. Separate from DeepSeek V4 Flash.
Entrada
Salida
Entrada
≈ $0.375-$0.75
Salida
≈ $1.5-$3
Lectura de caché
≈ $0.0075-$0.015
20 grupos
DeepSeek V4.1 Flash: multimodal reasoning, coding and tool use with a 1M-token context window. Separate from DeepSeek V4 Flash.
Entrada
Salida
Entrada
≈ $0.375-$0.75
Salida
≈ $1.5-$3
Lectura de caché
≈ $0.0075-$0.015
DeepSeek V4 Flash es una variante de baja latencia de DeepSeek V4, conserva el razonamiento y reduce tiempo de respuesta, ideal para alta concurrencia.
Entrada
Salida
Entrada
≈ $0.525-$1.05
Salida
≈ $1.57-$3.15
Lectura de caché
≈ $0.0175-$0.035
GLM 5.3 Flash: multimodal reasoning, coding and tool use with a 1M-token context window. Thinking is always enabled with low, high or max effort.
Entrada
Salida
Entrada
≈ $0.14-$0.28
Salida
≈ $0.49-$0.98
Lectura de caché
≈ $0.0405-$0.081
Gemini 3.5 Flash de Google es un modelo de chat multimodal rápido y económico, con imagen y texto y contexto de un millón de tokens, para alta concurrencia.
Entrada
Salida
Entrada
≈ $0.938-$1.88
Salida
≈ $6.25-$12.5
Lectura de caché
≈ $0.0938-$0.188
MiniMax M3 es un modelo de lenguaje con contexto de un millón de tokens, destacado en comprensión de documentos extensos, razonamiento y uso de herramientas.
Entrada
Salida
Entrada
≈ $1.2-$2.4
Salida
≈ $5-$10
Lectura de caché
≈ $1.5-$3
DeepSeek V4 es un modelo enfocado en el razonamiento, con contexto de 128K tokens, destacado en generación de código y lógica compleja a precio muy competitivo.
Entrada
Salida
Entrada
≈ $0.212-$0.425
Salida
≈ $0.475-$0.95
Lectura de caché
≈ $0.025-$0.05
GPT-5.5 de OpenAI es el modelo insignia para razonamiento complejo, código e instrucciones de varios pasos, con contexto de 400K tokens para apps exigentes.
Entrada
Salida
Entrada
≈ $4.25-$8.5
Salida
≈ $25-$50
Lectura de caché
≈ $0.425-$0.85
GPT-5.6 Sol de OpenAI es la versión de alta capacidad de GPT-5.6 para razonamiento complejo, código, agentes y automatización de producción exigente.
Entrada
Salida
Entrada
≈ $6-$12
Salida
≈ $40-$80
Lectura de caché
≈ $0.85-$1.7
OpenAI GPT-6 — a flagship model for complex reasoning, code generation, and multi-step instructions, with a 400K-token context window for demanding apps
Entrada
Salida
Entrada
≈ $3.5-$7
Salida
≈ $30-$60
Lectura de caché
≈ $0.531-$1.06
Grok 4.5 de xAI es un modelo de alta capacidad para razonamiento, análisis de código, contexto largo y asistentes conectados a herramientas.
Entrada
Salida
Entrada
≈ $0.6-$1.2
Salida
≈ $1.2-$2.4
Lectura de caché
≈ $0.6-$1.2
Grok 4.6 is an advanced AI model designed to deliver fast, writing, coding, research, data analysis, and creative problem-solving through natural conversation
Entrada
Salida
Entrada
≈ $0.6-$1.2
Salida
≈ $1.2-$2.4
Lectura de caché
≈ $0.6-$1.2
A premium reasoning route for visual front-end prototyping, repository-scale coding, large evidence sets, long-running agents, and complex knowledge work that benefits from a 1.05M-token working context.
Entrada
Salida
Entrada
≈ $2-$4
Salida
≈ $10-$20
Lectura de caché
≈ $0.2-$0.4
Gemini 2.5 Flash Lite de Google es un modelo de chat de costo ultrabajo y baja latencia, con contexto de un millón de tokens, para tareas de alta frecuencia.
Entrada
Salida
Entrada
≈ $0.1-$0.2
Salida
≈ $0.15-$0.3
Lectura de caché
≈ $0.01-$0.02
Gemini 3.1 Flash Lite de Google mejora el razonamiento sobre la 2.5 sin perder economía, equilibrando velocidad y calidad para tareas ligeras diarias.
Entrada
Salida
Entrada
≈ $0.15-$0.3
Salida
≈ $1-$2
Lectura de caché
≈ $0.0125-$0.025
Gemini 3.1 Pro de Google es el modelo multimodal insignia de la serie, con sólido razonamiento complejo y gran capacidad de contexto para producción exigente.
Entrada
Salida
Entrada
≈ $1.25-$2.5
Salida
≈ $7.5-$15
Lectura de caché
≈ $0.625-$1.25
GPT-4o mini de OpenAI es un modelo de chat multimodal rápido y asequible, con respuestas ágiles y bajo costo, para preguntas cotidianas y ayuda con código.
Entrada
Salida
Entrada
≈ $0.275-$0.55
Salida
≈ $0.412-$0.825
Lectura de caché
≈ $0.0138-$0.0275
GPT-5.4 de OpenAI es un modelo de alta capacidad para razonamiento avanzado, código y flujos de agentes, con contexto de 400K tokens para uso en producción.
Entrada
Salida
Entrada
≈ $2.5-$5
Salida
≈ $15-$30
Lectura de caché
≈ $0.25-$0.5
Claude Opus 4.8 de Anthropic es el modelo insignia, para razonamiento, codificación y escritura extensa muy exigentes, con gran manejo de contexto largo.
Entrada
Salida
Entrada
≈ $2.5-$5
Salida
≈ $12-$24
Lectura de caché
≈ $0.25-$0.5
Anthropic Claude Opus 5 from APIAny — Anthropic’s newest Opus-tier flagship for the hardest coding, long-running agents, and judgment-heavy review.
Entrada
Salida
Entrada
≈ $3.75-$7.5
Salida
≈ $18.75-$37.5
Lectura de caché
≈ $0.375-$0.75
Claude Sonnet 4.6 de Anthropic es un modelo insignia equilibrado, con razonamiento sólido a velocidad y costo de producción, para despliegues estables a escala.
Entrada
Salida
Entrada
≈ $1.5-$3
Salida
≈ $7.5-$15
Lectura de caché
≈ $1-$2
APIAny lista modelos públicos de chat y texto en un endpoint compatible con OpenAI, con precios en créditos en cada ficha.
Por APIAny Editorial · Actualizado
Filtre por tipo o proveedor, compare precios en créditos y abra una página de modelo para el playground y ejemplos de solicitud.
Fuentes
Las citas siguientes proceden de la documentación oficial de API que APIAny implementa.
The Chat Completions API endpoint will generate a model response from a list of messages comprising a conversation.
The Gemini API provides access to Google's most capable generative AI models.
The Images API provides several endpoints that let you generate images from text prompts or create edits of existing images.
El catálogo de modelos APIAny es la lista en vivo de modelos públicos de chat, imagen, vídeo, audio y seguridad que puede llamar con una clave API.