Los nuevos usuarios reciben créditos gratis, sin tarjeta Empezar
APIAny logoAPIAny
Modelos de IA
PreciosAPI gratis
Resources
Iniciar sesiónEmpezar
Tipo de modelo
Todos los modelos48Generación de texto20Generación de imágenes10Generación de video17Generación de audio0Detección de seguridad1
Provider

20 grupos

DeepSeek V4.1 Flash — Ilustración de escena, no generada por este modelo
LLM
Generación de textoDeepSeek logo

DeepSeek V4.1 Flash

DeepSeek V4.1 Flash: multimodal reasoning, coding and tool use with a 1M-token context window. Separate from DeepSeek V4 Flash.

Entrada

Salida

Entrada

750 créditos/1M

≈ $0.375-$0.75

Salida

3,000 créditos/1M

≈ $1.5-$3

Lectura de caché

15 créditos/1M

≈ $0.0075-$0.015

DeepSeek V4 Flash — Ilustración de escena, no generada por este modelo
LLM
Generación de textoDeepSeek logo

DeepSeek V4 Flash

DeepSeek V4 Flash es una variante de baja latencia de DeepSeek V4, conserva el razonamiento y reduce tiempo de respuesta, ideal para alta concurrencia.

Entrada

Salida

Entrada

1,050 créditos/1M

≈ $0.525-$1.05

Salida

3,150 créditos/1M

≈ $1.57-$3.15

Lectura de caché

35 créditos/1M

≈ $0.0175-$0.035

GLM 5.3 Flash — Ilustración de escena, no generada por este modelo
LLM
Generación de textoGLM logo

GLM 5.3 Flash

GLM 5.3 Flash: multimodal reasoning, coding and tool use with a 1M-token context window. Thinking is always enabled with low, high or max effort.

Entrada

Salida

Entrada

280 créditos/1M

≈ $0.14-$0.28

Salida

980 créditos/1M

≈ $0.49-$0.98

Lectura de caché

81 créditos/1M

≈ $0.0405-$0.081

Gemini 3.5 Flash — Ilustración de escena, no generada por este modelo
LLM
Generación de textoGoogle logo

Gemini 3.5 Flash

Gemini 3.5 Flash de Google es un modelo de chat multimodal rápido y económico, con imagen y texto y contexto de un millón de tokens, para alta concurrencia.

Entrada

Salida

Entrada

1,875 créditos/1M

≈ $0.938-$1.88

Salida

12,500 créditos/1M

≈ $6.25-$12.5

Lectura de caché

187.5 créditos/1M

≈ $0.0938-$0.188

MiniMax M3 — Ilustración de escena, no generada por este modelo
LLM
Generación de textoMiniMax logo

MiniMax M3

MiniMax M3 es un modelo de lenguaje con contexto de un millón de tokens, destacado en comprensión de documentos extensos, razonamiento y uso de herramientas.

Entrada

Salida

Entrada

2,400 créditos/1M

≈ $1.2-$2.4

Salida

10,000 créditos/1M

≈ $5-$10

Lectura de caché

3,000 créditos/1M

≈ $1.5-$3

DeepSeek V4 — Ilustración de escena, no generada por este modelo
LLM
Generación de textoDeepSeek logo

DeepSeek V4

DeepSeek V4 es un modelo enfocado en el razonamiento, con contexto de 128K tokens, destacado en generación de código y lógica compleja a precio muy competitivo.

Entrada

Salida

Entrada

425 créditos/1M

≈ $0.212-$0.425

Salida

950 créditos/1M

≈ $0.475-$0.95

Lectura de caché

50 créditos/1M

≈ $0.025-$0.05

GPT 5.5 — Ilustración de escena, no generada por este modelo
LLM
Generación de textoOpenAI logo

GPT 5.5

GPT-5.5 de OpenAI es el modelo insignia para razonamiento complejo, código e instrucciones de varios pasos, con contexto de 400K tokens para apps exigentes.

Entrada

Salida

Entrada

8,500 créditos/1M

≈ $4.25-$8.5

Salida

50,000 créditos/1M

≈ $25-$50

Lectura de caché

850 créditos/1M

≈ $0.425-$0.85

GPT 5.6 — Ilustración de escena, no generada por este modelo
LLM
Generación de textoOpenAI logo2 modelos

GPT 5.6

GPT-5.6 Sol de OpenAI es la versión de alta capacidad de GPT-5.6 para razonamiento complejo, código, agentes y automatización de producción exigente.

Entrada

Salida

Entrada

12,000 créditos/1M

≈ $6-$12

Salida

80,000 créditos/1M

≈ $40-$80

Lectura de caché

1,700 créditos/1M

≈ $0.85-$1.7

GPT 6 — Ilustración de escena, no generada por este modelo
LLM
Generación de textoOpenAI logo

GPT 6

OpenAI GPT-6 — a flagship model for complex reasoning, code generation, and multi-step instructions, with a 400K-token context window for demanding apps

Entrada

Salida

Entrada

7,000 créditos/1M

≈ $3.5-$7

Salida

60,000 créditos/1M

≈ $30-$60

Lectura de caché

1,062.47 créditos/1M

≈ $0.531-$1.06

Grok 4.5 — Ilustración de escena, no generada por este modelo
LLM
Generación de textoxAI logo2 modelos

Grok 4.5

Grok 4.5 de xAI es un modelo de alta capacidad para razonamiento, análisis de código, contexto largo y asistentes conectados a herramientas.

Entrada

Salida

Entrada

1,200 créditos/1M

≈ $0.6-$1.2

Salida

2,400 créditos/1M

≈ $1.2-$2.4

Lectura de caché

1,200 créditos/1M

≈ $0.6-$1.2

Grok 4.6 — Ilustración de escena, no generada por este modelo
LLM
Generación de textoxAI logo

Grok 4.6

Grok 4.6 is an advanced AI model designed to deliver fast, writing, coding, research, data analysis, and creative problem-solving through natural conversation

Entrada

Salida

Entrada

1,200 créditos/1M

≈ $0.6-$1.2

Salida

2,400 créditos/1M

≈ $1.2-$2.4

Lectura de caché

1,200 créditos/1M

≈ $0.6-$1.2

Kimi K3 — Ilustración de escena, no generada por este modelo
LLM
Generación de textoKimi logo

Kimi K3

A premium reasoning route for visual front-end prototyping, repository-scale coding, large evidence sets, long-running agents, and complex knowledge work that benefits from a 1.05M-token working context.

Entrada

Salida

Entrada

4,000 créditos/1M

≈ $2-$4

Salida

20,000 créditos/1M

≈ $10-$20

Lectura de caché

400 créditos/1M

≈ $0.2-$0.4

Gemini 2.5 Flash Lite — Ilustración de escena, no generada por este modelo
LLM
Generación de textoGoogle logo

Gemini 2.5 Flash Lite

Gemini 2.5 Flash Lite de Google es un modelo de chat de costo ultrabajo y baja latencia, con contexto de un millón de tokens, para tareas de alta frecuencia.

Entrada

Salida

Entrada

200 créditos/1M

≈ $0.1-$0.2

Salida

300 créditos/1M

≈ $0.15-$0.3

Lectura de caché

20 créditos/1M

≈ $0.01-$0.02

Gemini 3.1 Flash Lite — Ilustración de escena, no generada por este modelo
LLM
Generación de textoGoogle logo

Gemini 3.1 Flash Lite

Gemini 3.1 Flash Lite de Google mejora el razonamiento sobre la 2.5 sin perder economía, equilibrando velocidad y calidad para tareas ligeras diarias.

Entrada

Salida

Entrada

300 créditos/1M

≈ $0.15-$0.3

Salida

2,000 créditos/1M

≈ $1-$2

Lectura de caché

25 créditos/1M

≈ $0.0125-$0.025

Gemini 3.1 Pro — Ilustración de escena, no generada por este modelo
LLM
Generación de textoGoogle logo

Gemini 3.1 Pro

Gemini 3.1 Pro de Google es el modelo multimodal insignia de la serie, con sólido razonamiento complejo y gran capacidad de contexto para producción exigente.

Entrada

Salida

Entrada

2,500 créditos/1M

≈ $1.25-$2.5

Salida

15,000 créditos/1M

≈ $7.5-$15

Lectura de caché

1,250 créditos/1M

≈ $0.625-$1.25

GPT 4o Mini — Ilustración de escena, no generada por este modelo
LLM
Generación de textoOpenAI logo

GPT 4o Mini

GPT-4o mini de OpenAI es un modelo de chat multimodal rápido y asequible, con respuestas ágiles y bajo costo, para preguntas cotidianas y ayuda con código.

Entrada

Salida

Entrada

550 créditos/1M

≈ $0.275-$0.55

Salida

825 créditos/1M

≈ $0.412-$0.825

Lectura de caché

27.5 créditos/1M

≈ $0.0138-$0.0275

GPT 5.4 — Ilustración de escena, no generada por este modelo
LLM
Generación de textoOpenAI logo3 modelos

GPT 5.4

GPT-5.4 de OpenAI es un modelo de alta capacidad para razonamiento avanzado, código y flujos de agentes, con contexto de 400K tokens para uso en producción.

Entrada

Salida

Entrada

5,000 créditos/1M

≈ $2.5-$5

Salida

30,000 créditos/1M

≈ $15-$30

Lectura de caché

500 créditos/1M

≈ $0.25-$0.5

Claude Opus 4.8 — Ilustración de escena, no generada por este modelo
LLM
Generación de textoAnthropic logo

Claude Opus 4.8

Claude Opus 4.8 de Anthropic es el modelo insignia, para razonamiento, codificación y escritura extensa muy exigentes, con gran manejo de contexto largo.

Entrada

Salida

Entrada

5,000 créditos/1M

≈ $2.5-$5

Salida

24,000 créditos/1M

≈ $12-$24

Lectura de caché

500 créditos/1M

≈ $0.25-$0.5

Claude Opus 5 — Ilustración de escena, no generada por este modelo
LLM
Generación de textoAnthropic logo

Claude Opus 5

Anthropic Claude Opus 5 from APIAny — Anthropic’s newest Opus-tier flagship for the hardest coding, long-running agents, and judgment-heavy review.

Entrada

Salida

Entrada

7,500 créditos/1M

≈ $3.75-$7.5

Salida

37,500 créditos/1M

≈ $18.75-$37.5

Lectura de caché

750 créditos/1M

≈ $0.375-$0.75

Claude Sonnet 4.6 — Ilustración de escena, no generada por este modelo
LLM
Generación de textoAnthropic logo

Claude Sonnet 4.6

Claude Sonnet 4.6 de Anthropic es un modelo insignia equilibrado, con razonamiento sólido a velocidad y costo de producción, para despliegues estables a escala.

Entrada

Salida

Entrada

3,000 créditos/1M

≈ $1.5-$3

Salida

15,000 créditos/1M

≈ $7.5-$15

Lectura de caché

2,000 créditos/1M

≈ $1-$2

¿Qué modelos de generación de texto expone APIAny?

APIAny lista modelos públicos de chat y texto en un endpoint compatible con OpenAI, con precios en créditos en cada ficha.

Por APIAny Editorial · Actualizado 2026-09-01

¿Cómo encontrar el modelo APIAny adecuado?

Filtre por tipo o proveedor, compare precios en créditos y abra una página de modelo para el playground y ejemplos de solicitud.

¿Qué modelos hay en esta vista?

  1. DeepSeek V4.1 FlashDeepSeek V4.1 Flash: multimodal reasoning, coding and tool use with a 1M-token context window. Separate from DeepSeek V4 Flash.
  2. DeepSeek V4 FlashDeepSeek V4 Flash es una variante de baja latencia de DeepSeek V4, conserva el razonamiento y reduce tiempo de respuesta, ideal para alta concurrencia.
  3. GLM 5.3 FlashGLM 5.3 Flash: multimodal reasoning, coding and tool use with a 1M-token context window. Thinking is always enabled with low, high or max effort.
  4. Gemini 3.5 FlashGemini 3.5 Flash de Google es un modelo de chat multimodal rápido y económico, con imagen y texto y contexto de un millón de tokens, para alta concurrencia.
  5. MiniMax M3MiniMax M3 es un modelo de lenguaje con contexto de un millón de tokens, destacado en comprensión de documentos extensos, razonamiento y uso de herramientas.
  6. DeepSeek V4DeepSeek V4 es un modelo enfocado en el razonamiento, con contexto de 128K tokens, destacado en generación de código y lógica compleja a precio muy competitivo.
  7. GPT 5.5GPT-5.5 de OpenAI es el modelo insignia para razonamiento complejo, código e instrucciones de varios pasos, con contexto de 400K tokens para apps exigentes.
  8. GPT 5.6GPT-5.6 Sol de OpenAI es la versión de alta capacidad de GPT-5.6 para razonamiento complejo, código, agentes y automatización de producción exigente.
  9. GPT 6OpenAI GPT-6 — a flagship model for complex reasoning, code generation, and multi-step instructions, with a 400K-token context window for demanding apps
  10. Grok 4.5Grok 4.5 de xAI es un modelo de alta capacidad para razonamiento, análisis de código, contexto largo y asistentes conectados a herramientas.
  11. Grok 4.6Grok 4.6 is an advanced AI model designed to deliver fast, writing, coding, research, data analysis, and creative problem-solving through natural conversation
  12. Kimi K3A premium reasoning route for visual front-end prototyping, repository-scale coding, large evidence sets, long-running agents, and complex knowledge work that benefits from a 1.05M-token working context.
  13. Gemini 2.5 Flash LiteGemini 2.5 Flash Lite de Google es un modelo de chat de costo ultrabajo y baja latencia, con contexto de un millón de tokens, para tareas de alta frecuencia.
  14. Gemini 3.1 Flash LiteGemini 3.1 Flash Lite de Google mejora el razonamiento sobre la 2.5 sin perder economía, equilibrando velocidad y calidad para tareas ligeras diarias.
  15. Gemini 3.1 ProGemini 3.1 Pro de Google es el modelo multimodal insignia de la serie, con sólido razonamiento complejo y gran capacidad de contexto para producción exigente.
  16. GPT 4o MiniGPT-4o mini de OpenAI es un modelo de chat multimodal rápido y asequible, con respuestas ágiles y bajo costo, para preguntas cotidianas y ayuda con código.
  17. GPT 5.4GPT-5.4 de OpenAI es un modelo de alta capacidad para razonamiento avanzado, código y flujos de agentes, con contexto de 400K tokens para uso en producción.
  18. Claude Opus 4.8Claude Opus 4.8 de Anthropic es el modelo insignia, para razonamiento, codificación y escritura extensa muy exigentes, con gran manejo de contexto largo.
  19. Claude Opus 5Anthropic Claude Opus 5 from APIAny — Anthropic’s newest Opus-tier flagship for the hardest coding, long-running agents, and judgment-heavy review.
  20. Claude Sonnet 4.6Claude Sonnet 4.6 de Anthropic es un modelo insignia equilibrado, con razonamiento sólido a velocidad y costo de producción, para despliegues estables a escala.

Fuentes

¿Qué referencias oficiales cita esta página?

Las citas siguientes proceden de la documentación oficial de API que APIAny implementa.

The Chat Completions API endpoint will generate a model response from a list of messages comprising a conversation.

— OpenAI Chat Completions API

The Gemini API provides access to Google's most capable generative AI models.

— Google Gemini API

The Images API provides several endpoints that let you generate images from text prompts or create edits of existing images.

— OpenAI Images API

¿Qué modelos de IA expone APIAny?

El catálogo de modelos APIAny es la lista en vivo de modelos públicos de chat, imagen, vídeo, audio y seguridad que puede llamar con una clave API.

Todos los modelosGeneración de textoGeneración de imágenesGeneración de videoGeneración de audioDetección de seguridad

Una pasarela API para llamar todos tus modelos de IA de producción.

Modelos populares

  • Seedance 2.0
  • GPT Image 2
  • Nano Banana 2
  • Z-Image
  • Gemini Omni

Colecciones de modelos

  • Todas las colecciones
  • GPT API Family
  • Seedance API Family
  • Gemini API Family
  • GPT Image API

Tipos de modelo

  • Generación de texto
  • Generación de imágenes
  • Generación de video
  • Generación de audio

Plataforma

  • Modelos
  • Precios
  • Documentación
  • Acerca de
  • Contáctanos

Legal

  • Política de privacidad
  • Términos del servicio
  • Política de reembolso
EnglishFrançaisDeutsch中文日本語한국어Español
APIAny logoAPIAny© 2026 APIAny. Todos los derechos reservados.
support@apiany.ai