Neue Nutzer erhalten kostenlose Credits, keine Kreditkarte nötig Loslegen
APIAny logoAPIAny
KI-Modelle
PreiseKostenlose API
Resources
AnmeldenStarten
Modelltyp
Alle Modelle48Textgenerierung20Bildgenerierung10Videogenerierung17Audiogenerierung0Sicherheitsprüfung1
Provider

20 Gruppen

DeepSeek V4.1 Flash — Szenenillustration, keine Ausgabe dieses Modells
LLM
TextgenerierungDeepSeek logo

DeepSeek V4.1 Flash

DeepSeek V4.1 Flash: multimodal reasoning, coding and tool use with a 1M-token context window. Separate from DeepSeek V4 Flash.

Input

Output

Input

750 Credits/1M

≈ $0.375-$0.75

Output

3,000 Credits/1M

≈ $1.5-$3

Cache Read

15 Credits/1M

≈ $0.0075-$0.015

DeepSeek V4 Flash — Szenenillustration, keine Ausgabe dieses Modells
LLM
TextgenerierungDeepSeek logo

DeepSeek V4 Flash

DeepSeek V4 Flash — latenzarme Variante von DeepSeek V4, behält die Kern-Reasoning-Fähigkeiten bei und senkt Antwortzeit und Kosten für hohe Nebenläufigkeit.

Input

Output

Input

1,050 Credits/1M

≈ $0.525-$1.05

Output

3,150 Credits/1M

≈ $1.57-$3.15

Cache Read

35 Credits/1M

≈ $0.0175-$0.035

GLM 5.3 Flash — Szenenillustration, keine Ausgabe dieses Modells
LLM
TextgenerierungGLM logo

GLM 5.3 Flash

GLM 5.3 Flash: multimodal reasoning, coding and tool use with a 1M-token context window. Thinking is always enabled with low, high or max effort.

Input

Output

Input

280 Credits/1M

≈ $0.14-$0.28

Output

980 Credits/1M

≈ $0.49-$0.98

Cache Read

81 Credits/1M

≈ $0.0405-$0.081

Gemini 3.5 Flash — Szenenillustration, keine Ausgabe dieses Modells
LLM
TextgenerierungGoogle logo

Gemini 3.5 Flash

Google Gemini 3.5 Flash — schnelles, kosteneffizientes multimodales Chat-Modell mit Bild- und Texteingabe und einer Million Token Kontextfenster.

Input

Output

Input

1,875 Credits/1M

≈ $0.938-$1.88

Output

12,500 Credits/1M

≈ $6.25-$12.5

Cache Read

187.5 Credits/1M

≈ $0.0938-$0.188

MiniMax M3 — Szenenillustration, keine Ausgabe dieses Modells
LLM
TextgenerierungMiniMax logo

MiniMax M3

MiniMax M3 — großes Sprachmodell mit einem Kontextfenster von einer Million Token, stark im Verständnis langer Dokumente, Reasoning und Tool-Nutzung.

Input

Output

Input

2,400 Credits/1M

≈ $1.2-$2.4

Output

10,000 Credits/1M

≈ $5-$10

Cache Read

3,000 Credits/1M

≈ $1.5-$3

DeepSeek V4 — Szenenillustration, keine Ausgabe dieses Modells
LLM
TextgenerierungDeepSeek logo

DeepSeek V4

DeepSeek V4 — auf Reasoning fokussiertes Sprachmodell mit 128K-Token-Kontextfenster, stark bei Codegenerierung und komplexer Logik, sehr günstig.

Input

Output

Input

425 Credits/1M

≈ $0.212-$0.425

Output

950 Credits/1M

≈ $0.475-$0.95

Cache Read

50 Credits/1M

≈ $0.025-$0.05

GPT 5.5 — Szenenillustration, keine Ausgabe dieses Modells
LLM
TextgenerierungOpenAI logo

GPT 5.5

OpenAI GPT-5.5 — Flaggschiffmodell für komplexes Reasoning, Codegenerierung und mehrstufige Anweisungen, mit 400K Token Kontextfenster für anspruchsvolle Apps.

Input

Output

Input

8,500 Credits/1M

≈ $4.25-$8.5

Output

50,000 Credits/1M

≈ $25-$50

Cache Read

850 Credits/1M

≈ $0.425-$0.85

GPT 5.6 — Szenenillustration, keine Ausgabe dieses Modells
LLM
TextgenerierungOpenAI logo2 Modelle

GPT 5.6

OpenAI GPT-5.6 Sol ist die leistungsstarke GPT-5.6-Stufe für komplexes Reasoning, Codegenerierung, Agenten und anspruchsvolle Produktionsautomatisierung.

Input

Output

Input

12,000 Credits/1M

≈ $6-$12

Output

80,000 Credits/1M

≈ $40-$80

Cache Read

1,700 Credits/1M

≈ $0.85-$1.7

GPT 6 — Szenenillustration, keine Ausgabe dieses Modells
LLM
TextgenerierungOpenAI logo

GPT 6

OpenAI GPT-6 — a flagship model for complex reasoning, code generation, and multi-step instructions, with a 400K-token context window for demanding apps

Input

Output

Input

7,000 Credits/1M

≈ $3.5-$7

Output

60,000 Credits/1M

≈ $30-$60

Cache Read

1,062.47 Credits/1M

≈ $0.531-$1.06

Grok 4.5 — Szenenillustration, keine Ausgabe dieses Modells
LLM
TextgenerierungxAI logo2 Modelle

Grok 4.5

xAI Grok 4.5 ist ein leistungsstarkes Modell für Reasoning, Codeanalyse, lange Kontexte und toolgestützte Assistenten.

Input

Output

Input

1,200 Credits/1M

≈ $0.6-$1.2

Output

2,400 Credits/1M

≈ $1.2-$2.4

Cache Read

1,200 Credits/1M

≈ $0.6-$1.2

Grok 4.6 — Szenenillustration, keine Ausgabe dieses Modells
LLM
TextgenerierungxAI logo

Grok 4.6

Grok 4.6 is an advanced AI model designed to deliver fast, writing, coding, research, data analysis, and creative problem-solving through natural conversation

Input

Output

Input

1,200 Credits/1M

≈ $0.6-$1.2

Output

2,400 Credits/1M

≈ $1.2-$2.4

Cache Read

1,200 Credits/1M

≈ $0.6-$1.2

Kimi K3 — Szenenillustration, keine Ausgabe dieses Modells
LLM
TextgenerierungKimi logo

Kimi K3

A premium reasoning route for visual front-end prototyping, repository-scale coding, large evidence sets, long-running agents, and complex knowledge work that benefits from a 1.05M-token working context.

Input

Output

Input

4,000 Credits/1M

≈ $2-$4

Output

20,000 Credits/1M

≈ $10-$20

Cache Read

400 Credits/1M

≈ $0.2-$0.4

Gemini 2.5 Flash Lite — Szenenillustration, keine Ausgabe dieses Modells
LLM
TextgenerierungGoogle logo

Gemini 2.5 Flash Lite

Google Gemini 2.5 Flash Lite — extrem günstiges, latenzarmes Chat-Modell mit einer Million Token Kontextfenster, ideal für hochfrequente Alltagsaufgaben.

Input

Output

Input

200 Credits/1M

≈ $0.1-$0.2

Output

300 Credits/1M

≈ $0.15-$0.3

Cache Read

20 Credits/1M

≈ $0.01-$0.02

Gemini 3.1 Flash Lite — Szenenillustration, keine Ausgabe dieses Modells
LLM
TextgenerierungGoogle logo

Gemini 3.1 Flash Lite

Google Gemini 3.1 Flash Lite — verbessertes Reasoning gegenüber der 2.5-Generation bei günstigem Preis, balanciert Geschwindigkeit und Qualität.

Input

Output

Input

300 Credits/1M

≈ $0.15-$0.3

Output

2,000 Credits/1M

≈ $1-$2

Cache Read

25 Credits/1M

≈ $0.0125-$0.025

Gemini 3.1 Pro — Szenenillustration, keine Ausgabe dieses Modells
LLM
TextgenerierungGoogle logo

Gemini 3.1 Pro

Google Gemini 3.1 Pro — multimodales Flaggschiffmodell von Gemini mit starkem komplexem Reasoning und langer Kontextverarbeitung für Produktivanwendungen.

Input

Output

Input

2,500 Credits/1M

≈ $1.25-$2.5

Output

15,000 Credits/1M

≈ $7.5-$15

Cache Read

1,250 Credits/1M

≈ $0.625-$1.25

GPT 4o Mini — Szenenillustration, keine Ausgabe dieses Modells
LLM
TextgenerierungOpenAI logo

GPT 4o Mini

OpenAI GPT-4o mini — schnelles, günstiges multimodales Chat-Modell mit zügigen Antworten, ideal für alltägliche Fragen und leichte Programmierhilfe.

Input

Output

Input

550 Credits/1M

≈ $0.275-$0.55

Output

825 Credits/1M

≈ $0.412-$0.825

Cache Read

27.5 Credits/1M

≈ $0.0138-$0.0275

GPT 5.4 — Szenenillustration, keine Ausgabe dieses Modells
LLM
TextgenerierungOpenAI logo3 Modelle

GPT 5.4

OpenAI GPT-5.4 — leistungsstarkes Modell für fortgeschrittenes Reasoning, Codegenerierung und Agenten-Workflows, mit 400K Token Kontextfenster.

Input

Output

Input

5,000 Credits/1M

≈ $2.5-$5

Output

30,000 Credits/1M

≈ $15-$30

Cache Read

500 Credits/1M

≈ $0.25-$0.5

Claude Opus 4.8 — Szenenillustration, keine Ausgabe dieses Modells
LLM
TextgenerierungAnthropic logo

Claude Opus 4.8

Anthropic Claude Opus 4.8 — Flaggschiffmodell von Claude für anspruchsvollste Reasoning-, Coding- und Langtextaufgaben, mit exzellenter Kontextverarbeitung.

Input

Output

Input

5,000 Credits/1M

≈ $2.5-$5

Output

24,000 Credits/1M

≈ $12-$24

Cache Read

500 Credits/1M

≈ $0.25-$0.5

Claude Opus 5 — Szenenillustration, keine Ausgabe dieses Modells
LLM
TextgenerierungAnthropic logo

Claude Opus 5

Anthropic Claude Opus 5 from APIAny — Anthropic’s newest Opus-tier flagship for the hardest coding, long-running agents, and judgment-heavy review.

Input

Output

Input

7,500 Credits/1M

≈ $3.75-$7.5

Output

37,500 Credits/1M

≈ $18.75-$37.5

Cache Read

750 Credits/1M

≈ $0.375-$0.75

Claude Sonnet 4.6 — Szenenillustration, keine Ausgabe dieses Modells
LLM
TextgenerierungAnthropic logo

Claude Sonnet 4.6

Anthropic Claude Sonnet 4.6 — ausgewogenes Flaggschiffmodell mit starkem Reasoning bei produktionsreifer Geschwindigkeit und Kosten für stabile Großeinsätze.

Input

Output

Input

3,000 Credits/1M

≈ $1.5-$3

Output

15,000 Credits/1M

≈ $7.5-$15

Cache Read

2,000 Credits/1M

≈ $1-$2

Welche Textgenerierungsmodelle stellt APIAny bereit?

APIAny listet öffentliche Chat- und Textmodelle auf einem OpenAI-kompatiblen Endpunkt, mit aktuellen Credit-Preisen auf jeder Modellseite.

Von APIAny Editorial · Aktualisiert 2026-09-01

Wie finden Sie das passende APIAny-Modell?

Filtern Sie nach Typ oder Anbieter, vergleichen Sie Credit-Preise und öffnen Sie eine Modellseite für Playground-Tests und Request-Beispiele.

Welche Modelle sind in dieser Ansicht?

  1. DeepSeek V4.1 FlashDeepSeek V4.1 Flash: multimodal reasoning, coding and tool use with a 1M-token context window. Separate from DeepSeek V4 Flash.
  2. DeepSeek V4 FlashDeepSeek V4 Flash — latenzarme Variante von DeepSeek V4, behält die Kern-Reasoning-Fähigkeiten bei und senkt Antwortzeit und Kosten für hohe Nebenläufigkeit.
  3. GLM 5.3 FlashGLM 5.3 Flash: multimodal reasoning, coding and tool use with a 1M-token context window. Thinking is always enabled with low, high or max effort.
  4. Gemini 3.5 FlashGoogle Gemini 3.5 Flash — schnelles, kosteneffizientes multimodales Chat-Modell mit Bild- und Texteingabe und einer Million Token Kontextfenster.
  5. MiniMax M3MiniMax M3 — großes Sprachmodell mit einem Kontextfenster von einer Million Token, stark im Verständnis langer Dokumente, Reasoning und Tool-Nutzung.
  6. DeepSeek V4DeepSeek V4 — auf Reasoning fokussiertes Sprachmodell mit 128K-Token-Kontextfenster, stark bei Codegenerierung und komplexer Logik, sehr günstig.
  7. GPT 5.5OpenAI GPT-5.5 — Flaggschiffmodell für komplexes Reasoning, Codegenerierung und mehrstufige Anweisungen, mit 400K Token Kontextfenster für anspruchsvolle Apps.
  8. GPT 5.6OpenAI GPT-5.6 Sol ist die leistungsstarke GPT-5.6-Stufe für komplexes Reasoning, Codegenerierung, Agenten und anspruchsvolle Produktionsautomatisierung.
  9. GPT 6OpenAI GPT-6 — a flagship model for complex reasoning, code generation, and multi-step instructions, with a 400K-token context window for demanding apps
  10. Grok 4.5xAI Grok 4.5 ist ein leistungsstarkes Modell für Reasoning, Codeanalyse, lange Kontexte und toolgestützte Assistenten.
  11. Grok 4.6Grok 4.6 is an advanced AI model designed to deliver fast, writing, coding, research, data analysis, and creative problem-solving through natural conversation
  12. Kimi K3A premium reasoning route for visual front-end prototyping, repository-scale coding, large evidence sets, long-running agents, and complex knowledge work that benefits from a 1.05M-token working context.
  13. Gemini 2.5 Flash LiteGoogle Gemini 2.5 Flash Lite — extrem günstiges, latenzarmes Chat-Modell mit einer Million Token Kontextfenster, ideal für hochfrequente Alltagsaufgaben.
  14. Gemini 3.1 Flash LiteGoogle Gemini 3.1 Flash Lite — verbessertes Reasoning gegenüber der 2.5-Generation bei günstigem Preis, balanciert Geschwindigkeit und Qualität.
  15. Gemini 3.1 ProGoogle Gemini 3.1 Pro — multimodales Flaggschiffmodell von Gemini mit starkem komplexem Reasoning und langer Kontextverarbeitung für Produktivanwendungen.
  16. GPT 4o MiniOpenAI GPT-4o mini — schnelles, günstiges multimodales Chat-Modell mit zügigen Antworten, ideal für alltägliche Fragen und leichte Programmierhilfe.
  17. GPT 5.4OpenAI GPT-5.4 — leistungsstarkes Modell für fortgeschrittenes Reasoning, Codegenerierung und Agenten-Workflows, mit 400K Token Kontextfenster.
  18. Claude Opus 4.8Anthropic Claude Opus 4.8 — Flaggschiffmodell von Claude für anspruchsvollste Reasoning-, Coding- und Langtextaufgaben, mit exzellenter Kontextverarbeitung.
  19. Claude Opus 5Anthropic Claude Opus 5 from APIAny — Anthropic’s newest Opus-tier flagship for the hardest coding, long-running agents, and judgment-heavy review.
  20. Claude Sonnet 4.6Anthropic Claude Sonnet 4.6 — ausgewogenes Flaggschiffmodell mit starkem Reasoning bei produktionsreifer Geschwindigkeit und Kosten für stabile Großeinsätze.

Quellen

Welche offiziellen Referenzen zitiert diese Seite?

Die Zitate stammen aus offizieller API-Dokumentation, gegen die APIAny implementiert.

The Chat Completions API endpoint will generate a model response from a list of messages comprising a conversation.

— OpenAI Chat Completions API

The Gemini API provides access to Google's most capable generative AI models.

— Google Gemini API

The Images API provides several endpoints that let you generate images from text prompts or create edits of existing images.

— OpenAI Images API

Welche KI-Modelle stellt APIAny bereit?

Der APIAny-Modellkatalog ist die Live-Liste öffentlicher Chat-, Bild-, Video-, Audio- und Sicherheitsmodelle, die Sie mit einem API-Key aufrufen.

Alle ModelleTextgenerierungBildgenerierungVideogenerierungAudiogenerierungSicherheitsprüfung

Ein API-Gateway für alle produktionsreifen AI-Modelle.

Beliebte Modelle

  • Seedance 2.0
  • GPT Image 2
  • Nano Banana 2
  • Z-Image
  • Gemini Omni

Modellsammlungen

  • Alle Sammlungen
  • GPT API Family
  • Seedance API Family
  • Gemini API Family
  • GPT Image API

Modelltypen

  • Textgenerierung
  • Bildgenerierung
  • Videogenerierung
  • Audiogenerierung

Plattform

  • Modelle
  • Preise
  • Dokumentation
  • Über uns
  • Kontakt

Rechtliches

  • Datenschutz
  • Nutzungsbedingungen
  • Erstattungsrichtlinie
EnglishFrançaisDeutsch中文日本語한국어Español
APIAny logoAPIAny© 2026 APIAny. Alle Rechte vorbehalten.
support@apiany.ai