DeepSeek V4.1 Flash
DeepSeek V4.1 Flash: multimodal reasoning, coding and tool use with a 1M-token context window. Separate from DeepSeek V4 Flash.
입력
출력
입력
≈ $0.375-$0.75
출력
≈ $1.5-$3
캐시 읽기
≈ $0.0075-$0.015
총 20개 그룹
DeepSeek V4.1 Flash: multimodal reasoning, coding and tool use with a 1M-token context window. Separate from DeepSeek V4 Flash.
입력
출력
입력
≈ $0.375-$0.75
출력
≈ $1.5-$3
캐시 읽기
≈ $0.0075-$0.015
DeepSeek V4 Flash는 핵심 추론 능력을 유지하면서 응답 속도와 호출 비용을 크게 낮춘 저지연 버전으로, 대규모 동시 요청 시나리오에 적합합니다. APIAny의 OpenAI 호환 API로 바로 호출할 수 있으며 온라인 미리보기도 지원됩니다.
입력
출력
입력
≈ $0.525-$1.05
출력
≈ $1.57-$3.15
캐시 읽기
≈ $0.0175-$0.035
GLM 5.3 Flash: multimodal reasoning, coding and tool use with a 1M-token context window. Thinking is always enabled with low, high or max effort.
입력
출력
입력
≈ $0.14-$0.28
출력
≈ $0.49-$0.98
캐시 읽기
≈ $0.0405-$0.081
구글 Gemini 3.5 Flash는 빠르고 비용 효율이 높은 멀티모달 대화 모델로 이미지와 텍스트를 함께 입력받을 수 있고 백만 토큰 규모의 컨텍스트 윈도우를 제공해 대규모 동시 요청 처리 워크로드에 적합합니다. APIAny로 바로 호출할 수 있습니다.
입력
출력
입력
≈ $0.938-$1.88
출력
≈ $6.25-$12.5
캐시 읽기
≈ $0.0938-$0.188
MiniMax M3는 백만 토큰 규모의 컨텍스트 윈도우를 지원하는 대형 언어 모델로 긴 문서 이해, 복잡한 추론, 도구 호출에 강점을 보여 장문 대화와 지식베이스 질의응답에 적합합니다. APIAny의 OpenAI 호환 API로 바로 호출할 수 있습니다.
입력
출력
입력
≈ $1.2-$2.4
출력
≈ $5-$10
캐시 읽기
≈ $1.5-$3
DeepSeek V4는 추론 능력에 특화된 대형 언어 모델로 12만8천 토큰 컨텍스트 윈도우를 제공하며 코드 생성과 복잡한 논리 작업에서 뛰어난 성능을 매우 경쟁력 있는 가격에 제공합니다. APIAny의 OpenAI 호환 API로 바로 호출할 수 있으며 온라인 미리보기도 지원됩니다.
입력
출력
입력
≈ $0.212-$0.425
출력
≈ $0.475-$0.95
캐시 읽기
≈ $0.025-$0.05
OpenAI GPT-5.5는 복잡한 추론, 코드 생성, 다단계 지시 수행에 강한 플래그십 모델로 40만 토큰 규모의 컨텍스트 윈도우를 제공해 까다로운 프로덕션 애플리케이션에 적합합니다. APIAny의 OpenAI 호환 API로 바로 호출할 수 있습니다.
입력
출력
입력
≈ $4.25-$8.5
출력
≈ $25-$50
캐시 읽기
≈ $0.425-$0.85
OpenAI GPT-5.6 Sol은 복잡한 추론, 코드 생성, 에이전트와 고난도 프로덕션 자동화에 적합한 GPT-5.6 계열의 고성능 버전입니다.
입력
출력
입력
≈ $6-$12
출력
≈ $40-$80
캐시 읽기
≈ $0.85-$1.7
OpenAI GPT-6 — a flagship model for complex reasoning, code generation, and multi-step instructions, with a 400K-token context window for demanding apps
입력
출력
입력
≈ $3.5-$7
출력
≈ $30-$60
캐시 읽기
≈ $0.531-$1.06
xAI Grok 4.5는 추론, 코드 분석, 긴 컨텍스트와 도구 연결 어시스턴트 워크플로를 위한 고성능 모델입니다.
입력
출력
입력
≈ $0.6-$1.2
출력
≈ $1.2-$2.4
캐시 읽기
≈ $0.6-$1.2
Grok 4.6 is an advanced AI model designed to deliver fast, writing, coding, research, data analysis, and creative problem-solving through natural conversation
입력
출력
입력
≈ $0.6-$1.2
출력
≈ $1.2-$2.4
캐시 읽기
≈ $0.6-$1.2
A premium reasoning route for visual front-end prototyping, repository-scale coding, large evidence sets, long-running agents, and complex knowledge work that benefits from a 1.05M-token working context.
입력
출력
입력
≈ $2-$4
출력
≈ $10-$20
캐시 읽기
≈ $0.2-$0.4
구글 Gemini 2.5 Flash Lite는 초저비용, 저지연 대화 모델로 백만 토큰 규모의 컨텍스트 윈도우를 제공해 일상적이고 빈도가 높은 작업 처리에 이상적입니다. APIAny의 OpenAI 호환 API로 바로 호출할 수 있으며 온라인 미리보기도 지원됩니다.
입력
출력
입력
≈ $0.1-$0.2
출력
≈ $0.15-$0.3
캐시 읽기
≈ $0.01-$0.02
구글 Gemini 3.1 Flash Lite는 2.5 세대보다 추론 성능이 향상되면서도 경제적인 비용을 유지해 속도와 품질의 균형이 필요한 경량 작업에 적합합니다. APIAny의 OpenAI 호환 API로 바로 호출할 수 있으며 온라인 미리보기도 지원됩니다.
입력
출력
입력
≈ $0.15-$0.3
출력
≈ $1-$2
캐시 읽기
≈ $0.0125-$0.025
구글 Gemini 3.1 Pro는 Gemini 시리즈의 플래그십 멀티모달 모델로 이미지와 텍스트를 함께 처리하며 강력한 복잡 추론 능력과 긴 컨텍스트 처리 능력을 제공해 까다로운 프로덕션 애플리케이션에 적합합니다. APIAny로 바로 호출할 수 있습니다.
입력
출력
입력
≈ $1.25-$2.5
출력
≈ $7.5-$15
캐시 읽기
≈ $0.625-$1.25
OpenAI GPT-4o mini는 빠르고 저렴한 멀티모달 대화 모델로 신속한 응답과 낮은 비용을 갖춰 일상적인 질의응답과 가벼운 코딩 지원 작업에 적합합니다. APIAny의 OpenAI 호환 API로 바로 호출할 수 있으며 온라인 미리보기도 지원됩니다.
입력
출력
입력
≈ $0.275-$0.55
출력
≈ $0.412-$0.825
캐시 읽기
≈ $0.0138-$0.0275
OpenAI GPT-5.4는 고급 추론, 코드 생성, 에이전트 워크플로에 강한 고성능 모델로 40만 토큰 규모의 컨텍스트 윈도우를 제공해 까다로운 프로덕션 환경과 복잡한 자동화 작업에 적합합니다. APIAny의 OpenAI 호환 API로 바로 호출할 수 있습니다.
입력
출력
입력
≈ $2.5-$5
출력
≈ $15-$30
캐시 읽기
≈ $0.25-$0.5
Anthropic Claude Opus 4.8은 Claude 시리즈의 플래그십 모델로 가장 까다로운 추론, 코딩, 장문 작성 작업을 지원하며 뛰어난 롱 컨텍스트 처리 능력을 갖췄습니다. APIAny의 OpenAI 호환 API로 바로 호출할 수 있으며 온라인 미리보기도 지원됩니다.
입력
출력
입력
≈ $2.5-$5
출력
≈ $12-$24
캐시 읽기
≈ $0.25-$0.5
Anthropic Claude Opus 5 from APIAny — Anthropic’s newest Opus-tier flagship for the hardest coding, long-running agents, and judgment-heavy review.
입력
출력
입력
≈ $3.75-$7.5
출력
≈ $18.75-$37.5
캐시 읽기
≈ $0.375-$0.75
Anthropic Claude Sonnet 4.6은 균형 잡힌 플래그십 모델로 프로덕션 환경의 속도와 비용 안에서도 강력한 추론 성능을 안정적으로 제공해 대규모 상용 배포에 두루 적합합니다. APIAny의 OpenAI 호환 API로 바로 호출할 수 있습니다.
입력
출력
입력
≈ $1.5-$3
출력
≈ $7.5-$15
캐시 읽기
≈ $1-$2
APIAny는 OpenAI 호환 엔드포인트의 공개 채팅·텍스트 모델을 나열하며 각 모델 페이지에 크레딧 가격을 표시합니다.
작성 APIAny Editorial · 수정
유형이나 공급자로 필터하고 크레딧 가격을 비교한 뒤 모델 페이지에서 플레이그라운드와 요청 예시를 확인하세요.
출처
아래 인용은 APIAny가 구현의 기준으로 삼는 공식 API 문서에서 왔습니다.
The Chat Completions API endpoint will generate a model response from a list of messages comprising a conversation.
The Gemini API provides access to Google's most capable generative AI models.
The Images API provides several endpoints that let you generate images from text prompts or create edits of existing images.