엔터프라이즈급 전문적이고 안정적인 AI 대규모 모델 API 허브
모든 모델은 공식 소스로 제공되며 공식 릴레이되고, 충전 보너스와 환율 우위를 결합한 약 20% 할인 가격으로 다양한 우수한 대규모 모델을 통합합니다. 속도 제한 없음, 만료 없음, 계정 차단 위험 없음, 사용량 기반 과금, 장기적으로 안정적인 서비스입니다.
🔥 현재 추천 모델
다음은 현재 안정적으로 제공되는 인기 모델입니다. 전체 모델 목록과 실시간 요금은 APIYI 콘솔 과금 페이지에서 확인하십시오.모델 카테고리
🤖 OpenAI 시리즈
🆕 최신 모델
✅ 안정판 / 클래식
이미지 및 동영상 생성 모델은 전용 페이지로 이동되었습니다. 전체 목록과 과금을 보려면 Image & Video Generation Models를 방문하십시오.
🎭 Claude 시리즈 (Anthropic)
🆕 최신 모델
✅ 안정판 / 클래식
최신: Claude Opus 4.7은 코딩 벤치마크를 4.6 대비 13% 개선하고, tool 호출 오류를 1/3로 줄였으며, 4.6과 동일한 가격으로 xhigh 추론 티어를 추가했습니다. Sonnet 4.6은 Opus 4.5와 경쟁하며 현재 claude.ai의 기본값입니다. 안정판: Opus 4.5와 Sonnet 4.5는 프로덕션 환경에서 실전 검증을 거쳤습니다. Haiku 4.5는 뛰어난 가성비로 2배 속도를 제공합니다.
🌟 Google Gemini 시리즈
🆕 최신 모델
✅ 안정판 / 클래식
최신: Gemini 3.5 Flash는 Terminal-Bench 2.1, MCP Atlas 등에서 Gemini 3.1 Pro를 완전히 능가하며, 약 4배의 속도와 약 절반의 가격을 제공합니다. 오늘날의 최고의 가성비 모델입니다. Gemini 3.1 Pro Preview는 추론을 2배로 끌어올렸으며(ARC-AGI-2 77.1%), Google의 가장 진보된 모델입니다. Gemini 3.1 Flash Lite는 이제 GA이며, 높은 동시 실행 수를 위한 가장 저렴한 최전선 모델입니다. 안정판: Gemini 2.5 Pro(2M 컨텍스트)와 Gemini 2.5 Flash는 GA이며, 프로덕션에 이상적입니다.
🚀 xAI Grok 시리즈
🆕 최신 모델
✅ 안정 / 클래식
🔍 DeepSeek Series
🆕 최신 모델
✅ 안정판 / 클래식
🐘 중국 모델 시리즈
Zhipu AI (GLM)
🆕 최신: GLM-5.1 | ✅ 안정 / 클래식: GLM-5, GLM-4.6GLM-5.1 기능:
- 744B MoE 파라미터로, 최대 8시간까지의 장기 에이전트 작업을 지원합니다
- SWE-Bench Pro 58.4로, 오픈소스 모델 중 가장 강력한 코딩 성능을 제공합니다
- MIT 라이선스 오픈소스이며, 가성비가 뛰어납니다
Alibaba Qwen
🆕 최신: Qwen3.7-Max | ✅ 안정 / 클래식: Qwen Max, Plus, TurboMoonshot Kimi 시리즈
🆕 최신: Kimi K2.6 | ✅ 안정 / 클래식: Kimi K2.5, K2🌐 MiniMax 시리즈
🆕 최신: MiniMax M2.7 | ✅ 안정판 / 클래식: MiniMax M2.5MiniMax M2.7 특징:
- 10B 파라미터만으로 SWE-bench Pro 56.22%를 달성하며, 가장 작은 Tier-1 모델입니다
- 자체 진화형이며, 표준 $0.3 / 고속 (
MiniMax-M2.7-highspeed) $0.6, 입력 tokens 100만 개당 - 오픈소스로 공개된 모델 가중치
💰 요금 정보
결제 방식
- 종량제: 실제 token 사용량에 따라 과금됩니다
- 최소 과금 없음: 사용한 만큼만 결제하며 잔액은 만료되지 않습니다
- 실시간 차감: 각 호출 후 수수료가 잔액에서 즉시 차감됩니다
요금 장점
- 약간의 가격 혜택이 있는 공식 릴레이
- 대량 사용자는 더 좋은 요금을 위해 고객센터에 문의할 수 있습니다
- 신규 사용자는 등록 시 300만 token 테스트 크레딧을 받습니다
실시간 요금 보기
APIYI 콘솔 요금 페이지를 방문하여 모든 모델의 최신 요금을 확인하십시오.🛠️ 사용 권장 사항
모델 선택 가이드
프로그래밍 개발- 최고 성능: Claude Opus 4.7 (+13% 코딩 향상, 4.6 대비), GPT-5.5 (SWE-bench 88.7%), Claude Sonnet 4.6 (Opus 4.5와 견줄 만함)
- 높은 비용 대비 성능: Gemini 3.5 Flash (3.1 Pro를 약 절반 가격으로 능가), GLM-5.1 (SWE-Bench Pro 58.4), Kimi K2.6, DeepSeek V4 Flash
- 대안: DeepSeek V4 Pro, Qwen3.7-Max, MiniMax M2.7, o4-mini
- 최우선 선택: GPT-5.5, GPT-5.4, Gemini 3.1 Pro Preview, Claude Opus 4.7, Claude Sonnet 4.6
- 대안: chat-latest, Claude Sonnet 4.5, GPT-4.1, GPT-4o, Claude Haiku 4.5, GLM-4.6
- 최우선 선택: Gemini 3.5 Flash (~4배 속도), Claude Haiku 4.5 (2배 더 빠름), GPT-4o Mini
- 대안: Gemini 3.1 Flash Lite, Gemini 2.5 Flash, Grok 4 Fast, GPT-4.1 Mini
- 최신 권장: GPT Image 1.5 (4배 속도 향상, 정밀 편집, 최저 $0.01부터)
- 전문 디자인: SeeDream 4.5 (12억 파라미터, 4K 품질, $0.035/이미지), Nano Banana Pro (4K HD, 최고의 텍스트 렌더링)
- 높은 비용 대비 성능: Nano Banana ($0.025/이미지), SeeDream 4.0 ($0.025/이미지)
- 역공학 기반, 최저가: sora_image, gpt-4o-image
- 최우선 선택: Gemini 2.5 Pro (200만 컨텍스트)
- 대안: Claude 4 시리즈 (20만 컨텍스트)
비용 최적화 권장 사항
- 단계별 사용: 단순 작업에는 더 저렴한 모델을 사용하고, 복잡한 작업에는 고급 모델을 사용합니다
- 테스트 최적화: 먼저 작은 모델로 테스트하고, 필요를 파악한 뒤 큰 모델을 사용합니다
- 배치 처리: 유사 작업을 대량으로 처리할 때는 Nano 또는 Mini 버전을 선택합니다
- 캐시 재사용: 반복 질의에 대해 결과를 캐시합니다
🔗 관련 리소스
모델 목록은 계속 업데이트됩니다. 새로 출시된 우수한 모델을 신속하게 추가하겠습니다. 특정 모델 수요나 대량 요구사항이 있으시면 고객센터에 문의해 주십시오.