Skip to main content
APIYI는 400개 이상의 주류 AI 모델을 지원합니다. 이 페이지에서는 모델 정보, 가격, 사용 방법을 자세히 제공합니다.
엔터프라이즈급 전문적이고 안정적인 AI 대규모 모델 API 허브 모든 모델은 공식 소스로 제공되며 공식 릴레이되고, 충전 보너스와 환율 우위를 결합한 약 20% 할인 가격으로 다양한 우수한 대규모 모델을 통합합니다. 속도 제한 없음, 만료 없음, 계정 차단 위험 없음, 사용량 기반 과금, 장기적으로 안정적인 서비스입니다.

🔥 현재 추천 모델

다음은 현재 안정적으로 제공되는 인기 모델입니다. 전체 모델 목록과 실시간 요금은 APIYI 콘솔 과금 페이지에서 확인하십시오.
모델 업그레이드 권장 사항: 최상의 성능을 위해 최신 모델 사용을 권장합니다. 다만 다음 사항에 유의하십시오.
  1. 초기 불안정성은 흔합니다: 새로 출시된 모델은 공급업체의 제한된 연산 자원 때문에 응답 지연, 타임아웃 또는 간헐적인 오류가 발생할 수 있으며, 이는 보통 며칠에서 몇 주 내에 안정화됩니다
  2. 매개변수 호환성을 확인하십시오: 새 모델은 매개변수를 도입하거나 변경할 수 있습니다(예: max_completion_tokensmax_tokens를 대체함). 업그레이드하기 전에 API 매개변수가 이전 모델과 계속 호환되는지 확인하십시오
  3. 실서비스 적용 전에는 항상 테스트하십시오: 새 모델을 운영 환경에 배포하기 전에 테스트 환경에서 충분히 검증하여 출력 품질과 API 호환성이 기대에 부합하는지 확인하십시오

모델 카테고리

🤖 OpenAI 시리즈

🆕 최신 모델

GPT Pro 시리즈(예: gpt-5.5-pro, gpt-5-pro) 사용 안내:
  1. /v1/responses 엔드포인트만: /v1/chat/completions를 사용할 수 없습니다 — 호출하기 전에 SDK / 코드를 Responses API로 전환하십시오
  2. 매우 비쌉니다: 한 번의 호출 비용이 수달러에 이를 수 있으며, 실수로 Default 그룹에서 사용하는 것을 방지하기 위해 SVIP 그룹에만 열려 있습니다
  3. 전문적 필요가 아닌 경우에는 권장하지 않습니다: 일상 작업에는 GPT-5.5 / GPT-5.4를 사용하십시오. Pro는 극도의 추론 깊이가 필요한 연구와 최상위 작업에만 적합합니다

✅ 안정판 / 클래식

GPT-5 시리즈 사용 안내:
  1. Temperature 매개변수 temperature는 1로 설정해야 합니다(1만 지원합니다)
  2. max_completion_tokensmax_tokens 대신 사용합니다
  3. top_p 매개변수를 전달하지 마십시오
이미지 및 동영상 생성 모델은 전용 페이지로 이동되었습니다. 전체 목록과 과금을 보려면 Image & Video Generation Models를 방문하십시오.

🎭 Claude 시리즈 (Anthropic)

🆕 최신 모델

✅ 안정판 / 클래식

최신: Claude Opus 4.7은 코딩 벤치마크를 4.6 대비 13% 개선하고, tool 호출 오류를 1/3로 줄였으며, 4.6과 동일한 가격으로 xhigh 추론 티어를 추가했습니다. Sonnet 4.6은 Opus 4.5와 경쟁하며 현재 claude.ai의 기본값입니다. 안정판: Opus 4.5와 Sonnet 4.5는 프로덕션 환경에서 실전 검증을 거쳤습니다. Haiku 4.5는 뛰어난 가성비로 2배 속도를 제공합니다.

🌟 Google Gemini 시리즈

🆕 최신 모델

참고: Gemini 3 Pro Preview는 2026년 3월 9일에 중단되었습니다. Gemini 3.1 Pro Preview로 이전하시기 바랍니다.

✅ 안정판 / 클래식

최신: Gemini 3.5 Flash는 Terminal-Bench 2.1, MCP Atlas 등에서 Gemini 3.1 Pro를 완전히 능가하며, 약 4배의 속도와 약 절반의 가격을 제공합니다. 오늘날의 최고의 가성비 모델입니다. Gemini 3.1 Pro Preview는 추론을 2배로 끌어올렸으며(ARC-AGI-2 77.1%), Google의 가장 진보된 모델입니다. Gemini 3.1 Flash Lite는 이제 GA이며, 높은 동시 실행 수를 위한 가장 저렴한 최전선 모델입니다. 안정판: Gemini 2.5 Pro(2M 컨텍스트)와 Gemini 2.5 Flash는 GA이며, 프로덕션에 이상적입니다.

🚀 xAI Grok 시리즈

🆕 최신 모델

✅ 안정 / 클래식

🔍 DeepSeek Series

🆕 최신 모델

✅ 안정판 / 클래식

🐘 중국 모델 시리즈

Zhipu AI (GLM)

🆕 최신: GLM-5.1 | ✅ 안정 / 클래식: GLM-5, GLM-4.6
GLM-5.1 기능:
  • 744B MoE 파라미터로, 최대 8시간까지의 장기 에이전트 작업을 지원합니다
  • SWE-Bench Pro 58.4로, 오픈소스 모델 중 가장 강력한 코딩 성능을 제공합니다
  • MIT 라이선스 오픈소스이며, 가성비가 뛰어납니다

Alibaba Qwen

🆕 최신: Qwen3.7-Max | ✅ 안정 / 클래식: Qwen Max, Plus, Turbo

Moonshot Kimi 시리즈

🆕 최신: Kimi K2.6 | ✅ 안정 / 클래식: Kimi K2.5, K2

🌐 MiniMax 시리즈

🆕 최신: MiniMax M2.7 | ✅ 안정판 / 클래식: MiniMax M2.5
MiniMax M2.7 특징:
  • 10B 파라미터만으로 SWE-bench Pro 56.22%를 달성하며, 가장 작은 Tier-1 모델입니다
  • 자체 진화형이며, 표준 $0.3 / 고속 (MiniMax-M2.7-highspeed) $0.6, 입력 tokens 100만 개당
  • 오픈소스로 공개된 모델 가중치

💰 요금 정보

결제 방식

  • 종량제: 실제 token 사용량에 따라 과금됩니다
  • 최소 과금 없음: 사용한 만큼만 결제하며 잔액은 만료되지 않습니다
  • 실시간 차감: 각 호출 후 수수료가 잔액에서 즉시 차감됩니다

요금 장점

  • 약간의 가격 혜택이 있는 공식 릴레이
  • 대량 사용자는 더 좋은 요금을 위해 고객센터에 문의할 수 있습니다
  • 신규 사용자는 등록 시 300만 token 테스트 크레딧을 받습니다

실시간 요금 보기

APIYI 콘솔 요금 페이지를 방문하여 모든 모델의 최신 요금을 확인하십시오.

🛠️ 사용 권장 사항

모델 선택 가이드

프로그래밍 개발
  • 최고 성능: Claude Opus 4.7 (+13% 코딩 향상, 4.6 대비), GPT-5.5 (SWE-bench 88.7%), Claude Sonnet 4.6 (Opus 4.5와 견줄 만함)
  • 높은 비용 대비 성능: Gemini 3.5 Flash (3.1 Pro를 약 절반 가격으로 능가), GLM-5.1 (SWE-Bench Pro 58.4), Kimi K2.6, DeepSeek V4 Flash
  • 대안: DeepSeek V4 Pro, Qwen3.7-Max, MiniMax M2.7, o4-mini
텍스트 작성
  • 최우선 선택: GPT-5.5, GPT-5.4, Gemini 3.1 Pro Preview, Claude Opus 4.7, Claude Sonnet 4.6
  • 대안: chat-latest, Claude Sonnet 4.5, GPT-4.1, GPT-4o, Claude Haiku 4.5, GLM-4.6
신속 응답
  • 최우선 선택: Gemini 3.5 Flash (~4배 속도), Claude Haiku 4.5 (2배 더 빠름), GPT-4o Mini
  • 대안: Gemini 3.1 Flash Lite, Gemini 2.5 Flash, Grok 4 Fast, GPT-4.1 Mini
이미지 생성
  • 최신 권장: GPT Image 1.5 (4배 속도 향상, 정밀 편집, 최저 $0.01부터)
  • 전문 디자인: SeeDream 4.5 (12억 파라미터, 4K 품질, $0.035/이미지), Nano Banana Pro (4K HD, 최고의 텍스트 렌더링)
  • 높은 비용 대비 성능: Nano Banana ($0.025/이미지), SeeDream 4.0 ($0.025/이미지)
  • 역공학 기반, 최저가: sora_image, gpt-4o-image
장문 처리
  • 최우선 선택: Gemini 2.5 Pro (200만 컨텍스트)
  • 대안: Claude 4 시리즈 (20만 컨텍스트)

비용 최적화 권장 사항

  1. 단계별 사용: 단순 작업에는 더 저렴한 모델을 사용하고, 복잡한 작업에는 고급 모델을 사용합니다
  2. 테스트 최적화: 먼저 작은 모델로 테스트하고, 필요를 파악한 뒤 큰 모델을 사용합니다
  3. 배치 처리: 유사 작업을 대량으로 처리할 때는 Nano 또는 Mini 버전을 선택합니다
  4. 캐시 재사용: 반복 질의에 대해 결과를 캐시합니다

🔗 관련 리소스

모델 목록은 계속 업데이트됩니다. 새로 출시된 우수한 모델을 신속하게 추가하겠습니다. 특정 모델 수요나 대량 요구사항이 있으시면 고객센터에 문의해 주십시오.