
개발자를 위한 AI API
AI 채팅 API
PoYo AI 채팅 API를 사용하여 쓰기, 추론 및 코딩 기능을 구축합니다. LLM 모델, 대화 프로토콜, 지원되는 입력, 응답 제어 및 토큰 가격을 비교하십시오.
일치하는 모델
27개 모델

$2.28 입력 100만
kimi-k3
Moonshot AI's 2.8T-parameter flagship multimodal model with a 1M-token context window, built for long-horizon coding, deep reasoning, knowledge work, and tool-using agents.

$0.85 입력 100만
claude-sonnet-5
Claude Sonnet 5 API access for agentic coding, long-running agents, browser and computer use, professional workflows, 1M context, and up to 128K output.

$0.112 입력 100만
deepseek-v4-flash
DeepSeek V4 Flash is a fast, economical DeepSeek V4 API model with 1M-context chat, 284B total parameters, and 13B active parameters.

$0.348 입력 100만
deepseek-v4-pro
DeepSeek V4 Pro is a stronger reasoning, coding, and agent workflow model with 1M-context chat, 1.6T total parameters, and 49B active parameters.

$8.00 입력 100만
gpt-6-astra
GPT-6 Astra API for advanced reasoning, coding, and agent workflows. Use Chat Completions or Responses with pay-as-you-go pricing on PoYo.

$1.60 입력 100만
gpt-6-sol
GPT-6 Sol API on PoYo. Use Chat Completions or Responses at $1.6 input and $8 output per million tokens, 20% below official standard rates.

$8.00 입력 100만
claude-fable-5-1
Anthropic's most capable generally available model for long-horizon coding, knowledge work, research, vision, 1M context, and up to 128K output.

$0.06 입력 100만
gemini-3.7-flash
Google's GA Flash model for agentic coding, multimodal reasoning, web development, long-context knowledge work, and tool-using applications.

$0.06 입력 100만
gemini-3.8-flash
Google's best reasoning and coding Flash model for long-horizon software engineering, autonomous agents, and enterprise workflows.

$0.056 입력 100만
gpt-5-6-luna
GPT-5.6 API access for Sol, Terra, and Luna through the Responses API, from high-throughput automation to frontier coding and agent workflows.

$0.08 입력 100만
gpt-6-luna
GPT-6 Luna API on PoYo. Use Chat Completions or Responses at $0.08 input and $0.4 output per million tokens, 20% below official standard rates.

$1.60 입력 100만
grok-4.6
xAI's frontier model for long-running agents, coding, engineering, knowledge work, and ambitious interactive or visual projects.

$1.60 입력 100만
grok-4.7
Grok 4.7 API on PoYo. Use Chat Completions at $1.6 input and $4.8 output per million tokens, 20% below official standard rates.

$2.00 입력 100만
claude-opus-5
Anthropic's flagship agentic model for advanced coding, long-horizon execution, computer use, deep research, and professional knowledge work.

$3.20 입력 100만
claude-opus-5-5
Claude Opus 5.5 API on PoYo. Use Chat Completions or Claude Messages at $3.2 input and $16 output per million tokens, 20% below official standard rates.

$1.60 입력 100만
claude-sonnet-5-5
Claude Sonnet 5.5 API on PoYo. Use Chat Completions or Claude Messages at $1.6 input and $8 output per million tokens, 20% below official standard rates.

$0.30 입력 100만
deepseek-flash
DeepSeek V4.1 Flash is a 552B MoE chat model with native vision, 1M context, 384K max output, and 8B/16B active parameters for cheaper agent workloads.

$1.60 입력 100만
gpt-6.1-sol
GPT-6.1 Sol API on PoYo. Use Chat Completions or Responses at $1.6 input and $8 output per million tokens, 20% below official standard rates.

$3.00 입력 100만
gpt-5.5
GPT-5.5 API access for chat, coding, reasoning, and production agent workflows.

$1.05 입력 100만
gpt-5.4
GPT-5.4 API access for chat, coding, reasoning, and production agent workflows.

$0.90 입력 100만
gemini-3.5-flash
Gemini 3.5 Flash API access for chat, coding, reasoning, and production agent workflows.

$0.438 입력 100만
gpt-5.2
GPT-5.2 API access for chat, coding, reasoning, and production agent workflows.

$4.00 입력 100만
claude-opus-4-8
Claude Opus 4.8 supports long-context chat, agentic coding, professional reasoning, high-output workflows, 1M context, and up to 128K output.

$4.00 입력 100만
claude-opus-4-7
Anthropic's most capable generally available model for frontier coding, deep reasoning, and high-resolution vision.

$1.44 입력 100만
claude-sonnet-4-6
Claude Sonnet 4.6 and Claude Opus 4.6 API access for coding, agents, computer use, and long-context reasoning.

$0.80 입력 100만
claude-opus-4-5-20251101
Anthropic's Claude 4.5 series model — Opus, Sonnet & Haiku

$0.40 입력 100만
gemini-3-flash-preview
Google's Gemini 3 series model — Flash Preview & Pro Preview
채팅 모델 API - 가격 및 모델 적합성
모델을 선택하기 전에 공급자, 지원 입력, 출력 형식 및 가격을 비교하세요.
정확한 작업 매칭
카탈로그 메타데이터에 Chat가 포함된 모델만 여기에 표시됩니다.
제공사 비교
작업 디렉터리를 벗어나지 않고 여러 제공사의 모델 제품군을 비교하세요.
API 준비 경로
각 모델 카드는 PoYo 가격, 예시, 플레이그라운드, API 세부 정보로 연결됩니다.
| 모델 | 제공사 | 작업 유형 | 가격 |
|---|---|---|---|
| Kimi K3 kimi-k3 | Moonshot AI | Chat | $2.28입력 100만 |
| Claude Sonnet 5 claude-sonnet-5 | Anthropic | Chat | $0.85입력 100만 |
| DeepSeek V4 Flash deepseek-v4-flash | DeepSeek | Chat | $0.112입력 100만 |
| DeepSeek V4 Pro deepseek-v4-pro | DeepSeek | Chat | $0.348입력 100만 |
| GPT-6 Astra gpt-6-astra | OpenAI | Chat | $8.00입력 100만 |
| GPT-6 Sol gpt-6-sol | OpenAI | Chat | $1.60입력 100만 |
| Claude Fable 5.1 claude-fable-5-1 | Anthropic | Chat | $8.00입력 100만 |
| Gemini 3.7 Flash gemini-3.7-flash | Chat | $0.06입력 100만 | |
| Gemini 3.8 Flash gemini-3.8-flash | Chat | $0.06입력 100만 | |
| GPT-5.6 gpt-5-6-luna | OpenAI | Chat | $0.056입력 100만 |
| GPT-6 Luna gpt-6-luna | OpenAI | Chat | $0.08입력 100만 |
| Grok 4.6 grok-4.6 | xAI | Chat | $1.60입력 100만 |
| Grok 4.7 grok-4.7 | xAI | Chat | $1.60입력 100만 |
| Claude Opus 5 claude-opus-5 | Anthropic | Chat | $2.00입력 100만 |
| Claude Opus 5.5 claude-opus-5-5 | Anthropic | Chat | $3.20입력 100만 |
| Claude Sonnet 5.5 claude-sonnet-5-5 | Anthropic | Chat | $1.60입력 100만 |
| DeepSeek V4.1 Flash deepseek-flash | DeepSeek | Chat | $0.30입력 100만 |
| GPT-6.1 Sol gpt-6.1-sol | OpenAI | Chat | $1.60입력 100만 |
| GPT-5.5 gpt-5.5 | OpenAI | Chat | $3.00입력 100만 |
| GPT-5.4 gpt-5.4 | OpenAI | Chat | $1.05입력 100만 |
| Gemini 3.5 Flash gemini-3.5-flash | Chat | $0.90입력 100만 | |
| GPT-5.2 gpt-5.2 | OpenAI | Chat | $0.438입력 100만 |
| Claude Opus 4.8 claude-opus-4-8 | Anthropic | Chat | $4.00입력 100만 |
| Claude Opus 4.7 claude-opus-4-7 | Anthropic | Chat | $4.00입력 100만 |
| Claude 4.6 API claude-sonnet-4-6 | Anthropic | Chat | $1.44입력 100만 |
| Claude 4.5 Series claude-opus-4-5-20251101 | Anthropic | Chat | $0.80입력 100만 |
| Gemini 3 Series gemini-3-flash-preview | Chat | $0.40입력 100만 |
자주 묻는 질문
AI 채팅 API란 무엇인가요?
+
AI 채팅 API가 대화 메시지를 받아들이고 언어 모델 응답을 반환합니다. 자신의 애플리케이션에서 쓰기, 추론, 코딩 및 보조 기능을 사용할 수 있습니다. 사용 가능한 입력 유형 및 컨트롤은 선택한 모델 및 API 프로토콜에 따라 다릅니다.
어떤 LLM API 모델을 선택해야 합니까?
+
제품에서 사용하는 프롬프트, 대화 길이 및 출력을 사용하여 모델을 평가합니다. 답변 품질, 지침 따르기, 속도 및 토큰 비용을 비교하십시오. 하나의 인상적인 답변 중에서 선택하기보다는 평가에 어렵고 실패한 사례를 포함시키십시오.
모든 PoYo 채팅 모델은 동일한 요청 형식을 사용합니까?
+
아니요. 모델 문서를 사용하여 OpenAI 호환 채팅 완료, Claude Messages 또는 Gemini 기본 형식을 선택하세요. 메시지 구조, 인증 세부정보 및 지원되는 컨트롤은 다를 수 있습니다. 모델 이름만 변경하는 대신 문서화된 프로토콜에 맞게 요청을 조정하세요.
여러 차례 대화 내용을 어떻게 보존하나요?
+
관련 메시지를 애플리케이션에 저장하고 선택한 프로토콜에 필요한 기록을 보냅니다. 모델 컨텍스트 제한 내에서 유지하고 더 이상 작업에 도움이 되지 않는 자료를 제거하거나 요약합니다. 새로운 API 요청이 이전 요청을 자동으로 기억한다고 가정하면 안 됩니다.
AI 채팅 API는 스트리밍 응답을 지원하나요?
+
선택한 모델 및 엔드포인트에 대한 스트리밍 지원 및 요청 옵션을 확인하세요. 가능하다면 클라이언트의 부분 이벤트, 완료 및 오류를 처리하세요. 검증 또는 다운스트림 처리 전에 워크플로에 완전한 응답이 필요한 경우 비스트리밍 경로를 유지하세요.
이미지나 기타 미디어를 채팅 모델에 보낼 수 있나요?
+
해당 모델에 대해 문서화된 미디어 유형과 메시지 구조만 사용하십시오. 일부 LLM 엔드포인트는 텍스트 전용이고 다른 엔드포인트는 다중 모드 입력을 지원합니다. 업로드를 구현하기 전에 크기, 형식 및 콘텐츠 제한을 확인하고 모델이 실제 미디어를 얼마나 잘 처리하는지 테스트하십시오.
JSON이나 다른 구조화된 응답을 요청할 수 있나요?
+
일부 모델은 구조화된 출력 컨트롤을 노출합니다. 다른 사람들은 프롬프트에 의해서만 안내될 수 있습니다. 지원되는 메커니즘을 확인하고, 사용 가능한 경우 명확한 스키마를 제공하고, 애플리케이션에서 반환된 데이터의 유효성을 검사하세요. 모든 응답이 스키마를 충족한다는 증거로 JSON 요청을 처리하지 마십시오.
채팅 모델이 자동으로 웹을 검색하거나 도구를 호출할 수 있나요?
+
엔드포인트가 기능을 지원하고 애플리케이션이 필요한 도구를 제공하거나 활성화하는 경우에만 해당됩니다. 모델은 도구 호출을 실행하지 않고 설명할 수 있습니다. 문서화된 도구 프로토콜을 확인하고 통합 시 실행, 권한 및 결과 처리를 명시적으로 유지하세요.
부정확한 AI 채팅 답변을 어떻게 줄일 수 있나요?
+
관련 소스 자료를 제공하고 작업을 정확하게 수행하며 모델에 누락된 정보와 알려진 사실을 구별하도록 요청합니다. 신뢰할 수 있는 데이터에 대해 중요한 출력을 검증하고 반복되는 실패 사례를 테스트합니다. 모델 선택 및 프롬프트를 통해 품질이 향상될 수 있지만 생성된 답변에는 여전히 적절한 검토가 필요합니다.
AI 채팅 API 가격은 어떻게 계산되나요?
+
채팅 가격은 일반적으로 입력 및 출력 토큰을 분리하며 일부 모델에는 추가적인 계층 구분이 있습니다. 선택한 모델의 가격과 사용 반응을 읽어보세요. 긴 컨텍스트를 반복적으로 전송하면 각 차례의 비용이 증가할 수 있으므로 견적에 대화 기록을 포함하세요.
컨텍스트 오류, 속도 제한 또는 시간 초과에 대해서는 어떻게 해야 합니까?
+
반환된 오류와 선택한 모델 제한을 확인하세요. 크기가 너무 큰 컨텍스트를 줄이고 동시 요청을 제어하며 적절한 경우 제한적인 재시도를 사용합니다. 부분 스트리밍 응답의 경우 수신된 내용을 기록하고 대화 차례를 자동으로 복제하는 대신 애플리케이션이 복구해야 하는 방법을 결정합니다.
AI 채팅 API 통합 예시는 어디서 찾을 수 있나요?
+
올바른 끝점, 인증, 메시지 본문 및 예제에 대한 모델 페이지와 해당 API 문서를 엽니다. 모델별 llms.txt 리소스도 프로토콜을 식별합니다. 자동화된 비즈니스 작업에 키를 사용하기 전에 서버에 키를 보관하고 출력의 유효성을 검사하세요.