
AI API untuk pengembang
API Chat AI
Membangun fitur penulisan, penalaran, dan pengkodean dengan PoYo API Chat AI. Bandingkan model LLM, protokol percakapan, input yang didukung, kontrol respons, dan harga token.
Model yang cocok
27 model

$2.28 1M input
kimi-k3
Moonshot AI's 2.8T-parameter flagship multimodal model with a 1M-token context window, built for long-horizon coding, deep reasoning, knowledge work, and tool-using agents.

$0.85 1M input
claude-sonnet-5
Claude Sonnet 5 API access for agentic coding, long-running agents, browser and computer use, professional workflows, 1M context, and up to 128K output.

$0.112 1M input
deepseek-v4-flash
DeepSeek V4 Flash is a fast, economical DeepSeek V4 API model with 1M-context chat, 284B total parameters, and 13B active parameters.

$0.348 1M input
deepseek-v4-pro
DeepSeek V4 Pro is a stronger reasoning, coding, and agent workflow model with 1M-context chat, 1.6T total parameters, and 49B active parameters.

$8.00 1M input
gpt-6-astra
GPT-6 Astra API for advanced reasoning, coding, and agent workflows. Use Chat Completions or Responses with pay-as-you-go pricing on PoYo.

$1.60 1M input
gpt-6-sol
GPT-6 Sol API on PoYo. Use Chat Completions or Responses at $1.6 input and $8 output per million tokens, 20% below official standard rates.

$8.00 1M input
claude-fable-5-1
Anthropic's most capable generally available model for long-horizon coding, knowledge work, research, vision, 1M context, and up to 128K output.

$0.06 1M input
gemini-3.7-flash
Google's GA Flash model for agentic coding, multimodal reasoning, web development, long-context knowledge work, and tool-using applications.

$0.06 1M input
gemini-3.8-flash
Google's best reasoning and coding Flash model for long-horizon software engineering, autonomous agents, and enterprise workflows.

$0.056 1M input
gpt-5-6-luna
GPT-5.6 API access for Sol, Terra, and Luna through the Responses API, from high-throughput automation to frontier coding and agent workflows.

$0.08 1M input
gpt-6-luna
GPT-6 Luna API on PoYo. Use Chat Completions or Responses at $0.08 input and $0.4 output per million tokens, 20% below official standard rates.

$1.60 1M input
grok-4.6
xAI's frontier model for long-running agents, coding, engineering, knowledge work, and ambitious interactive or visual projects.

$1.60 1M input
grok-4.7
Grok 4.7 API on PoYo. Use Chat Completions at $1.6 input and $4.8 output per million tokens, 20% below official standard rates.

$2.00 1M input
claude-opus-5
Anthropic's flagship agentic model for advanced coding, long-horizon execution, computer use, deep research, and professional knowledge work.

$3.20 1M input
claude-opus-5-5
Claude Opus 5.5 API on PoYo. Use Chat Completions or Claude Messages at $3.2 input and $16 output per million tokens, 20% below official standard rates.

$1.60 1M input
claude-sonnet-5-5
Claude Sonnet 5.5 API on PoYo. Use Chat Completions or Claude Messages at $1.6 input and $8 output per million tokens, 20% below official standard rates.

$0.30 1M input
deepseek-flash
DeepSeek V4.1 Flash is a 552B MoE chat model with native vision, 1M context, 384K max output, and 8B/16B active parameters for cheaper agent workloads.

$1.60 1M input
gpt-6.1-sol
GPT-6.1 Sol API on PoYo. Use Chat Completions or Responses at $1.6 input and $8 output per million tokens, 20% below official standard rates.

$3.00 1M input
gpt-5.5
GPT-5.5 API access for chat, coding, reasoning, and production agent workflows.

$1.05 1M input
gpt-5.4
GPT-5.4 API access for chat, coding, reasoning, and production agent workflows.

$0.90 1M input
gemini-3.5-flash
Gemini 3.5 Flash API access for chat, coding, reasoning, and production agent workflows.

$0.438 1M input
gpt-5.2
GPT-5.2 API access for chat, coding, reasoning, and production agent workflows.

$4.00 1M input
claude-opus-4-8
Claude Opus 4.8 supports long-context chat, agentic coding, professional reasoning, high-output workflows, 1M context, and up to 128K output.

$4.00 1M input
claude-opus-4-7
Anthropic's most capable generally available model for frontier coding, deep reasoning, and high-resolution vision.

$1.44 1M input
claude-sonnet-4-6
Claude Sonnet 4.6 and Claude Opus 4.6 API access for coding, agents, computer use, and long-context reasoning.

$0.80 1M input
claude-opus-4-5-20251101
Anthropic's Claude 4.5 series model — Opus, Sonnet & Haiku

$0.40 1M input
gemini-3-flash-preview
Google's Gemini 3 series model — Flash Preview & Pro Preview
Berbicara Model API - Harga dan Model yang Cocok
Bandingkan penyedia, masukan yang didukung, format keluaran dan harga sebelum memilih model.
Cocok dengan tugas
Model muncul di sini hanya jika katalog metadata mereka termasuk Chat.
Perbandingan penyedia
Ulasan keluarga model di seluruh penyedia tanpa meninggalkan direktori tugas.
API-jalan siap
Setiap kartu model menghubungkan ke PoYo harga, contoh, kontrol taman bermain dan API details.
| Model | Penyedia | Jenis tugas | Harga |
|---|---|---|---|
| Kimi K3 kimi-k3 | Moonshot AI | Chat | $2.281M input |
| Claude Sonnet 5 claude-sonnet-5 | Anthropic | Chat | $0.851M input |
| DeepSeek V4 Flash deepseek-v4-flash | DeepSeek | Chat | $0.1121M input |
| DeepSeek V4 Pro deepseek-v4-pro | DeepSeek | Chat | $0.3481M input |
| GPT-6 Astra gpt-6-astra | OpenAI | Chat | $8.001M input |
| GPT-6 Sol gpt-6-sol | OpenAI | Chat | $1.601M input |
| Claude Fable 5.1 claude-fable-5-1 | Anthropic | Chat | $8.001M input |
| Gemini 3.7 Flash gemini-3.7-flash | Chat | $0.061M input | |
| Gemini 3.8 Flash gemini-3.8-flash | Chat | $0.061M input | |
| GPT-5.6 gpt-5-6-luna | OpenAI | Chat | $0.0561M input |
| GPT-6 Luna gpt-6-luna | OpenAI | Chat | $0.081M input |
| Grok 4.6 grok-4.6 | xAI | Chat | $1.601M input |
| Grok 4.7 grok-4.7 | xAI | Chat | $1.601M input |
| Claude Opus 5 claude-opus-5 | Anthropic | Chat | $2.001M input |
| Claude Opus 5.5 claude-opus-5-5 | Anthropic | Chat | $3.201M input |
| Claude Sonnet 5.5 claude-sonnet-5-5 | Anthropic | Chat | $1.601M input |
| DeepSeek V4.1 Flash deepseek-flash | DeepSeek | Chat | $0.301M input |
| GPT-6.1 Sol gpt-6.1-sol | OpenAI | Chat | $1.601M input |
| GPT-5.5 gpt-5.5 | OpenAI | Chat | $3.001M input |
| GPT-5.4 gpt-5.4 | OpenAI | Chat | $1.051M input |
| Gemini 3.5 Flash gemini-3.5-flash | Chat | $0.901M input | |
| GPT-5.2 gpt-5.2 | OpenAI | Chat | $0.4381M input |
| Claude Opus 4.8 claude-opus-4-8 | Anthropic | Chat | $4.001M input |
| Claude Opus 4.7 claude-opus-4-7 | Anthropic | Chat | $4.001M input |
| Claude 4.6 API claude-sonnet-4-6 | Anthropic | Chat | $1.441M input |
| Claude 4.5 Series claude-opus-4-5-20251101 | Anthropic | Chat | $0.801M input |
| Gemini 3 Series gemini-3-flash-preview | Chat | $0.401M input |
Pertanyaan yang sering diajukan
Apa itu API Chat AI?
+
API obrolan AI menerima pesan percakapan dan mengembalikan respons model bahasa. Ini memungkinkan fitur penulisan, penalaran, pengkodean, dan asisten di aplikasi Anda sendiri. Jenis masukan dan kontrol yang tersedia bergantung pada model dan protokol API yang dipilih.
Model API LLM manakah yang harus saya pilih?
+
Evaluasi model dengan petunjuk, durasi percakapan, dan keluaran yang digunakan produk Anda. Bandingkan kualitas jawaban, mengikuti instruksi, kecepatan dan biaya token. Sertakan contoh-contoh yang sulit dan tidak berhasil dalam evaluasi daripada memilih satu jawaban yang mengesankan.
Apakah setiap model obrolan PoYo menggunakan format permintaan yang sama?
+
Tidak. Gunakan dokumentasi model untuk memilih Penyelesaian Obrolan yang kompatibel dengan OpenAI, format asli Claude Messages, atau Gemini. Struktur pesan, detail autentikasi, dan kontrol yang didukung dapat berbeda. Sesuaikan permintaan dengan protokol yang terdokumentasi alih-alih hanya mengubah nama model.
Bagaimana cara mempertahankan konteks percakapan multi-putaran?
+
Simpan pesan yang relevan di aplikasi Anda dan kirimkan riwayat yang diperlukan oleh protokol yang dipilih. Tetap dalam batas konteks model dan hapus atau rangkum materi yang tidak lagi membantu tugas. Permintaan API baru tidak boleh dianggap mengingat permintaan sebelumnya secara otomatis.
Apakah API Chat AI mendukung respons streaming?
+
Periksa dukungan streaming dan opsi permintaan untuk model dan titik akhir yang dipilih. Jika tersedia, tangani sebagian peristiwa, penyelesaian, dan kesalahan di klien Anda. Pertahankan jalur non-streaming saat alur kerja Anda memerlukan respons lengkap sebelum validasi atau pemrosesan downstream.
Dapatkah saya mengirim gambar atau media lain ke model obrolan?
+
Hanya gunakan jenis media dan struktur pesan yang didokumentasikan untuk model tersebut. Beberapa titik akhir LLM hanya berupa teks dan lainnya mendukung input multimodal. Periksa batasan ukuran, format, dan konten sebelum menerapkan upload, dan uji seberapa baik model tersebut menangani media Anda yang sebenarnya.
Bisakah saya meminta JSON atau respons terstruktur lainnya?
+
Beberapa model memperlihatkan kontrol keluaran terstruktur; yang lain hanya dapat dibimbing oleh petunjuknya. Konfirmasikan mekanisme yang didukung, berikan skema yang jelas jika tersedia, dan validasi data yang dikembalikan dalam aplikasi Anda. Jangan perlakukan permintaan JSON sebagai bukti bahwa setiap respons akan memenuhi skema Anda.
Bisakah model obrolan menjelajahi web atau memanggil alat secara otomatis?
+
Hanya ketika titik akhir mendukung kemampuan tersebut dan aplikasi Anda menyediakan atau mengaktifkan alat yang diperlukan. Sebuah model dapat mendeskripsikan pemanggilan alat tanpa menjalankannya. Periksa protokol alat yang terdokumentasi dan pertahankan eksekusi, izin, dan penanganan hasil secara eksplisit dalam integrasi Anda.
Bagaimana cara mengurangi jawaban obrolan AI yang tidak akurat?
+
Menyediakan materi sumber yang relevan, membuat tugas menjadi tepat dan meminta model untuk membedakan informasi yang hilang dari fakta yang diketahui. Validasi keluaran penting terhadap data tepercaya dan uji kasus kegagalan yang berulang. Pilihan dan dorongan model dapat meningkatkan kualitas, namun jawaban yang dihasilkan masih memerlukan tinjauan yang tepat.
Bagaimana cara menghitung harga API obrolan AI?
+
Penetapan harga obrolan biasanya memisahkan token masukan dan keluaran, dan beberapa model memiliki perbedaan tingkat tambahan. Baca harga model yang dipilih dan respons penggunaan. Sertakan riwayat percakapan dalam perkiraan Anda, karena mengirimkan konteks panjang berulang kali dapat meningkatkan biaya setiap giliran.
Apa yang harus saya lakukan terhadap kesalahan konteks, batas kecepatan, atau batas waktu?
+
Periksa kesalahan yang dikembalikan dan batas model yang dipilih. Kurangi konteks yang terlalu besar, kendalikan permintaan serentak, dan gunakan percobaan ulang terbatas jika diperlukan. Untuk respons streaming parsial, catat apa yang diterima dan putuskan bagaimana aplikasi Anda harus pulih alih-alih menduplikasi percakapan secara diam-diam.
Di mana saya dapat menemukan contoh integrasi API obrolan AI?
+
Buka halaman model dan dokumentasi API-nya untuk titik akhir, autentikasi, isi pesan, dan contoh yang benar. Sumber daya llms.txt khusus model juga mengidentifikasi protokol. Simpan kunci di server dan validasi keluaran sebelum menggunakannya dalam tindakan bisnis otomatis.
Menjelajahi semua model AI
Buka pasar model penuh untuk membandingkan gambar, video, audio, chat, 3D dan model alat.
Lihat semua modelMembangun dengan API
Buka halaman model untuk parameter, harga dan dokumentasi API.
Dokumentasi APIHalaman tugas yang terkait