API Chat AI

AI API untuk pengembang

API Chat AI

Membangun fitur penulisan, penalaran, dan pengkodean dengan PoYo API Chat AI. Bandingkan model LLM, protokol percakapan, input yang didukung, kontrol respons, dan harga token.

Model yang cocok

27 model

Kimi K3
Berbicara

$2.28 1M input

kimi-k3

Moonshot AI's 2.8T-parameter flagship multimodal model with a 1M-token context window, built for long-horizon coding, deep reasoning, knowledge work, and tool-using agents.

Claude Sonnet 5
Berbicara

$0.85 1M input

claude-sonnet-5

Claude Sonnet 5 API access for agentic coding, long-running agents, browser and computer use, professional workflows, 1M context, and up to 128K output.

DeepSeek V4 Flash
Berbicara

$0.112 1M input

deepseek-v4-flash

DeepSeek V4 Flash is a fast, economical DeepSeek V4 API model with 1M-context chat, 284B total parameters, and 13B active parameters.

DeepSeek V4 Pro
Berbicara

$0.348 1M input

deepseek-v4-pro

DeepSeek V4 Pro is a stronger reasoning, coding, and agent workflow model with 1M-context chat, 1.6T total parameters, and 49B active parameters.

GPT-6 Astra
Berbicara

$8.00 1M input

gpt-6-astra

GPT-6 Astra API for advanced reasoning, coding, and agent workflows. Use Chat Completions or Responses with pay-as-you-go pricing on PoYo.

GPT-6 Sol
Berbicara

$1.60 1M input

gpt-6-sol

GPT-6 Sol API on PoYo. Use Chat Completions or Responses at $1.6 input and $8 output per million tokens, 20% below official standard rates.

Claude Fable 5.1
Berbicara

$8.00 1M input

claude-fable-5-1

Anthropic's most capable generally available model for long-horizon coding, knowledge work, research, vision, 1M context, and up to 128K output.

Gemini 3.7 Flash
Berbicara

$0.06 1M input

gemini-3.7-flash

Google's GA Flash model for agentic coding, multimodal reasoning, web development, long-context knowledge work, and tool-using applications.

Gemini 3.8 Flash
Berbicara

$0.06 1M input

gemini-3.8-flash

Google's best reasoning and coding Flash model for long-horizon software engineering, autonomous agents, and enterprise workflows.

GPT-5.6
Berbicara

$0.056 1M input

gpt-5-6-luna

GPT-5.6 API access for Sol, Terra, and Luna through the Responses API, from high-throughput automation to frontier coding and agent workflows.

GPT-6 Luna
Berbicara

$0.08 1M input

gpt-6-luna

GPT-6 Luna API on PoYo. Use Chat Completions or Responses at $0.08 input and $0.4 output per million tokens, 20% below official standard rates.

Grok 4.6
Berbicara

$1.60 1M input

grok-4.6

xAI's frontier model for long-running agents, coding, engineering, knowledge work, and ambitious interactive or visual projects.

Grok 4.7
Berbicara

$1.60 1M input

grok-4.7

Grok 4.7 API on PoYo. Use Chat Completions at $1.6 input and $4.8 output per million tokens, 20% below official standard rates.

Claude Opus 5
Berbicara

$2.00 1M input

claude-opus-5

Anthropic's flagship agentic model for advanced coding, long-horizon execution, computer use, deep research, and professional knowledge work.

Claude Opus 5.5
Berbicara

$3.20 1M input

claude-opus-5-5

Claude Opus 5.5 API on PoYo. Use Chat Completions or Claude Messages at $3.2 input and $16 output per million tokens, 20% below official standard rates.

Claude Sonnet 5.5
Berbicara

$1.60 1M input

claude-sonnet-5-5

Claude Sonnet 5.5 API on PoYo. Use Chat Completions or Claude Messages at $1.6 input and $8 output per million tokens, 20% below official standard rates.

DeepSeek V4.1 Flash
Berbicara

$0.30 1M input

deepseek-flash

DeepSeek V4.1 Flash is a 552B MoE chat model with native vision, 1M context, 384K max output, and 8B/16B active parameters for cheaper agent workloads.

GPT-6.1 Sol
Berbicara

$1.60 1M input

gpt-6.1-sol

GPT-6.1 Sol API on PoYo. Use Chat Completions or Responses at $1.6 input and $8 output per million tokens, 20% below official standard rates.

GPT-5.5
Berbicara

$3.00 1M input

gpt-5.5

GPT-5.5 API access for chat, coding, reasoning, and production agent workflows.

GPT-5.4
Berbicara

$1.05 1M input

gpt-5.4

GPT-5.4 API access for chat, coding, reasoning, and production agent workflows.

Gemini 3.5 Flash
Berbicara

$0.90 1M input

gemini-3.5-flash

Gemini 3.5 Flash API access for chat, coding, reasoning, and production agent workflows.

GPT-5.2
Berbicara

$0.438 1M input

gpt-5.2

GPT-5.2 API access for chat, coding, reasoning, and production agent workflows.

Claude Opus 4.8
Berbicara

$4.00 1M input

claude-opus-4-8

Claude Opus 4.8 supports long-context chat, agentic coding, professional reasoning, high-output workflows, 1M context, and up to 128K output.

Claude Opus 4.7
Berbicara

$4.00 1M input

claude-opus-4-7

Anthropic's most capable generally available model for frontier coding, deep reasoning, and high-resolution vision.

Claude 4.6 API
Berbicara

$1.44 1M input

claude-sonnet-4-6

Claude Sonnet 4.6 and Claude Opus 4.6 API access for coding, agents, computer use, and long-context reasoning.

Claude 4.5 Series
Berbicara

$0.80 1M input

claude-opus-4-5-20251101

Anthropic's Claude 4.5 series model — Opus, Sonnet & Haiku

Gemini 3 Series
Berbicara

$0.40 1M input

gemini-3-flash-preview

Google's Gemini 3 series model — Flash Preview & Pro Preview

Berbicara Model API - Harga dan Model yang Cocok

Bandingkan penyedia, masukan yang didukung, format keluaran dan harga sebelum memilih model.

Cocok dengan tugas

Model muncul di sini hanya jika katalog metadata mereka termasuk Chat.

Perbandingan penyedia

Ulasan keluarga model di seluruh penyedia tanpa meninggalkan direktori tugas.

API-jalan siap

Setiap kartu model menghubungkan ke PoYo harga, contoh, kontrol taman bermain dan API details.

ModelPenyediaJenis tugasHarga
Kimi K3

kimi-k3

Moonshot AIChat$2.281M input
Claude Sonnet 5

claude-sonnet-5

AnthropicChat$0.851M input
DeepSeek V4 Flash

deepseek-v4-flash

DeepSeekChat$0.1121M input
DeepSeek V4 Pro

deepseek-v4-pro

DeepSeekChat$0.3481M input
GPT-6 Astra

gpt-6-astra

OpenAIChat$8.001M input
GPT-6 Sol

gpt-6-sol

OpenAIChat$1.601M input
Claude Fable 5.1

claude-fable-5-1

AnthropicChat$8.001M input
Gemini 3.7 Flash

gemini-3.7-flash

GoogleChat$0.061M input
Gemini 3.8 Flash

gemini-3.8-flash

GoogleChat$0.061M input
GPT-5.6

gpt-5-6-luna

OpenAIChat$0.0561M input
GPT-6 Luna

gpt-6-luna

OpenAIChat$0.081M input
Grok 4.6

grok-4.6

xAIChat$1.601M input
Grok 4.7

grok-4.7

xAIChat$1.601M input
Claude Opus 5

claude-opus-5

AnthropicChat$2.001M input
Claude Opus 5.5

claude-opus-5-5

AnthropicChat$3.201M input
Claude Sonnet 5.5

claude-sonnet-5-5

AnthropicChat$1.601M input
DeepSeek V4.1 Flash

deepseek-flash

DeepSeekChat$0.301M input
GPT-6.1 Sol

gpt-6.1-sol

OpenAIChat$1.601M input
GPT-5.5

gpt-5.5

OpenAIChat$3.001M input
GPT-5.4

gpt-5.4

OpenAIChat$1.051M input
Gemini 3.5 Flash

gemini-3.5-flash

GoogleChat$0.901M input
GPT-5.2

gpt-5.2

OpenAIChat$0.4381M input
Claude Opus 4.8

claude-opus-4-8

AnthropicChat$4.001M input
Claude Opus 4.7

claude-opus-4-7

AnthropicChat$4.001M input
Claude 4.6 API

claude-sonnet-4-6

AnthropicChat$1.441M input
Claude 4.5 Series

claude-opus-4-5-20251101

AnthropicChat$0.801M input
Gemini 3 Series

gemini-3-flash-preview

GoogleChat$0.401M input

Pertanyaan yang sering diajukan

Apa itu API Chat AI?

+

API obrolan AI menerima pesan percakapan dan mengembalikan respons model bahasa. Ini memungkinkan fitur penulisan, penalaran, pengkodean, dan asisten di aplikasi Anda sendiri. Jenis masukan dan kontrol yang tersedia bergantung pada model dan protokol API yang dipilih.

Model API LLM manakah yang harus saya pilih?

+

Evaluasi model dengan petunjuk, durasi percakapan, dan keluaran yang digunakan produk Anda. Bandingkan kualitas jawaban, mengikuti instruksi, kecepatan dan biaya token. Sertakan contoh-contoh yang sulit dan tidak berhasil dalam evaluasi daripada memilih satu jawaban yang mengesankan.

Apakah setiap model obrolan PoYo menggunakan format permintaan yang sama?

+

Tidak. Gunakan dokumentasi model untuk memilih Penyelesaian Obrolan yang kompatibel dengan OpenAI, format asli Claude Messages, atau Gemini. Struktur pesan, detail autentikasi, dan kontrol yang didukung dapat berbeda. Sesuaikan permintaan dengan protokol yang terdokumentasi alih-alih hanya mengubah nama model.

Bagaimana cara mempertahankan konteks percakapan multi-putaran?

+

Simpan pesan yang relevan di aplikasi Anda dan kirimkan riwayat yang diperlukan oleh protokol yang dipilih. Tetap dalam batas konteks model dan hapus atau rangkum materi yang tidak lagi membantu tugas. Permintaan API baru tidak boleh dianggap mengingat permintaan sebelumnya secara otomatis.

Apakah API Chat AI mendukung respons streaming?

+

Periksa dukungan streaming dan opsi permintaan untuk model dan titik akhir yang dipilih. Jika tersedia, tangani sebagian peristiwa, penyelesaian, dan kesalahan di klien Anda. Pertahankan jalur non-streaming saat alur kerja Anda memerlukan respons lengkap sebelum validasi atau pemrosesan downstream.

Dapatkah saya mengirim gambar atau media lain ke model obrolan?

+

Hanya gunakan jenis media dan struktur pesan yang didokumentasikan untuk model tersebut. Beberapa titik akhir LLM hanya berupa teks dan lainnya mendukung input multimodal. Periksa batasan ukuran, format, dan konten sebelum menerapkan upload, dan uji seberapa baik model tersebut menangani media Anda yang sebenarnya.

Bisakah saya meminta JSON atau respons terstruktur lainnya?

+

Beberapa model memperlihatkan kontrol keluaran terstruktur; yang lain hanya dapat dibimbing oleh petunjuknya. Konfirmasikan mekanisme yang didukung, berikan skema yang jelas jika tersedia, dan validasi data yang dikembalikan dalam aplikasi Anda. Jangan perlakukan permintaan JSON sebagai bukti bahwa setiap respons akan memenuhi skema Anda.

Bisakah model obrolan menjelajahi web atau memanggil alat secara otomatis?

+

Hanya ketika titik akhir mendukung kemampuan tersebut dan aplikasi Anda menyediakan atau mengaktifkan alat yang diperlukan. Sebuah model dapat mendeskripsikan pemanggilan alat tanpa menjalankannya. Periksa protokol alat yang terdokumentasi dan pertahankan eksekusi, izin, dan penanganan hasil secara eksplisit dalam integrasi Anda.

Bagaimana cara mengurangi jawaban obrolan AI yang tidak akurat?

+

Menyediakan materi sumber yang relevan, membuat tugas menjadi tepat dan meminta model untuk membedakan informasi yang hilang dari fakta yang diketahui. Validasi keluaran penting terhadap data tepercaya dan uji kasus kegagalan yang berulang. Pilihan dan dorongan model dapat meningkatkan kualitas, namun jawaban yang dihasilkan masih memerlukan tinjauan yang tepat.

Bagaimana cara menghitung harga API obrolan AI?

+

Penetapan harga obrolan biasanya memisahkan token masukan dan keluaran, dan beberapa model memiliki perbedaan tingkat tambahan. Baca harga model yang dipilih dan respons penggunaan. Sertakan riwayat percakapan dalam perkiraan Anda, karena mengirimkan konteks panjang berulang kali dapat meningkatkan biaya setiap giliran.

Apa yang harus saya lakukan terhadap kesalahan konteks, batas kecepatan, atau batas waktu?

+

Periksa kesalahan yang dikembalikan dan batas model yang dipilih. Kurangi konteks yang terlalu besar, kendalikan permintaan serentak, dan gunakan percobaan ulang terbatas jika diperlukan. Untuk respons streaming parsial, catat apa yang diterima dan putuskan bagaimana aplikasi Anda harus pulih alih-alih menduplikasi percakapan secara diam-diam.

Di mana saya dapat menemukan contoh integrasi API obrolan AI?

+

Buka halaman model dan dokumentasi API-nya untuk titik akhir, autentikasi, isi pesan, dan contoh yang benar. Sumber daya llms.txt khusus model juga mengidentifikasi protokol. Simpan kunci di server dan validasi keluaran sebelum menggunakannya dalam tindakan bisnis otomatis.