
API AI dành cho nhà phát triển
API trò chuyện AI
Xây dựng các tính năng viết, lý luận và mã hóa với API trò chuyện AI PoYo. So sánh các mô hình LLM, giao thức hội thoại, đầu vào được hỗ trợ, kiểm soát phản hồi và định giá mã thông báo.
Các mô hình phù hợp
Các mô hình 27

$2.28 Nhập 1M
kimi-k3
Moonshot AI's 2.8T-parameter flagship multimodal model with a 1M-token context window, built for long-horizon coding, deep reasoning, knowledge work, and tool-using agents.

$0.85 Nhập 1M
claude-sonnet-5
Claude Sonnet 5 API access for agentic coding, long-running agents, browser and computer use, professional workflows, 1M context, and up to 128K output.

$0.112 Nhập 1M
deepseek-v4-flash
DeepSeek V4 Flash is a fast, economical DeepSeek V4 API model with 1M-context chat, 284B total parameters, and 13B active parameters.

$0.348 Nhập 1M
deepseek-v4-pro
DeepSeek V4 Pro is a stronger reasoning, coding, and agent workflow model with 1M-context chat, 1.6T total parameters, and 49B active parameters.

$8.00 Nhập 1M
gpt-6-astra
GPT-6 Astra API for advanced reasoning, coding, and agent workflows. Use Chat Completions or Responses with pay-as-you-go pricing on PoYo.

$1.60 Nhập 1M
gpt-6-sol
GPT-6 Sol API on PoYo. Use Chat Completions or Responses at $1.6 input and $8 output per million tokens, 20% below official standard rates.

$8.00 Nhập 1M
claude-fable-5-1
Anthropic's most capable generally available model for long-horizon coding, knowledge work, research, vision, 1M context, and up to 128K output.

$0.06 Nhập 1M
gemini-3.7-flash
Google's GA Flash model for agentic coding, multimodal reasoning, web development, long-context knowledge work, and tool-using applications.

$0.06 Nhập 1M
gemini-3.8-flash
Google's best reasoning and coding Flash model for long-horizon software engineering, autonomous agents, and enterprise workflows.

$0.056 Nhập 1M
gpt-5-6-luna
GPT-5.6 API access for Sol, Terra, and Luna through the Responses API, from high-throughput automation to frontier coding and agent workflows.

$0.08 Nhập 1M
gpt-6-luna
GPT-6 Luna API on PoYo. Use Chat Completions or Responses at $0.08 input and $0.4 output per million tokens, 20% below official standard rates.

$1.60 Nhập 1M
grok-4.6
xAI's frontier model for long-running agents, coding, engineering, knowledge work, and ambitious interactive or visual projects.

$1.60 Nhập 1M
grok-4.7
Grok 4.7 API on PoYo. Use Chat Completions at $1.6 input and $4.8 output per million tokens, 20% below official standard rates.

$2.00 Nhập 1M
claude-opus-5
Anthropic's flagship agentic model for advanced coding, long-horizon execution, computer use, deep research, and professional knowledge work.

$3.20 Nhập 1M
claude-opus-5-5
Claude Opus 5.5 API on PoYo. Use Chat Completions or Claude Messages at $3.2 input and $16 output per million tokens, 20% below official standard rates.

$1.60 Nhập 1M
claude-sonnet-5-5
Claude Sonnet 5.5 API on PoYo. Use Chat Completions or Claude Messages at $1.6 input and $8 output per million tokens, 20% below official standard rates.

$0.30 Nhập 1M
deepseek-flash
DeepSeek V4.1 Flash is a 552B MoE chat model with native vision, 1M context, 384K max output, and 8B/16B active parameters for cheaper agent workloads.

$1.60 Nhập 1M
gpt-6.1-sol
GPT-6.1 Sol API on PoYo. Use Chat Completions or Responses at $1.6 input and $8 output per million tokens, 20% below official standard rates.

$3.00 Nhập 1M
gpt-5.5
GPT-5.5 API access for chat, coding, reasoning, and production agent workflows.

$1.05 Nhập 1M
gpt-5.4
GPT-5.4 API access for chat, coding, reasoning, and production agent workflows.

$0.90 Nhập 1M
gemini-3.5-flash
Gemini 3.5 Flash API access for chat, coding, reasoning, and production agent workflows.

$0.438 Nhập 1M
gpt-5.2
GPT-5.2 API access for chat, coding, reasoning, and production agent workflows.

$4.00 Nhập 1M
claude-opus-4-8
Claude Opus 4.8 supports long-context chat, agentic coding, professional reasoning, high-output workflows, 1M context, and up to 128K output.

$4.00 Nhập 1M
claude-opus-4-7
Anthropic's most capable generally available model for frontier coding, deep reasoning, and high-resolution vision.

$1.44 Nhập 1M
claude-sonnet-4-6
Claude Sonnet 4.6 and Claude Opus 4.6 API access for coding, agents, computer use, and long-context reasoning.

$0.80 Nhập 1M
claude-opus-4-5-20251101
Anthropic's Claude 4.5 series model — Opus, Sonnet & Haiku

$0.40 Nhập 1M
gemini-3-flash-preview
Google's Gemini 3 series model — Flash Preview & Pro Preview
Chuyện trò chuyện Model API - Giá cả và mô hình phù hợp
So sánh nhà cung cấp, đầu vào hỗ trợ, định dạng đầu ra và giá trước khi chọn mô hình.
Đúng phù hợp với nhiệm vụ
Các mô hình chỉ xuất hiện ở đây khi các metadata danh mục của họ bao gồm Chat.
So sánh nhà cung cấp
Xem xét các gia đình mô hình trên các nhà cung cấp mà không rời khỏi thư mục nhiệm vụ.
Các đường dẫn sẵn sàng cho API
Mỗi thẻ mô hình liên kết đến giá PoYo, ví dụ, điều khiển sân chơi và chi tiết API.
| Mô hình | Nhà cung cấp | Các loại nhiệm vụ | Giá |
|---|---|---|---|
| Kimi K3 kimi-k3 | Moonshot AI | Chat | $2.28Nhập 1M |
| Claude Sonnet 5 claude-sonnet-5 | Anthropic | Chat | $0.85Nhập 1M |
| DeepSeek V4 Flash deepseek-v4-flash | DeepSeek | Chat | $0.112Nhập 1M |
| DeepSeek V4 Pro deepseek-v4-pro | DeepSeek | Chat | $0.348Nhập 1M |
| GPT-6 Astra gpt-6-astra | OpenAI | Chat | $8.00Nhập 1M |
| GPT-6 Sol gpt-6-sol | OpenAI | Chat | $1.60Nhập 1M |
| Claude Fable 5.1 claude-fable-5-1 | Anthropic | Chat | $8.00Nhập 1M |
| Gemini 3.7 Flash gemini-3.7-flash | Chat | $0.06Nhập 1M | |
| Gemini 3.8 Flash gemini-3.8-flash | Chat | $0.06Nhập 1M | |
| GPT-5.6 gpt-5-6-luna | OpenAI | Chat | $0.056Nhập 1M |
| GPT-6 Luna gpt-6-luna | OpenAI | Chat | $0.08Nhập 1M |
| Grok 4.6 grok-4.6 | xAI | Chat | $1.60Nhập 1M |
| Grok 4.7 grok-4.7 | xAI | Chat | $1.60Nhập 1M |
| Claude Opus 5 claude-opus-5 | Anthropic | Chat | $2.00Nhập 1M |
| Claude Opus 5.5 claude-opus-5-5 | Anthropic | Chat | $3.20Nhập 1M |
| Claude Sonnet 5.5 claude-sonnet-5-5 | Anthropic | Chat | $1.60Nhập 1M |
| DeepSeek V4.1 Flash deepseek-flash | DeepSeek | Chat | $0.30Nhập 1M |
| GPT-6.1 Sol gpt-6.1-sol | OpenAI | Chat | $1.60Nhập 1M |
| GPT-5.5 gpt-5.5 | OpenAI | Chat | $3.00Nhập 1M |
| GPT-5.4 gpt-5.4 | OpenAI | Chat | $1.05Nhập 1M |
| Gemini 3.5 Flash gemini-3.5-flash | Chat | $0.90Nhập 1M | |
| GPT-5.2 gpt-5.2 | OpenAI | Chat | $0.438Nhập 1M |
| Claude Opus 4.8 claude-opus-4-8 | Anthropic | Chat | $4.00Nhập 1M |
| Claude Opus 4.7 claude-opus-4-7 | Anthropic | Chat | $4.00Nhập 1M |
| Claude 4.6 API claude-sonnet-4-6 | Anthropic | Chat | $1.44Nhập 1M |
| Claude 4.5 Series claude-opus-4-5-20251101 | Anthropic | Chat | $0.80Nhập 1M |
| Gemini 3 Series gemini-3-flash-preview | Chat | $0.40Nhập 1M |
Những câu hỏi thường được hỏi
API trò chuyện AI là gì?
+
API trò chuyện AI chấp nhận tin nhắn hội thoại và trả về phản hồi theo mô hình ngôn ngữ. Nó cho phép viết, lý luận, mã hóa và các tính năng trợ lý trong ứng dụng của riêng bạn. Các loại đầu vào và điều khiển có sẵn tùy thuộc vào mô hình và giao thức API đã chọn.
Tôi nên chọn mô hình API LLM nào?
+
Đánh giá các mô hình bằng lời nhắc, thời lượng cuộc trò chuyện và kết quả đầu ra mà sản phẩm của bạn sử dụng. So sánh chất lượng câu trả lời, hướng dẫn sau, tốc độ và chi phí mã thông báo. Đưa những ví dụ khó và không thành công vào phần đánh giá thay vì chọn ra một câu trả lời ấn tượng.
Mọi mô hình trò chuyện PoYo có sử dụng cùng một định dạng yêu cầu không?
+
Không. Sử dụng tài liệu mô hình để chọn Định dạng gốc trò chuyện tương thích với OpenAI, Claude Messages hoặc Gemini. Cấu trúc thông báo, chi tiết xác thực và các điều khiển được hỗ trợ có thể khác nhau. Điều chỉnh yêu cầu theo giao thức được ghi lại thay vì chỉ thay đổi tên mô hình.
Làm cách nào để duy trì bối cảnh hội thoại nhiều lượt?
+
Lưu trữ các tin nhắn liên quan trong ứng dụng của bạn và gửi lịch sử theo yêu cầu của giao thức đã chọn. Giữ trong giới hạn ngữ cảnh của mô hình và loại bỏ hoặc tóm tắt tài liệu không còn hữu ích cho nhiệm vụ. Không nên cho rằng yêu cầu API mới sẽ tự động ghi nhớ các yêu cầu trước đó.
API trò chuyện AI có hỗ trợ phản hồi phát trực tuyến không?
+
Kiểm tra hỗ trợ phát trực tuyến và các tùy chọn yêu cầu cho mô hình và điểm cuối đã chọn. Nếu có, hãy xử lý các sự kiện một phần, sự hoàn thành và lỗi trong ứng dụng khách của bạn. Giữ đường dẫn không phát trực tuyến khi quy trình công việc của bạn cần phản hồi hoàn chỉnh trước khi xác thực hoặc xử lý tiếp theo.
Tôi có thể gửi hình ảnh hoặc phương tiện khác tới mô hình trò chuyện không?
+
Chỉ sử dụng loại phương tiện và cấu trúc thông báo được ghi lại cho kiểu máy đó. Một số điểm cuối LLM chỉ ở dạng văn bản và một số điểm cuối khác hỗ trợ đầu vào đa phương thức. Kiểm tra các giới hạn về kích thước, định dạng và nội dung trước khi triển khai tải lên và kiểm tra xem mô hình xử lý phương tiện thực tế của bạn tốt như thế nào.
Tôi có thể yêu cầu JSON hoặc phản hồi có cấu trúc khác không?
+
Một số mô hình hiển thị các điều khiển đầu ra có cấu trúc; những người khác chỉ có thể được hướng dẫn bởi lời nhắc. Xác nhận cơ chế được hỗ trợ, cung cấp lược đồ rõ ràng nếu có và xác thực dữ liệu trả về trong ứng dụng của bạn. Đừng coi yêu cầu JSON là bằng chứng cho thấy mọi phản hồi sẽ đáp ứng lược đồ của bạn.
Mô hình chat có thể duyệt web hoặc gọi công cụ tự động được không?
+
Chỉ khi điểm cuối hỗ trợ khả năng và ứng dụng của bạn cung cấp hoặc kích hoạt các công cụ cần thiết. Một mô hình có thể mô tả lệnh gọi công cụ mà không cần thực hiện nó. Kiểm tra giao thức công cụ được ghi lại và đảm bảo việc thực thi, quyền cũng như xử lý kết quả rõ ràng trong quá trình tích hợp của bạn.
Làm cách nào để giảm các câu trả lời trò chuyện AI không chính xác?
+
Cung cấp tài liệu nguồn có liên quan, thực hiện nhiệm vụ chính xác và yêu cầu mô hình phân biệt thông tin còn thiếu với các sự kiện đã biết. Xác thực các kết quả đầu ra quan trọng dựa trên dữ liệu đáng tin cậy và kiểm tra các trường hợp lỗi định kỳ. Việc lựa chọn và nhắc nhở mô hình có thể cải thiện chất lượng nhưng các câu trả lời được tạo ra vẫn cần được xem xét phù hợp.
Giá API trò chuyện AI được tính như thế nào?
+
Giá trò chuyện thường phân tách mã thông báo đầu vào và đầu ra và một số mô hình có sự phân biệt cấp độ bổ sung. Đọc giá mô hình đã chọn và phản hồi sử dụng. Hãy đưa lịch sử hội thoại vào ước tính của bạn vì việc gửi đi nhiều lần ngữ cảnh dài có thể làm tăng chi phí cho mỗi lượt.
Tôi nên làm gì với lỗi ngữ cảnh, giới hạn tốc độ hoặc thời gian chờ?
+
Kiểm tra lỗi trả về và giới hạn model đã chọn. Giảm bối cảnh quá khổ, kiểm soát các yêu cầu đồng thời và sử dụng số lần thử có giới hạn khi thích hợp. Để có phản hồi phát trực tuyến một phần, hãy ghi lại nội dung đã nhận và quyết định cách ứng dụng của bạn sẽ khôi phục thay vì âm thầm sao chép lượt hội thoại.
Tôi có thể tìm thấy các ví dụ về tích hợp API trò chuyện AI ở đâu?
+
Mở trang mô hình và tài liệu API của nó để biết điểm cuối, xác thực, nội dung thông báo và ví dụ chính xác. Tài nguyên llms.txt dành riêng cho mô hình cũng xác định giao thức. Giữ các khóa trên máy chủ và xác thực kết quả đầu ra trước khi sử dụng chúng trong các hoạt động kinh doanh tự động.