API di chat IA

API IA per sviluppatori

API di chat IA

Crea funzionalità di scrittura, ragionamento e codifica con l'API di chat IA PoYo. Confronta modelli LLM, protocolli di conversazione, input supportati, controlli di risposta e prezzi dei token.

Modelli corrispondenti

27 modelli

Kimi K3
Chiacchierata

$2.28 Ingresso 1M

kimi-k3

Moonshot AI's 2.8T-parameter flagship multimodal model with a 1M-token context window, built for long-horizon coding, deep reasoning, knowledge work, and tool-using agents.

Claude Sonnet 5
Chiacchierata

$0.85 Ingresso 1M

claude-sonnet-5

Claude Sonnet 5 API access for agentic coding, long-running agents, browser and computer use, professional workflows, 1M context, and up to 128K output.

DeepSeek V4 Flash
Chiacchierata

$0.112 Ingresso 1M

deepseek-v4-flash

DeepSeek V4 Flash is a fast, economical DeepSeek V4 API model with 1M-context chat, 284B total parameters, and 13B active parameters.

DeepSeek V4 Pro
Chiacchierata

$0.348 Ingresso 1M

deepseek-v4-pro

DeepSeek V4 Pro is a stronger reasoning, coding, and agent workflow model with 1M-context chat, 1.6T total parameters, and 49B active parameters.

GPT-6 Astra
Chiacchierata

$8.00 Ingresso 1M

gpt-6-astra

GPT-6 Astra API for advanced reasoning, coding, and agent workflows. Use Chat Completions or Responses with pay-as-you-go pricing on PoYo.

GPT-6 Sol
Chiacchierata

$1.60 Ingresso 1M

gpt-6-sol

GPT-6 Sol API on PoYo. Use Chat Completions or Responses at $1.6 input and $8 output per million tokens, 20% below official standard rates.

Claude Fable 5.1
Chiacchierata

$8.00 Ingresso 1M

claude-fable-5-1

Anthropic's most capable generally available model for long-horizon coding, knowledge work, research, vision, 1M context, and up to 128K output.

Gemini 3.7 Flash
Chiacchierata

$0.06 Ingresso 1M

gemini-3.7-flash

Google's GA Flash model for agentic coding, multimodal reasoning, web development, long-context knowledge work, and tool-using applications.

Gemini 3.8 Flash
Chiacchierata

$0.06 Ingresso 1M

gemini-3.8-flash

Google's best reasoning and coding Flash model for long-horizon software engineering, autonomous agents, and enterprise workflows.

GPT-5.6
Chiacchierata

$0.056 Ingresso 1M

gpt-5-6-luna

GPT-5.6 API access for Sol, Terra, and Luna through the Responses API, from high-throughput automation to frontier coding and agent workflows.

GPT-6 Luna
Chiacchierata

$0.08 Ingresso 1M

gpt-6-luna

GPT-6 Luna API on PoYo. Use Chat Completions or Responses at $0.08 input and $0.4 output per million tokens, 20% below official standard rates.

Grok 4.6
Chiacchierata

$1.60 Ingresso 1M

grok-4.6

xAI's frontier model for long-running agents, coding, engineering, knowledge work, and ambitious interactive or visual projects.

Grok 4.7
Chiacchierata

$1.60 Ingresso 1M

grok-4.7

Grok 4.7 API on PoYo. Use Chat Completions at $1.6 input and $4.8 output per million tokens, 20% below official standard rates.

Claude Opus 5
Chiacchierata

$2.00 Ingresso 1M

claude-opus-5

Anthropic's flagship agentic model for advanced coding, long-horizon execution, computer use, deep research, and professional knowledge work.

Claude Opus 5.5
Chiacchierata

$3.20 Ingresso 1M

claude-opus-5-5

Claude Opus 5.5 API on PoYo. Use Chat Completions or Claude Messages at $3.2 input and $16 output per million tokens, 20% below official standard rates.

Claude Sonnet 5.5
Chiacchierata

$1.60 Ingresso 1M

claude-sonnet-5-5

Claude Sonnet 5.5 API on PoYo. Use Chat Completions or Claude Messages at $1.6 input and $8 output per million tokens, 20% below official standard rates.

DeepSeek V4.1 Flash
Chiacchierata

$0.30 Ingresso 1M

deepseek-flash

DeepSeek V4.1 Flash is a 552B MoE chat model with native vision, 1M context, 384K max output, and 8B/16B active parameters for cheaper agent workloads.

GPT-6.1 Sol
Chiacchierata

$1.60 Ingresso 1M

gpt-6.1-sol

GPT-6.1 Sol API on PoYo. Use Chat Completions or Responses at $1.6 input and $8 output per million tokens, 20% below official standard rates.

GPT-5.5
Chiacchierata

$3.00 Ingresso 1M

gpt-5.5

GPT-5.5 API access for chat, coding, reasoning, and production agent workflows.

GPT-5.4
Chiacchierata

$1.05 Ingresso 1M

gpt-5.4

GPT-5.4 API access for chat, coding, reasoning, and production agent workflows.

Gemini 3.5 Flash
Chiacchierata

$0.90 Ingresso 1M

gemini-3.5-flash

Gemini 3.5 Flash API access for chat, coding, reasoning, and production agent workflows.

GPT-5.2
Chiacchierata

$0.438 Ingresso 1M

gpt-5.2

GPT-5.2 API access for chat, coding, reasoning, and production agent workflows.

Claude Opus 4.8
Chiacchierata

$4.00 Ingresso 1M

claude-opus-4-8

Claude Opus 4.8 supports long-context chat, agentic coding, professional reasoning, high-output workflows, 1M context, and up to 128K output.

Claude Opus 4.7
Chiacchierata

$4.00 Ingresso 1M

claude-opus-4-7

Anthropic's most capable generally available model for frontier coding, deep reasoning, and high-resolution vision.

Claude 4.6 API
Chiacchierata

$1.44 Ingresso 1M

claude-sonnet-4-6

Claude Sonnet 4.6 and Claude Opus 4.6 API access for coding, agents, computer use, and long-context reasoning.

Claude 4.5 Series
Chiacchierata

$0.80 Ingresso 1M

claude-opus-4-5-20251101

Anthropic's Claude 4.5 series model — Opus, Sonnet & Haiku

Gemini 3 Series
Chiacchierata

$0.40 Ingresso 1M

gemini-3-flash-preview

Google's Gemini 3 series model — Flash Preview & Pro Preview

Chiacchierata API del modello: prezzi e adattamento del modello

Confronta fornitori, input supportati, formati di output e prezzi prima di scegliere un modello.

Corrispondenza esatta dell'attività

I modelli vengono visualizzati qui solo quando i metadati del loro catalogo includono Chat.

Confronto tra provider

Esamina le famiglie di modelli tra i provider senza uscire dalla directory delle attività.

Percorsi pronti per l'API

Ogni scheda modello si collega ai prezzi PoYo, agli esempi, ai controlli del parco giochi e ai dettagli API.

ModelProviderTipi di attivitàPrezzo
Kimi K3

kimi-k3

Moonshot AIChat$2.28Ingresso 1M
Claude Sonnet 5

claude-sonnet-5

AnthropicChat$0.85Ingresso 1M
DeepSeek V4 Flash

deepseek-v4-flash

DeepSeekChat$0.112Ingresso 1M
DeepSeek V4 Pro

deepseek-v4-pro

DeepSeekChat$0.348Ingresso 1M
GPT-6 Astra

gpt-6-astra

OpenAIChat$8.00Ingresso 1M
GPT-6 Sol

gpt-6-sol

OpenAIChat$1.60Ingresso 1M
Claude Fable 5.1

claude-fable-5-1

AnthropicChat$8.00Ingresso 1M
Gemini 3.7 Flash

gemini-3.7-flash

GoogleChat$0.06Ingresso 1M
Gemini 3.8 Flash

gemini-3.8-flash

GoogleChat$0.06Ingresso 1M
GPT-5.6

gpt-5-6-luna

OpenAIChat$0.056Ingresso 1M
GPT-6 Luna

gpt-6-luna

OpenAIChat$0.08Ingresso 1M
Grok 4.6

grok-4.6

xAIChat$1.60Ingresso 1M
Grok 4.7

grok-4.7

xAIChat$1.60Ingresso 1M
Claude Opus 5

claude-opus-5

AnthropicChat$2.00Ingresso 1M
Claude Opus 5.5

claude-opus-5-5

AnthropicChat$3.20Ingresso 1M
Claude Sonnet 5.5

claude-sonnet-5-5

AnthropicChat$1.60Ingresso 1M
DeepSeek V4.1 Flash

deepseek-flash

DeepSeekChat$0.30Ingresso 1M
GPT-6.1 Sol

gpt-6.1-sol

OpenAIChat$1.60Ingresso 1M
GPT-5.5

gpt-5.5

OpenAIChat$3.00Ingresso 1M
GPT-5.4

gpt-5.4

OpenAIChat$1.05Ingresso 1M
Gemini 3.5 Flash

gemini-3.5-flash

GoogleChat$0.90Ingresso 1M
GPT-5.2

gpt-5.2

OpenAIChat$0.438Ingresso 1M
Claude Opus 4.8

claude-opus-4-8

AnthropicChat$4.00Ingresso 1M
Claude Opus 4.7

claude-opus-4-7

AnthropicChat$4.00Ingresso 1M
Claude 4.6 API

claude-sonnet-4-6

AnthropicChat$1.44Ingresso 1M
Claude 4.5 Series

claude-opus-4-5-20251101

AnthropicChat$0.80Ingresso 1M
Gemini 3 Series

gemini-3-flash-preview

GoogleChat$0.40Ingresso 1M

Domande frequenti

Che cos’è un’API di chat IA?

+

Un'API di chat IA accetta messaggi di conversazione e restituisce una risposta basata sul modello linguistico. Abilita le funzionalità di scrittura, ragionamento, codifica e assistente nella tua applicazione. I tipi di input e i controlli disponibili dipendono dal modello selezionato e dal protocollo API.

Quale modello API LLM dovrei scegliere?

+

Valuta i modelli con i suggerimenti, la durata delle conversazioni e gli output utilizzati dal tuo prodotto. Confronta la qualità delle risposte, il rispetto delle istruzioni, la velocità e il costo dei token. Includere esempi difficili e infruttuosi nella valutazione piuttosto che selezionare da un'unica risposta impressionante.

Ogni modello di chat PoYo utilizza lo stesso formato di richiesta?

+

No. Utilizzare la documentazione del modello per scegliere i completamenti chat compatibili con OpenAI, il formato nativo Claude Messages o Gemini. Le strutture dei messaggi, i dettagli di autenticazione e i controlli supportati possono differire. Adattare la richiesta al protocollo documentato invece di modificare solo il nome del modello.

Come posso preservare il contesto della conversazione a più turni?

+

Memorizza i messaggi rilevanti nella tua applicazione e invia la cronologia richiesta dal protocollo selezionato. Mantieniti entro il limite del contesto del modello e rimuovi o riassumi il materiale che non aiuta più l'attività. Non si deve presumere che una nuova richiesta API ricordi automaticamente le richieste precedenti.

L'API della chat IA supporta le risposte in streaming?

+

Controlla il supporto dello streaming e le opzioni di richiesta per il modello e l'endpoint scelti. Se disponibile, gestisci eventi parziali, completamenti ed errori nel tuo client. Mantieni un percorso non-streaming quando il tuo flusso di lavoro necessita di una risposta completa prima della convalida o dell'elaborazione downstream.

Posso inviare immagini o altri media a un modello di chat?

+

Utilizzare solo tipi di media e strutture di messaggi documentati per quel modello. Alcuni endpoint LLM sono di solo testo mentre altri supportano input multimodali. Controlla le limitazioni su dimensioni, formato e contenuto prima di implementare i caricamenti e verifica quanto bene il modello gestisce i tuoi contenuti multimediali reali.

Posso richiedere JSON o un'altra risposta strutturata?

+

Alcuni modelli espongono controlli di output strutturato; altri possono essere guidati solo da suggerimenti. Conferma il meccanismo supportato, fornisci uno schema chiaro ove disponibile e convalida i dati restituiti nella tua applicazione. Non considerare una richiesta JSON come una prova che ogni risposta soddisferà il tuo schema.

Un modello di chat può navigare sul Web o richiamare strumenti automaticamente?

+

Solo quando l'endpoint supporta la funzionalità e l'applicazione fornisce o abilita gli strumenti richiesti. Un modello può descrivere una chiamata strumento senza eseguirla. Controlla il protocollo dello strumento documentato e mantieni esplicite l'esecuzione, le autorizzazioni e la gestione dei risultati nella tua integrazione.

Come posso ridurre le risposte imprecise della chat IA?

+

Fornire materiale di partenza pertinente, rendere il compito preciso e chiedere al modello di distinguere le informazioni mancanti dai fatti noti. Convalida gli output importanti rispetto a dati attendibili e testa i casi di errore ricorrenti. La scelta del modello e i suggerimenti possono migliorare la qualità, ma le risposte generate necessitano comunque di un'adeguata revisione.

Come viene calcolato il prezzo dell'API di chat IA?

+

I prezzi della chat in genere separano i token di input e di output e alcuni modelli prevedono ulteriori distinzioni di livello. Leggi la risposta sui prezzi e sull'utilizzo del modello selezionato. Includi la cronologia delle conversazioni nella tua stima, poiché l'invio ripetuto di un contesto lungo può aumentare il costo di ogni turno.

Cosa devo fare in caso di errori di contesto, limiti di velocità o timeout?

+

Controllare l'errore restituito e i limiti del modello selezionato. Riduci il contesto sovradimensionato, controlla le richieste simultanee e utilizza tentativi limitati ove appropriato. Per una risposta in streaming parziale, registra ciò che è stato ricevuto e decidi come ripristinare la tua applicazione invece di duplicare silenziosamente un turno di conversazione.

Dove posso trovare esempi di integrazione dell'API di chat IA?

+

Aprire la pagina del modello e la relativa documentazione API per l'endpoint, l'autenticazione, il corpo del messaggio e gli esempi corretti. La risorsa llms.txt specifica del modello identifica anche il protocollo. Conserva le chiavi sul server e convalida gli output prima di utilizzarli in azioni aziendali automatizzate.