
Claude Sonnet 5 ha due prezzi ufficiali che gli sviluppatori devono distinguere. Fino al 31 agosto 2026, il prezzo di lancio di Anthropic è $2 per 1 milione di token di input e $10 per 1 milione di token di output. A partire da 1 settembre 2026, il prezzo standard diventa $3 input e $15 output per 1 milione di token.
Poyo.ai attualmente elenca Claude Sonnet 5 a $0.85 per 1 milione di token di input e $4.275 per 1 milione di token di output.
C'è un'altra modifica dei costi che è facile non notare: Anthropic afferma che il nuovo tokenizzatore di Sonnet 5 produce circa 30% più token per lo stesso testo rispetto a Sonnet 4.6. La forma della richiesta API è ampiamente compatibile, ma un carico di lavoro equivalente può consumare più token anche quando la tariffa per token sembra familiare.
Prezzi controllati il 19 luglio 2026. La scadenza introduttiva rende questo articolo urgente. Verificare le tariffe attuali prima di impegnare un budget di produzione.
Prezzi di Claude Sonnet 5 in breve
| Percorso o periodo tariffario | Ingresso / 1M token | Uscita / 1M token | Data di entrata in vigore |
|---|---|---|---|
| Anthropic introduttivo | $2.00 | $10.00 | Fino al 31 agosto 2026 |
| Anthropic standard | $3.00 | $15.00 | Dal 1 settembre 2026 |
| Poyo.ai | $0.85 | $4.275 | Prezzo attuale a consumo |
Anthropic elenca anche tariffe diverse per scritture nella cache dei prompt di cinque minuti e un'ora, letture della cache, elaborazione batch, strumenti lato server e alcuni percorsi della piattaforma cloud. Confronta la struttura completa dei prezzi per il tuo carico di lavoro, non solo l'input e l'output non memorizzati nella cache.
Per i prezzi attuali di Poyo, le specifiche del modello e il supporto degli endpoint, aprire la pagina del modello Claude Sonnet 5 API.
Perché i prezzi Claude Sonnet 5 appaiono diversi tra i siti web
I risultati della ricerca attuale mescolano almeno quattro cose diverse:
- Prezzo introduttivo API: Ingresso $2 e uscita $10 fino al 31 agosto.
- Prezzo standard API: Ingresso $3 e uscita $15 a partire dal 1 settembre.
- Abbonamenti Claude: i piani consumer o team non corrispondono all'utilizzo API a consumo.
- Percorsi cloud e di terze parti: tariffe, sconti e servizi della piattaforma inclusi potrebbero variare.
L'articolo di lancio di Anthropic tratta sia le tariffe introduttive che quelle standard. Alcuni grafici comparativi utilizzano la tariffa standard futura, mentre il testo nelle vicinanze evidenzia lo sconto di lancio temporaneo. Un piano dei costi affidabile dovrebbe memorizzare l'origine del prezzo e la data di validità insieme alla stima.
Esempi di costi reali Claude Sonnet 5
Gli esempi seguenti utilizzano tariffe per token non memorizzati nella cache ed escludono tasse, addebiti per strumenti ed elaborazioni speciali.
Esempio 1: un milione di token di input e 200,000 token di output
| Percorso | Costo di input | Costo di output | Totale |
|---|---|---|---|
| Anthropic introduttivo | $2.00 | $2.00 | $4.00 |
| Anthropic standard | $3.00 | $3.00 | $6.00 |
| Poyo.ai | $0.85 | $0.855 | $1.705 |
Questo esempio ha cinque volte più input che output, ma l'output contribuisce per metà al totale Anthropic introduttivo e standard.
Esempio 2: un agente di codifica di lunga durata
Un agente di codifica non effettua una richiesta. Può ispezionare file, chiamare un terminale, leggere l'output del test, riprovare una patch e verificare il risultato. Se un'attività ha una media:
- 250,000 token di input;
- 40,000 token di output;
- quattro turni di utilizzo degli strumenti;
- Tentativi 1.4 per correzione riuscita;
l'unità utile non è il prezzo per token. Si tratta del costo totale per correzione verificata. Registra l'utilizzo del token per tentativo e distingue un successo netto da una risposta che ha richiesto una riparazione manuale.
Esempio 3: un flusso di lavoro del documento nel contesto 1M
Sonnet 5 supporta una finestra di contesto da 1 milione di token al prezzo standard per token. Ciò non significa che ogni richiesta dovrebbe includere un milione di token. Il recupero, la segmentazione dei documenti, il contesto stabile memorizzato nella cache e un'analisi per fasi possono essere più economici e più facili da convalidare.
Il nuovo tokenizzatore significa anche che la stessa raccolta di documenti potrebbe occupare più spazio in quella finestra rispetto a Sonnet 4.6.
Il nuovo tokenizzatore può modificare il costo della richiesta equivalente
Anthropic documenta che lo stesso testo di input produce circa 30% più token su Sonnet 5 che su Sonnet 4.6, con la variazione esatta a seconda del contenuto.
Ciò influisce:
- Conteggi dei token
usage; - quanto testo rientra nella finestra di contesto 1M;
- limiti di uscita ottimizzati per Sonnet 4.6;
- dimensioni della cache dei prompt;
- previsioni dei costi per richiesta e mensili.
Supponiamo che un carico di lavoro Sonnet 4.6 utilizzasse in precedenza 100 milioni di token di input mensili. Un aumento approssimativo di 30% renderebbe lo stesso testo 130 milioni di token prima di tenere conto di cambiamenti di comportamento o revisioni tempestive.
Non applicare 30% come supplemento di fatturazione universale. Ricalcola i token dei prompt dell'agente con il tokenizzatore Sonnet 5. Il numero è un avviso di migrazione approssimativo, non un moltiplicatore garantito per ogni lingua e carico di lavoro.
Benchmark Claude Sonnet 5 e miglioramenti in termini di capacità
Anthropic posiziona Sonnet 5 come il modello di classe Sonnet più agente e un miglioramento sostanziale rispetto a Sonnet 4.6 nel ragionamento, nell'uso degli strumenti, nella codifica e nel lavoro di conoscenza. Il confronto di lancio si concentra sulle curve costo-prestazioni tra la ricerca degli agenti e l'uso del computer anziché presentare un punteggio universale.
Le aree di capacità pratica sono:
Codifica agentica
Sonnet 5 è progettato per pianificare, utilizzare terminali e browser, eseguire il debug, eseguire test e continuare attraverso il lavoro di ingegneria in più fasi. Il caso di migrazione è più forte laddove Sonnet 4.6 si ferma presto, corregge i sintomi anziché le cause alla radice o necessita di ripetute manovre.
Utilizzo degli strumenti e agenti di lunga durata
Anthropic segnala un follow-through più efficace e una gamma più ampia di opzioni di rapporto costo-prestazioni a tutti i livelli di impegno. Per la produzione, misura l'accuratezza della selezione degli strumenti, il recupero dopo i guasti e se l'agente convalida il proprio risultato.
Utilizzo del computer
Il materiale di lancio mette a confronto Sonnet 5 con Sonnet 4.6 e Opus 4.8 su OSWorld-Verified. I sistemi di utilizzo del computer richiedono ancora autorizzazioni mirate, limiti di conferma e monitoraggio. Un miglioramento del benchmark non elimina il rischio operativo.
Lavoro di conoscenza
La ricerca professionale, l'analisi dei documenti e i flussi di lavoro dei dati traggono vantaggio quando un modello necessita di meno passaggi o di meno correzioni umane. Utilizza una rubrica di dominio invece di fare affidamento solo su un benchmark generale.
Comportamento sicuro
Anthropic riporta tassi inferiori di allucinazioni, servilismo e diversi comportamenti agenti indesiderati rispetto a Sonnet 4.6 nelle sue valutazioni interne. Alcune richieste di sicurezza informatica potrebbero anche essere soggette a garanzie in tempo reale più rigorose.
Claude Sonnet 5 vs Sonnet 4.6
| Area | Claude Sonnet 5 | Claude Sonnet 4.6 |
|---|---|---|
| Posizionamento | Modello Sonnet più agentico | Livello di produzione del Sonnet precedente |
| Contesto | 1M token | 1M token |
| Output massimo | 128K token | 128K token |
| Comportamento di pensiero | Pensiero adattivo attivo per impostazione predefinita | Le richieste potrebbero essere eseguite senza pensare se omesse |
| Bilancio del pensiero manuale | RIMOSSO; restituisce 400 | Deprecato |
| Parametri di campionamento non predefiniti | Ritorno 400 | Diverso comportamento migratorio |
| Tokenizzatore | Più recente; circa 30% più token per lo stesso testo | Tokenizzatore precedente |
| Formato della richiesta API | In gran parte drop-in, con cambiamenti di comportamento documentati | Base di riferimento esistente |
| Guadagni più forti | Codifica e lavoro agentico | Riferimento precedente inferiore |
Chiamare Sonnet 5 un aggiornamento drop-in non significa "cambiare l'ID del modello e saltare il test". Anthropic consiglia specificamente di ricontare i prompt, rivedere i budget di output, rimuovere i parametri di campionamento non supportati e migrare dal pensiero esteso manuale al pensiero adattivo.
Claude Sonnet 5 rispetto a GPT-5.6 Terra
Il confronto GPT-5.6 più utile è solitamente Terra, non l'intera famiglia. Entrambi mirano al lavoro di produzione che richiede un ragionamento forte senza pagare sempre il livello di punta.
| Area decisionale | Claude Sonnet 5 | GPT-5.6 Terra |
|---|---|---|
| Punti di forza | Codifica agentica, uso del computer, flussi di lavoro professionali | Codifica equilibrata, ricerca, agenti che utilizzano strumenti |
| Contesto | 1M token | Controlla i limiti attuali del modello e la documentazione dell'endpoint |
| Uscita | Fino a 128K | Controlla i limiti attuali dell'endpoint |
| Stile nativo API | Claude Messages | OpenAI Responses |
| Poyo prezzo d'ingresso | $0.85 / 1M | $0.70 / 1M |
| Poyo prezzo di uscita | $4.275 / 1M | $4.20 / 1M |
| Preoccupazione migratoria | Nuovo tokenizzatore e modifiche al comportamento | Responses API e selezione del livello |
Le tariffe dei token Poyo sono vicine. Ciò rende il tasso di successo, la latenza, l’affidabilità dello strumento e l’ergonomia dello sviluppatore più importanti della piccola differenza di prezzo di listino.
Vale la pena passare a Claude Sonnet 5?
Forti candidati alla migrazione
- agenti di codifica che si fermano regolarmente prima della verifica;
- flussi di lavoro di utilizzo del browser e del computer;
- orchestrazione degli strumenti a lungo termine;
- compiti professionali in cui il Sonnet 4.6 necessita di correzioni ripetute;
- team che desiderano capacità quasi Opus senza una tariffa di classe Opus.
Carichi di lavoro che richiedono un'attenta misurazione
- applicazioni a lungo contesto con utilizzo di token pesanti;
- prompt già vicini al contesto o ai limiti
max_tokens; - applicazioni che impostano esplicitamente la temperatura,
top_potop_k; - sistemi che utilizzano budget manuali estesi;
- classificazione ed estrazione semplici che possono adattarsi a un modello più leggero.
Elenco di controllo della migrazione Claude Sonnet 5
- Ricalcola i token dei prompt reali. Non riutilizzare le misurazioni dei token Sonnet 4.6.
- Rivedi i limiti di output. Il pensiero e il testo condividono il budget di output.
- Utilizza il pensiero adattivo. Il pensiero manuale
budget_tokensè stato rimosso. - Rimuovi le impostazioni di campionamento non supportate. Errori restituiti da temperatura non predefinita,
top_petop_k. - Schemi e loop degli strumenti di test. Il comportamento dell'agente è più importante di una demo a turno singolo.
- Misura il costo per successo verificato. Include tentativi e correzione umana.
- Esegui un rollout graduale. Segmenta i risultati per tipo di attività prima di inviare tutto il traffico.
Come chiamare Claude Sonnet 5 su Poyo.ai
Utilizza l'ID modello claude-sonnet-5. Poyo.ai supporta un percorso chat compatibile con OpenAI e un percorso Anthropic Messages nativo.
curl https://api.poyo.ai/v1/messages \
-H "Authorization: Bearer $POYO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-sonnet-5",
"max_tokens": 4096,
"messages": [
{
"role": "user",
"content": "Review this failing test and propose a verified fix plan."
}
]
}'
Crea una chiave dal dashboard Poyo, quindi esamina la pagina del modello Claude Sonnet 5 e la documentazione API.
Domande frequenti
Quanto costa Claude Sonnet 5?
La tariffa di lancio di Anthropic fino al 31 agosto, 2026 è l'input $2 e l'output $10 per 1 milione di token. A partire dal 1 settembre, la tariffa standard è ingresso $3 e uscita $15. Poyo.ai attualmente elenca l'ingresso $0.85 e l'uscita $4.275.
Claude Sonnet 5 utilizza più token di Sonnet 4.6?
Anthropic afferma che il nuovo tokenizzatore produce circa 30% più token per lo stesso testo, con l'aumento esatto a seconda del carico di lavoro.
Claude Sonnet 5 è un aggiornamento API immediato?
Le forme di richiesta e risposta sono ampiamente compatibili, ma il pensiero adattivo, i parametri di campionamento, i budget del pensiero manuale e il conteggio dei token richiedono test di migrazione.
Claude Sonnet 5 supporta una finestra di contesto 1M?
Sì. Anthropic elenca una finestra di contesto da 1 milione di token e fino a 128K token di output.
Claude Sonnet 5 è più economico di GPT-5.6?
Dipende dal livello GPT-5.6 e dal percorso di accesso. Su Poyo.ai, Sonnet 5 e GPT-5.6 Terra hanno prezzi di output simili, quindi il successo dell'attività e il consumo di token dovrebbero guidare la decisione.