Cos'è Claude Haiku 5.5
Claude Haiku 5.5 è il modello di intelligenza artificiale più piccolo ed economico della famiglia Claude di Anthropic, presentato il 7 ottobre 2026. Costa 0,10 dollari per milione di token in ingresso e 0,50 in uscita per le richieste fino a 100.000 token, lo stesso prezzo di GPT-6 Luna, il modello economico di OpenAI. Non è il modello più potente di Anthropic: è quello pensato per i compiti piccoli e ripetuti, da fare tante volte spendendo poco. Fonte: Simon Willison, Claude Haiku 5.5, 2026.
La notizia conta perché Haiku, nelle generazioni precedenti, era spesso scartato: costava poco ma sbagliava troppo per lavori seri. Con la versione 5.5 Anthropic sostiene di aver colmato il vuoto, e porta dei test per dimostrarlo. Per una PMI italiana la domanda concreta è una sola: per i lavori di tutti i giorni serve davvero il modello più caro?
Quanto costa Haiku 5.5 rispetto a GPT-6 Luna e Sonnet 5.5
Il prezzo è il punto di partenza. Sotto i 100.000 token per richiesta, Haiku 5.5 e Luna costano uguale. Oltre quella soglia i prezzi di Haiku salgono di cinque volte, a 0,50 dollari in ingresso e 2,50 in uscita. Fonte: VentureBeat, Anthropic launches Claude Haiku 5.5, 2026.
| Modello | Ingresso (per milione di token) | Uscita (per milione di token) |
|---|---|---|
| Haiku 5.5 (fino a 100.000 token) | 0,10 $ | 0,50 $ |
| Haiku 5.5 (oltre 100.000 token) | 0,50 $ | 2,50 $ |
| Haiku 4.5 (versione precedente) | 1,00 $ | 5,00 $ |
| Sonnet 5.5 | 2,00 $ | 10,00 $ |
I conti: sotto la soglia, Haiku 5.5 costa un ventesimo di Sonnet 5.5 e un decimo di Haiku 4.5. Un milione di token in uscita, che equivale a molte centinaia di pagine di testo generato, costa 50 centesimi. Attenzione però a un dettaglio: Haiku 5.5 usa un nuovo sistema di conteggio dei token che, secondo il test di Simon Willison, conta circa il 25% di token in più sullo stesso testo rispetto a Haiku 4.5. Il risparmio reale rispetto alla versione precedente è quindi un po' inferiore a quello che dice il listino.
Cosa dicono i test: Haiku 5.5 contro Luna
Nei test pubblicati da Anthropic, Haiku 5.5 batte Luna in tutte le prove in cui i due modelli sono confrontati. Sono dati dichiarati dall'azienda, non verificati da terzi. Fonte: VentureBeat, 2026.
| Test | Haiku 5.5 | GPT-6 Luna |
|---|---|---|
| OSWorld 2.1 (uso del computer) | 72,4% | 48,9% |
| Terminal-Bench 4.0 (lavoro da terminale) | 39,2% | 16,4% |
| FrontierCode 1.1 (programmazione) | 46,4% | 42,4% |
Il dato su Terminal-Bench va letto con cautela: il 39,2% si ottiene con lo sforzo di ragionamento al massimo, mentre l'impostazione predefinita, che è su medio, si ferma intorno al 20%. Sonnet 5.5 resta davanti a Haiku 5.5 in tutti i test della tabella di Anthropic. Haiku non è un sostituto del modello grande: è un'alternativa più economica per i compiti più semplici.
Il limite nascosto: Haiku 5.5 consuma più token
Un prezzo uguale per token non significa un costo uguale per compito. Il test indipendente di Artificial Analysis dà a Haiku 5.5 un punteggio di 43 sul suo indice di intelligenza, contro 38 di Luna, ma con sforzo massimo Haiku produce circa 162.000 token in uscita per compito, contro circa 50.000 di Luna. Con sforzo alto Haiku scende a 38 punti con circa 55.000 token. Fonte: Implicator, Claude Haiku 5.5 matches GPT-6 Luna pricing, 2026.
Per Artificial Analysis, Claude Haiku 5.5 ottiene 43 punti contro i 38 di GPT-6 Luna, ma al massimo sforzo usa circa tre volte i token di Luna per ogni compito. Fonte: Implicator, 2026.
In pratica, sui soli token in uscita, a parità di prezzo il costo per compito di Haiku al massimo sforzo è circa tre volte quello di Luna: è un calcolo nostro sui dati citati, che non include i token in ingresso. Artificial Analysis ha dichiarato che le sue stime di costo non riflettono ancora i prezzi a scaglioni e che pubblicherà il costo per compito più avanti. Il consiglio è non fidarsi del solo listino e misurare il costo sul proprio lavoro.
Haiku 5.5 come aiutante dei modelli grandi
Anthropic propone Haiku 5.5 soprattutto per i compiti delegati da Opus 5.5 e Sonnet 5.5, cioè come sub-agente: il modello grande ragiona e coordina, Haiku esegue i passaggi piccoli. L'esempio citato è quello di Rogo, in cui un modello grande costruisce una presentazione mentre Haiku recupera un singolo dato di fatturato per una slide. Il responsabile di Rogo ha detto che è «abbastanza accurato da fidarsi e abbastanza veloce ed economico da poterlo usare molto». Fonte: Implicator, 2026.
Circola anche un confronto tra Opus 5.5 da solo e Opus 5.5 con dieci sub-agenti Haiku, che darebbe un risultato simile a meno costo e meno tempo. Non l'abbiamo trovato nelle fonti che abbiamo potuto verificare, quindi non lo riportiamo come dato: l'idea di fondo è plausibile, ma i numeri vanno controllati nella documentazione di Anthropic.
Cosa cambia per una PMI italiana
Per un'azienda piccola il messaggio non è «cambia modello domani». È che per molti lavori ripetitivi un modello economico basta: smistare le email in arrivo, estrarre dati da fatture e moduli, rispondere alle domande frequenti dei clienti, classificare i contatti. Sono compiti con un numero limitato di esiti, dove la differenza tra un modello da 10 dollari e uno da 0,50 dollari per milione di token di uscita si vede in bolletta, non nella qualità. Abbiamo spiegato come ragionare sui costi in quanto costa l'AI in azienda e come ridurre i costi.
Il secondo effetto riguarda la concorrenza. Con Haiku 5.5 e Luna allo stesso prezzo, i fornitori si contendono il segmento economico, e questo di solito fa scendere i listini. Chi costruisce processi su un solo fornitore rischia di restare indietro: conviene progettare i sistemi in modo da poter cambiare modello senza rifare tutto. Il tema è lo stesso delle automazioni AI per le PMI: il modello è una parte sostituibile, il processo no.
Quanto costa provare Haiku 5.5
Provarlo costa pochissimo. Se un processo gestisce 1.000 richieste al mese e ognuna produce circa 1.000 token di risposta, parliamo di un milione di token in uscita, quindi circa 50 centesimi al mese di sola risposta, più gli ingressi. Con il consumo maggiore di token osservato da Artificial Analysis il conto può salire, ma resta una frazione di quello che costa il lavoro manuale. Il costo vero non è il modello: è il tempo per collegarlo ai tuoi strumenti e per controllare i risultati.
Come iniziare: i 3 passi per una PMI italiana
1. Scegli un solo processo. Prendi un'attività ripetitiva e a basso rischio, come smistare le email o estrarre dati da documenti. Non partire dal servizio clienti più delicato.
2. Confronta due modelli sullo stesso lavoro. Prendi 50 casi reali, falli fare al modello che usi oggi e a Haiku 5.5, e confronta qualità, tempo e costo totale, compresi i token consumati.
3. Tieni una persona nel controllo. Fino a quando non hai visto i risultati su un mese di lavoro vero, fai rivedere a una persona le risposte dubbie. Abbiamo spiegato come impostare questo tipo di sistemi nella guida agli agenti AI per le PMI.
Come Ogaia costruisce sistemi AI per le PMI
In Ogaia | Lead Generation & AI Automation progettiamo sistemi AI su misura per PMI e professionisti italiani: agenti che rispondono ai nuovi contatti, qualificano le richieste e fissano gli appuntamenti. Il modello è solo uno dei pezzi, e lo scegliamo caso per caso in base a qualità, velocità e costo, senza legare il cliente a un solo fornitore.
Se vuoi capire quali processi della tua azienda possono girare su un modello economico come Haiku 5.5 senza perdere qualità, prenota una call gratuita di 45 minuti: uscirai con una mappa chiara dei tuoi colli di bottiglia, indipendentemente da quello che decidi di fare dopo.
