Scienza e tecnologia

Claude Haiku 5.5 è ufficiale: fino al 90% più economico e il più veloce modello di Anthropic. Ma l’AI non doveva rallentare?

Anthropic ha appena lanciato Claude Haiku 5.5, il modello più piccolo e veloce della sua gamma, e i numeri fanno un certo effetto: rispetto al precedente Haiku 4.5, costa in media il 75% in meno per la maggior parte delle richieste. Per le richieste fino a 100.000 token, che rappresentano circa il 90% di quelle che arrivano ad Haiku, il risparmio sale addirittura al 90%. E sia chiaro che tutto ciò non arriva a scapito delle prestazioni.

Preferisci ascoltare il riassunto audio? Abbiamo scelto una voce realizzata con strumenti avanzati IA per rendere i nostri testi subito accessibili a tutti

Haiku 5.5 infatti non è solo più economico: è anche il modello più veloce mai rilasciato da Anthropic (a parità di modalità standard), ed è il primo della famiglia Haiku a supportare la regolazione del livello di ragionamento, proprio come i modelli più grandi. In pratica, possiamo scegliere se ottimizzarlo per il costo o per la qualità della risposta.

A cosa serve un modello del genere? Haiku 5.5 è pensato per compiti ad alto volume e bassa complessità: riassunti, classificazioni, query su database, risposte rapide al cliente.

Non è il modello giusto per ragionamenti complessi o per il coding avanzato, dove Sonnet 5.5 e Opus 5.5 restano nettamente superiori. Ma per tutto il lavoro “di supporto” che un agente AI deve fare in background, Haiku 5.5 è esattamente quello che serve: veloce, preciso e abbastanza economico da poterlo chiamare migliaia di volte senza che il costo diventi un problema.

Sui benchmark ufficiali, Haiku 5.5 ottiene il 72,4% su OSWorld 2.1 (uso del computer), il 45,9% su Humanity’s Last Exam senza strumenti e il 39,2% su Terminal-Bench 4.0 per il coding agentivo. Per confronto, Haiku 4.5 su Terminal-Bench si fermava allo 0%: un salto enorme, anche se Sonnet 5.5 resta a 70,6% e rimane la scelta giusta per i compiti di coding complessi.

Sul fronte sicurezza e allineamento, Anthropic segnala miglioramenti significativi rispetto a Haiku 4.5: meno comportamenti non allineati e minore disponibilità a cooperare con usi impropri. Le protezioni in ambito cybersecurity sono più restrittive del predecessore ma leggermente meno stringenti rispetto agli altri modelli recenti: bloccano il penetration testing offensivo ma permettono un’ampia gamma di attività difensive.

Haiku 5.5 è disponibile da subito su tutte le piattaforme, incluse AWS, Google Cloud e Microsoft Azure. Sull’API di Anthropic, gli sviluppatori possono accedervi con il nome claude-haiku-5-5.

Parallelamente al lancio di Haiku 5.5, Anthropic ha anche dimezzato il prezzo delle cache read su Claude Sonnet 5.5: da 0,20 a 0,10 dollari per milione di token. Dato che le cache read rappresentano una quota rilevante del consumo totale di token nei flussi agentici, questo si traduce in un risparmio di circa il 20% sul costo complessivo di Sonnet 5.5 per la maggior parte dei casi d’uso. Infine, Anthropic introduce un credito API mensile per gli abbonati ai piani Max e Team: 100 dollari al mese per Max 5x, 200 per Max 20x e fino a 500 dollari in pool condiviso per i Team, utilizzabili su qualsiasi modello della piattaforma.

Haiku 5.5 è l’ultimo tassello che mancava alla “famiglia 5.5” di Anthropic e sulla carta mantiene tutte le aspettative: i modelli di Anthropic sono ora più scalabili, a seconda del compito necessario.

Claude Opus 5.5 per i compiti più impegnativi ora ha un ecosistema di modelli più coerente e meno costoso da orchestrare. Almeno fino al prossimo rilascio, che con i ritmi attuali non tarderà ad arrivare.


Source link

articoli Correlati

Back to top button
Translate »