Michael Nuñez
Mercoledì Anthropic ha rilasciato Claude Haiku 4.5 , un modello di intelligenza artificiale più piccolo e notevolmente più economico che eguaglia le capacità di codifica di sistemi considerati all’avanguardia solo pochi mesi fa, segnando l’ultima salva di una competizione sempre più intensa per dominare l’intelligenza artificiale aziendale.Il modello costa 1 dollaro per milione di token in input e 5 dollari per milione di token in output, circa un terzo del prezzo del modello Sonnet 4 di medie dimensioni di Anthropic rilasciato a maggio, pur operando a una velocità più che doppia. In alcune attività, in particolare nell’utilizzo autonomo dei computer, Haiku 4.5 supera addirittura il suo predecessore più costoso.”Haiku 4.5 rappresenta un netto balzo in avanti in termini di prestazioni ed è ora in gran parte intelligente quanto Sonnet 4, pur essendo significativamente più veloce e costando un terzo”, ha dichiarato un portavoce di Anthropic a VentureBeat, sottolineando la rapidità con cui le capacità dell’intelligenza artificiale stanno diventando una merce man mano che la tecnologia matura
Come l’accesso gratuito all’intelligenza artificiale avanzata potrebbe rimodellare il mercato aziendale
Con una mossa insolita che potrebbe rimodellare le dinamiche competitive nel mercato dell’intelligenza artificiale, Anthropic rende Haiku 4.5 disponibile per tutti gli utenti gratuiti della sua piattaforma Claude.ai . La decisione democratizza di fatto l’accesso a quella che l’azienda definisce “intelligenza di livello quasi-frontiera”, funzionalità che fino a pochi mesi fa sarebbero state disponibili solo su costosi modelli premium.
“Il lancio di Claude Haiku 4.5 significa che l’intelligence di livello quasi-frontiera è disponibile gratuitamente a tutti gli utenti tramite Claude.ai”, ha dichiarato il portavoce di Anthropic a VentureBeat. “Offre inoltre vantaggi significativi ai nostri clienti aziendali: Sonnet 4.5 può gestire la pianificazione di frontiera, mentre Haiku 4.5 supporta i sub-agenti, consentendo sistemi multi-agente che affrontano refactoring complessi, migrazioni e build di funzionalità di grandi dimensioni con velocità e qualità.”Questa architettura multi-agente segna un cambiamento significativo nel modo in cui vengono implementati i sistemi di intelligenza artificiale. Invece di affidarsi a un singolo modello monolitico, le aziende possono ora orchestrare team di agenti di intelligenza artificiale specializzati: un modello Sonnet 4.5 più sofisticato che suddivide i problemi complessi e delega le sottoattività a più agenti Haiku 4.5 che lavorano in parallelo. Per i team di sviluppo software, questo potrebbe significare che Sonnet 4.5 pianifica un importante refactoring del codice mentre gli agenti Haiku 4.5 eseguono simultaneamente modifiche su decine di file.Questo approccio rispecchia il modo in cui le organizzazioni umane distribuiscono il lavoro e potrebbe rivelarsi particolarmente prezioso per le aziende che cercano di bilanciare prestazioni ed efficienza dei costi, una considerazione fondamentale man mano che l’implementazione dell’intelligenza artificiale si espande
Il percorso di Anthropic verso un fatturato annuo di 7 miliardi di dollari
Il lancio del modello coincide con le rivelazioni secondo cui l’attività di Anthropic sta vivendo una crescita esponenziale. Il fatturato annuo dell’azienda si avvicina ai 7 miliardi di dollari questo mese , ha dichiarato Anthropic a Reuters, in aumento rispetto agli oltre 5 miliardi di dollari registrati ad agosto. Le proiezioni interne ottenute da Reuters suggeriscono che l’azienda punta a raggiungere un fatturato annuo compreso tra 20 e 26 miliardi di dollari per il 2026, con una crescita compresa tra oltre il 200% e quasi il 300%.L’azienda serve attualmente oltre 300.000 clienti aziendali, con prodotti enterprise che rappresentano circa l’80% del fatturato. Tra le offerte di maggior successo di Anthropic c’è Claude Code , uno strumento di generazione di codice che ha raggiunto quasi 1 miliardo di dollari di fatturato annuo dal suo lancio all’inizio di quest’anno.Questi numeri arrivano mentre l’intelligenza artificiale entra in quello che molti nel settore definiscono un punto di svolta critico. Dopo due anni di quella che Mike Krieger, Chief Product Officer di Anthropic, ha recentemente descritto come ” AI FOMO ” – ovvero quando le aziende hanno adottato strumenti di intelligenza artificiale senza chiare metriche di successo – le aziende ora richiedono ritorni sugli investimenti misurabili.”I prodotti migliori possono essere basati su qualche tipo di parametro o valutazione del successo”, ha affermato Krieger nel podcast “Superhuman AI” . “L’ho notato spesso parlando con aziende che stanno implementando l’intelligenza artificiale”.
Il lancio di Anthropic avviene in un contesto di crescente attenzione all’approccio dell’azienda alla sicurezza e alla regolamentazione dell’intelligenza artificiale. Martedì, David Sacks, “zar” dell’intelligenza artificiale della Casa Bianca e investitore di capitale di rischio, ha accusato Anthropic di ” mettere in atto una sofisticata strategia di cattura normativa basata sulla paura” che sta “danneggiando l’ecosistema delle startup “.
L’attacco aveva come bersaglio le dichiarazioni di Jack Clark, co-fondatore e responsabile politico di Anthropic, che aveva dichiarato di essere ” profondamente spaventato ” dalla traiettoria dell’intelligenza artificiale. Clark ha dichiarato a Bloomberg di aver trovato le critiche di Sacks ” sconcertanti “.
Anthropic ha affrontato tali preoccupazioni direttamente nei suoi materiali di lancio, sottolineando che Haiku 4.5 è stato sottoposto a approfonditi test di sicurezza. L’azienda ha classificato il modello come ASL-2 , il suo standard di sicurezza AI di Livello 2, rispetto alla più restrittiva designazione ASL-3 per i modelli più potenti Sonnet 4.5 e Opus 4.1.
“I nostri team hanno messo a punto e testato le nostre capacità agentiche fino al limite per valutare se possano essere utilizzate per attività dannose come la generazione di disinformazione o la promozione di comportamenti fraudolenti come le truffe”, ha dichiarato il portavoce a VentureBeat. “Nella nostra valutazione automatizzata dell’allineamento, abbiamo mostrato un tasso complessivo di comportamenti disallineati statisticamente significativamente inferiore rispetto a Claude Sonnet 4.5 e Claude Opus 4.1, rendendolo, secondo questo parametro, il nostro modello più sicuro finora.”
L’azienda ha affermato che i test di sicurezza hanno dimostrato che Haiku 4.5 presenta solo rischi limitati per quanto riguarda la produzione di armi chimiche, biologiche, radiologiche e nucleari. Anthropic ha inoltre implementato classificatori progettati per rilevare e filtrare gli attacchi di tipo “prompt injection”, un metodo comune per tentare di manipolare i sistemi di intelligenza artificiale per produrre contenuti dannosi.
L’enfasi sulla sicurezza riflette la missione fondante di Anthropic. L’azienda è stata fondata nel 2021 da ex dirigenti di OpenAI, tra cui i fratelli Dario e Daniela Amodei, che hanno lasciato l’azienda a causa delle preoccupazioni sulla direzione presa da OpenAI in seguito alla partnership con Microsoft. Anthropic si è posizionata come un’azienda che adotta un approccio più cauto e orientato alla ricerca nello sviluppo dell’intelligenza artificiale
I risultati del benchmark mostrano che Haiku 4.5 compete con modelli più grandi e costosi
Secondo i benchmark di Anthropic, Haiku 4.5 si comporta in modo competitivo o addirittura superiore a diversi modelli più grandi su più criteri di valutazione. Nel test SWE-bench Verified , un test ampiamente utilizzato che misura la capacità dei sistemi di intelligenza artificiale di risolvere problemi di ingegneria del software reali, Haiku 4.5 ha ottenuto un punteggio del 73,3%, leggermente superiore al 72,7% di Sonnet 4 e vicino al 74,5% del GPT-5 Codex.Il modello ha dimostrato particolare efficacia nelle attività di utilizzo del computer, ottenendo il 50,7% nel benchmark OSWorld, rispetto al 42,2% di Sonnet 4. Questa capacità consente all’IA di interagire direttamente con le interfacce del computer, cliccando pulsanti, compilando moduli e navigando tra le applicazioni, il che potrebbe rivelarsi rivoluzionario per l’automazione delle attività digitali di routine.Nei benchmark specifici per la codifica come Terminal-Bench , che testa la capacità degli agenti di intelligenza artificiale di completare attività software complesse utilizzando strumenti da riga di comando, Haiku 4.5 ha ottenuto un punteggio del 41,0%, dietro solo al 50,0% di Sonnet 4.5 tra i modelli Claude.Il modello mantiene una finestra di contesto di 200.000 token per gli utenti standard, mentre gli sviluppatori che accedono alla piattaforma Claude Developer possono utilizzare una finestra di contesto di 1 milione di token. Questa maggiore capacità significa che il modello può elaborare basi di codice o documenti estremamente grandi in una singola richiesta, all’incirca l’equivalente di un libro di 1.500 pagine.
Cosa dicono sulla concorrenza i tre principali modelli di intelligenza artificiale rilasciati in due mesi
Interrogato sulla rapida successione di lanci di modelli, il portavoce di Anthropic ha sottolineato l’attenzione dell’azienda sull’esecuzione piuttosto che sul posizionamento competitivo.
“Ci concentriamo sulla spedizione dei migliori prodotti possibili per i nostri clienti e la nostra velocità di spedizione parla da sola”, ha affermato il portavoce. “Ciò che era all’avanguardia solo cinque mesi fa, ora è più veloce, più economico e più accessibile”.Questa velocità è in contrasto con la precedente e più moderata programmazione di lancio dell’azienda. Anthropic sembrava aver sospeso lo sviluppo della sua linea Haiku dopo il rilascio della versione 3.5 alla fine dello scorso anno, portando alcuni osservatori a ipotizzare che l’azienda avesse declassato i modelli più piccoli.Questo rapido miglioramento del rapporto prezzo-prestazioni convalida una promessa fondamentale dell’intelligenza artificiale: le funzionalità diventeranno notevolmente più economiche nel tempo, man mano che la tecnologia matura e le aziende ottimizzano i loro modelli. Per le imprese, ciò suggerisce che gli attuali vincoli di budget per l’implementazione dell’IA potrebbero allentarsi considerevolmente nei prossimi anni.
Le applicazioni pratiche di Haiku 4.5 abbracciano un’ampia gamma di funzioni aziendali, dal servizio clienti all’analisi finanziaria, fino allo sviluppo software. La combinazione di velocità e intelligenza del modello lo rende particolarmente adatto per attività in tempo reale e a bassa latenza, come le conversazioni con chatbot e le interazioni con l’assistenza clienti, dove ritardi anche di pochi secondi possono compromettere l’esperienza utente.Nei servizi finanziari, l’architettura multi-agente abilitata dall’abbinamento di Sonnet 4.5 con Haiku 4.5 potrebbe trasformare il modo in cui le aziende monitorano i mercati e gestiscono il rischio. Anthropic prevede che Haiku 4.5 monitori migliaia di flussi di dati simultaneamente, tracciando cambiamenti normativi, segnali di mercato e rischi di portafoglio, mentre Sonnet 4.5 gestisce modelli predittivi complessi e analisi strategiche.Per le organizzazioni di ricerca, la divisione del lavoro potrebbe ridurre drasticamente i tempi. Sonnet 4.5 potrebbe orchestrare un’analisi completa, mentre più agenti Haiku 4.5 parallelizzano le revisioni della letteratura, la raccolta dati e la sintesi dei documenti da decine di fonti, potenzialmente “comprimendo settimane di ricerca in ore”, secondo le descrizioni dei casi d’uso di Anthropic.Diverse aziende hanno già integrato Haiku 4.5 e riportato risultati positivi. Guy Gur-Ari, co-fondatore della startup di coding Augment, ha affermato che il modello “ha raggiunto un punto di forza che non pensavamo fosse possibile: una qualità di codifica quasi all’avanguardia con velocità e costi incredibili”. Nei test interni di Augment, Haiku 4.5 ha raggiunto il 90% delle prestazioni di Sonnet 4.5, eguagliando modelli molto più grandi.Jeff Wang, CEO di Windsurf, un’altra startup focalizzata sulla programmazione, ha affermato che Haiku 4.5 “sta sfumando i confini” dei tradizionali compromessi tra velocità, costi e qualità. “È un modello di frontiera veloce che mantiene i costi efficienti e indica la direzione verso cui si sta muovendo questa classe di modelli”.Jon Noronha, co-fondatore dell’azienda di software per presentazioni Gamma, ha dichiarato che Haiku 4.5 “ha superato i nostri attuali modelli in termini di rispetto delle istruzioni per la generazione di testo nelle diapositive, raggiungendo il 65% di precisione rispetto al 44% del nostro modello di livello premium: si tratta di un punto di svolta per l’economia della nostra unità”.