c.franzen
Fino a poco tempo fa, la pratica di sviluppare agenti di intelligenza artificiale era un po’ come allenare un maratoneta con una memoria di trenta secondi.Certo, potresti fornire ai tuoi modelli di intelligenza artificiale strumenti e istruzioni, ma dopo qualche decina di interazioni (diversi giri di pista, per estendere la nostra analogia con la corsa) perderebbero inevitabilmente il contesto e inizierebbero ad avere allucinazioni.
Con gli ultimi aggiornamenti di OpenAI alla sua API Responses (l’interfaccia di programmazione dell’applicazione che consente agli sviluppatori sulla piattaforma OpenAI di accedere a più strumenti agentici come la ricerca web e la ricerca di file con una singola chiamata), l’azienda segnala che l’era degli agenti limitati sta tramontando.Gli aggiornamenti annunciati oggi includono la compattazione lato server, i contenitori shell ospitati e l’implementazione del nuovo standard ” Skills ” per gli agenti.
Con questi tre importanti aggiornamenti, OpenAI sta effettivamente fornendo agli agenti una scrivania permanente, un terminale e una memoria che non si deteriora e che dovrebbe aiutarli a evolversi ulteriormente in lavoratori digitali affidabili e a lungo termine.Tecnologia: superare l'”amnesia contestuale”L’ostacolo tecnico più significativo per gli agenti autonomi è sempre stato il “disordine” delle attività di lunga durata. Ogni volta che un agente richiama uno strumento o esegue uno script, la cronologia delle conversazioni si allunga.Alla fine, il modello raggiunge il limite di token e lo sviluppatore è costretto a troncare la cronologia, spesso eliminando proprio il “ragionamento” di cui l’agente ha bisogno per completare il lavoro.La risposta di OpenAI è la compattazione lato server. A differenza del semplice troncamento, la compattazione consente agli agenti di funzionare per ore o addirittura giorni.I primi dati della piattaforma di e-commerce Triple Whale suggeriscono che si tratti di una svolta in termini di stabilità: il loro agente, Moby, ha gestito con successo una sessione con 5 milioni di token e 150 chiamate di strumenti senza alcun calo di precisione.In termini pratici, questo significa che il modello può “riassumere” le proprie azioni passate in uno stato compresso, mantenendo vivo il contesto essenziale e cancellando il rumore. Trasforma il modello da un assistente smemorato in un processo di sistema persistente.
L’approccio di OpenAI privilegia un “substrato programmabile” ottimizzato per la velocità di sviluppo. Integrando shell, memoria e competenze nell’API Responses, offre un’esperienza “chiavi in mano” per la rapida creazione di agenti complessi.La startup di ricerca basata sull’intelligenza artificiale aziendale Glean ha già segnalato un aumento della precisione degli strumenti dal 73% all’85% utilizzando il framework Skills di OpenAI.Abbinando lo standard aperto alla sua API proprietaria Responses, l’azienda fornisce un substrato chiavi in mano ad alte prestazioni.Non si tratta solo di leggere la skill; la si ospita all’interno di una shell Debian 12 gestita, gestendo le policy di rete e applicando la compattazione lato server per garantire che l’agente non si perda durante una sessione da cinque milioni di token. Questa è la scelta “ad alte prestazioni” per gli ingegneri che devono implementare worker autonomi e di lunga durata senza il sovraccarico di dover creare un ambiente di esecuzione personalizzato.Nel frattempo, Anthropic si è concentrata sul “mercato delle competenze”. Il suo punto di forza risiede in un catalogo consolidato di manuali di partnership pre-confezionati, forniti da aziende come Atlassian, Figma e Stripe.Implicazioni per i decisori tecnici aziendaliPer gli ingegneri concentrati su “implementazione rapida e messa a punto”, la combinazione di Server-side Compaction e Skills fornisce un enorme aumento della produttivitàInvece di creare una gestione personalizzata dello stato per ogni esecuzione dell’agente, gli ingegneri possono sfruttare la compattazione integrata per gestire attività che richiedono più ore.Le competenze consentono di creare “IP confezionati”, in cui specifiche conoscenze procedurali specializzate o di perfezionamento possono essere modularizzate e riutilizzate in diversi progetti interni.Per coloro che hanno il compito di spostare l’intelligenza artificiale da una “chat box” a un flusso di lavoro di livello produttivo, l’annuncio di OpenAI segna la fine dell’era delle “infrastrutture su misura”.
In passato, l’orchestrazione di un agente richiedeva un notevole lavoro di scaffolding manuale: gli sviluppatori dovevano creare una logica di gestione dello stato personalizzata per gestire lunghe conversazioni e sandbox effimere e sicure per eseguire il codice.La sfida non è più “Come faccio a fornire un terminale a questo agente?”, ma “Quali competenze sono autorizzate per quali utenti?” e “Come possiamo verificare gli artefatti prodotti nel file system ospitato?”. OpenAI ha fornito il motore e lo chassis; il compito dell’orchestratore è ora quello di definire le regole del gioco.Per i responsabili delle operazioni di sicurezza (SecOps), dotare un modello di intelligenza artificiale di una shell e dell’accesso alla rete rappresenta un’evoluzione ad alto rischio. L’utilizzo di Domain Secrets e Org Allowlist da parte di OpenAI fornisce una strategia di difesa approfondita, garantendo che gli agenti possano richiamare le API senza esporre credenziali non elaborate al contesto del modello.Tuttavia, poiché gli agenti diventano più facili da implementare tramite “competenze”, le SecOps devono essere vigili sulle “competenze dannose” che potrebbero introdurre vulnerabilità di iniezione immediata o percorsi di esfiltrazione di dati non autorizzati.Come dovrebbero decidere le imprese?OpenAI non vende più solo un “cervello” (il modello); vende anche l'”ufficio” (il contenitore), la “memoria” (la compattazione) e il “manuale di formazione” (le competenze). Per i leader aziendali, la scelta sta diventando chiara:Scegli l’API Responses di OpenAI se i tuoi agenti richiedono un’esecuzione con stato esplosiva. Se hai bisogno di un contenitore cloud gestito in grado di funzionare per ore e gestire oltre 5 milioni di token senza degradazione del contesto, lo stack integrato di OpenAI è il “sistema operativo ad alte prestazioni” per lo standard agentskills.io.Scegli Anthropic se la tua strategia si basa sulla connettività immediata con i partner. Se il tuo flusso di lavoro si basa su integrazioni preconfigurate esistenti provenienti da un’ampia gamma di fornitori terzi, l’ecosistema maturo di Anthropic offre un’esperienza più “plug-and-play” per lo stesso standard aperto.In definitiva, questa convergenza segnala che l’IA è uscita dall’era del “giardino recintato”. Standardizzando su agentskills.io, il settore sta trasformando il “prompt spaghetti” in un’architettura condivisa, versionata e realmente portabile per il futuro del lavoro digitale.