Economia CircolareInnovazione Green

Il costo nascosto degli agenti AI: l’importanza della memoria operativa

redazione 3 min di lettura
Illustrazione del costo nascosto degli agenti AI

In Breve

Qual è il costo principale associato agli agenti AI?
Il costo principale è legato alla gestione della memoria operativa e all'aumento dei token utilizzati.
Come influisce la memoria operativa sui sistemi multi-agente?
Nei sistemi multi-agente, la memoria operativa aumenta i costi a causa della complessità delle interazioni.
Quali sono i principi fondamentali per progettare la memoria degli agenti?
I principi includono la scrittura concorrente, la memoria condivisa e la separazione tra memoria attiva e storica.

Il panorama dell’intelligenza artificiale (AI) sta subendo una trasformazione significativa con l’emergere di sistemi agentici che non solo eseguono compiti, ma anche memorizzano informazioni operative. Questa evoluzione non è priva di costi, e uno degli aspetti più critici è la gestione della memoria operativa, che incide su costi, prestazioni e accuratezza, specialmente quando si scala.

A differenza delle prime applicazioni aziendali, che si basavano su richieste puntuali e recupero di contesto, gli agenti AI sono progettati per interagire in modo dinamico. Essi aggiornano il proprio stato, eseguono chiamate a strumenti e trasferiscono contesto, creando interazioni cicliche e persistenti. Ogni azione compiuta da un agente produce uno stato memorizzato, il che implica che, in scenari di prova limitati, i costi principali possono sembrare legati all’accesso al modello, ai token e al recupero delle informazioni.

Tuttavia, nei sistemi multi-agente, la spesa tende ad aumentare con la complessità dei compiti. Esempi pratici dimostrano che ci sono differenze significative di costo tra progetti che utilizzano semplici chat e quelli che impiegano agenti complessi. Le analisi tecniche rivelano che i sistemi multi-agente possono consumare un ordine di grandezza di token molto superiore rispetto ai modelli tradizionali. I fattori che contribuiscono all’aumento dei costi includono loop dinamici, chiamate a strumenti, tentativi di recupero delle informazioni, trasferimenti di contesto e la necessità di mantenere la provenienza operativa per decisioni e condivisione tra agenti.

Per progettare un sistema di dati efficace per flotte di agenti, è fondamentale definire i livelli di servizio della memoria. Ciò include la velocità di accesso, chi può aggiornare le informazioni, quali agenti devono condividere lo stato e per quanto tempo le informazioni devono rimanere immediatamente disponibili. Tre principi emergono come prioritari: garantire la capacità di scrittura concorrente per adattarsi all’aumento del numero di agenti; evitare copie ridondanti attraverso una memoria condivisa per ridurre costi e incoerenze; e separare la memoria attiva, che richiede accesso frequente, dalla memoria storica, che può essere archiviata su supporti meno costosi.

Le decisioni su come conservare le modifiche storiche, che possono includere versioni complete, delta o snapshot periodici, influenzano non solo lo spazio di archiviazione, ma anche i tempi di ricostruzione e i costi operativi. Queste scelte tecniche determinano il modello economico del deployment e dovrebbero essere validate nelle fasi iniziali. Testare il carico di scrittura, le regole di retention e i modelli di condivisione mentre il sistema è ancora in fase di sviluppo consente di identificare e correggere i costi nascosti prima che un progetto di prova diventi una flotta operativa.

Nonostante la recente riduzione dei costi dei modelli e i miglioramenti nell’inferenza, le implementazioni su larga scala continueranno a generare flussi di dati operativi da scrivere, condividere, proteggere, recuperare e conservare. La sostenibilità economica di tali sistemi dipenderà sia dal numero di agenti coinvolti sia dal volume di memoria mantenuta per ciascun compito.

Scritto da

redazione

Autore della redazione Agenda Ambiente.