01 lug, 2026
Con il passaggio dell'IA a un funzionamento continuo, le prestazioni dipendono non solo dalla velocità di esecuzione dei sistemi, ma anche dalla loro capacità di conservare, accedere e riutilizzare i dati prodotti.
In molte aziende, gli investimenti nell'intelligenza artificiale sono direttamente collegati a risultati concreti, come il miglioramento del processo decisionale, l'accelerazione dello sviluppo dei prodotti e la fornitura di esperienze utente più personalizzate.
Pensate a come le aziende sviluppano prodotti su piattaforme e servizi basati sul cloud. Il vantaggio competitivo non deriva da una singola intuizione, ma dall'accumulo di conoscenze attraverso anni di interazioni con i clienti, test, fallimenti, feedback e miglioramenti. Maggiore è la conoscenza istituzionale che un'azienda riesce a conservare e applicare, più rapidamente può migliorare.
I sistemi di intelligenza artificiale stanno iniziando a funzionare allo stesso modo. Inizialmente, la sfida consisteva nell'addestrare il modello. Con la maturazione delle implementazioni, il loro valore dipende sempre più dall'efficacia con cui riescono a conservare, accedere e riutilizzare i dati accumulati attraverso interazioni e output precedenti. Inizialmente il lavoro sembra gestibile, ma le aspettative aumentano con il progredire delle implementazioni. Non è più sufficiente che i sistemi analizzino ciò che è già accaduto. Ci si aspetta che continuino ad apprendere, a perfezionare le raccomandazioni e ad adattare le esperienze man mano che arrivano nuovi dati. Il modello è ancora importante, ma lo è altrettanto la capacità del sistema di conservare ciò che ha già visto e di riproporlo quando necessario.
Il comportamento dei clienti, i risultati precedenti e i modelli in evoluzione devono persistere e rimanere accessibili, e questo cambia la prospettiva. Le prestazioni del modello contano ancora, ma non rappresentano più l'intero quadro. La questione più ampia è se il sistema stesso sia in grado di sostenere tale contesto nel corso della sua evoluzione.
Per anni, le discussioni sull'intelligenza artificiale si sono concentrate sui modelli e sulla potenza di calcolo. Le organizzazioni hanno investito in GPU, assunto data scientist e si sono concentrate sulla formazione. Il sistema di archiviazione ha supportato il processo, conservando i set di dati e rimanendo perlopiù in background.
Ora che questi sistemi sono ampiamente diffusi, sta emergendo qualcos'altro. I modelli vengono eseguiti ininterrottamente e il lavoro si è spostato dalla creazione di intelligenza artificiale alla sua scalabilità. Questo viene spesso descritto come IA agentiva: sistemi che non si limitano a rispondere alle richieste, ma portano avanti il contesto e si basano su ciò che hanno già fatto.
Generano output, attingono a dati memorizzati e si basano su interazioni precedenti. Quella che a prima vista sembra una singola richiesta è spesso solo una fase di un ciclo continuo di recupero del contesto, perfezionamento delle risposte e immissione di nuove informazioni nel sistema.
Il miglioramento dei sistemi dipende sempre più dall'efficacia con cui i dati vengono conservati, consultati e riutilizzati nei diversi flussi di lavoro. Negli ambienti hyperscale, ovvero infrastrutture cloud enormi e distribuite a livello globale in cui operano questi sistemi, lo storage a oggetti diventa il sistema di registrazione per i dati accumulati. Costruita su larga scala su dischi rigidi, fornisce le fondamenta solide ed economiche che consentono ai sistemi di intelligenza artificiale di preservare il contesto, estenderlo nel tempo e migliorarlo continuamente.
Una volta che i sistemi iniziano a funzionare in questo modo, il ruolo dello storage comincia a cambiare. Nello sviluppo del prodotto, il feedback dei clienti, i risultati precedenti, i dati dei test e le interazioni passate continuano a fornire indicazioni su cosa migliorare in futuro. Lo stesso schema si ripete in tutti i settori in cui i sistemi di intelligenza artificiale dipendono dalla conservazione e dal riutilizzo dei dati.
L'archiviazione a oggetti è stata a lungo considerata una destinazione in cui i dati vengono archiviati una volta che non sono più in uso attivo. Quel modello funzionava quando i carichi di lavoro erano episodici. Ma i sistemi di intelligenza artificiale che apprendono e si evolvono continuamente non hanno un punto di arrivo netto.
Ogni interazione lascia qualcosa dietro di sé. I dati in uscita si accumulano e, una volta memorizzati, entrano a far parte del contesto operativo del sistema. Anziché scomparire, questi risultati rimangono disponibili insieme a tutto ciò che li ha preceduti e contribuiscono a plasmare ciò che accadrà in seguito. Con il passare del tempo e la crescita di questi sistemi, l'archiviazione a oggetti assume un ruolo sempre più centrale, non solo come repository, ma come livello in cui i dati accumulati persistono, rimangono accessibili e possono essere reinseriti nei flussi di lavoro attivi per influenzare i risultati futuri.
I dati continuano a transitare attraverso altri livelli. Viene caricato in memoria, elaborato da livelli intermedi e utilizzato in tempo reale, spesso più di una volta all'interno di un singolo flusso di lavoro. Ma alla fine dovrà pur persistere da qualche parte. Deve rimanere accessibile, durevole e pronto per essere riutilizzato.
Questo ruolo ricade sempre più sull'archiviazione a oggetti, che nei cloud hyperscale si basa su dischi rigidi. Infatti, oltre il 90% della capacità dei data center cloud risiede su dischi rigidi, a dimostrazione non solo di dove vengono archiviati i dati, ma anche di dove devono risiedere su larga scala.¹ L'archiviazione è il modo in cui l'IA conserva il contesto. Su larga scala, smette di essere una considerazione secondaria e diventa parte integrante di ciò che definisce le capacità del sistema.
Nell'era dell'addestramento, la questione relativa ai dati era semplice: ne abbiamo a sufficienza per costruire un modello utile?
In sistemi come questi, inizia a emergere una questione diversa: il sistema è in grado di accedere ai dati corretti, al momento giusto, spesso ripetutamente durante il suo funzionamento?
È qui che smette di essere una questione teorica. Si osservano sistemi che attingono ripetutamente ai dati archiviati, affinando i risultati man mano che viene aggiunto ulteriore contesto. Quella che a prima vista sembra una singola query è spesso, dietro le quinte, una serie di ricerche, ognuna delle quali dipende da ciò che è già stato memorizzato. Con la maturazione di questi sistemi, i dati assumono un nuovo ruolo. Ciò che rimane in magazzino tra un utilizzo attivo e l'altro non è inattivo. Fa parte di ciò che il sistema conosce: output precedenti, interazioni e segnali che determinano ciò che accadrà in seguito. Il contesto accumulato inizia ad assumere la stessa importanza del modello stesso. Su larga scala, i carichi di lavoro dell'IA continuano a generare enormi volumi di dati, ma gran parte di essi viene ancora trattata come transitoria, ovvero utilizzata una sola volta e poi scartata, anziché essere conservata come base su cui il sistema può costruire.
È qui che entra in gioco un nuovo vincolo. Poiché i dati sono diventati una risorsa a lungo termine, la sfida non consiste più semplicemente nella quantità di dati che possono essere archiviati, ma nella quantità di dati che può rimanere accessibile, durevole e riutilizzabile man mano che i sistemi continuano a scalare.
Il mercato si sta già adattando a questa realtà. IDC prevede che la capacità di archiviazione a oggetti crescerà a un tasso annuo composto del 25,6%, a testimonianza della crescente domanda di dati persistenti e accessibili su larga scala.²
In teoria, i sistemi di intelligenza artificiale sono progettati per l'efficienza. In pratica, mantenere tale efficienza diventa più difficile man mano che le aziende aumentano di dimensioni. L'informatica continua a progredire con modelli sempre più potenti e sofisticati. Con la maturazione delle implementazioni, la quantità di dati che questi sistemi conservano e su cui fanno affidamento cresce ancora più rapidamente.
Le organizzazioni stanno diventando sempre più brave a recuperare e utilizzare le informazioni, integrando i dati giusti nei flussi di lavoro al momento opportuno. Ma allo stesso tempo, il volume di ciò che vogliono conservare continua ad aumentare. I dati storici aziendali, i risultati precedenti, le interazioni con i clienti e le conoscenze organizzative accumulate acquisiscono maggiore valore con la maturazione dei sistemi. La qualità dell'output di un sistema di intelligenza artificiale riflette sempre più la profondità e l'ampiezza delle informazioni a cui può accedere.
Quando le prestazioni sono insufficienti, l'istinto è comunque quello di aggiungere più potenza di calcolo. Ma questo non sempre risolve il problema di fondo. Al di là dell'elaborazione dei dati, il problema più complesso è mantenere l'accesso ai dati accumulati che forniscono contesto ai sistemi e garantire che possano essere conservati, recuperati e riutilizzati man mano che i sistemi si evolvono.
Questo squilibrio comincia a manifestarsi anche nella pianificazione delle infrastrutture. Man mano che i sistemi di intelligenza artificiale conservano e riutilizzano una maggiore quantità di dati, il livello dati assume un ruolo sempre più importante nelle decisioni architetturali che determinano l'efficacia con cui tali sistemi possono scalare.
Alla fine, i sistemi non sono più limitati dalla loro velocità di esecuzione, ma dalla quantità di dati storici che possono conservare come stato utilizzabile.
Le decisioni infrastrutturali che le organizzazioni prenderanno ora determineranno fino a che punto potranno effettivamente spingersi i loro sistemi di intelligenza artificiale.
Gran parte di ciò viene descritto come definito dal software, e una porzione considerevole del comportamento del sistema è plasmata dal modo in cui i dati vengono distribuiti e consultati. Ma con l'aumentare della diffusione, un'altra realtà diventa sempre più difficile da ignorare: la capacità di crescita di questi sistemi è in definitiva determinata dall'hardware sottostante.
L'infrastruttura di intelligenza artificiale opera su più livelli. La memoria supporta ciò che sta accadendo ora. La tecnologia Flash consente l'accesso ad alta velocità laddove la latenza è un fattore critico. In entrambi i casi, l'archiviazione a oggetti su larga scala basata su dischi rigidi fornisce una base solida in cui i dati rimangono disponibili per un utilizzo a lungo termine.
Man mano che i sistemi diventano più continui, tale distinzione si accentua. I livelli di prestazioni gestiscono l'elaborazione immediata, mentre l'archiviazione a oggetti garantisce che quanto già accaduto rimanga disponibile. Poiché questi sistemi generano e riutilizzano continuamente grandi volumi di dati non strutturati, non possono essere sostenuti basandosi esclusivamente sui livelli di prestazioni. Con il passaggio di densità, durata e scalabilità da considerazioni secondarie a vincoli centrali, gli hard disk rimangono fondamentali.
Il software determina il comportamento del sistema. L'hardware determina ciò che può sapere.
Ad un certo punto, ogni investimento nell'IA si scontra con la stessa domanda: come può il sistema continuare a crescere senza superare la capacità dell'infrastruttura sottostante? La densità di archiviazione è il punto in cui si trova la risposta a questa domanda. Il vero limite nell'IA aziendale è la continuità, non la potenza di calcolo. La capacità di archiviare più dati senza espandere l'infrastruttura influisce direttamente sul grado di scalabilità di un sistema.
Su larga scala, l'effetto si amplifica. In una configurazione da un exabyte, la piattaforma Mozaic™ 4+ di Seagate migliora l'efficienza dell'infrastruttura di circa il 47% rispetto alle configurazioni standard da 30 TB, riducendo al contempo l'ingombro del data center e il consumo energetico.3
La decisione relativa alle infrastrutture e la decisione aziendale si rivelano essere la stessa cosa. I sistemi che conservano ciò che hanno appreso, lo recuperano in modo efficiente e lo riutilizzano in milioni di interazioni vedranno il loro valore aumentare. I sistemi basati su infrastrutture che trattano i dati come transitori finiranno per stabilizzarsi. Non perché i modelli siano sbagliati, ma perché le fondamenta su cui si basano non sono in grado di reggere il peso.
L'archiviazione è il modo in cui l'IA accumula conoscenza e, su larga scala, il contesto conservato determina quanto il sistema può imparare dal proprio passato, adattarsi e fornire valore all'azienda.
Scopri come le architetture di storage multilivello, basate su HDD, supportano lo storage di oggetti su larga scala.
Riferimenti
Vicepresidente, Marketing Tecnico e Cloud