OpenAI sta lavorando a una nuova tecnologia chiamata “Strawberry”

Reuters ha riportato che OpenAI, l’azienda che ha sviluppato ChatGPT, sta lavorando a una nuova tecnologia di intelligenza artificiale con il nome in codice “Strawberry”. Secondo fonti interne e documenti riservati visionati da Reuters, questo progetto mira a migliorare significativamente le capacità di ragionamento dei modelli di IA.

Il progetto Strawberry è considerato all’interno di OpenAI come un potenziale passo avanti nella creazione di modelli con capacità di ragionamento più avanzate. L’obiettivo principale sembra essere quello di permettere all’IA non solo di generare risposte, ma di pianificare in anticipo e navigare autonomamente su internet per condurre ricerche approfondite.

Tecnicamente, Strawberry utilizza un approccio particolare nella fase di “post-training” dei modelli di IA. Il metodo avrebbe similitudini con il “Self-Taught Reasoner” (STaR) sviluppato all’Università di Stanford nel 2022, che permette ai modelli di IA di migliorarsi autonomamente generando i propri dati di addestramento.

STaR fa generare al modello delle spiegazioni passo-passo (ragionamenti) per rispondere a domande. Il modello verifica la correttezza delle risposte confrontandole con le risposte corrette già presenti nel dataset. Se la risposta generata è corretta, il modello viene addestrato su quella spiegazione. In caso contrario, viene fornita la risposta corretta e il modello prova a generare un nuovo ragionamento per quella risposta, migliorando così la sua capacità di ragionare e rispondere correttamente in futuro. Questo ciclo iterativo continua, affinando continuamente le abilità del modello senza la necessità di enormi dataset di addestramento predefiniti.

OpenAI sta testando Strawberry su compiti che richiedono pianificazione a lungo termine e su un dataset di “ricerca approfondita”. L’azienda vorrebbe che i suoi modelli potessero navigare autonomamente sul web con l’assistenza di un “agente utilizzatore del computer” (CUA, computer-using agent) in grado di intraprendere azioni basate sui risultati delle ricerche.

Strawberry sembra essere l’evoluzione di un progetto precedente chiamato Q*, di cui si era già parlato in passato (qualcuno affermava che Altman fosse stato licenziato a causa di quel progetto). Le dimostrazioni interne di Q* avevano mostrato la capacità di rispondere a complesse domande scientifiche e matematiche, superando le capacità dei modelli commerciali attuali.

Questo sviluppo si inserisce in un contesto più ampio di ricerca nel campo dell’IA. Altre grandi aziende tecnologiche come Google, Meta e Microsoft stanno lavorando su progetti simili per migliorare le capacità di ragionamento dell’IA. Tuttavia, c’è ancora dibattito nella comunità scientifica sulla possibilità che i modelli linguistici di grandi dimensioni (LLM) possano effettivamente incorporare capacità di ragionamento astratto e pianificazione a lungo termine.

Il miglioramento delle capacità di ragionamento è considerato cruciale per ampliare le potenziali applicazioni dell’IA in campi come la ricerca scientifica e lo sviluppo di software complessi. Sam Altman, CEO di OpenAI, ha dichiarato che le capacità di ragionamento sono “l’area di progresso più importante” per l’IA.

Nonostante l’entusiasmo per questi sviluppi, emergono anche preoccupazioni etiche e di sicurezza. La prospettiva di un’IA con capacità di ragionamento avanzate solleva questioni sulla sua controllabilità e sulle potenziali implicazioni per la società.

OpenAI ha mantenuto un atteggiamento cauto nelle comunicazioni ufficiali riguardo a Strawberry, limitandosi a confermare la ricerca continua su nuove capacità di IA, in linea con la pratica comune del settore. Non è chiaro quando o se Strawberry diventerà disponibile pubblicamente.

Luca Sambucci lavora da oltre trent'anni nella cybersecurity, occupandosi oggi di sicurezza dell'intelligenza artificiale o AI Security. Ha collaborato come esperto con il Governo italiano, la Commissione europea, il Centro Comune di Ricerca e l'Agenzia Europea per la Difesa. È fondatore di Noctive Security, startup che sviluppa software automatizzati di red teaming per LLM e agenti AI. Questo blog è personale e le opinioni espresse appartengono ai singoli autori.