OpenAI lancia il modello o1: più tempo per rispondere, maggiore precisione | Chat AI | OpenAI free | OpenAI stock | Turtles AI

OpenAI lancia il modello o1: più tempo per rispondere, maggiore precisione
La nuova famiglia di modelli di AI promette migliori capacità di ragionamento in attività complesse come scienza, matematica e programmazione
Editorial Team12 settembre 2024

 

 

OpenAI ha presentato il nuovo modello o1, una famiglia di modelli di AI progettati per migliorare la capacità di ragionamento e verifica dei fatti. Nonostante alcune limitazioni iniziali e costi elevati, o1 rappresenta un avanzamento significativo rispetto ai precedenti modelli come GPT-4o. Il modello è disponibile per utenti ChatGPT Plus e Team, con l’espansione prevista anche agli utenti Enterprise e Educational.

Punti chiave:

  • Ragionamento potenziato: o1 si distingue per la capacità di pensare in modo più approfondito e metodico prima di rispondere.
  • Famiglia di modelli: La linea o1 include versioni come o1-preview e o1-mini, con accesso limitato ai messaggi.
  • Migliori prestazioni in ambito tecnico: o1 eccelle in compiti complessi di programmazione, matematica e scienza.
  • Costi elevati: Il modello presenta costi significativamente superiori rispetto a GPT-4o, rendendolo meno accessibile per l’uso generalizzato.

 

OpenAI ha recentemente lanciato una nuova linea di modelli di AI denominata o1, con lo scopo di migliorare le capacità di ragionamento dei suoi sistemi generativi. Questo sviluppo segna un’evoluzione significativa rispetto al modello GPT-4o, con un focus particolare su compiti complessi come la risoluzione di problemi matematici, analisi di codice e compiti scientifici. Il modello, precedentemente noto con il nome in codice "Strawberry", mira a superare le limitazioni precedenti introducendo la possibilità di "pensare" per un periodo di tempo più lungo prima di fornire risposte, ottimizzando così la qualità delle risposte stesse.

La famiglia o1 comprende attualmente due versioni: "o1-preview", più robusta, e "o1-mini", progettata per compiti più leggeri e incentrata sulla generazione di codice. Gli utenti che desiderano provare questi modelli devono essere abbonati ai piani ChatGPT Plus o Team, con una futura estensione prevista anche per i piani aziendali ed educativi. La disponibilità gratuita per o1-mini è in programma, ma senza una data precisa. 

Un elemento chiave che distingue o1 dai suoi predecessori è l’uso di una catena di ragionamento interna, ovvero la capacità di eseguire diversi passaggi di verifica prima di arrivare a una conclusione, riducendo così gli errori. Questo tipo di approccio risulta particolarmente utile per compiti che richiedono un’elaborazione sequenziale complessa, come la sintesi di informazioni provenienti da più fonti o la risoluzione di problemi strutturati. L’approccio di apprendimento di rinforzo adottato per o1 permette al sistema di migliorare attraverso penalizzazioni e ricompense, rendendolo più preciso nel tempo.

Le prestazioni di o1 sono evidenti in vari test: nella "International Mathematics Olympiad", o1 ha risolto con successo l’83% dei problemi, un enorme salto rispetto al 13% ottenuto dal modello GPT-4o. Inoltre, il modello ha raggiunto un’alta percentuale nelle competizioni di programmazione online, dimostrando notevoli miglioramenti nelle capacità di codifica e ragionamento logico. Tuttavia, questi avanzamenti hanno un costo: l’uso dell’API di o1 risulta tre volte più costoso per l’input e quattro volte per l’output rispetto a GPT-4o, rendendo o1 una soluzione meno accessibile per utenti con budget limitati. Questo aspetto, insieme ai limiti settimanali sui messaggi (30 per o1-preview e 50 per o1-mini), potrebbe rappresentare un ostacolo per l’adozione diffusa nel breve termine.

Nonostante i miglioramenti, o1 non è privo di difetti. Alcuni test hanno dimostrato che il modello può ancora commettere errori o "allucinare" risposte, inventando dettagli non presenti nei dati forniti. Questi errori sono più comuni rispetto a GPT-4o, ma OpenAI ha dichiarato di voler continuare a perfezionare il modello nel tempo, con future versioni che potrebbero "pensare" per periodi più lunghi, fino a giorni o settimane, per migliorare ulteriormente le capacità di ragionamento.

Con la concorrenza nel settore dell’AI sempre più agguerrita, OpenAI si trova di fronte alla sfida di continuare a innovare, migliorare l’accessibilità e ridurre i costi dei suoi modelli, mentre altre aziende, come Google DeepMind, stanno adottando approcci simili per potenziare le capacità di ragionamento delle loro AI.

Con il debutto di o1, OpenAI segna un passo importante verso modelli AI più avanzati, che potrebbero trasformare diversi settori, ma l’efficacia reale del modello sarà testata solo con il tempo e l’evoluzione delle sue funzionalità.