Alibaba accende il suo sole artificiale: Qwen3-Max brilla con un trilione di parametri | Llm cosa sono | Come usare chatgpt | Large language models examples | Turtles AI

Alibaba accende il suo sole artificiale: Qwen3-Max brilla con un trilione di parametri
Dal colosso cinese arriva un modello capace di pensare e agire, accompagnato da Qwen3-Omni, l’intelligenza che unisce voce, immagini e realtà immersiva, con investimenti titanici per alimentare la nuova era dell’autonomia digitale
Editorial Team25 settembre 2025

 


Alibaba ha svelato il modello Qwen3-Max, dotato di oltre mille miliardi di parametri, che eccelle nella generazione di codice e nei compiti agentici con minima supervisione. In contemporanea ha presentato Qwen3-Omni, un’intelligenza multimodale per AR/VR e applicazioni immersive.

Punti chiave:

  • Qwen3-Max supera la soglia del trilione di parametri, posizionandosi come il modello più ambizioso finora di Alibaba.
  • Le sue capacità agentiche permettono azioni autonome con istruzioni ridotte, ben al di là del semplice chatbot.
  • Qwen3-Omni integra testo, immagini, audio e video in un’unica architettura “nativamente omni-modale”.
  • Il gruppo si impegna a investire massicciamente (380 miliardi di yuan) per infrastrutture AI su scala nazionale.

Alibaba ha recuperato gli occhi del mondo tecnologico durante la sua conferenza annuale, annunciando un nuovo traguardo nella sua ambiziosa corsa verso l’intelligenza artificiale generativa: Qwen3-Max, modello da oltre un trilione di parametri, creato per affrontare non solo compiti di conversazione, ma vere attività in autonomia. Con questo passo, l’azienda estende il proprio raggio d’azione ben oltre il tradizionale ruolo da e-commerce e computing in cloud.

Qwen3-Max non è semplicemente grande per dimensioni: è stato progettato con un’architettura Mixture of Experts (MoE) che attiva solo porzioni del modello per ogni compito, per risparmiare risorse e mantenere performance stabili. Alibaba rivela che il modello è stato addestrato su circa 36 trilioni di token  un volume dati che abbraccia testi multilingue, codici sorgenti, scientifico, documenti specialistici  e che può gestire contesti con lunghezze fino a un milione di parole o simboli. Inoltre sono state introdotte tecniche come “ChunkFlow” per gestire in modo efficiente input lunghi e strumenti interni come SanityCheck e EasyCheckpoint per ridurre interruzioni dovute a problemi hardware.

Per facilitare l’adozione, Alibaba offre due modalità operative per Qwen3-Max: una versione Instruct (orientata a compiti di ragionamento e generazione guidata) già disponibile su Qwen Chat e tramite API, e una modalità Thinking (agentica) ancora in fase di completamento, pensata per scenari che richiedono pianificazione e uso di strumenti esterni. Nel benchmark pubblico Text Arena, la versione Instruct ha già raggiunto posizioni di vertice globali, e nei test su codifica reali (SWE-Bench Verified) ha ottenuto punteggi competitivi. Alibaba afferma che Qwen3-Max supera modelli come Claude, DeepSeek-V3.1 e altri concorrenti nelle metriche Tau2-Bench. 

In parallelo, l’azienda ha introdotto Qwen3-Omni, un modello concepito per gestire simultaneamente testo, immagini, audio e video, definito “nativamente omni-modale” (ossia non come semplice integrazione posteriore) con risposte in testo e audio.  Il modello è progettato con un’architettura “Thinker-Talker” che separa il ragionamento  dalla generazione vocale, con attenzione particolare alla latenza nei flussi vocali in tempo reale. Nella relazione tecnica, Alibaba afferma che Qwen3-Omni raggiunge prestazioni pari (o quasi) ai modelli specializzati per ciascuna modalità, e conquista posizioni di vertice in molti benchmark multimodali, inclusi audio e audio-visivi. Le versioni pubbliche disponibili sono tre con 30 miliardi di parametri ciascuna, e sono rilasciate sotto licenza Apache 2.0, favorendo l’uso commerciale e lo sviluppo estensivo. 

Sul fronte finanziario e infrastrutturale, Alibaba ha annunciato l’intenzione di dedicare 380 miliardi di yuan (circa 53 miliardi di dollari) nei prossimi tre anni allo sviluppo dell’ecosistema AI  server, reti, data center, storage, chip  e ha già lasciato intendere che non si fermerà a questa cifra, in risposta alla crescente domanda nel settore.  Il CEO Eddie Wu ha osservato che la velocità con cui si sta sviluppando il settore supera ogni aspettativa, e che le richieste infrastrutturali stanno crescendo in modo “inaspettato”.  Inoltre, Alibaba punta a controllare la “full stack” dell’AInon solo modelli e software, ma anche il livello hardware (inclusi chip proprietari) e la rete fisica che li supporta. 

Un’ulteriore novità correlata è Qwen3-ASR-Flash, un modello vocale dedicato alla trascrizione speech-to-text, basato sulle tecnologie di Qwen3-Omni e addestrato su decine di milioni di ore di dati audio. In test pubblici ha mostrato tassi di errore molto bassi: 3,97 % per il cinese standard, 3,48 % per accenti cinesi e 3,81 % per l’inglese, valori che surclassano modelli come Gemini 2.5 Pro e GPT4o-Transcribe.  Nel panorama AI globale si assiste così a un’evoluzione parallela: i modelli multimodali stanno mutando non soltanto la modalità di interazione (testo/immagine/audio/video), ma introducono l’idea che l’AI possa “pensare” e “agire” come un agente, non solo rispondere a domande.

Alla luce di queste mosse, il panorama dell’AIsoprattutto in Asia  si fa ancora più dinamico, con un Alibaba intenzionato a giocare un ruolo da protagonista nella definizione dei modelli generativi di prossima generazione.