Alibaba rilascia Qwen 3.5: MoE sparso multimodale, 262K di contesto, Apache 2.0
In una frase Il 16 febbraio 2026 Alibaba apre Qwen 3.5 partendo dal flagship 397B-A17B: MoE sparso con 512 esperti di cui 11 attivi, attenzione Gated DeltaNet, input multimodale e 262.144 token di contesto nativi (circa 1M con YaRN). Licenza Apache 2.0 e 201 lingue; primo tra gli open-weight su instruction following e multilinguismo, ancora indietro sul reasoning.
Il 16 febbraio 2026 Alibaba ha pubblicato Qwen 3.5, la nuova famiglia dei suoi modelli aperti, con licenza Apache 2.0: chiunque può scaricarli, usarli e modificarli, anche per scopi commerciali, senza pagare nulla.
Il primo modello uscito è anche il più grande: 397 miliardi di parametri totali, ma solo 17 miliardi attivi per ogni richiesta. È il principio del Mixture of Experts: dentro il modello ci sono 512 specialisti e per ogni domanda ne vengono chiamati soltanto 11. Il risultato è la qualità di un modello enorme al costo di calcolo di uno piccolo. Nelle due settimane successive sono arrivate le taglie più maneggevoli — 122B, 35B, 27B il 24 febbraio, poi 9B, 4B, 2B e 0,8B il 2 marzo — quelle che si possono davvero far girare su un server aziendale o su un PC.
Due caratteristiche contano più delle altre. La prima: non legge solo testo, ma anche immagini e video. La seconda: può tenere in mente 262.144 token per volta, cioè diverse centinaia di pagine in un colpo solo, e con una tecnica di estensione chiamata YaRN si arriva intorno al milione. Le lingue supportate sono 201.
Sui confronti conviene essere precisi. Al momento del lancio i concorrenti erano GPT-5.2, Claude 4.5 Opus e Gemini 3 Pro. Qwen 3.5 risulta il migliore tra i modelli aperti nel seguire istruzioni e nel multilinguismo, ma resta indietro sul ragionamento puro. Non è quindi il modello più intelligente in assoluto: è il più utile fra quelli che puoi tenere in casa.
Aziende
Alibaba
Tool
Qwen 3.5
Tag
Fonti