DeepSeek V3 — costo di training $5.6M distrugge l'economia dei modelli fondazionali
In una frase DeepSeek V3: modello MoE da 685B addestrato per $5.6M che supera GPT-4o e Claude 3.5 Sonnet su coding e matematica. Licenza MIT. Innesca un dibattito globale sull'efficienza AI cinese, i controlli export USA e il vero costo dell'AI frontier.
Un laboratorio AI cinese chiamato DeepSeek ha rilasciato un enorme modello aperto chiamato V3 che ha scioccato l'intera industria AI. Il modello supera GPT-4o di OpenAI e Claude 3.5 Sonnet di Anthropic su coding e matematica — eppure è stato addestrato per soli 5.6 milioni di dollari. I modelli leader USA si ritiene costino centinaia di milioni da addestrare. Questo singolo fatto ha ribaltato un'assunzione ampiamente condivisa: che solo le aziende con capitali enormi potessero produrre AI frontier. Il modello è rilasciato sotto licenza MIT, quindi chiunque può usarlo commercialmente gratuitamente. La release ha innescato reazioni immediate a livello globale — i legislatori USA hanno messo in dubbio l'efficacia dei controlli all'export sui chip AI, gli investitori hanno riconsiderato le valutazioni delle aziende AI USA, e gli sviluppatori si sono precipitati a eseguirlo in locale. È stata la release open-model più dirompente dalla Llama originale.
Aziende
DeepSeek
Tool
DeepSeek V3
Tag
Fonti