Ling-3.0: 5,1 miliardi di parametri attivi per token
Ling-3.0-flash ha generato un aumento mensile del traffico dell’831% nel mese di lancio, secondo TAdviser, riducendo il costo per token attivo da $0,008 a $0,0007.
Tag
Ling-3.0-flash ha generato un aumento mensile del traffico dell’831% nel mese di lancio, secondo TAdviser, riducendo il costo per token attivo da $0,008 a $0,0007.
Inferenza AI: il chip Sohu ottimizza l’esecuzione dei modelli transformer, riducendo i costi del 30% e superando le GPU NVIDIA. Scopri come la specializzazione hardware sta ridefinendo il futuro dell’AI.
SageMaker AI ha dimezzato l’inferenza grazie a 32 token paralleli, riducendo del 38% la durata media delle sessioni di training. Scopri il meccanismo e le implicazioni tecniche.
Nel 2026, OpenAI rilascia GPT-5.5, ma il dato chiave non è l’accuratezza, bensì la scomparsa dell’intervento umano. Cosa significa per il futuro del lavoro cognitivo?
LeCun alza 1,03 miliardi per ‘world models’, sfidando i grandi modelli linguistici. Un’architettura cognitiva che integra previsioni fisiche e interazioni ambientali.