Ling-3.0 : 5,1 milliards de paramètres actifs par token
efficience-computationnelleLe modèle Ling-3.0-flash MoE utilise seulement 5,1 milliards de paramètres actifs par token, optimisant l'efficacité et réduisant les coûts d’inférence.
Read Report →