Thinking Machines Lab dévoile Inkling-Small : un modèle MoE multimodal de 276 milliards de poids
8/10Thinking Machines Lab a annoncé Inkling-Small, un modèle mixture-of-experts multimodal possédant 276 milliards de poids totaux et 12 milliards de poids actifs. Ce modèle innovant peut fonctionner sur un seul GPU NVIDIA B300, marquant un progrès majeur en efficacité dans le déploiement de modèles massifs.
