Évaluation technique du modèle GLM-5.1 : Architecture MoE, performances de codage et intégration API
Architecture et Spécifications Techniques
Le modèle GLM-5.1 introduit une architecture Mixture of Experts (MoE) totalisant 744 milliards de paramètres, dont environ 40 milliards sont activés lors de l'inférence. Cette conception permet de maintenir une empreinte mémoire optimisée tout en offrant des capacités de traitement parallèle étendues. L ...
Publié le 20 juillet à 02h19