Meta lance Muse Glimmer, un modèle IA open-weight de 30B conçu pour fonctionner en local

Par
KOMCHAD
KOMCHAD นำเสนอข่าวไอที AI สมาร์ตโฟน Gadget คอมพิวเตอร์ ความปลอดภัยไซเบอร์ และนวัตกรรมล่าสุดในภาษาไทย

Meta lance Muse Glimmer, un modèle IA open-weight de 30B conçu pour fonctionner en local
Meta a publié Muse Glimmer, un nouveau modèle d’intelligence artificielle open-weight de 30 milliards de paramètres, conçu pour exécuter localement des charges de travail agentiques sur des PC et stations de travail plutôt que d’envoyer chaque tâche dans le cloud.

L’intérêt du lancement tient à l’association d’une architecture dense relativement compacte avec des poids ouverts, un long contexte et des fonctions destinées aux agents. Les développeurs peuvent créer des systèmes capables de raisonner en plusieurs étapes, d’appeler des outils, de traiter des informations multimodales et de poursuivre un workflow tout en conservant davantage de calcul en local.

Muse Glimmer vise les agents IA locaux toujours actifs
Muse Glimmer est un modèle dense de 30 milliards de paramètres de Meta Superintelligence Labs, conçu pour des charges agentiques pouvant rester actives sur la machine de l’utilisateur. Meta le destine au raisonnement multi-étapes, au code, à l’utilisation d’outils, à la compréhension multimodale et à la reprise après échec, plutôt qu’aux seuls échanges courts de questions-réponses.

Un modèle 30B conçu pour fonctionner sur un seul GPU
Le modèle est prévu pour fonctionner localement sur un seul GPU suffisamment puissant, rapprochant des PC grand public et stations de travail des tâches IA souvent dépendantes du cloud. Meta fournit les poids sous licence Apache 2.0, permettant utilisation, modification et redistribution, y compris commerciale, sous réserve des conditions de licence.

Distillé de Muse Spark avec un long contexte
Muse Glimmer est distillé du modèle Muse Spark, plus grand. La documentation de Meta et de son écosystème mentionne plus de 120 000 tokens de contexte et un composant de perception dédié aux entrées multimodales. L’objectif est de conserver un important contexte de travail pendant de longues chaînes de décisions, d’appels d’outils et de résultats.

AMD et NVIDIA poussent le déploiement local
AMD a annoncé lors de tests Windows préliminaires jusqu’à 24 tokens/s sur Ryzen AI Max+ 395 et jusqu’à 53 tokens/s sur Radeon AI PRO R9700 avec dFlash. NVIDIA met également en avant Muse Glimmer pour les workflows agentiques locaux. Les performances réelles dépendent de la quantification, de la mémoire, de la pile logicielle et du matériel.

Pourquoi l’IA locale open-weight compte
Exécuter un agent en local peut réduire les coûts récurrents de tokens cloud et conserver davantage de données de travail sur l’appareil. C’est important pour les fichiers locaux, messages ou données propriétaires et donne davantage de contrôle sur l’inférence, la personnalisation et l’intégration. Un modèle 30B exige toutefois beaucoup de mémoire et du matériel performant et ne fonctionnera pas de la même manière sur tous les portables ordinaires.

Meta prépare aussi Muse Spark 1.2 en open-weight
La sortie de Glimmer montre également le retour de Meta vers une stratégie open-weight plus forte. Mark Zuckerberg a déclaré qu’une version open-weight de Muse Spark 1.2, plus puissant, serait publiée prochainement. Glimmer est donc à la fois un modèle local utilisable aujourd’hui et un signal que Meta veut ouvrir davantage la famille Muse au-delà d’un cloud fermé.

Partager cet article
Suivre :
KOMCHAD นำเสนอข่าวไอที AI สมาร์ตโฟน Gadget คอมพิวเตอร์ ความปลอดภัยไซเบอร์ และนวัตกรรมล่าสุดในภาษาไทย
Laisser un commentaire