IA · Verificado por ViaMind
Meta lanza Muse Glimmer, un modelo abierto de 30B para agentes locales
Meta presenta Muse Glimmer, un modelo denso de 30 mil millones de parámetros con ventana de contexto de más de 120K tokens, optimizado para flujos de trabajo agénticos locales en hardware NVIDIA.
Fuente: NVIDIA Technical Blog · Ver original ↗
Lo reportado
Lanzamiento y arquitectura
Según NVIDIA Technical Blog, Meta lanzó Muse Glimmer, un modelo denso de 30 mil millones de parámetros con una ventana de contexto de más de 120K tokens. Está diseñado para trabajo agéntico local y de larga duración, no solo para conversaciones.
Rendimiento y despliegue
El modelo puede ejecutarse completamente en dispositivo en GPUs NVIDIA, incluidas GeForce RTX 5090, DGX Spark, DGX Station y Jetson. Según la fuente, alcanza 20K tokens por segundo en una sola GPU, lo que permite agentes siempre activos que procesan datos localmente.
Opciones de implementación
NVIDIA Technical Blog indica que Muse Glimmer ofrece opciones de despliegue flexibles mediante contenedores NVIDIA NIM, SGLang y vLLM, facilitando la inferencia privada y eficiente para casos de uso como automatización de software y agentes autónomos.
Estado de evidencia: Las afirmaciones materiales incluidas fueron contrastadas con la evidencia enlazada.
Qué seguir
Observar si aparecen benchmarks independientes que validen el rendimiento y la coherencia en tareas agénticas de larga duración, y si Meta publica más detalles sobre licencia y disponibilidad.
Compartir esta historia
RECIBE VIAMIND RADAR
Lo que importa,
directo en tu correo.
Un resumen diario con una historia clave de cada sección.


