Muse Glimmer, el nuevo modelo de Meta, ya está disponible en Ollama
Tecnología

Muse Glimmer, el nuevo modelo de Meta, ya está disponible en Ollama

Meta ha lanzado Muse Glimmer, su modelo de inteligencia artificial más reciente y el primero publicado por Meta Superintelligence Labs. Desde ahora, los usuarios de Ollama pueden descargarlo y ejecutarlo localmente, lo que abre la puerta a una nueva generación de aplicaciones de agentes de IA que corren directamente en el equipo del usuario.

Muse Glimmer es un modelo multimodal de 30 mil millones de parámetros, diseñado específicamente para cargas de trabajo de agentes que se ejecutan de forma local. Con Ollama, es posible utilizarlo para potenciar aplicaciones de agentes de codificación como Claude Code, Codex, Pi y otras, así como asistentes personales de larga duración como OpenClaw y Hermes.

Para descargar y ejecutar Muse Glimmer localmente, primero hay que instalar Ollama y después correr el comando ollama run muse-glimmer. Además, el motor MLX de Ollama ofrece un rendimiento de última generación en Apple Silicon, con soporte para DFlash y entrada de imágenes, mediante el comando ollama run muse-glimmer:30b-mlx.

Una de las ventajas de Muse Glimmer es que permite ejecutar agentes de codificación de manera local. Por ejemplo, para usarlo con Claude Code, se ejecuta ollama launch claude --model muse-glimmer. Para una opción más ligera, se puede probar Pi con ollama launch pi --model muse-glimmer. También es compatible con frameworks de asistentes personales como OpenClaw y Hermes, usando ollama launch openclaw --model muse-glimmer y ollama launch hermes --model muse-glimmer.

Además, ollama launch funciona con Codex, OpenCode, Copilot y más integraciones. Muse Glimmer también ofrece control sobre la fuerza de razonamiento: baja, media, alta y muy alta. Se recomienda usar el nivel alto para tareas complejas de codificación y de agentes, y niveles más bajos cuando la velocidad sea prioridad.

Con la versión 0.32.7 de Ollama, el motor MLX ahora soporta DFlash, lo que se suma al soporte previo de predicción multi-token (MTP) para lograr un rendimiento entre 1.5 y 1.8 veces más rápido. La nueva compatibilidad con entrada de imágenes en el motor MLX permite que los agentes de codificación realicen llamadas a herramientas de baja latencia y de forma consecutiva en tareas que requieren imágenes, como construir sitios web o aplicaciones a partir de un dibujo o maqueta, aplicaciones de uso de computadora impulsadas por capturas de pantalla, y lectura de documentos, recibos y gráficos.

Imagen: Foto de Tara Winstead en Pexels

DEJAR UNA RESPUESTA

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *