
Canonical se complace en anunciar que el nuevo NVIDIA Nemotron 3.5 Lightning de NVIDIA, un modelo abierto y personalizable creado para agentes de IA siempre activos, ahora está disponible en Ubuntu con una instalación de un solo comando.
NVIDIA Nemotron 3.5 Lightning es un modelo abierto de 30B Mix of Experts (MoE) con 3B de parámetros activos diseñado para cargas de trabajo proxy de alto rendimiento. Es totalmente personalizable, lo que permite a las organizaciones poseer, ajustar e implementar modelos en cualquier lugar donde se ejecute el agente, manteniendo al mismo tiempo el control sobre el comportamiento del modelo, el procesamiento de datos y la implementación.
Nemotron 3.5 Lightning ahora lanzado en Ubuntu
Canonical permite el acceso a Nemotron 3.5 Lightning en el lanzamiento a través de instantáneas de inferencia: tiempos de ejecución de inferencia de IA preempaquetados y distribuidos como paquetes de instantáneas para una implementación consistente en todos los sistemas. Los desarrolladores y las empresas pueden implementar modelos en plataformas NVIDIA compatibles con un solo comando:
sudo snap install nemotron-3-5-lightningLas instantáneas de inferencia convierten las implementaciones de Nemotron 3.5 Lightning en operaciones simples y estandarizadas. Este tiempo de ejecución listo para producción se escala de manera consistente en estaciones de trabajo, dispositivos perimetrales y servidores, lo que permite a los equipos concentrarse en crear agentes de IA en lugar de administrar la infraestructura. Los usuarios que implementan Nemotron 3.5 Lightning a través de instantáneas de inferencia pueden beneficiarse de:
- 1 millón de ventanas de contexto de token: las ventanas de contexto de Nemotron permiten agentes de IA autónomos y persistentes que mantienen el contexto en flujos de trabajo de varios pasos y de larga duración.
- Arquitectura MoE híbrida de alto rendimiento: Nemotron 3.5 Lightning presenta un modelo de mezcla de expertos 30B con parámetros activos 3B, que se deriva del Nemotron 3 Ultra de vanguardia de NVIDIA.
- Tiempo de ejecución consistente en todos los entornos: las instantáneas de inferencia garantizan un comportamiento idéntico en la nube, en las instalaciones y en los sistemas perimetrales.
- Simplifique las operaciones: los conjuntos de complementos estandarizados reducen la complejidad del mantenimiento, la aplicación de parches y las actualizaciones.
- Ejecución segura y restringida: aislamiento estricto mediante actualizaciones automatizadas y distribución verificada
Para las empresas, esto significa tiempos de implementación significativamente más rápidos, ahorrando semanas de trabajo de integración y validación y permitiendo una infraestructura de IA escalable desde un único artefacto portátil.
aprender más:









