es.wedoany.com Noticia: El 11 de agosto, varios empleados que participan en el proyecto Nemotron 4 de NVIDIA revelaron que esta empresa de chips estadounidense está desarrollando una nueva generación de la familia de modelos de inteligencia artificial de código abierto, y se espera que el modelo más grande tenga al menos 1 billón de parámetros. NVIDIA reiteró ese mismo día que está avanzando en la investigación y desarrollo de Nemotron 4, pero no confirmó la escala de parámetros mencionada ni la fecha de lanzamiento.

Nemotron 4 aún no ha completado su entrenamiento final, y NVIDIA tampoco ha establecido una fecha oficial de lanzamiento. Los empleados que participan en el proyecto estiman que la serie de modelos podría estar lista a finales del otoño de 2026 como muy pronto, con el objetivo de competir con los principales modelos de código abierto a nivel mundial.
El modelo más grande de la serie Nemotron 3 de NVIDIA es actualmente el Nemotron 3 Ultra, que utiliza una arquitectura de mezcla de expertos y Mamba-Attention, con 550 mil millones de parámetros totales y 55 mil millones de parámetros activados por token. Este modelo se preentrenó con 20 billones de tokens de texto y admite una ventana de contexto de hasta 1 millón de tokens.
El 11 de agosto, NVIDIA también lanzó Nemotron 3.5 Lightning. Este modelo tiene 30 mil millones de parámetros totales y 3 mil millones de parámetros activados, y puede utilizarse para tareas de agentes como revisión de código, invocación de herramientas y monitoreo de alertas de seguridad, y ya está listo para uso comercial.





















