aiexpert
Inicio / Noticias / Nota
Chips · 08 jul 2026, 15:33 · 1 fuente

NVIDIA Nemotron 3 Ultra iguala desempeño de modelos cerrados a 10x menor costo vía ajuste de harness LangChain

NVIDIA Nemotron 3 Ultra ha logrado desempeño líder en benchmark en la suite de pruebas Deep Agents de LangChain sin reentrenamiento de modelo, ejecutándose a 10x menor costo de inferencia que modelos cerrados líderes y entregando paridad de tareas comerciales con modelos propietarios de mayor puntuación. LangChain ajustó su harness Deep Agents—no el modelo mismo—al optimizar prompts del sistema, descripciones de herramientas y middleware alrededor del Nemotron 3 Ultra. Cada ganancia provino de ingeniería del entorno en lugar de ajuste fino, y el perfil optimizado ahora está disponible directamente en LangChain.

LangChain tiene 200+ millones de descargas mensuales y con este ajuste ofrece a las empresas un stack completamente abierto combinando el modelo Nemotron 3 Ultra ajustado, código de orquestación LangChain Deep Agents y el runtime seguro OpenShell de NVIDIA para ejecución segura de acciones de agente. Los primeros adoptantes incluyen Abridge, Amdocs, Box e integrador de sistemas global EY, quienes están incorporando agentes especializados directamente en plataformas y expandiendo capacidades de implementación NVIDIA. La arquitectura—modelo abierto, harness abierto, runtime abierto—permite a las empresas poseer y personalizar el stack completo de punta a punta.

Nemotron 3 Ultra está disponible hoy a través de plataformas hospedadas incluyendo Baseten, Crusoe Cloud, DeepInfra, Fireworks, Nebius y Together AI. El blueprint ajustado (NVIDIA NemoClaw para LangChain Deep Agents) está disponible ahora, dirigido al cambio de asistentes de IA que responden preguntas a agentes que toman acciones dentro de sistemas comerciales centrales—trabajo de mayores riesgos requiriendo propiedad de stack completo.

Fuentes

Todo lo que sostiene esta nota
  1. 01 Primary source blogs.nvidia.com