aiexpert
Início / Notícias / Nota
Chips · 08 de jul. de 2026, 15:33 · 1 fonte

NVIDIA Nemotron 3 Ultra atinge desempenho de modelos fechados a 10x menor custo via ajuste de harness LangChain

NVIDIA Nemotron 3 Ultra alcançou desempenho líder de benchmark na suite de testes Deep Agents do LangChain sem retreinamento de modelo, rodando a 10x menor custo de inferência do que modelos fechados líderes e entregando paridade de tarefas comerciais com modelos proprietários de maior pontuação. LangChain ajustou seu harness Deep Agents—não o modelo em si—ao otimizar prompts do sistema, descrições de ferramentas e middleware ao redor do Nemotron 3 Ultra. Todo ganho veio de engenharia de ambiente em vez de ajuste fino, e o perfil otimizado agora está disponível diretamente no LangChain.

LangChain tem 200+ milhões de downloads mensais e com este ajuste oferece às empresas um stack completamente aberto combinando o modelo Nemotron 3 Ultra ajustado, código de orquestração LangChain Deep Agents e o runtime seguro OpenShell da NVIDIA para execução segura de ações de agente. Os primeiros adotantes incluem Abridge, Amdocs, Box e a integradora de sistemas global EY, que estão incorporando agentes especializados diretamente em plataformas e expandindo capacidades de implementação NVIDIA. A arquitetura—modelo aberto, harness aberto, runtime aberto—permite que empresas possuam e customizem o stack completo de ponta a ponta.

Nemotron 3 Ultra está disponível hoje através de plataformas hospedadas incluindo Baseten, Crusoe Cloud, DeepInfra, Fireworks, Nebius e Together AI. O blueprint ajustado (NVIDIA NemoClaw para LangChain Deep Agents) está disponível agora, direcionando a mudança de assistentes de IA que respondem perguntas para agentes que tomam ações dentro de sistemas comerciais centrais—trabalho de maiores apostas exigindo propriedade de stack completo.

Fontes

Tudo que sustenta esta nota
  1. 01 Primary source blogs.nvidia.com