NVIDIA Nemotron Alcança Performance Líder em Benchmarks com o Harness Deep Agents da LangChain

O ajuste do harness LangChain Deep Agents para o NVIDIA Nemotron 3 Ultra entrega performance líder e conclusão de tarefas mais rápida em um stack aberto que as empresas podem executar, personalizar e controlar.
por

O NVIDIA Nemotron 3 Ultra oferece performance líder a um custo menor do que os principais modelos fechados, na maior e mais adotada plataforma de orquestração de agentes de IA.

A LangChain ajustou seu harness Deep Agents para o NVIDIA Nemotron 3 Ultra e alcançou a maior precisão entre os modelos abertos, concluindo mais tarefas com throughput maior e operando com custo de inferência por execução 10x menor do que os principais modelos fechados.

No benchmark Deep Agents da LangChain, o Nemotron 3 Ultra também atingiu paridade em tarefas de negócio com os modelos fechados de maior pontuação. Não foi necessário retreinar o modelo. Todo o ganho veio da engenharia do ambiente ao redor do modelo, não do modelo em si.

Com um décimo do custo, as equipes que usam o NVIDIA Nemotron 3 Ultra podem rodar avaliações continuamente, experimentar mais rápido e criar agentes especializados em mais áreas do negócio.

A plataforma de engenharia de agentes da LangChain tem mais de 200 milhões de downloads mensais. Ao ajustar o harness Deep Agents especificamente para o NVIDIA Nemotron 3 Ultra, ela viabiliza agentes de alta performance, que concluem mais tarefas, rodam mais rápido e dão às empresas um stack totalmente aberto para personalizar, ter como próprio e executar em qualquer lugar.

“O caminho para construir agentes melhores é continuar aprimorando o sistema ao redor do modelo”, disse Harrison Chase, cofundador e CEO da LangChain. “Memória, uso de ferramentas, avaliação e comportamento do modelo se potencializam quando as equipes conseguem ajustá-los em conjunto. Nosso trabalho com a NVIDIA mostra que as empresas podem obter uma performance forte de um stack aberto e, ao mesmo tempo, manter o controle sobre os sistemas de agentes que estão construindo.”

Abridge, Amdocs e Box estão incorporando agentes especializados diretamente em suas plataformas, e a EY, integradora global de sistemas, está ampliando sua capacidade de implementação NVIDIA em torno dos blueprints NVIDIA NemoClaw para LangChain Deep Agents, ajudando clientes a personalizar, avaliar e governar agentes especializados em workflows de alto valor.

O fundador e CEO da NVIDIA, Jensen Huang, conversou recentemente com Chase sobre por que os últimos seis meses trouxeram um salto em IA útil para as empresas.

Engenharia de Harness, Não Fine-Tuning

A equipe da LangChain executou o Nemotron 3 Ultra na sua suíte pública de benchmark Deep Agents e depois analisou os traces de execução do deep agent para descobrir exatamente onde ele perdia pontos. Em vez de retreinar o modelo, a equipe ajustou o harness ao redor dele: system prompts, descrições de ferramentas e middleware.

Qualquer desenvolvedor que use o LangChain Deep Agents com o Nemotron 3 Ultra já pode colocar isso em prática hoje: o perfil ajustado está disponível diretamente pela LangChain.

Um Stack Aberto Feito para Ser Seu

O NVIDIA NemoClaw para LangChain Deep Agents é o blueprint aberto de referência que empacota esse trabalho para empresas que constroem sua própria IA especializada: sistemas de modelos, ferramentas e runtime, ajustados para seus próprios workflows. Ele combina o LangChain Deep Agents Code, ajustado para o Nemotron 3 Ultra, com o runtime seguro NVIDIA OpenShell para executar ações de agentes com segurança.

Um modelo aberto, um harness aberto e um runtime seguro aberto significam que as empresas são donas do stack inteiro, de ponta a ponta. Elas podem personalizá-lo em torno da expertise que diferencia o negócio, seguir aprimorando e executar onde quiserem: infraestrutura própria, nuvem própria, governança própria.

Essa distinção pesa mais à medida que os agentes assumem tarefas de maior risco. A mudança de assistentes de IA que respondem perguntas para agentes que agem dentro dos sistemas centrais altera o que as empresas obtêm da sua IA.

O NemoClaw para LangChain Deep Agents e o perfil ajustado do modelo Nemotron 3 Ultra já estão disponíveis. Os desenvolvedores podem baixar o harness Deep Agents ajustado diretamente da LangChain ou usar o blueprint NemoClaw para LangChain Deep Agents como ponto de partida para criar agentes especializados do zero.

Como Começar

Os desenvolvedores LangChain podem acessar o Nemotron 3 Ultra nas plataformas Baseten, Crusoe Cloud, DeepInfra, Fireworks, Nebius e Together AI, o que dá um caminho direto e hospedado para levar o harness ajustado à produção.

A EY pode ajudar as empresas a começar a construir seus próprios agentes especializados hoje, usando esse stack de software aberto.

Saiba mais sobre o NVIDIA NemoClaw para LangChain Deep Agents e o NVIDIA Nemotron.