De acordo com o monitoramento da Beating, a NVIDIA lançou o modelo de código aberto Nemotron 3.5 Lightning, projetado especificamente para realizar tarefas de execução prolongada por Agentes. O modelo possui 30 bilhões de parâmetros totais, com apenas 3 bilhões ativados por token, sendo responsável principalmente por tarefas de alta frequência, como chamadas de ferramentas, verificação de resultados e agendamento de sub-Agentes. A abordagem da NVIDIA é dividir as funções dos Agentes de forma mais aprofundada: planejamentos complexos são atribuídos a modelos maiores como o Nemotron 3 Ultra, enquanto a execução repetitiva em larga escala é delegada ao Lightning. A empresa afirma que sua velocidade de saída pode chegar a quatro vezes a de modelos da mesma categoria. No PinchBench, o Lightning atingiu 86% de precisão e, com precisão semelhante, concluiu 10 mil tarefas 30% mais rápido que o Qwen3.6 35B. O modelo utiliza arquitetura MoE, foi treinado especificamente para Agent Harness e incorpora previsão de múltiplos tokens e decodificação especulativa. A NVIDIA fornece pesos em BF16 e NVFP4, permitindo execução em dispositivos locais como RTX 5090 e DGX Spark, além de suporte a llama.cpp, Ollama, LM Studio e Unsloth. Também enfatiza a personalizabilidade: a NVIDIA disponibilizou os pesos, parte dos dados de treinamento e as receitas de treinamento, permitindo que empresas realizem pós-treinamento para tarefas específicas como código, segurança e direito. Casos apresentados pela empresa mostram que, após o pós-treinamento, o Lightning obteve melhorias significativas em várias tarefas profissionais.
NVIDIA abre o código do Nemotron 3.5 Lightning para execução de ferramentas de agente
MarsBitCompartilhar
A NVIDIA lança o Nemotron 3.5 Lightning como código aberto, otimizado para execução de ferramentas de agentes em ambientes de notícias on-chain. O modelo possui 30 bilhões de parâmetros ativos por token e opera quatro vezes mais rápido que modelos semelhantes. Alcança 86% de precisão no PinchBench e conclui 10.000 tarefas 30% mais rápido que o Qwen3.6 35B. Desenvolvido com arquitetura MoE, suporta múltiplas plataformas e oferece pesos abertos para treinamento. Novas listagens de tokens podem se beneficiar de sua velocidade e opções de personalização.
Fonte:Mostrar original
Aviso legal: as informações nesta página podem ter sido obtidas de terceiros e não refletem necessariamente os pontos de vista ou opiniões da KuCoin. Este conteúdo é fornecido apenas para fins informativos gerais, sem qualquer representação ou garantia de qualquer tipo, nem deve ser interpretado como aconselhamento financeiro ou de investimento. A KuCoin não é responsável por quaisquer erros ou omissões, ou por quaisquer resultados do uso destas informações.
Os investimentos em ativos digitais podem ser arriscados. Avalie cuidadosamente os riscos de um produto e a sua tolerância ao risco com base nas suas próprias circunstâncias financeiras. Para mais informações, consulte nossos termos de uso e divulgação de risco.