source avatarMinty

Compartilhar

Correias podem desbloquear sistemas de IA mais poderosos? Pesquisadores desenvolveram uma nova correia que permite que modelos existentes manipulem fluxos de trabalho mais longos e complexos. O Modelo de Linguagem Recursivo (RLM) mantém arquivos grandes e conjuntos de dados fora do contexto principal do modelo. O modelo usa código para selecionar peças relevantes, enviar cada uma por meio de uma solicitação de modelo separada e combinar os resultados. Isso difere das sessões regulares, onde arquivos, saídas de ferramentas e resultados se acumulam em um único contexto. À medida que o contexto cresce, os modelos podem começar a perder o rastro de detalhes importantes. Para testar se essa estrutura também melhora o aprendizado, os pesquisadores usaram RL para treinar o Qwen3-30B dentro de uma correia RLM fixa, usando apenas tarefas curtas, e depois avaliaram-no em tarefas 8 a 32 vezes mais longas. Nas avaliações mais longas, o modelo treinado com RLM mostrou melhora substancial, enquanto o mesmo modelo treinado sem a correia geralmente apresentou pouco progresso. Em experimentos separados, ele também aplicou as mesmas estratégias em novos domínios que exigiam etapas subjacentes semelhantes.

No.0 picture
Aviso legal: as informações nesta página podem ter sido obtidas de terceiros e não refletem necessariamente os pontos de vista ou opiniões da KuCoin. Este conteúdo é fornecido apenas para fins informativos gerais, sem qualquer representação ou garantia de qualquer tipo, nem deve ser interpretado como aconselhamento financeiro ou de investimento. A KuCoin não é responsável por quaisquer erros ou omissões, ou por quaisquer resultados do uso destas informações. Os investimentos em ativos digitais podem ser arriscados. Avalie cuidadosamente os riscos de um produto e a sua tolerância ao risco com base nas suas próprias circunstâncias financeiras. Para mais informações, consulte nossos termos de uso e divulgação de risco.