Dois artigos de pesquisa recém-publicados podem significar muito para a arquitetura central dos Transformers, de modo a garantir a eles uma memória de longo prazo, torná-los melhores em lidar com contextos mais longos e se tornarem mais eficientes. Você confiaria mais na IA se os LLMs se lembrassem de conversas anteriores, aprendessem com elas e citassem as fontes? Pois é.
A proposta de pesquisadores da Sakana AI e do Institute of Science Tokyo é o Transformer², um framework de autoadaptação projetado para melhorar o desempenho dos LLMs, abrindo caminho para sistemas de IA dinâmicos e auto-organizados. Diferentemente dos sistemas de IA tradicionais que são pré-treinados para tarefas específicas, o Transformer² ajusta dinamicamente suas configurações internas para lidar com diversos desafios, que vão desde
Modelos autoadaptativos visam solucionar os desafios apresentados pelos métodos tradicionais de ajuste fino, que geralmente são computacionalmente intensivos e estáticos em sua capacidade de lidar com diversas tarefas. Para desenvolver o Transformers², a equipe de IA da Sakana se inspirou em como o cérebro humano se reconecta após uma lesão. Primeiro, o modelo analisa a tarefa recebida para entender seus requisitos antes de tentar aprender; então, se ajusta dinamicamente e fornece resultados personalizados para essa tarefa.
Este é um conteúdo exclusivo para assinantes.
Cadastre-se grátis para ler agora
e acesse 5 conteúdos por mês.
É assinante ou já tem senha? Faça login. Já recebe a newsletter? Ative seu acesso.
Para potências médias e empresas, isso significa escolher quais renúncias são aceitáveis.
Em manifesto recém-publicado, Zuckerberg defende que distribuir superinteligência é o que nos torna seguros. No mesmo dia, a Meta abriu os pesos do seu modelo menor e manteve o maior fechado.
Pesquisa da Okta com 306 CISOs mostra que a infraestrutura de identidade é, ao mesmo tempo, o problema e a solução para controlar agentes de IA dentro das empresas
Modelos de linguagem genômica já conseguem projetar genomas virais funcionais. O avanço promete novas terapias e muda a escala do debate sobre biossegurança.
Apenas de 10% a 20% das tarefas empresariais exigem os modelos mais poderosos. O roteamento multimodelo transforma essa diferença em economia.
Tem mais: a IA já entrou na avaliação de desempenho dos CEOs, mas ainda não entrou nos sistemas que medem esse desempenho.
Aproveite nossas promoções de renovação
Clique aquiPara continuar navegando como visitante, vá por aqui.
Cadastre-se grátis, leia até 5 conteúdos por mês,
e receba nossa newsletter diária.
Já recebe a newsletter? Ative seu acesso
