Dois artigos de pesquisa recém-publicados podem significar muito para a arquitetura central dos Transformers, de modo a garantir a eles uma memória de longo prazo, torná-los melhores em lidar com contextos mais longos e se tornarem mais eficientes. Você confiaria mais na IA se os LLMs se lembrassem de conversas anteriores, aprendessem com elas e citassem as fontes? Pois é.
A proposta de pesquisadores da Sakana AI e do Institute of Science Tokyo é o Transformer², um framework de autoadaptação projetado para melhorar o desempenho dos LLMs, abrindo caminho para sistemas de IA dinâmicos e auto-organizados. Diferentemente dos sistemas de IA tradicionais que são pré-treinados para tarefas específicas, o Transformer² ajusta dinamicamente suas configurações internas para lidar com diversos desafios, que vão desde
Modelos autoadaptativos visam solucionar os desafios apresentados pelos métodos tradicionais de ajuste fino, que geralmente são computacionalmente intensivos e estáticos em sua capacidade de lidar com diversas tarefas. Para desenvolver o Transformers², a equipe de IA da Sakana se inspirou em como o cérebro humano se reconecta após uma lesão. Primeiro, o modelo analisa a tarefa recebida para entender seus requisitos antes de tentar aprender; então, se ajusta dinamicamente e fornece resultados personalizados para essa tarefa.
Este é um conteúdo exclusivo para assinantes.
Cadastre-se grátis para ler agora
e acesse 5 conteúdos por mês.
É assinante ou já tem senha? Faça login. Já recebe a newsletter? Ative seu acesso.
Conversas com IA já podem ser auditadas, pesquisadas e usadas como prova. As empresas agora precisam decidir quanto desse material querem guardar.
Três estudos sobre o futuro chegam a um diagnóstico parecido: a IA virou infraestrutura, mas esbarra em limites de energia, recursos, demografia e confiança
A China puxa a instalação recorde de robôs industriais, enquanto investidores apostam em robôs de uso geral e num "momento GPT-3" da IA Física em cerca de um ano
Por que a IA não precisa falar, nem ser cara, para ser útil
Estudos apontam menos erros de sintaxe sem avanço equivalente em segurança. O desafio é medir quanto da velocidade de programação resiste ao custo de revisar, corrigir e manter o software.
Agentes multiplicam a inferência. Custo, latência, privacidade e continuidade decidem onde ela vai acontecer.
Aproveite nossas promoções de renovação
Clique aquiPara continuar navegando como visitante, vá por aqui.
Cadastre-se grátis, leia até 5 conteúdos por mês,
e receba nossa newsletter diária.
Já recebe a newsletter? Ative seu acesso
