s
INTELIGÊNCIA ARTIFICIAL

O futuro dos Transformers na IA e sua evolução

Estudos mostram que memória de longo prazo para Transformers permite lidar com contextos mais longos

Dois artigos de pesquisa recém-publicados podem significar muito para a arquitetura central dos Transformers, de modo a garantir a eles uma memória de longo prazo, torná-los melhores em lidar com contextos mais longos e se tornarem mais eficientes. Você confiaria mais na IA se os LLMs se lembrassem de conversas anteriores, aprendessem com elas e citassem as fontes? Pois é.

A proposta de pesquisadores da Sakana AI e do Institute of Science Tokyo é o Transformer², um framework de autoadaptação projetado para melhorar o desempenho dos LLMs, abrindo caminho para sistemas de IA dinâmicos e auto-organizados. Diferentemente dos sistemas de IA tradicionais que são pré-treinados para tarefas específicas, o Transformer² ajusta dinamicamente suas configurações internas para lidar com diversos desafios, que vão desde

  • Matemática: resolver problemas complexos com precisão.
  • Codificação: auxiliar desenvolvedores com geração e depuração de código.
  • Raciocínio: enfrentar desafios lógicos com proficiência semelhante à humana.
  • Compreensão visual: analisar imagens e padrões complexos de forma efetiva.

Modelos autoadaptativos visam solucionar os desafios apresentados pelos métodos tradicionais de ajuste fino, que geralmente são computacionalmente intensivos e estáticos em sua capacidade de lidar com diversas tarefas. Para desenvolver o Transformers², a equipe de IA da Sakana se inspirou em como o cérebro humano se reconecta após uma lesão. Primeiro, o modelo analisa a tarefa recebida para entender seus requisitos antes de tentar aprender; então, se ajusta dinamicamente e fornece resultados personalizados para essa tarefa.

Este é um conteúdo exclusivo para assinantes.

Cadastre-se grátis para ler agora
e acesse 5 conteúdos por mês.

É assinante ou já tem senha? Faça login. Já recebe a newsletter? Ative seu acesso.

O que trava a empresa AI-first

Inteligência Artificial

O que trava a empresa AI-first

Dados do BCG e da MIT Sloan Management Review mostram que a ambição de IA no C-level corre à frente das duas frentes necessárias para sustentá-la: a arquitetura de dados e a competência das equipes. E nenhuma delas tem responsável cl...

Caixa apertado, IA em ascensão: os sinais do agricultor latino-americano em 2026

Inteligência Artificial

Caixa apertado, IA em ascensão: os sinais do agricultor latino-americ...

Estudo global da consultoria mostra produtores cortando gastos com fertilizante e maquinário, adotando biológicos e testando IA Generativa

Desaceleração da IA: uma aposta arriscada

Inteligência Artificial

Desaceleração da IA: uma aposta arriscada

Quanto mais capital depende da velocidade da fronteira, maior o custo econômico de pisar no freio.

Pensamento crítico vale mais na era da IA no trabalho

Inteligência Artificial

Pensamento crítico vale mais na era da IA no trabalho

Pesquisa da WSJ Intelligence e da PMI com 2.507 profissionais mostra que, quanto mais a IA avança no trabalho, mais valiosos ficam julgamento, criatividade e pensamento crítico humanos

Como construir uma cultura forte de segurança cibernética na empresa

Inteligência Artificial

Como construir uma cultura forte de segurança cibernética na empresa

A nova edição do estudo do SANS Institute mostra como fazer a correlação entre profissionais dedicados no time de cibersegurança e o número de pessoas na empresa para mudar a cultura

Cibersegurança é um dos maiores riscos à soberania digital

Inteligência Artificial

Cibersegurança é um dos maiores riscos à soberania digital

Levantamento da Capgemini com 1.300 executivos mostra que cibersegurança é a dimensão mais associada a risco operacional na disputa por controle sobre dados, nuvem e IA