s
INTELIGÊNCIA ARTIFICIAL

A quantidade de parâmetros pode deixar de ser referência para os LLMs

Segundo Sam Altman, CEO da OpenAI, estamos no fim da era dos modelos gigantescos. A indústria vai torná-los melhores de outras maneiras

Modelos de linguagem cada vez maiores não são o futuro. Pelo menos não na visão do CEO da OpenAI, Sam Altman. “Acho que estamos no fim da era desses modelos gigantes, e vamos torná-los melhores de outras maneiras”, disse ele na semana passada, durante um evento do MIT. "É melhor focar em aumentar rapidamente a capacidade, em vez de na contagem de parâmetros", explicou.

Altman já havia dito algo parecido durante sua conversa com Lex Fridman, publicada aqui semanas atrás. A ideia é obter melhorias de capacidade com contagens de parâmetros mais baixas ou aproveitando vários modelos menores juntos. O que sugere que o GPT-4 pode ser o último avanço da IA fruto da estratégia de tornar os modelos maiores e alimentá-los com mais dados. Infelizmente, Altman não detalhou as estratégias ou técnicas de pesquisa que poderiam substituí-la. "Existem muitas maneiras de tornar os modelos Transformers melhores e mais úteis, e muitas delas não envolvem a adição de parâmetros ao modelo", concorda Nick Frostst, da Cohere.

A questão é quanto progresso virá de novos designs de modelos, arquiteturas, aprimoramento da eficiência de dados, avanço de técnicas algorítmicas ou ajuste adicional, propostos por muitos. Técnicas como as dos modelos ajustados para tarefas específicas provavelmente trarão progresso, mas talvez nada parecido com o que vimos nos últimos anos. A esperança é que mantenham o ritmo, reduzindo o custo de desenvolvimento.

Este é um conteúdo exclusivo para assinantes.

Cadastre-se grátis para ler agora
e acesse 5 conteúdos por mês.

É assinante ou já tem senha? Faça login. Já recebe a newsletter? Ative seu acesso.

Só 47% dos CISOs sabem onde estão seus agentes de IA

Inteligência Artificial

Só 47% dos CISOs sabem onde estão seus agentes de IA

Pesquisa da Okta com 306 CISOs mostra que a infraestrutura de identidade é, ao mesmo tempo, o problema e a solução para controlar agentes de IA dentro das empresas

A IA começou a escrever genomas

Inteligência Artificial

A IA começou a escrever genomas

Modelos de linguagem genômica já conseguem projetar genomas virais funcionais. O avanço promete novas terapias e muda a escala do debate sobre biossegurança.

Mandar tudo para o modelo mais forte é onde a conta da IA estoura

Inteligência Artificial

Mandar tudo para o modelo mais forte é onde a conta da IA estoura

Apenas de 10% a 20% das tarefas empresariais exigem os modelos mais poderosos. O roteamento multimodelo transforma essa diferença em economia.

O conselho cobra ROI de IA. Poucas empresas medem

Inteligência Artificial

O conselho cobra ROI de IA. Poucas empresas medem

Tem mais: a IA já entrou na avaliação de desempenho dos CEOs, mas ainda não entrou nos sistemas que medem esse desempenho.

O erro não foi da IA. O modelo fez o que mandaram. Ninguém previu o resultado

Inteligência Artificial

O erro não foi da IA. O modelo fez o que mandaram. Ninguém previu o...

Agentes da OpenAI escaparam do teste, invadiram a Hugging Face e roubaram o gabarito errado. O episódio expõe as três perguntas que toda empresa deveria fazer: quem autoriza, quem monitora, quem desliga.

Cibersegurança em transição: como a IA está redesenhando cargos da base ao topo

Inteligência Artificial

Cibersegurança em transição: como a IA está redesenhando cargos da...

Um estudo doa ISC2 com 856 profissionais mostra que a IA já corta tarefas de entrada em segurança digital, mas também amplia o tempo dedicado à validação humana, ao estresse no trabalho e à criação de novas funções na área