s
INTELIGÊNCIA ARTIFICIAL

Pequenos Modelos de Linguagem: Por que menor às vezes é melhor

A nova tendência para o mercado de inteligência artificial são os Pequenos Modelos de Linguagem, que cativou empresas como Hugging Face, Mistral AI, Nvidia e OpenAI, entre outros.

Esta semana marca mais uma tendência em IA com o surgimento de pequenos modelos de linguagem da Hugging Face, Mistral AI, Nvidia e OpenAI, entre outros. Essas e outras empresas estão voltando sua atenção para modelos menos potentes, esperando que custos mais baixos e desempenho sólido conquistem mais clientes.

Devemos esperar ver modelos 100 vezes menores e mais baratos nos próximos um a dois anos. "Em cinco, eles se tornarão mais eficientes, os LLMs continuarão a se tornar mais baratos de treinar e a inferência de LLM se tornará generalizada”, profetizou Bindu Reddy, a CEO da Abacus.AI.

Na prática, começa a ficar muito claro que, para muitas tarefas, como resumir documentos ou gerar imagens, modelos grandes podem ser um exagero. Como consequência, os consumidores têm buscado maneiras de executar tecnologia generativa baseada em IA de forma mais barata, principalmente nessa fase em que os retornos do investimento em IA Generativa ainda não são claros. Como os Small Language Models (SLMs) usam menos poder de computação, eles podem responder perguntas por apenas um sexto do custo de modelos de linguagem grandes em muitos casos, calcula Yoav Shoham, cofundador da AI21 Labs.

Este é um conteúdo exclusivo para assinantes.

Cadastre-se grátis para ler agora
e acesse 5 conteúdos por mês.

É assinante ou já tem senha? Faça login. Já recebe a newsletter? Ative seu acesso.

A volta ao tecnonacionalismo e suas implicações sobre a soberania digital

Inteligência Artificial

A volta ao tecnonacionalismo e suas implicações sobre a soberania di...

Para potências médias e empresas, isso significa escolher quais renúncias são aceitáveis.

Por Philipe Moura*, especial para The Shift
Distribuir IA é distribuir poder?

Inteligência Artificial

Distribuir IA é distribuir poder?

Em manifesto recém-publicado, Zuckerberg defende que distribuir superinteligência é o que nos torna seguros. No mesmo dia, a Meta abriu os pesos do seu modelo menor e manteve o maior fechado.

Só 47% dos CISOs sabem onde estão seus agentes de IA

Inteligência Artificial

Só 47% dos CISOs sabem onde estão seus agentes de IA

Pesquisa da Okta com 306 CISOs mostra que a infraestrutura de identidade é, ao mesmo tempo, o problema e a solução para controlar agentes de IA dentro das empresas

A IA começou a escrever genomas

Inteligência Artificial

A IA começou a escrever genomas

Modelos de linguagem genômica já conseguem projetar genomas virais funcionais. O avanço promete novas terapias e muda a escala do debate sobre biossegurança.

Mandar tudo para o modelo mais forte é onde a conta da IA estoura

Inteligência Artificial

Mandar tudo para o modelo mais forte é onde a conta da IA estoura

Apenas de 10% a 20% das tarefas empresariais exigem os modelos mais poderosos. O roteamento multimodelo transforma essa diferença em economia.

O conselho cobra ROI de IA. Poucas empresas medem

Inteligência Artificial

O conselho cobra ROI de IA. Poucas empresas medem

Tem mais: a IA já entrou na avaliação de desempenho dos CEOs, mas ainda não entrou nos sistemas que medem esse desempenho.