s
INTELIGÊNCIA ARTIFICIAL

Pequenos Modelos de Linguagem: Por que menor às vezes é melhor

A nova tendência para o mercado de inteligência artificial são os Pequenos Modelos de Linguagem, que cativou empresas como Hugging Face, Mistral AI, Nvidia e OpenAI, entre outros.

Esta semana marca mais uma tendência em IA com o surgimento de pequenos modelos de linguagem da Hugging Face, Mistral AI, Nvidia e OpenAI, entre outros. Essas e outras empresas estão voltando sua atenção para modelos menos potentes, esperando que custos mais baixos e desempenho sólido conquistem mais clientes.

Devemos esperar ver modelos 100 vezes menores e mais baratos nos próximos um a dois anos. "Em cinco, eles se tornarão mais eficientes, os LLMs continuarão a se tornar mais baratos de treinar e a inferência de LLM se tornará generalizada”, profetizou Bindu Reddy, a CEO da Abacus.AI.

Na prática, começa a ficar muito claro que, para muitas tarefas, como resumir documentos ou gerar imagens, modelos grandes podem ser um exagero. Como consequência, os consumidores têm buscado maneiras de executar tecnologia generativa baseada em IA de forma mais barata, principalmente nessa fase em que os retornos do investimento em IA Generativa ainda não são claros. Como os Small Language Models (SLMs) usam menos poder de computação, eles podem responder perguntas por apenas um sexto do custo de modelos de linguagem grandes em muitos casos, calcula Yoav Shoham, cofundador da AI21 Labs.

Este é um conteúdo exclusivo para assinantes.

Cadastre-se grátis para ler agora
e acesse 5 conteúdos por mês.

É assinante ou já tem senha? Faça login. Já recebe a newsletter? Ative seu acesso.

A IA limpa o código e esconde as falhas

Inteligência Artificial

A IA limpa o código e esconde as falhas

Estudos apontam menos erros de sintaxe sem avanço equivalente em segurança. O desafio é medir quanto da velocidade de programação resiste ao custo de revisar, corrigir e manter o software.

A IA não vai morar em um lugar só

Inteligência Artificial

A IA não vai morar em um lugar só

Agentes multiplicam a inferência. Custo, latência, privacidade e continuidade decidem onde ela vai acontecer.

O que trava a empresa AI-first

Inteligência Artificial

O que trava a empresa AI-first

Dados do BCG e da MIT Sloan Management Review mostram que a ambição de IA no C-level corre à frente das duas frentes necessárias para sustentá-la: a arquitetura de dados e a competência das equipes. E nenhuma delas tem responsável cl...

Caixa apertado, IA em ascensão: os sinais do agricultor latino-americano em 2026

Inteligência Artificial

Caixa apertado, IA em ascensão: os sinais do agricultor latino-americ...

Estudo global da consultoria mostra produtores cortando gastos com fertilizante e maquinário, adotando biológicos e testando IA Generativa

Desaceleração da IA: uma aposta arriscada

Inteligência Artificial

Desaceleração da IA: uma aposta arriscada

Quanto mais capital depende da velocidade da fronteira, maior o custo econômico de pisar no freio.

Pensamento crítico vale mais na era da IA no trabalho

Inteligência Artificial

Pensamento crítico vale mais na era da IA no trabalho

Pesquisa da WSJ Intelligence e da PMI com 2.507 profissionais mostra que, quanto mais a IA avança no trabalho, mais valiosos ficam julgamento, criatividade e pensamento crítico humanos