s
INTELIGÊNCIA ARTIFICIAL

Estamos entrando na era da “IA faz-tudo”

Nos próximos anos, a multimodalidade será norma para os LLMs, que vão ser treinados para responder a prompts de texto, imagem, código, voz e vídeo.

Anote aí: a multimodalidade será a norma da próxima era dos grandes modelos de linguagem (os LLMs). O que significa que eles serão treinados para lidar com combinações de texto, imagem, vídeo e prompts de código, abrindo muitos novos casos de uso e experiências de usuário. A OpenAI já trabalha nessa direção. E, não por acaso, o Google criou o Gemini para ser multimodal desde o lançamento.

"A IA multimodal se tornará o padrão, mesmo para aplicativos regulares de chatbot”, opina Robert Nishihara, CEO da Anyscale, a empresa por trás da estrutura de desenvolvimento Ray, que impulsionou grande parte do boom da IA Generativa.

O pulo do gato será a criação de LLMs multimodais desde sua concepção, exigindo mudanças ao nível de arquitetura. Embora já existam alguns modelos multimodais hoje, os recursos para lidar com diferentes tipos de dados foram costurados em cima de LLMs baseados em texto. Pesquisadores chineses endereçam bem essa necessidade de mudança de arquitetura em um paper apresentando o OneLLM, um grande modelo de linguagem multimodal (MLLM) que suporta oito modalidades diferentes de dados. Ficou curioso? Experimente a partir do que já foi liberado sobre o OneLLM no GitHub.

Este é um conteúdo exclusivo para assinantes.

Cadastre-se grátis para ler agora
e acesse 5 conteúdos por mês.

É assinante ou já tem senha? Faça login. Já recebe a newsletter? Ative seu acesso.

Robôs humanoides podem rivalizar com trabalho humano até 2030

Inteligência Artificial

Robôs humanoides podem rivalizar com trabalho humano até 2030

Com IA Generativa, custo em queda e mobilidade avançada, humanoides devem ganhar força na indústria e nas residências, de acordo com estudo

Protocolo A2A quer resolver a interoperabilidade entre agentes de IA

Inteligência Artificial

Protocolo A2A quer resolver a interoperabilidade entre agentes de IA

Nova padronização entre agentes lançada pelo Google promete reduzir custos e acelerar inovações

Guerra do futuro será travada por chips, genes e códigos

Inteligência Artificial

Guerra do futuro será travada por chips, genes e códigos

O novo relatório da OTAN revela um campo de batalha onde IA, Biotecnologia e Big Data definem estratégias, alianças e riscos inéditos

Bancos brasileiros apostam alto em Inteligência Artificial

Inteligência Artificial

Bancos brasileiros apostam alto em Inteligência Artificial

O crescimento do investimento é impulsionado por iniciativas estratégicas para viabilizar uma base tecnológica robusta, especialmente na adoção de IA, GenAI e Cloud

AI Index 2025: a corrida não é por capacidade, e sim por controle

Inteligência Artificial

AI Index 2025: a corrida não é por capacidade, e sim por controle

Relatório anual de Stanford mostra que a inteligência artificial ficou mais barata, rápida e onipresente — e que o verdadeiro poder está agora nas mãos de quem implementa

A nova era do trabalho exige IA para trabalhadores de todas as idades

Inteligência Artificial

A nova era do trabalho exige IA para trabalhadores de todas as idades

Garantir que tecnologias de IA sejam acessíveis e justas para trabalhadores mais velhos não é apenas um imperativo ético — é uma vantagem competitiva em um mundo que envelhece rapidamente