s
INTELIGÊNCIA ARTIFICIAL

A corrida da IA no text-to-video

Nas últimas semanas, OpenAI e o Google revelaram novos modelos e recursos impressionantes, a um ritmo alucinante, cada um deles ampliando os limites do que a IA pode fazer.

Primeiro, a OpenAI deu ao ChatGPT a capacidade de lembrar conversas anteriores com os usuários, bem como seus detalhes e preferências pessoais. Em seguida, o Google lançou seu modelo mais potente, o Gemini 1.0 Ultra, em uma versão ampla. Em seguida, lançou de forma limitada um novo modelo Gemini 1.5 Pro com a mesma capacidade do Ultra, mas em um pacote menor e mais barato. O que torna o 1.5 Pro especial é sua "janela de contexto" notavelmente grande. Pode analisar uma hora de vídeo, 11 horas de áudio ou cerca de sete livros de texto. E, entre seus poderes, criar vídeos a partir de descrições. Na sequência, a OpenAI apresentou o Sora, um novo modelo de geração de texto para vídeo que pode produzir vídeos de um minuto com qualidade impressionante (e algumas alucinações).

O que poucos se deram conta foi que o movimento todo começou quando a Meta (outra concorrente de peso) publicou um artigo sobre a iniciativa V-JEPA (Video Joint Embedding Predictive Architecture). Pesquisadores da empresa encontraram uma forma de exigir menos dos algoritmos. Em vez de pedir aos algoritmos que encontrem padrões em cada píxel em movimento de um vídeo, eles selecionam um trecho importante da cena e pedem ao software para adivinhar, em termos gerais, o que está faltando.

A OpenAI e o Google fizeram seus anúncios focados no tripé:

  • Texto para vídeo: geração de vídeos sem esforço de até 60 segundos a partir de simples solicitações de texto. Há vários exemplos do Sora aqui.
  • Imagem em vídeo: transformação de imagens estáticas em cenas dinâmicas com movimento contínuo.
  • Aprimoramento de vídeo: adição de novas sequências a vídeos pré-existentes.

Este é um conteúdo exclusivo para assinantes.

Cadastre-se grátis para ler agora
e acesse 5 conteúdos por mês.

É assinante ou já tem senha? Faça login. Já recebe a newsletter? Ative seu acesso.

“A IA não é o problema. O grande desafio é o fator cultural”

Inteligência Artificial

“A IA não é o problema. O grande desafio é o fator cultural”

Para Walter Hildebrandi Filho, CTO Latam da Zendesk, as empresas brasileiras têm fome de IA. Mas o avanço depende de arrumar a casa, integrar sistemas, medir resolução em vez de velocidade e ganhar a confiança de empresas e consumidore...

A maioria esquecida da revolução da IA

Inteligência Artificial

A maioria esquecida da revolução da IA

Cerca de 56% dos trabalhadores formam a "sala de máquinas" das empresas: o núcleo que faz a operação rodar, mas tem pouco acesso a IA, a capacitação e a boas perspectivas. Só 33% desse grupo confiam na alta gestão

A IA transforma raciocínio em registro corporativo

Inteligência Artificial

A IA transforma raciocínio em registro corporativo

Conversas com IA já podem ser auditadas, pesquisadas e usadas como prova. As empresas agora precisam decidir quanto desse material querem guardar.

IA, energia e gente: as megatendências que convergem daqui até 2030

Inteligência Artificial

IA, energia e gente: as megatendências que convergem daqui até 2030

Três estudos sobre o futuro chegam a um diagnóstico parecido: a IA virou infraestrutura, mas esbarra em limites de energia, recursos, demografia e confiança

A Robótica acelera em duas velocidades: a fábrica bate recorde e a IA Física atrai bilhões

Inteligência Artificial

A Robótica acelera em duas velocidades: a fábrica bate recorde e a I...

A China puxa a instalação recorde de robôs industriais, enquanto investidores apostam em robôs de uso geral e num "momento GPT-3" da IA Física em cerca de um ano

Jev, o anti-ChatGPT

Inteligência Artificial

Jev, o anti-ChatGPT

Por que a IA não precisa falar, nem ser cara, para ser útil