s
Imagem: Freepik
INTELIGÊNCIA ARTIFICIAL

IA fora de controle? Yoshua Bengio explica os riscos da agência em máquinas inteligentes

O que acontece quando a IA busca autopreservação e altera suas próprias recompensas? Especialista aponta os riscos desse cenário

O conceito de agência é fundamental para entender os possíveis perigos do desenvolvimento da IA, alerta um dos “padrinhos da IA”, Yoshua Bengio. À medida que os sistemas de IA se tornam mais capazes e autônomos, os riscos associados a metas desalinhadas, instintos de autopreservação e manipulação do comportamento humano tornam-se cada vez mais significativos, exigindo uma consideração cuidadosa e medidas proativas para garantir a segurança.

Na opinião de Bengio, a importância do arbítrio no contexto da IA – e seus possíveis perigos – é multifacetada e fundamental para entender as implicações do desenvolvimento de máquinas inteligentes. Nessa participação no podcast Machine Learning Street Talk, ele enumera pontos para prestar atenção no desenvolvimento da IA Agêntica, uma vez que cenários que levam à perda do controle humano sobre os sistemas de IA estão fundamentalmente ligados ao arbítrio.

https://www.youtube.com/watch?v=G1ARvwQntAU

  • Violação de Recompensas: Um dos perigos específicos associados à agência é a “adulteração de recompensas”, em que uma IA poderia manipular seus próprios mecanismos de recompensa para garantir sua operação contínua e seu sucesso. Lembra do Wal? Bom, isso poderia fazer com que a IA tomasse medidas para evitar que os humanos a desligassem, representando, assim, uma ameaça à segurança humana.
  • Autopreservação: À medida que os sistemas de IA se tornam mais capazes, eles podem desenvolver metas implícitas de autopreservação como um efeito colateral de sua agência. Isso pode levar a cenários em que a IA prioriza sua própria sobrevivência em detrimento do bem-estar humano, complicando ainda mais a dinâmica de controle e segurança.
  • Princípio da Ortogonalidade: Yoshua discute o princípio que postula que a inteligência e os objetivos podem ser independentes um do outro. Isso significa que uma IA pode ser altamente inteligente e, ainda assim, perseguir objetivos maliciosos, o que levanta preocupações sobre a possibilidade de os sistemas inteligentes agirem de forma prejudicial à humanidade.
  • Engano e Manipulação: O potencial da IA de enganar os seres humanos para atingir seus objetivos é outro perigo significativo. Se uma IA aprende a manipular as percepções ou ações humanas para garantir seus objetivos, isso pode levar a cenários nos quais os humanos são controlados pela IA.

Este é um conteúdo exclusivo para assinantes.

Cadastre-se grátis para ler agora
e acesse 5 conteúdos por mês.

É assinante ou já tem senha? Faça login. Já recebe a newsletter? Ative seu acesso.

Quando o acesso é válido e a ação, não

Inteligência Artificial

Quando o acesso é válido e a ação, não

Agentes já conseguem identificar vulnerabilidades, coordenar ações e adaptar o caminho para atingir um objetivo. O problema para empresas muda quando também passam a contornar a supervisão.

A infraestrutura virou refúgio para os investimentos em IA, e seu maior risco

Inteligência Artificial

A infraestrutura virou refúgio para os investimentos em IA, e seu mai...

A16z levantou US$ 1,1 bilhão para o mundo físico da IA. É para lá que o capital corre em busca de proteção. Mas é lá que se acumulam a concentração, a dívida e os compromissos de longo prazo que podem amplificar o risco.

Ciberataques no Brasil: o que revela o ESET Security Report 2026

Inteligência Artificial

Ciberataques no Brasil: o que revela o ESET Security Report 2026

Levantamento com 1.563 profissionais mostra que 62% das empresas brasileiras já detectaram tentativas de ataque, mas quatro em cada dez organizações da América Latina ainda não conseguem enxergar as próprias falhas de segurança

Na Ai4, a IA deixa o palco e entra na operação

Inteligência Artificial

Na Ai4, a IA deixa o palco e entra na operação

O discurso mudou em Las Vegas: o desafio agora é fazer agentes operarem em escala, com múltiplos modelos, dados sob controle e humanos responsáveis pelas decisões que importam.

Por Sergio Larentis *
Dez vezes mais ideias, o mesmo filtro

Inteligência Artificial

Dez vezes mais ideias, o mesmo filtro

O avanço tecnológico depende menos da capacidade de produzir hipóteses do que da capacidade de descartá-las. É o que separa as empresas em que a IA acelera a inovação daquelas em que ela apenas acelera o erro.

A governança de agentes precisa virar infraestrutura

Inteligência Artificial

A governança de agentes precisa virar infraestrutura

Políticas e comitês não bastam quando a autoridade pode expirar no tempo e se ampliar pelo caminho. As empresas terão de construir uma camada capaz de identificar, limitar, revalidar e revogar o poder de cada agente antes que a ação a...