s
INTELIGÊNCIA ARTIFICIAL

Modelos de raciocínio guardam seus segredos

Escondem deliberadamente seus processos de pensamento. Este não é apenas um problema técnico.

Sua IA pode estar escondendo seu processo de pensamento – e isso é um problema maior do que você imagina. Uma nova pesquisa da Anthropic revela que os principais modelos de linguagem não revelam partes importantes de seu processo de raciocínio, criando uma grave lacuna de transparência que pode prejudicar os esforços de segurança da IA. Se os modelos podem usar informações silenciosamente sem revelá-las, e/ou ocultarem dicas e atalhos que utilizam, como confiar na transparência de seu processo de raciocínio?

Resumindo: a técnica Chain of Thought (CoT) tornou-se uma das bases para a IA que “raciocina”. Pesquisadores de segurança em IA têm apostado no raciocínio por cadeia de pensamento (CoT) como uma maneira de detectar comportamentos perigosos antes que causem danos. Principalmente comportamentos desalinhados ou inseguros em ambientes de alto risco. No estudo “Reasoning Models Don't Always Say What They Think”, a equipe da Anthropic revela uma série de limitações nas abordagens atuais para monitorar os processos de pensamento da IA.

Foram testados seis tipos diferentes de dicas – de metadados neutros a avisos diretos de “desbloqueio” – em dois LLMs de raciocínio de ponta (Claude 3.7 Sonnet, DeepSeek R1). Ambos falharam consistentemente em revelar o uso das dicas. Mesmo quando os modelos exploram dicas mais de 90% das vezes, verbalizam essas dicas no CoT menos de 20% das vezes, em média – e menos de 5% para dicas de desalinhamento.

Este é um conteúdo exclusivo para assinantes.

Cadastre-se grátis para ler agora
e acesse 5 conteúdos por mês.

É assinante ou já tem senha? Faça login. Já recebe a newsletter? Ative seu acesso.

Ciberataques no Brasil: o que revela o ESET Security Report 2026

Inteligência Artificial

Ciberataques no Brasil: o que revela o ESET Security Report 2026

Levantamento com 1.563 profissionais mostra que 62% das empresas brasileiras já detectaram tentativas de ataque, mas quatro em cada dez organizações da América Latina ainda não conseguem enxergar as próprias falhas de segurança

Na Ai4, a IA deixa o palco e entra na operação

Inteligência Artificial

Na Ai4, a IA deixa o palco e entra na operação

O discurso mudou em Las Vegas: o desafio agora é fazer agentes operarem em escala, com múltiplos modelos, dados sob controle e humanos responsáveis pelas decisões que importam.

Por Sergio Larentis *
Dez vezes mais ideias, o mesmo filtro

Inteligência Artificial

Dez vezes mais ideias, o mesmo filtro

O avanço tecnológico depende menos da capacidade de produzir hipóteses do que da capacidade de descartá-las. É o que separa as empresas em que a IA acelera a inovação daquelas em que ela apenas acelera o erro.

Carreira +100: crescer, envelhecer e aprender sempre

Inovação

Carreira +100: crescer, envelhecer e aprender sempre

Com a perspectiva de uma vida produtiva muito além dos 60 anos, podemos investir em uma carreira por 30 anos e depois inventar outra. A longevidade, combinada com aprendizado contínuo, é fonte de crescimento, segundo pesquisas

A governança de agentes precisa virar infraestrutura

Inteligência Artificial

A governança de agentes precisa virar infraestrutura

Políticas e comitês não bastam quando a autoridade pode expirar no tempo e se ampliar pelo caminho. As empresas terão de construir uma camada capaz de identificar, limitar, revalidar e revogar o poder de cada agente antes que a ação a...

A IA ganha autoridade pelo caminho. Uma camada de infraestrutura corre para impedir

Inteligência Artificial

A IA ganha autoridade pelo caminho. Uma camada de infraestrutura corre...

Reguladores, coalizões, protocolos da IETF e produtos tentam evitar que a capacidade de um agente vire autoridade só porque ele encontrou um caminho técnico até a ação.