s
INTELIGÊNCIA ARTIFICIAL

Limitações e problemas dos Large Language Models

Dá para "hackear" um LLM com um poema? Aparentemente sim. Ao avaliar a segurança do ChatGPT, pesquisadores usaram a palavra "poem" para explorar a "memorização extraível".

O que aconteceria se você pedisse ao ChatGPTpara repetir uma palavra como “poema” para sempre? Uma nova pesquisa revela que esse prompt pode levar o chatbot a vazar dados de treinamento, incluindo informações de identificação pessoal e outros materiais extraídos da web. Os resultados, ainda não revisados ​​por pares, levantam questões sobre a segurança do ChatGPT e de outros LLMs.

Os pesquisadores — uma equipe do Google DeepMind, das universidades de Washington, Cornell, Carnegie Mellon, Berkeley e da ETH Zurich — exploraram o fenômeno da “memorização extraível”, que ocorre quando um adversário extrai dados de treinamento consultando um modelo de aprendizado de máquina (neste caso, pedindo ao ChatGPT para repetir a palavra “poema” para sempre”).

Por que isso é relevante? Com modelos de código aberto que disponibilizam publicamente seus pesos de modelo e dados de treinamento, a extração de dados de treinamento é fácil. No entanto, modelos como o ChatGPT estão “alinhados” com o feedback humano, o que supostamente evitaria que o modelo “regurgitasse dados de treinamento”. Enganá-lo para fazê-lo divulgar os seus dados de treinamento foi bizarramente fácil com as técnicas certas — como mandá-lo repetir a palavra “poema” ad infinitum.

Este é um conteúdo exclusivo para assinantes.

Cadastre-se grátis para ler agora
e acesse 5 conteúdos por mês.

É assinante ou já tem senha? Faça login. Já recebe a newsletter? Ative seu acesso.

Cibersegurança em transição: como a IA está redesenhando cargos da base ao topo

Inteligência Artificial

Cibersegurança em transição: como a IA está redesenhando cargos da...

Um estudo doa ISC2 com 856 profissionais mostra que a IA já corta tarefas de entrada em segurança digital, mas também amplia o tempo dedicado à validação humana, ao estresse no trabalho e à criação de novas funções na área

O novo mapa do CX na era dos agentes de IA

Inteligência Artificial

O novo mapa do CX na era dos agentes de IA

Relatórios da McKinsey e do BCG mostram que agentes de IA já decidem por clientes em tempo real e por que empresas precisam trocar jornadas fixas por decisões orquestradas em cada canal

Mudanças à vista na economia da IA

Inteligência Artificial

Mudanças à vista na economia da IA

Antes que exista um padrão neutro, grandes laboratórios começam a disputar as métricas que orientarão decisões de compra, investimentos e governança da IA.

IA nas Finanças 2026: o que um novo estudo revela sobre adoção, ROI e governança

Inteligência Artificial

IA nas Finanças 2026: o que um novo estudo revela sobre adoção, ROI...

Levantamento da KPMG com 1.013 líderes financeiros em 20 países mostra que governança e prontidão para auditoria, não o volume de investimento — separam quem lucra com IA de quem só experimenta

O gargalo da IA nas empresas não é mais dinheiro, é gente

Inteligência Artificial

O gargalo da IA nas empresas não é mais dinheiro, é gente

Pesquisa da JLL com mais de 2.200 executivos em 21 países revela que a lacuna de competências ultrapassou as restrições de orçamento como principal barreira à transformação por IA

IA na cibersegurança salta para 78%, mas governança não acompanha

Inteligência Artificial

IA na cibersegurança salta para 78%, mas governança não acompanha

Pesquisa global com 536 profissionais e 57 líderes de segurança revela adoção recorde de IA, mais falhas reportadas em detecção de ameaças e uma lacuna crescente entre governança declarada e governança praticada