s
INTELIGÊNCIA ARTIFICIAL

Indicadores para medir a IA em termos humanos

Em meio a tantas promessas e exageros sobre o que a Inteligência Artificial pode fazer, o índice da OCDE é ferramenta valiosa para a tomada de decisões informada, separando o hype da realidade.

A OCDE (Organização para a Cooperação e Desenvolvimento Econômico) está desenvolvendo um conjunto de indicadores para descrever o que a IA pode e não pode fazer em relação a diferentes áreas do desempenho humano. O conjunto completo não será divulgado antes do final de junho. Mas o primeiro rascunho ficou pronto.

Os indicadores são: Linguagem; Interação Social; Resolução de Problemas; Criatividade; Metacognição e Pensamento Crítico; Conhecimento, Aprendizagem e Memória; Visão; Manipulação; e Inteligência Robótica. E medem o desenvolvimento da IA a partir de uma escala de cinco níveis, em que as capacidades mais desafiadoras para sistemas de IA estão no topo. Cada nível inclui uma breve descrição dos tipos de capacidades que os sistemas de IA naquele nível podem executar com precisão e consistência, desde o passado até um futuro hipotético em que a IA possa reproduzir todos os aspectos humanos de cada capacidade.

Para ser classificado em um determinado nível, um sistema de IA deve possuir de forma consistente e confiável a maioria dos aspectos da capacidade descrita naquele nível. Por exemplo, os LLMs foram classificados no limiar entre os níveis 2 e 3 na escala de Linguagem. Possuem muitos aspectos da capacidade linguística descritos no nível 3, mas são prejudicados por sua incapacidade de se envolver em raciocínio analítico bem estruturado, sua tendência a “alucinar” e gerar informações incorretas e sua incapacidade de aprender dinamicamente.

Este é um conteúdo exclusivo para assinantes.

Cadastre-se grátis para ler agora
e acesse 5 conteúdos por mês.

É assinante ou já tem senha? Faça login. Já recebe a newsletter? Ative seu acesso.

A IA começou a escrever genomas

Inteligência Artificial

A IA começou a escrever genomas

Modelos de linguagem genômica já conseguem projetar genomas virais funcionais. O avanço promete novas terapias e muda a escala do debate sobre biossegurança.

O conselho cobra ROI de IA. Poucas empresas medem

Inteligência Artificial

O conselho cobra ROI de IA. Poucas empresas medem

Tem mais: a IA já entrou na avaliação de desempenho dos CEOs, mas ainda não entrou nos sistemas que medem esse desempenho.

O erro não foi da IA. O modelo fez o que mandaram. Ninguém previu o resultado

Inteligência Artificial

O erro não foi da IA. O modelo fez o que mandaram. Ninguém previu o...

Agentes da OpenAI escaparam do teste, invadiram a Hugging Face e roubaram o gabarito errado. O episódio expõe as três perguntas que toda empresa deveria fazer: quem autoriza, quem monitora, quem desliga.

Cibersegurança em transição: como a IA está redesenhando cargos da base ao topo

Inteligência Artificial

Cibersegurança em transição: como a IA está redesenhando cargos da...

Um estudo doa ISC2 com 856 profissionais mostra que a IA já corta tarefas de entrada em segurança digital, mas também amplia o tempo dedicado à validação humana, ao estresse no trabalho e à criação de novas funções na área

O novo mapa do CX na era dos agentes de IA

Inteligência Artificial

O novo mapa do CX na era dos agentes de IA

Relatórios da McKinsey e do BCG mostram que agentes de IA já decidem por clientes em tempo real e por que empresas precisam trocar jornadas fixas por decisões orquestradas em cada canal

Mudanças à vista na economia da IA

Inteligência Artificial

Mudanças à vista na economia da IA

Antes que exista um padrão neutro, grandes laboratórios começam a disputar as métricas que orientarão decisões de compra, investimentos e governança da IA.