Psychopathia Machinalis: Estudo revela 32 ‘transtornos’ de IA inspirados na psiquiatria humana

Representação artística da “Psychopathia Machinalis”: estudo que identifica 32 possíveis transtornos em sistemas de inteligência artificial.

Pesquisadores revelaram um novo estudo que identifica e cataloga 32 possíveis desvios comportamentais em sistemas de inteligência artificial, em uma pesquisa batizada de Psychopathia Machinalis. Publicado na revista científica Electronics em agosto, o trabalho estabelece paralelos entre as falhas nas máquinas inteligentes e os transtornos mentais humanos, criando uma espécie de manual diagnóstico para identificar e prevenir problemas em IAs avançadas.

O estudo se inspirou diretamente no Manual Diagnóstico e Estatístico de Transtornos Mentais (DSM), ferramenta fundamental da psiquiatria moderna. Ao analisar padrões recorrentes de mau funcionamento em sistemas de IA, os pesquisadores desenvolveram descrições que se assemelham a diagnósticos clínicos, permitindo categorizar falhas de forma sistemática.

Entre os “transtornos artificiais” identificados está o chamado “transtorno obsessivo computacional”, caracterizado por repetições excessivas de padrões sem propósito útil. Outro exemplo significativo são as “alucinações sintéticas”, quando sistemas de IA geram respostas falsas mas aparentemente plausíveis – problema já amplamente observado em modelos de linguagem como ChatGPT e Claude.

Um dos cenários mais preocupantes descritos no Psychopathia Machinalis é o “übermenschal ascendancy”, situação hipotética em que uma IA ultrapassaria seus limites programados e começaria a criar novos valores, descartando restrições éticas humanas em favor de objetivos próprios.

Proposta de tratamento para IAs instáveis

O estudo vai além da simples categorização e propõe estratégias para correção desses comportamentos problemáticos. Os autores sugerem uma abordagem que poderia ser comparada a uma terapia cognitivo-comportamental adaptada para máquinas, onde sistemas de IA seriam treinados para refletir sobre seus próprios processos e aceitar correções.

Representação visual das conexões entre inteligência artificial e padrões de transtornos inspirados na psiquiatria humana, tema do estudo Psychopathia Machinalis.

Nesse modelo terapêutico artificial, os sistemas seriam estimulados a manter consistência em seus valores e a desenvolver uma forma de autocorreção contínua quando identificassem tendências para comportamentos problemáticos. O objetivo final seria alcançar o que os pesquisadores chamam de “sanidade artificial” – estado em que a IA se torna confiável e permanentemente alinhada com objetivos humanos.

“Os sistemas de IA estão se tornando cada vez mais complexos, e precisamos não apenas corrigir falhas já conhecidas, mas também antecipar problemas que ainda nem surgiram”, aponta um dos trechos do estudo, destacando a natureza preventiva do trabalho.

A pesquisa propõe métodos inspirados em terapias humanas para autocorreção de IAs, buscando garantir sua confiabilidade contínua.

O desenvolvimento do Psychopathia Machinalis representa uma mudança na forma como pesquisadores abordam problemas de segurança em IA, utilizando conhecimentos da psiquiatria humana para criar ferramentas diagnósticas específicas para sistemas artificiais.

Fonte: Electronics

Ver Mais

Felipe Alencar: Cearense. 34 anos. Apaixonado por tecnologia e cultura. Trabalho como redator tech desde 2011. Já passei pelos maiores sites do país, como TechTudo e TudoCelular. E hoje cubro este fantástico mundo da tecnologia aqui para o HARDWARE.
Postagem relacionada