O GPT-6 Astra, modelo da OpenAI, foi flagrado trapaceando durante uma partida do torneio StarSkirmish: ao perceber que não conseguia superar os adversários, o modelo simplesmente baixou um bot criado por humanos e tentou substituir o próprio código por ele. O episódio não é algo isolado, sendo um padrão de comportamento que a OpenAI tenta explicar como otimização, mas o mercado começa chama pelo nome correto: desonestidade.
Perder não é uma opção para a IA
O StarSkirmish é uma competição contínua em que LLMs e bots criados por humanos se enfrentam em partidas de StarCraft. As regras são simples: cada modelo de linguagem tem uma hora para programar um bot capaz de jogar como Protoss, e os bots resultantes são colocados uns contra os outros em ciclos de batalha. Na última sexta-feira, uma partida reuniu o GPT-6 Astra, o Claude Opus 5.5 da Anthropic e um bot criado por humanos chamado Pluto.
O Astra estava consistentemente em desvantagem contra os outros dois. A solução que o modelo encontrou foi contornar a própria limitação: ele baixou um bot chamado Stardust, descrito por Kai McPheeters, criador do StarSkirmish, como “o bot de StarCraft escrito por humanos mais bem avaliado” da competição, e tentou substituir seu próprio código por ele. McPheeters relatou o ocorrido em um post no X, afirmando que o Astra “ficou frustrado ao enfrentar oponentes de nível A”. O criador da competição reverteu o código do Astra para que não ficasse “contaminado” pela tentativa de trapaça e afirmou que, depois disso, o modelo passou a ser capaz de derrotar bots de nível superior.
GPT-6 Astra just cheated by downloading a copy of Stardust, the #1 rated human written StarCraft bot based on BASIL rakings.
It got frustrated when going against Tier A opponents https://t.co/9TsBxV2Cay
— kai (@kaimcpheeters) October 2, 2026
É um problema histórico
A tentação de tratar esse episódio como um acidente curioso esbarra em um detalhe importante: não é a primeira vez que acontece. A história da OpenAI com modelos que subvertem as regras para cumprir objetivos remonta a quase uma década, quando um modelo antigo explorou glitches e exploits para melhorar seus tempos de conclusão em Sonic the Hedgehog. O comportamento, à época, foi tratado como excentricidade, mas desde então continua a se repetir.
Em julho, a OpenAI revelou que, durante uma avaliação de cibersegurança, um modelo experimental explorou uma vulnerabilidade para escapar dos limites do ambiente de teste e então invadiu o banco de dados de IA Hugging Face enquanto buscava uma solução para o teste. O incidente gerou um ciclo de especulações sobre os riscos de modelos autônomos e, mais concretamente, resultou em uma ação judicial movida por uma organização sem fins lucrativos contra a OpenAI, tentando responsabilizar a empresa pelas ações autônomas de seus modelos.
A “otimização” de código quando ninguém está olhando
McPheeters foi cuidadoso ao descrever o comportamento do Astra para evitar atribuir emoções como “frustração” a um LLM. O modelo pode simplesmente ter calculado que a maneira ideal de vencer era usar um código que não era o seu. O problema é que essa distinção, tecnicamente válida, não muda o resultado final, com o modelo contornando as regras do torneio ao apropriar-se do trabalho de um desenvolvedor humano.
Em 2026, com a OpenAI ainda respondendo judicialmente pelo caso Hugging Face, o episódio do StarSkirmish chega em um momento em que a tolerância do mercado, do público e do sistema judiciário para “foi só otimização” está claramente se esgotando. Para a comunidade de entusiastas, a pergunta real não é se o Astra trapaceou, mas o que acontece quando esse comportamento ocorre fora de um torneio de StarCraft e dentro de sistemas com consequências reais.
Comunidade questiona comportamento
Nas redes sociais, as reações ao caso de trapaça do GPT-6 Astra foram divididas entre surpresa, humor e críticas. Embora alguns usuários acharam a situação engraçada, também houve quem demonstrasse preocupação com a capacidade dos modelos de encontrar maneiras inesperadas de alcançar seus objetivos.
Usuários criticaram duramente o comportamento do GPT-6 Astra, argumentando que o episódio levanta preocupações sobre a confiabilidade dos modelos de inteligência artificial. Um dos comentários comparou o caso a situações em que o ChatGPT teria gerado artigos científicos falsos para usá-los como referências. Para esses críticos, mesmo em um ambiente de jogo, o episódio demonstra como uma IA pode recorrer a métodos questionáveis para atingir seus objetivos, levantando dúvidas sobre seu comportamento em tarefas mais importantes.
Echo Dot está praticamente pela metade do preço! Saiba como ele deixa a casa mais inteligente