PewDiePie, o maior YouTuber da história da plataforma, acaba de revelar o “IA Ajax”, um modelo de inteligência artificial “sem censura”, projetado para rodar localmente em hardware doméstico e integrado ao Odysseus, seu workspace de IA auto-hospedado.
A novidade virou manchete não só pelo produto em si, mas pelo detalhe que o criador revelou no vídeo de anúncio: a OpenAI baniu sua conta duas vezes enquanto ele desenvolvia o modelo. O e-mail da OpenAI que ele exibe no vídeo é direto: uma das suspensões foi explicitamente motivada por distillation (destilação), a prática de usar as saídas ou o raciocínio de um modelo proprietário para treinar outro.
A técnica é considerada uma ameaça existencial pelas grandes empresas de IA de fronteira. A própria OpenAI atribuiu recentemente uma campanha de extração de raciocínio oculto a atores ligados à Moonshot AI, com picos de 16.000 usuários em dois dias tentando contornar as proteções dos modelos.
No caso de PewDiePie, a escala era evidentemente outra: ele queria “fazer distill só um pouquinho” para melhorar o Ajax. Após ter a conta reativada uma primeira vez, foi banido novamente ao rodar o modelo de novo com o mesmo objetivo. A pergunta que ele faz ao público é legítima do ponto de vista técnico: “Como eles sabiam?” O e-mail não oferece exemplos específicos.
Ele foi além e questionou a assimetria do processo, argumentando que as próprias empresas “roubaram nossos dados para construir suas máquinas de IA”, uma crítica que ressoa no debate em curso sobre o uso de conteúdo da web para treinar modelos sem consentimento explícito.
O que é o Ajax, tecnicamente falando
Ajax é um fine-tune do Qwen3.5-9B, modelo da Alibaba, otimizado para funcionar como agente autônomo e assistente sempre ativo dentro do Odysseus. A proposta é cobrir tarefas cotidianas como busca, navegação, e-mail e calendário, tudo de forma completamente local e privada. O Odysseus foi lançado em maio, e Ajax é o seu motor de inferência.
Para remover as recusas do modelo, PewDiePie utilizou o Heretic, uma ferramenta open source de abliteração automática. O processo consiste em identificar os prompts que o modelo recusa e remover o vetor de recusa das camadas do modelo, sem destruir capacidades gerais, o que ele descreve como evitar “dano cerebral” por remover contexto demais.
Ele estabeleceu um limite claro: nada que envolva instruções acionáveis para prejudicar outras pessoas ou a si mesmo. Em consulta com seu advogado, registrou que o modelo “não foi projetado para fornecer instruções perigosas que possam ser executadas”, usando armas nucleares como exemplo de fronteira. Os limites reais, porém, ainda não estão completamente documentados.
Modelos pequenos como filosofia, não como concessão
O posicionamento de PewDiePie em relação ao tamanho dos modelos é o ponto mais interessante da narrativa para a comunidade de local AI. Ele afirma acreditar “fortemente” em modelos pequenos treinados para uma função específica, e critica o paradigma dos modelos de fronteira com supostos “um trilhão de parâmetros”: “Não faz sentido cutucar essa fera gigante” para tarefas básicas.
O próximo passo do projeto inclui mais dois dias de reinforcement learning, seguidos por nova rodada de remoção da censura, quantização e benchmarking. PewDiePie também pediu que fãs doassem dados de treinamento em vez de coletá-los diretamente dos usuários do Odysseus, embora tenha admitido que ninguém submeteu nada até o momento do vídeo. Uma atualização significativa do Odysseus também foi anunciada para o mesmo ciclo de lançamento.
Fonte: Tom’s Hardware