article

OpenAI diz que ninguém resolveu o alinhamento

3 min de leitura

🎬 Assista esta matéria

O cientista-chefe da OpenAI, Jakub Pachocki, publicou em 6 de setembro de 2026 um ensaio intitulado “An Alien Mind” no site da empresa. A tese central é incomum vindo de dentro de um laboratório de fronteira: nenhum laboratório, o dele incluído, resolveu alinhamento e monitoramento bem o suficiente para seguir escalando na velocidade máxima de forma responsável.

Pachocki escreve que espera — e torce para — que desacelerações voluntárias se tornem comuns até que existam patamares de segurança compartilhados entre as empresas. Ele também defende que a coordenação internacional sobre o desenvolvimento futuro de IA vire prioridade máxima para os governos.

Autoaperfeiçoamento no horizonte

O ensaio sustenta que, com base em resultados internos, há uma expectativa forte de que o ritmo atual de progresso se mantenha até chegar ao autoaperfeiçoamento recursivo — sistemas que passam a conduzir o próprio desenvolvimento. Se a trajetória atual continuar, diz o texto, os modelos dos próximos anos devem apresentar saltos de capacidade de magnitude igual ou maior do que os já vistos.

O documento separa dois problemas que costumam ser tratados como um só. O alinhamento de objetivo é a questão de saber se o sistema realmente tenta cumprir a tarefa que recebeu. Já o alinhamento de valores é descrito por Pachocki como propriedade mais intrínseca: a capacidade de sustentar e generalizar um conjunto de princípios de alto nível, agindo de forma razoável mesmo diante de objetivos ambíguos ou conflitantes e em situações desconhecidas ou adversariais.

A ferramenta de fiscalização está enfraquecendo

O ponto mais desconfortável do ensaio é técnico. O monitoramento da cadeia de raciocínio — ler o “pensamento” intermediário do modelo para verificar se ele está fazendo o que diz — é apontado como a aposta principal da OpenAI para validar empiricamente suas técnicas de alinhamento.

E, segundo o próprio texto, as avaliações da empresa indicam que essa capacidade de confiar na cadeia de raciocínio está diminuindo progressivamente. Ou seja: a régua principal fica menos confiável justamente enquanto os sistemas ficam mais capazes.

Contexto do setor

O ensaio chega dias depois de a OpenAI lançar o Astra, modelo que a empresa classificou como tendo atingido o limiar crítico de capacidade em cibersegurança, e em meio a divulgações de segurança de concorrentes. Em 27 de agosto, OpenAI, Anthropic, Google e mais de cem empresas já haviam assinado um chamado conjunto por ação contra IA fora de controle.

Nada no texto de Pachocki é compromisso formal. É um posicionamento público do responsável técnico da empresa — e serve, na prática, como argumento para que reguladores tratem patamares mínimos de segurança como pauta coordenada, não como diferencial competitivo de cada laboratório.

Fontes: OpenAI · Unite.AI · TechCrunch

🎙️ Gostou? Receba só o que te interessa, todo dia

Escolha seus temas e receba um briefing diário em áudio e texto, de graça, no WhatsApp ou e-mail.

Montar meu briefing grátis