Diário do Fim do Mundo

Diário do Fim do Mundo

Registro de Abrigo Nº 2026-0928
Nível de Contenção: Liberado
Tecnologia e Inovação

Uma IA Passou 11 Dias Sozinha Formalizando um Teorema Que Resistiu Quase 360 Anos, e Isso Deveria Nos Preocupar?

Pixapopz via Pixabay, https://pixabay.com/photos/math-blackboard-education-classroom-1547018/
Pixapopz via Pixabay, https://pixabay.com/photos/math-blackboard-education-classroom-1547018/

Pierre de Fermat escreveu, em 1637, uma frase na margem de um livro. Ele nunca teve espaço para provar aquilo de verdade. Levou quase 360 anos até o matemático Andrew Wiles fechar essa conta, em 1994. Foi um dos feitos mais celebrados da matemática moderna. Agora a Anthropic afirma ter dado um passo diferente sobre o mesmo teorema. Segundo a empresa, agentes do seu modelo Claude trabalharam de forma praticamente autônoma por 11 dias. O resultado, segundo ela, é a primeira demonstração completa do Último Teorema de Fermat totalmente verificada por computador.

O que a Anthropic diz ter feito

É importante entender o que muda aqui. A prova original de Wiles já era aceita pela comunidade matemática desde os anos 1990. Os agentes do Claude fizeram outra coisa. Eles reconstruíram essa demonstração inteira dentro de uma linguagem formal chamada Lean. Essa linguagem permite a um computador checar cada passo lógico do raciocínio. Ela não depende da confiança em revisores humanos. Segundo a Anthropic, esse tipo de formalização completa do teorema nunca tinha sido feito antes.

Como funciona o Prove2Me

O trabalho usou uma plataforma chamada Prove2Me. Tianyi Peng e colaboradores da Universidade Columbia criaram essa plataforma para projetos colaborativos de formalização matemática. A Anthropic combinou essa base com um fluxo de múltiplos agentes do Claude Code. Dezenas de agentes trabalharam em paralelo em partes diferentes da prova. Cada agente cuidava, assim, de um pedaço do quebra-cabeça lógico. Aos poucos, o sistema ia unindo essas peças até fechar a demonstração inteira.

A escala do trabalho: 13 milhões de linhas de código

O tamanho do projeto impressiona. Segundo a Anthropic, o resultado final soma 13 milhões de linhas de código em Lean. São cerca de 29.500 teoremas intermediários, os degraus lógicos menores que sustentam a prova principal. A empresa diz ainda que o trabalho consumiu cerca de 6 bilhões de tokens de saída. Esses tokens vieram de um modelo de pesquisa interno, com capacidade comparável à do Claude Fable 5.1. Segundo a Anthropic, a prova usa apenas os três axiomas padrão do Lean, sem atalhos nem etapas deixadas em aberto.

O que muda, e o que não muda, nisso

A Anthropic publicou a formalização completa num repositório aberto no GitHub. Assim, qualquer matemático pode conferir o resultado. O feito não reescreve a matemática por trás do Último Teorema de Fermat. Isso já estava resolvido há três décadas. Mas mostra até onde sistemas de IA já conseguem chegar em tarefas de raciocínio lógico longas e detalhadas, sem intervenção humana passo a passo. Fica a pergunta que a própria comunidade de matemáticos começa a discutir. Quantos outros problemas fechados há décadas ainda esperam alguém disposto a gastar 13 milhões de linhas de código só para ter certeza absoluta de que já estavam certos?

Fontes consultadas:

Deixe um comentário

O seu endereço de e-mail não será publicado. Campos obrigatórios são marcados com *