GPT 5.5 Pro resolve matemática em nível de doutorado - Medalhista Fields atordoado
A mais recente versão interna do GPT 5.5 Pro da OpenAI fez algo que está enviando ondas de choque através da matemática acadêmica: resolveu um problema de teoria dos números aditivos de nível de doutorado em menos de uma hora - sem qualquer sugestão humana, estrutura ou orientação intermediária.
A avaliação foi conduzida por ninguém menos que Sir Timothy Gowers, medalhista Fields e um dos matemáticos mais respeitados do mundo. Seu veredicto? O modelo demonstrou o que ele chamou de “capacidade de prova original” – a capacidade de construir um novo argumento matemático a partir do zero.
O que aconteceu
Gowers apresentou ao modelo um problema aberto na teoria aditiva dos números – um subcampo preocupado com as propriedades aditivas dos inteiros. O problema resistiu a uma solução simples, exigindo uma visão criativa em vez de computação de força bruta.
Em 60 minutos, o GPT 5.5 Pro produziu uma prova completa e logicamente coerente. Gowers descreveu a cadeia de raciocínio como “notavelmente elegante” – o tipo de prova que um talentoso estudante de pós-graduação poderia produzir após semanas de trabalho.
“Isso não é correspondência de padrões em dados de treinamento. Isso é criatividade matemática genuína.” - Revisor anônimo
Por que isso é importante
Este avanço tem três implicações imediatas:
-
A investigação matemática está prestes a acelerar dramaticamente. Se os modelos de fronteira puderem provar de forma autónoma novos teoremas, o estrangulamento passa de “encontrar provas” para “fazer as perguntas certas”.
-
A educação matemática enfrenta questões existenciais. Quando uma máquina consegue raciocinar melhor que os candidatos a doutoramento, o que deveríamos ensinar? O consenso emergente é que a intuição matemática e a formulação de problemas tornam-se mais valiosas do que a computação.
-
A definição de “compreensão” está sob pressão. O modelo realmente compreende a matemática ou está realizando uma conclusão de padrão ultrassofisticada? O próprio Gowers admite que a distinção é confusa.
O panorama geral
O desempenho matemático do GPT 5.5 Pro faz parte de uma tendência mais ampla. Os modelos de fronteira estão ultrapassando limiar após limiar nos benchmarks de raciocínio. As implicações vão muito além da matemática – desde a descoberta científica automatizada até o projeto de engenharia assistido por IA.
O que está claro é que a linha entre “ferramenta” e “colega” está ficando mais tênue a cada mês.
Leitura relacionada: GPT 5.5 Instant Edition: O que os desenvolvedores precisam saber · Raciocínio paralelo adaptativo: quando LLMs são multitarefas