IAs chinesas superam rivais humanos em olimpíada de matemática
IAs chinesas superam rivais humanos em olimpíada de matemática
Modelos de IA gabaritam prova da Olimpíada Internacional de Matemática pela primeira vez (ilustração: Vitor Pádua/Tecnoblog)
Resumo
Modelos de IA de Huawei e Xiaohongshu acertaram 100% das questões na Olimpíada Internacional de Matemática (IMO) em julho, superando competidores humanos.
A prova foi realizada sem intervenção humana e as questões só foram liberadas após a finalização da prova por parte dos estudantes inscritos.
Outras IAs, incluindo ChatGPT e Claude, também testaram as questões da IMO, com resultados positivos, mas não oficiais.
Os modelos de IA Celia, da Huawei, e dots-node-3.0, da Xiaohongshu gabaritaram a prova da Olimpíada Internacional de Matemática (IMO, na sigla em inglês), superando os competidores humanos. Esse é o primeiro registro da tecnologia de inteligência artificial acertando 100% das questões em desafios do tipo. No ano passado, Google e OpenAI haviam divulgado seus resultados, que foram muito positivos, mas não perfeitos.
Segundo a Xiaohongshu, chegar aos 100% é extremamente difícil, o que fica comprovado pelo resultado entre humanos: dos 666 participantes em Xangai, apenas sete conseguiram gabaritar a prova. A empresa afirma que é a primeira vez que seu modelo é testado com questões da IMO.
Segundo o Taipei Times, as questões só foram liberadas para o teste com os modelos de IA depois de concluídas entre os estudantes reais. Além disso, nenhuma intervenção humana foi permitida durante as resoluções.
A empresa de capital de risco Menlo Ventures, dos Estados Unidos, realizou testes próprios com o auxílio de um parceiro para verificar a taxa de acerto de IAs americanas, já que elas não participariam oficialmente da prova. O ChatGPT na versão GPT-5.6 Sol (OpenAI), o Claude Fable 5 (Anthropic) e a ferramenta da Axiom Math também gabaritaram o teste.
Claude Fable 5 também foi testada de forma extraoficial (imagem: Lupa Charleaux/Tecnoblog)
Essa não é a primeira vez que modelos de IA são testados em provas da Olimpíada Internacional de Matemática. Em 2024, o Google “conquistou” a medalha de prata com o modelo da DeepMind, que acertou quatro de seis questões. A resolução, no entanto, demorou cerca de três dias.
Já em 2025, o modelo ficou com nota suficiente para ganhar o ouro, assim como o ChatGPT, mas não chegou à nota máxima. É importante destacar que não foram revelados os modelos exatos usados nos testes anteriores.
IAs chinesas superam rivais humanos em olimpíada de matemática
IAs chinesas superam rivais humanos em olimpíada de matemática
Fonte: Tecnoblog
