Resumo
Modelos de IA de Huawei e Xiaohongshu acertaram 100% das questões na Olimpíada Internacional de Matemática (IMO) em julho, superando competidores humanos.
A prova foi realizada sem intervenção humana e as questões só foram liberadas após a finalização da prova por parte dos estudantes inscritos.
Outras IAs, incluindo ChatGPT e Claude, também testaram as questões da IMO, com resultados positivos, mas não oficiais.
Os modelos de IA Celia, da Huawei, e dots-node-3.0, da Xiaohongshu gabaritaram a prova da Olimpíada Internacional de Matemática (IMO, na sigla em inglês), superando os competidores humanos. Esse é o primeiro registro da tecnologia de inteligência artificial acertando 100% das questões em desafios do tipo. No ano passado, Google e OpenAI haviam divulgado seus resultados, que foram muito positivos, mas não perfeitos.
Segundo a Xiaohongshu, chegar aos 100% é extremamente difícil, o que fica comprovado pelo resultado entre humanos: dos 666 participantes em Xangai, apenas sete conseguiram gabaritar a prova. A empresa afirma que é a primeira vez que seu modelo é testado com questões da IMO.
Segundo o Taipei Times, as questões só foram liberadas para o teste com os modelos de IA depois de concluídas entre os estudantes reais. Além disso, nenhuma intervenção humana foi permitida durante as resoluções.
