Testes de matemática têm sido o principal método para avaliar as capacidades de modelos de IA como ChatGPT e Claude. A OpenAI afirma que seus modelos estão apresentando resultados tão expressivos que os testes matemáticos atuais estão se tornando menos úteis. Por isso, pesquisadores propuseram um desafio ainda maior.
Eles submeteram um modelo inédito a cerca de 4 mil problemas matemáticos ainda não resolvidos. Os resultados surpreenderam e preocuparam.
A IA gerou 722 manuscritos, organizados em 372 grupos com resultados relacionados. Segundo a OpenAI, cada resultado exigiu em média três horas de processamento lógico.
“Dias bastante empolgantes estão próximos para a comunidade matemática!” afirmou Stefano Gogioso, integrante do Conselho de Especialistas em Futuras Tecnologias e IA do BeInCrypto
A inteligência artificial está se tornando poderosa demais, rápido demais?
Esse é o ponto central. A IA de ponta começa a ultrapassar a etapa de responder a perguntas já conhecidas e passa a gerar possíveis respostas para questões inéditas.
Patrocinado

Patrocinado
Isso pode ampliar significativamente o volume de trabalho intelectual que um pesquisador, engenheiro ou analista consegue realizar.
No entanto, quantidade não significa veracidade. Muitos dos documentos da OpenAI apresentam demonstrações matemáticas verificáveis por computador. Outros, não. A própria empresa alerta que alguns resultados ainda não verificados “podem conter falhas”.
Isso traz um novo desafio: pessoas podem ter dificuldade para revisar pesquisas na mesma velocidade com que a IA consegue produzi-las.
Were releasing a broad range of new mathematical results produced by an internal frontier model.
Weve been consulting with the independent Advisory Group on Mathematics and Artificial Intelligence at the Institute for Advanced Study, and we have drawn on their advice and…
— OpenAI (@OpenAI) October 6, 2026
A inteligência artificial já pode realizar análises preditivas e tomar decisões de investimento?
Possivelmente, mas o setor financeiro apresenta desafios diferentes.
Uma prova matemática pode ser eventualmente confirmada ou refutada. Já os mercados são instáveis e em constante transformação.
Testes recentes ainda mostram a IA de ponta com dificuldades diante de pesquisas financeiras complexas, enquanto estudos sobre timing de mercado apontam pouca vantagem preditiva.
No curto prazo, a maior oportunidade está na análise aprofundada, não na previsão perfeita.
Uma IA capaz de horas de raciocínio prolongado poderia avaliar documentos, teleconferências de resultados, dados macroeconômicos e cenários concorrentes ao mesmo tempo, verificando muitas mais hipóteses do que um analista individualmente.
Esse pode ser o principal sinal do experimento da OpenAI. A IA começa a demonstrar capacidade de produzir análises robustas em volume extraordinário. A próxima questão é definir quais desses trabalhos merecem credibilidade.

