Agentes de IA Encontram Erros de Décadas em Artigos Científicos

Editado por: Svitlana Velhush

A inteligência artificial está sendo cada vez mais utilizada para verificar publicações científicas e bases de dados. Exemplos recentes demonstram como agentes de IA identificam imprecisões que passaram despercebidas por décadas.

O químico teórico Sebastian Pioss, do Zhejiang Lab em Hangzhou, utilizou um modelo de inteligência artificial para prever os pontos de ebulição de moléculas. O sistema gerou valores que contradiziam dados de um manual de referência de 75 anos. A princípio, Pioss suspeitou de um erro no modelo, mas a verificação das fontes originais revelou o contrário: os dados de referência eram, de fato, os incorretos.

Em outras situações, a IA identificou um erro de digitação em um artigo e valores incorretos de medições de pontos de ebulição que datavam de cem anos atrás. Segundo Pioss, esses equívocos poderiam ter causado muitos problemas aos pesquisadores ao utilizarem a base de dados.

Ferramentas semelhantes são também empregadas para auditar trabalhos de conferências. Numa análise da SAI Labs, agentes de IA examinaram 168 artigos provenientes de apresentações orais da ICML 2026. Das 92 pesquisas com um número suficiente de afirmações verificáveis, os agentes conseguiram reproduzir mais de duas em cada cinco alegações principais em apenas 34 casos. A reprodução completa — mais de 80% das afirmações — foi alcançada em apenas oito artigos.

James Zou, de Stanford, e seus colegas desenvolveram um "verificador de IA" que escaneou artigos da NeurIPS. O número de erros objetivos em fórmulas, cálculos e figuras aumentou de 3,8 por artigo em 2021 para 5,9 em 2025 — um incremento de 55%. Essas ferramentas permitem operar em escalas inatingíveis para seres humanos.

Contudo, especialistas alertam: a IA também comete erros. Odd Erik Gundersen, da Universidade Norueguesa de Ciência e Tecnologia, ressalta a necessidade de supervisão humana. Como, então, garantir a confiabilidade do conhecimento científico na era da verificação automatizada?

A análise foca em erros objetivos, deixando as questões de novidade e relevância a critério humano. Isso ajuda a evitar sobrecarregar a IA com julgamentos subjetivos.

12 Visualizações

Fontes

  • AI agents are checking the scientific literature — and spotting decades-old errors

Leia mais artigos sobre este tema:

Trump admin revokes visa of Brazilian ambassador to US The Trump administration has revoked the visa of Brazil’s ambassador to the US, escalating a rift between Washington and Brasilia. The State Department did not declare Amb. Maria Luiza Ribeiro Viotti to be “persona

Image
Reply
Encontrou um erro ou imprecisão?Vamos considerar seus comentários assim que possível.