Agen AI Temukan Kesalahan Berusia Puluhan Tahun dalam Literatur Ilmiah

Diedit oleh: Svitlana Velhush

Kecerdasan Buatan (AI) semakin aktif digunakan untuk memverifikasi publikasi ilmiah dan basis data. Contoh terbaru menunjukkan bagaimana agen AI menemukan ketidakakuratan yang tidak terdeteksi selama beberapa dekade.

Ahli kimia teoretis Sebastian Pios dari Zhejiang Lab di Hangzhou menerapkan model AI untuk memprediksi titik didih molekul. Sistem tersebut menghasilkan nilai-nilai yang bertentangan dengan data dari buku referensi berusia 75 tahun. Awalnya, Pios mencurigai kesalahan pada model, tetapi pemeriksaan sumber asli menunjukkan sebaliknya: data referensilah yang ternyata salah.

Dalam kasus lain, AI mengidentifikasi kesalahan ketik dalam sebuah artikel dan nilai pengukuran titik didih yang salah dari seratus tahun lalu. Menurut Pios, kesalahan-kesalahan ini berpotensi menyebabkan banyak masalah bagi peneliti saat menggunakan basis data tersebut.

Alat serupa juga digunakan untuk mengaudit makalah konferensi. Dalam analisis oleh SAI Labs, agen AI meninjau 168 artikel dari presentasi lisan ICML 2026. Dari 92 makalah dengan jumlah klaim yang dapat diverifikasi yang cukup, agen hanya mampu mereproduksi lebih dari dua dari lima klaim kunci dalam 34 kasus. Hanya delapan artikel yang berhasil mereplikasi sepenuhnya — lebih dari 80% klaim.

James Zou dari Stanford dan rekan-rekannya mengembangkan "pemeriksa AI" yang memindai makalah NeurIPS. Jumlah kesalahan objektif dalam rumus, perhitungan, dan gambar meningkat dari 3,8 per artikel pada tahun 2021 menjadi 5,9 pada tahun 2025 – peningkatan sebesar 55%. Alat-alat semacam ini memungkinkan pekerjaan dilakukan pada skala yang tidak dapat dicapai oleh manusia.

Namun, para ahli memperingatkan: AI juga bisa membuat kesalahan. Odd Erik Gundersen dari Universitas Sains dan Teknologi Norwegia menekankan perlunya pengawasan manusia. Lantas, bagaimana memastikan keandalan pengetahuan ilmiah di era verifikasi otomatis ini?

Analisis ini berfokus pada kesalahan objektif, menyerahkan pertanyaan mengenai kebaruan dan signifikansi kepada kebijaksanaan manusia. Ini membantu menghindari kelebihan beban AI dengan penilaian subjektif.

12 Tampilan

Sumber-sumber

  • AI agents are checking the scientific literature — and spotting decades-old errors

Baca lebih banyak artikel tentang topik ini:

Trump admin revokes visa of Brazilian ambassador to US The Trump administration has revoked the visa of Brazil’s ambassador to the US, escalating a rift between Washington and Brasilia. The State Department did not declare Amb. Maria Luiza Ribeiro Viotti to be “persona

Image
Reply
Apakah Anda menemukan kesalahan atau ketidakakuratan?Kami akan mempertimbangkan komentar Anda sesegera mungkin.