Yapay Zeka Ajanları Bilimsel Literatürdeki On Yıllık Hataları Tespit Ediyor

Düzenleyen: Svitlana Velhush

Yapay zeka, bilimsel yayınların ve veri tabanlarının kontrol edilmesi için giderek daha aktif bir şekilde kullanılıyor. Son örnekler, yapay zeka ajanlarının on yıllardır fark edilmeden kalan yanlışlıkları nasıl tespit ettiğini gösteriyor.

Hangzhou'daki Zhejiang Laboratuvarı'ndan teorik kimyager Sebastian Pios, moleküllerin kaynama noktalarını tahmin etmek için bir yapay zeka modeli kullandı. Sistem, 75 yıllık bir referans kitabındaki verilerle çelişen değerler verdi. Başlangıçta Pios modelin hatalı olduğundan şüphelenmiş olsa da, orijinal kaynakların kontrol edilmesi tam tersini gösterdi: Yanlış olan referans verilerin kendisiydi.

Diğer durumlarda ise yapay zeka, bir makalede yazım hatası ve yüz yıllık kaynama noktası ölçümlerinde yanlış değerler tespit etti. Pios'a göre, bu hatalar veri tabanını kullanan araştırmacılara önemli sorunlar yaşatabilirdi.

Benzer araçlar, konferans çalışmalarının denetlenmesi için de kullanılıyor. SAI Labs analizinde, yapay zeka ajanları ICML 2026 sözlü sunumlarından 168 makaleyi inceledi.

Kontrol edilebilir yeterli sayıda iddiaya sahip 92 çalışmadan, ajanlar beş temel iddianın ikisinden fazlasını yalnızca 34 durumda yeniden üretebildi. İddiaların %80'inden fazlasının tamamen tekrarlanabildiği makale sayısı ise sadece sekizdi.

Stanford'dan James Zou ve meslektaşları, NeurIPS makalelerini tarayan bir "Yapay Zeka Denetçisi" geliştirdi. Formüllerdeki, hesaplamalardaki ve çizimlerdeki nesnel hata sayısı, 2021'de makale başına 3,8'den 2025'te 5,9'a yükselerek %55'lik bir artış gösterdi. Bu tür araçlar, insan erişiminin ötesinde ölçeklerde çalışmaya imkan tanıyor.

Ancak uzmanlar, yapay zekanın da hata yapabileceği konusunda uyarıyor. Norveç Bilim ve Teknoloji Üniversitesi'nden Odd Erik Gundersen, insan kontrolünün gerekliliğini vurguluyor. Otomatikleştirilmiş doğrulama çağında bilimsel bilginin güvenilirliği nasıl sağlanacak?

Analiz, nesnel hatalara odaklanırken, yenilik ve önem gibi konuları insanların takdirine bırakıyor. Bu yaklaşım, yapay zekanın öznel yargılarla aşırı yüklenmesini önlemeye yardımcı oluyor.

12 Görüntülenme

Kaynaklar

  • AI agents are checking the scientific literature — and spotting decades-old errors

Bu konuyla ilgili daha fazla makale okuyun:

Trump admin revokes visa of Brazilian ambassador to US The Trump administration has revoked the visa of Brazil’s ambassador to the US, escalating a rift between Washington and Brasilia. The State Department did not declare Amb. Maria Luiza Ribeiro Viotti to be “persona

Image
Reply
Bir hata veya yanlışlık buldunuz mu?Yorumlarınızı en kısa sürede değerlendireceğiz.