Yapay Zeka Ajanları Bilimsel Literatürdeki On Yıllık Hataları Tespit Ediyor

Düzenleyen: Svitlana Velhush

Yapay zeka, bilimsel yayınların ve veri tabanlarının kontrol edilmesi için giderek daha aktif bir şekilde kullanılıyor. Son örnekler, yapay zeka ajanlarının on yıllardır fark edilmeden kalan yanlışlıkları nasıl tespit ettiğini gösteriyor.

Hangzhou'daki Zhejiang Laboratuvarı'ndan teorik kimyager Sebastian Pios, moleküllerin kaynama noktalarını tahmin etmek için bir yapay zeka modeli kullandı. Sistem, 75 yıllık bir referans kitabındaki verilerle çelişen değerler verdi. Başlangıçta Pios modelin hatalı olduğundan şüphelenmiş olsa da, orijinal kaynakların kontrol edilmesi tam tersini gösterdi: Yanlış olan referans verilerin kendisiydi.

Diğer durumlarda ise yapay zeka, bir makalede yazım hatası ve yüz yıllık kaynama noktası ölçümlerinde yanlış değerler tespit etti. Pios'a göre, bu hatalar veri tabanını kullanan araştırmacılara önemli sorunlar yaşatabilirdi.

Benzer araçlar, konferans çalışmalarının denetlenmesi için de kullanılıyor. SAI Labs analizinde, yapay zeka ajanları ICML 2026 sözlü sunumlarından 168 makaleyi inceledi.

Kontrol edilebilir yeterli sayıda iddiaya sahip 92 çalışmadan, ajanlar beş temel iddianın ikisinden fazlasını yalnızca 34 durumda yeniden üretebildi. İddiaların %80'inden fazlasının tamamen tekrarlanabildiği makale sayısı ise sadece sekizdi.

Stanford'dan James Zou ve meslektaşları, NeurIPS makalelerini tarayan bir "Yapay Zeka Denetçisi" geliştirdi. Formüllerdeki, hesaplamalardaki ve çizimlerdeki nesnel hata sayısı, 2021'de makale başına 3,8'den 2025'te 5,9'a yükselerek %55'lik bir artış gösterdi. Bu tür araçlar, insan erişiminin ötesinde ölçeklerde çalışmaya imkan tanıyor.

Ancak uzmanlar, yapay zekanın da hata yapabileceği konusunda uyarıyor. Norveç Bilim ve Teknoloji Üniversitesi'nden Odd Erik Gundersen, insan kontrolünün gerekliliğini vurguluyor. Otomatikleştirilmiş doğrulama çağında bilimsel bilginin güvenilirliği nasıl sağlanacak?

Analiz, nesnel hatalara odaklanırken, yenilik ve önem gibi konuları insanların takdirine bırakıyor. Bu yaklaşım, yapay zekanın öznel yargılarla aşırı yüklenmesini önlemeye yardımcı oluyor.

38 Görüntülenme

Kaynaklar

  • AI agents are checking the scientific literature — and spotting decades-old errors

Yorumlar

Bu konuyla ilgili daha fazla makale okuyun:

Anthropic put out a 154-page report Wednesday saying it caught scientists trying to use Claude to research biological weapons. Chikungunya, bird flu, work headed for a foreign military lab. Anthropic's own bioweapon filters were switched off from May 2025 to April 2026. Nearly a

Reply
Bir hata veya yanlışlık buldunuz mu?Yorumlarınızı en kısa sürede değerlendireceğiz.