Zhejiang Üniversitesi'nin Qiushi Engine yapay zeka ajanı özerk araştırmada Claude Code'u geride bıraktı
Çin'in Qiushi Engine modeli, yapay zeka ajanlarını bağımsız bilimsel araştırma kapasitesi üzerinden sıralayan ResearchClawBench testinde liderliğe yerleşti.
Zhejiang Üniversitesi öncülüğündeki bir ekip tarafından geçen hafta tanıtılan Qiushi Engine, Şanghay Yapay Zeka Laboratuvarı tarafından geliştirilen ResearchClawBench kıyaslama testinde (yapay zeka ajanlarının bağımsız araştırma görevlerini ne ölçüde yürütebildiğini ölçen değerlendirme platformu) birinci sıraya yerleşti. Test, ajanların insan yazarlı referans makalelerle karşılaştırılabilir sonuçlara ulaşıp ulaşamadığını ya da özgün yazarların bulgularını aşıp aşamadığını ölçüyor.
Qiushi Engine, büyük dil modeline dayanan bir yapay zeka ajanı olarak kurgulanmış; geliştiricileri bu sistemin yalnızca belirli görevlerle sınırlı kalmayan, fiziksel ortamlarda baştan sona özerk bilimsel keşif yapabildiğini belirtiyor. Sonuçlar, ABD'li yapay zeka şirketi Anthropic'in Claude Code modelini bu ölçütte geride bıraktığını ortaya koyuyor.
Bununla birlikte araştırmacılar, Qiushi Engine'in henüz güvenilir biçimde yeni keşifler üretemediğini de kabul ediyor. Sistem şu an için var olan bulgulara ulaşmayı çoğaltabilmekte; özgün ve doğrulanabilir bilimsel katkı üretme kapasitesi ise geliştirilmeye devam eden bir hedef olarak duruyor.
Risk — Yapay zeka destekli araştırma araçları henüz bağımsız özgün bilim üretemiyor; bu sistemlerin kurumsal karar süreçlerinde insan denetimi olmaksızın kullanılması yanıltıcı sonuçlar doğurabilir.
Fırsat — Çin kaynaklı açık rekabet, yapay zeka ajanı pazarında fiyat ve performans baskısını artırıyor; teknoloji tedarikini çeşitlendirmek isteyen şirketler için alternatif değerlendirme penceresi açılıyor.
Kaynak: SCMP Economy haberinden derlenmiştir. Orijinal haber ↗