OpenAI Astra modelinde recurrent depth tekniği tartışma yarattı
OpenAI'ın Astra modelinde kullanacağı recurrent depth yöntemi, yapay zekânın düşünce zincirini izlemeyi zorlaştırabilir. Uzmanlar güvenlik risklerine dikkat çekti.

OpenAI'ın yeni Astra modelinde kullanılacağı belirtilen recurrent depth tekniği, yapay zekâ güvenliği uzmanlarını endişelendirdi. Yöntem opaque recurrence olarak da adlandırılıyor. Normal şartlarda bir akıl yürütme modelinin düşünce zinciri, problemi çözerken izlediği adımları gösteriyor.
Bu kayıtlar modeldeki istenmeyen davranışların incelenmesinde kullanılabiliyor. Opaque recurrence yönteminde model aynı sorguyu bir döngü içinde birkaç kez işliyor. Bu durum geleneksel düşünce zincirine göre daha az okunabilir iz bırakıyor.
Astra'da tekniğin kullanımı şimdilik sınırlı tutuluyor. Modelin düşünce zincirinin hâlâ okunabilir olması bekleniyor. OpenAI, sistemin tamamen insanlar tarafından anlaşılamayan bir iç akıl yürütme biçimine geçeceği yönündeki değerlendirmelere karşı çıktı.
Redwood Research CEO'su Buck Shlegeris, tekniğin daha ileri götürülmesi halinde OpenAI'ın yineleme miktarını büyük ölçüde artırarak düşünce zincirinin izlenebilirliğini tamamen ortadan kaldırabileceğini söyledi. Yapay zekâ güvenliği savunucusu Zvi Mowshowitz, laboratuvarlar arasında dibe doğru yarışı önlemek için yasal düzenlemelerin gerekli olabileceğini savundu.
Redwood Research Baş Bilim İnsanı Ryan Greenblatt'ın en büyük endişesi, bu yaklaşımın ölçeklenerek modelin akıl yürütmesinin tamamını veya neredeyse tamamını insanlar tarafından görülemeyen iç süreçlere taşıması ihtimali. Anthropic ve Google DeepMind'ın da söz konusu tekniği tartıştığı belirtildi.







