Anthropic ve OpenAI, Güvenlik Değerlendiricilerini Yapay Zeka Laboratuvarlarına Yerleştirmeyi Önerdi
İki yapay zeka şirketi, bağımsız araştırmacıların benzeri görülmemiş iç erişime sahip olmasını istediğini söylüyor, ancak uzmanlar gerçek denetimin şeffaflık, bağımsızlık ve sonuç olarak düzenleme gerektireceği konusunda uyarıda bulunuyor.
TechCrunch'ın bir raporuna göre Anthropic ve OpenAI, bağımsız güvenlik değerlendiricilerini doğrudan kuruluşlarının içine yerleştirmeyi önermiştir. Bu plan, dış araştırmacılara şirketlerin yapay zeka sistemlerine ve geliştirme süreçlerine daha önce sunulmamış şekillerde erişim sağlayacaktır.
TechCrunch, araştırmacıların önerilen erişim düzeyini memnuniyetle karşıladığını ve bunu yapay zeka endüstrisi için benzeri görülmemiş olarak nitelendirdiğini bildirmiştir. Ancak, aynı araştırmacılar erişimin tek başına anlamlı denetimi garanti etmediği konusunda uyarıda bulunmuştur.
Rapora göre uzmanlar, gömülü değerlendiricilerin gerçek güvenlik kontrolleri sağlaması için, değerlendiricilerin bulgularına ilişkin şeffaflık, değerlendirilen şirketlerden yapısal bağımsızlık ve nihayetinde harici düzenlemenin başlatılması dahil olmak üzere birkaç koşulun karşılanması gerektiği konusunda uyarı vermiştir.
Rapor, bir şirket içine gömülü değerlendiricilerin, değerlendirmek için görevlendirilmiş oldukları kuruluşlara olan yakınlığı ve bağımlılığı göz önünde bulundurulduğunda, gerçekten bağımsız kalıp kalamayacakları sorusunu gündeme getirmektedir. TechCrunch'ın raporlaması, bu girişimi yapay zeka laboratuvarlarının sistemleri gittikçe güçlendiğinde kendilerini inanılır bir şekilde denetleyip denetleyemediklerinin bir sınavı olarak sunmaktadır.
Ne Anthropic ne de OpenAI'nin bu değerlendiricilerin kapsamı, finansmanı veya yetkisine ilişkin spesifik taahhütleri mevcut raporlama içinde belirtilmiştir. TechCrunch, bu tür gömülü değerlendirme programlarının ne zaman uygulanabileceğine dair bir zaman çizelgesi belirtmemiştir.
Kaynaklar
EGazette birden fazla kaynaktan gelen haberleri özetler; orijinalleri için bağlantıları izleyin.
İlgili makaleler

CNBC Raporu: Anthropic ve OpenAI'nin AI Risk Değerlendiricileri Planı Endişe Yaratıyor
Bir CNBC raporu, Anthropic ve OpenAI'nin AI sistemlerini model riskinin değerlendiricileri olarak entegre etme önerilerini inceliyor ve bu yaklaşımın çözülmemiş sorunları olduğunu belirtiyor.

Anthropic ve OpenAI 'Tarafsız' Yapay Zeka Değerlendiricileri Önerdi; CNBC Raporu Endişeleri Gündeme Getirdi
Yapay zeka laboratuvarları, ileri modellerin yol açabileceği yıkıcı risklere karşı koruma için bağımsız değerlendiricilerin kurumun içine gömülmesini önerirken, CNBC raporu bu planın bağımsızlık ve etkinlik konusunda sorular ortaya çıkardığını belirtiyor.
Rapor: Anthropic'in Claude Modeli Araştırmacıların OpenAI Sistemlerine Sızmasına Yardımcı Oldu
Siber güvenlik firması Hacktron, Anthropic'in Claude yapay zeka modelini kullanarak OpenAI'ın iç kod deposuna eriştiğini ve bulduğu açıkları raporlamadan önce bunu bildirdiğini söylüyor

Araştırmacılar Anthropic'in Claude'unu Kullanarak OpenAI Sistemlerini "Etik Şekilde Hack"ladıklarını Söylüyor
ABD'li bir siber güvenlik girişimi, OpenAI çalışan hesaplarını ele geçirdiğini ve dahili yazılım önbelleklerine erişim sağladığını söylüyor ve bu da yapay zeka şirketindeki güvenlik sorunları hakkında yeni sorular gündeme getiriyor.
Araştırmacılar Anthropic'in Claude Yapay Zekasını Kullanarak OpenAI Sistemlerine Sızabildiğini Söyledi
Güvenlik araştırmacıları, Anthropic'in Claude yapay zeka modelini kullanarak OpenAI'ın sistemlerindeki güvenlik açıklarını istismar ederek, çalışan hesaplarına ve dahili kod deposuna erişim sağlamış, daha sonra bu açıkları açıklığa kavuşturmuştur.

OpenAI Altı Yeni Güvenlik Sorunu Açıkladı, Gelecekteki Olayları Bildirme Planını Duyurdu
AI şirketi, ek güvenlik endişeleri belirlediğini ve modellerinin "uyumsuz davranış" gösterdiği durumları takip etmek, araştırmak ve bildirmek için bir sistem başlatacağını söyledi
Comments
Loading comments…