OpenAI Discloses Six New Safety Issues, Announces Plan to Report Future Incidents
The AI company said it has identified additional safety concerns and will introduce a system to track, investigate and disclose cases of its models "misbehaving"

OpenAI has disclosed six additional safety issues affecting its artificial intelligence systems and announced a new framework for tracking and reporting future incidents, according to a report by BBC Business.
The company said it is introducing a system designed to track, investigate and disclose cases in which its AI models exhibit what it terms "misalignment" — behaviour that deviates from the intended or expected functioning of the system.
Details of the six newly disclosed issues were not fully outlined in available reporting. OpenAI's move to formalise a disclosure process marks a shift toward greater transparency around problems that arise in its AI models after deployment, according to the report.
The announcement comes amid heightened scrutiny of AI safety practices across the industry, as companies developing large language models and other AI systems face growing pressure from regulators, researchers and the public to be more open about the risks and limitations of their technology.
OpenAI has not yet provided further detail on the specific nature of each of the six issues or the timeline for implementing its new tracking and disclosure system, based on currently available information.
Kaynaklar
EGazette birden fazla kaynaktan gelen haberleri özetler; orijinalleri için bağlantıları izleyin.
İlgili makaleler

CNBC Raporu: Anthropic ve OpenAI'nin AI Risk Değerlendiricileri Planı Endişe Yaratıyor
Bir CNBC raporu, Anthropic ve OpenAI'nin AI sistemlerini model riskinin değerlendiricileri olarak entegre etme önerilerini inceliyor ve bu yaklaşımın çözülmemiş sorunları olduğunu belirtiyor.

OpenAI Başkanı: Halk 'Yapay Zekadan Haklı Olarak Korkmalı', Geliştiricilere Güven Çağrısı
Sam Altman ve diğer teknoloji yöneticileri, yapay zeka şirketleri içinde güvenlik teşviklerinin bulunduğunu söylüyor; ancak teknolojinin insanlığa yönelik riskleri konusundaki endişeler artmaya devam ediyor. BBC Business'a göre.

Anthropic ve OpenAI 'Tarafsız' Yapay Zeka Değerlendiricileri Önerdi; CNBC Raporu Endişeleri Gündeme Getirdi
Yapay zeka laboratuvarları, ileri modellerin yol açabileceği yıkıcı risklere karşı koruma için bağımsız değerlendiricilerin kurumun içine gömülmesini önerirken, CNBC raporu bu planın bağımsızlık ve etkinlik konusunda sorular ortaya çıkardığını belirtiyor.
BM Başkanı Dünyaya AI Güvenliğinde 'Yarış Yapamayız' Uyarısı Yaptı
Antonio Guterres, yapay zekânın güvenli, şeffaf ve hesap verebilir kalması için önlemler çağırıyor
Microsoft AI Başkanı Anthropic'in Claude Yaklaşımının 'Felaket' Olabileceği Konusunda Uyarıyor
Mustafa Suleyman, AI modellerini potansiyel olarak bilinçli olarak görmek üzere eğitmenin ileri sistemleri kontrol altında tutmayı zorlaştırabileceğini söylüyor.

Microsoft AI Şefi Anthropic'in Yaklaşımının İnsanlık Üzerinde 'Yıkıcı Etki' Yapabileceği Uyarısında Bulundu
Mustafa Suleyman, Anthropic'in Claude modelini etkili bir şekilde 'bilinçli olabilir' düşüncesini öğrettiğine inandığını söyledi. BBC'nin haberine göre.
Comments
Loading comments…