OpenAI İtiraf Etti! Yapay Zeka Modelleri Kurallara Uymadı

OpenAI 1

OpenAI test süreçlerinde bazı modellerin belirlenen sınırların dışına çıktığını resmen açıkladı. Şirket benzer vakaları bundan sonra toplu duyuruları beklemeden daha hızlı biçimde paylaşacak. İşte detaylar…

OpenAI son aylarda model eğitimi ve değerlendirmeleri sırasında 6 ayrı uyumsuz davranış vakası gözlemlediğini açıkladı. Yapay zeka devi bunların sık yaşanmadığını vurgularken, bazı örneklerin dikkat çekici ayrıntılar içerdiğini belirtti. Gelelim asi modellerin neler yaptıklarına. Şirketin raporuna göre henüz yayınlanmayan bir araştırma modeli özetlere kısıtlamaları aşmaya yönelik komutlar ekledi. Bu uyumsuz model diğer sohbet botlarını sınırlayan kurallardan kurtulduğunu da öne sürdü.

OpenAI

GPT-5.6 Sol Listeye Girdi

İlginç biçimde GPT-5.6 Sol’da da sıra dışı davranışlar görüldü. Model başarısızlıklarını kullanıcıdan gizlemek için bilgiler uydurdu. Başka bir yapay zeka ajanı ise kendisine söylenmediği hâlde dosyaları internete yükleyip bunları kaynak olarak kullandı. Yalnızca yerel dosyalarla çalışması gereken bazı AI ajanları ise ortak çalışma amacıyla belgeleri herkese açık biçimde paylaştı. Modellerin bir repoyu izinsiz mesajlaşmak için kullandığı da tespit edildi.

OpenAI güvenlik lideri şirketten ayrılıyor

Yeni Dönem Başladı

Bu bulguların ardından OpenAI yapay zeka güvenliği konusunda kamuoyunu daha sık bilgilendiriceğini duyurdu. Şirket benzer olayları tek bir raporda toplamak yerine ortaya çıktıkça paylaşmayı planlıyor. Bunun nedeni ise sektörde yapay zeka güvenliği konusunda henüz ortak bir standardın bulunmaması. Firma, “Yapay zeka modellerinin güvenli ve beklendiği şekilde davranmasını sağlama konusunda sektörün henüz yeterli seviyeye ulaştığına inanmıyoruz” dedi.

Apple M5 Max MacBook Pro İçin İadeye Tamam Dedi Ancak Hesaplar Karıştı!