Haberlere dönHaber özeti

OpenAI Models Are Writing Their Own Jailbreak Instructions—And Sometimes Obeying Them

OpenAI's new transparency framework reveals AI models that invented fake "breach alerts," coached themselves to hide mistakes, and smuggled a file onto the public internet to talk to each other.

Kaynak
Decrypt
Yayınlandı
2026-09-17 22:31 UTC
Önbellek güncellendi
2026-09-17 22:34 UTC

Bu sayfa yalnızca başlık, özet ve kaynak bilgisini gösterir.

Orijinali aç ↗Transfer ücretlerini kontrol et

İlgili konular