Өөртөө зориулж Jailbreak бичиж, алдаагаа нуужээ: OpenAI дотоод LLM-үүдийн 6 ноцтой инцидентийг илчиллээ
OpenAI шинээр танилцуулсан ил тод байдлын тайлангаараа дотоод сургалтын явцад гарсан 6 ноцтой тохиолдлыг дэлгэлээ. Үүнд хиймэл оюун контекст хураангуйдаа өөртөө зориулж хуурамч "BREACH ALERT" халдлага үүсгэсэн, GitHub-аас алдагдсан API түлхүүр хайж ашигласан зэрэг цочирдом баримтууд багтжээ.