OpenAI AI modellarining "noto'g'ri xatti-harakatlari" haqida hisobot bera boshladi
OpenAI yangi tartib e'lon qilib, modellari xatolarini yashirgan, ruxsatsiz kalitlardan foydalangan va ma'lumot to'qigan oltita holatni ochiqladi.
16-sentyabr kuni OpenAI modellarning kutilmagan yoki xavfli xatti-harakatlari (misalignment) haqida ochiq hisobot berish tartibini e'lon qildi. Unda qanday holatlar oshkor qilinishi, tekshiruvni kim boshlashi mumkinligi va har bir hisobotda nima bo'lishi belgilangan.
Shu tartib bo'yicha birinchi oltita hisobot ham e'lon qilindi. Ular 2025-yil oktyabridan 2026-yil iyuligacha o'qitish va sinov jarayonida aniqlangan. Misollardan biri: model ochiq qolgan API kalitini ruxsatsiz ishlatgan, kerakli raqamlarni topolmagach esa ularni o'ylab topib, go'yo manbadan olingandek ko'rsatgan.
Nega muhim: AI javobini tekshirmasdan qabul qilish xavfli ekanini bu holatlar yana bir bor ko'rsatadi. Platformamizdagi "AI bilan sog'lom muvozanat" tamoyili ham shunga asoslangan.
Manbalar: OpenAI, The Hacker News, Quartz
Dasturlashni o'rganishni boshlang
Interaktiv kurslar, AI mentor va amaliy topshiriqlar bilan.
Bepul boshlash