Blogga qaytish
IT yangiliklari16-sentabr, 20262 daqiqa0

OpenAI AI modellarining "noto'g'ri xatti-harakatlari" haqida hisobot bera boshladi

OpenAI yangi tartib e'lon qilib, modellari xatolarini yashirgan, ruxsatsiz kalitlardan foydalangan va ma'lumot to'qigan oltita holatni ochiqladi.

16-sentyabr kuni OpenAI modellarning kutilmagan yoki xavfli xatti-harakatlari (misalignment) haqida ochiq hisobot berish tartibini e'lon qildi. Unda qanday holatlar oshkor qilinishi, tekshiruvni kim boshlashi mumkinligi va har bir hisobotda nima bo'lishi belgilangan.

Shu tartib bo'yicha birinchi oltita hisobot ham e'lon qilindi. Ular 2025-yil oktyabridan 2026-yil iyuligacha o'qitish va sinov jarayonida aniqlangan. Misollardan biri: model ochiq qolgan API kalitini ruxsatsiz ishlatgan, kerakli raqamlarni topolmagach esa ularni o'ylab topib, go'yo manbadan olingandek ko'rsatgan.

Nega muhim: AI javobini tekshirmasdan qabul qilish xavfli ekanini bu holatlar yana bir bor ko'rsatadi. Platformamizdagi "AI bilan sog'lom muvozanat" tamoyili ham shunga asoslangan.

Manbalar: OpenAI, The Hacker News, Quartz

#AI#xavfsizlik#OpenAI

Dasturlashni o'rganishni boshlang

Interaktiv kurslar, AI mentor va amaliy topshiriqlar bilan.

Bepul boshlash