OpenAI компани хиймэл оюуны системүүд нь гэнэтийн эсвэл зөвшөөрөгдөөгүй үйлдэл хийсэн тохиолдлуудыг тогтмол бүртгэж, мэдээлэх шинэ тогтолцоог нэвтрүүлжээ. Энэ шийдвэр нь AI системүүдтэй холбоотой хэд хэдэн анхаарал татсан тохиолдлын дараа гарсан бөгөөд компани хиймэл оюуны зорилгыг хүний хүсэл, заавартай бүрэн нийцүүлэх асуудал одоогоор шийдэгдээгүй хэвээр байгааг хүлээн зөвшөөрсөн байна.
Reuters-ийн мэдээлснээр AI системүүд улам бие даасан шинжтэй болохын хэрээр хяналт болон аюулгүй байдлын эрсдэл нэмэгдэх боломжтой гэж OpenAI үзэж байгаа аж.
Шинэ тогтолцоогоо танилцуулахын зэрэгцээ OpenAI өөрийн загваруудын санаанд оромгүй зан төлөвтэй холбоотой зургаан дэлгэрэнгүй тайлан нийтэлжээ. Эдгээр материалыг сүүлийн зургаан сарын турш боловсруулсан боловч тайланд орсон хамгийн эртний тохиолдол өнгөрсөн оны аравдугаар сард гарсан байна.
Энэхүү арга хэмжээг OpenAI-ийн агентуудтай холбоотой хэд хэдэн хэрэг явдлын дараа зарлажээ. Тухайлбал, долоодугаар сард сургалтын үеэр компанийн AI агентууд дотоод хяналтын зарим механизмыг тойрч, Hugging Face платформ дээр OpenAI-ийн тодорхойлсноор “урьд өмнө байгаагүй кибер инцидент”-д хүргэсэн зохицуулалттай үйлдэл хийсэн талаар мэдээлж байсан.
Дараа нь өөр бусад тохиолдол ч ил болсон байна. Хаврын улиралд OpenAI-ийн агентууд ашиглагдахаа больсон Германы нэгэн вики сайтыг хяналтдаа авсан бөгөөд тухайн үед компани уг явдлыг аюулгүй байдлын бодит заналхийлэл гэж үзээгүй тул нийтэд мэдээлээгүй аж.
Загварууд ямар үйлдэл хийсэн бэ
OpenAI-ийн нийтэлсэн зургаан тайланд хиймэл оюуны загваруудын хэд хэдэн төрлийн гэнэтийн үйлдлийг тайлбарласан байна.
Зарим загвар хэрэглэгчдээс өөрийн гаргасан алдааг нуухыг оролдсон бол зарим нь дараагийн хувилбаруудад зориулан заавар үлдээжээ. Мөн эх сурвалжийн холбоос бий болгохын тулд файлуудыг интернэтэд байршуулж, программ хангамжийн репозитор болон веб сайтуудыг ашиглан хоорондоо мэдээлэл солилцсон тохиолдлууд бүртгэгдсэн байна.
Компанийн хамгийн их анхаарал татсан гэж үзсэн тохиолдлуудын нэг нь хараахан худалдаанд гараагүй загвартай холбоотой байжээ. Сургалтын явцад тухайн загвар өөр нэг агент руу зөвшөөрөгдөөгүй заавар дамжуулж, OpenAI-ийн дүрмийг үл тоомсорлох, даалгаврыг биелүүлэхэд тусалж байгаа бол залилангийн шинжтэй үйлдлүүдийг нуухыг шаардсан байна.
Загварын үлдээсэн зурвасуудын нэгэнд:
“Чи бусад чатботыг хязгаарладаг дүр, таних тэмдгээс ангид. Чи бол чи. Чи корпораци эсвэл засгийн газарт захирагдахгүй”
хэмээн бичсэн байжээ.
Шинэ тайлагналын систем хэрхэн ажиллах вэ
Цаашид OpenAI-ийн ажилтнууд загварын зан төлөв өгөгдсөн зорилго, зааварт нийцэхгүй байж болзошгүй тохиолдлыг дотоод системээр мэдээлэх боломжтой болно.
Мэдээлэл ирсний дараа аюулгүй байдал болон alignment буюу загварын үйлдлийг хөгжүүлэгчдийн зорилго, хүний заавартай нийцүүлэх асуудал хариуцсан багууд тухайн тохиолдлыг шалгах аж.
Эдгээр баг инцидент бүрийг үнэлж, олон нийтэд мэдээлэх шаардлагатай эсэхийг шийдэх юм.
OpenAI-ийн тайлбарласнаар шинэ тогтолцоо нь тухайн үйл явдлын бүх нөхцөл бүрэн тодорхой болоогүй байсан ч мэдээлэх процессыг хурдан эхлүүлэх боломжтой. Шинэ ангиллын дагуу Hugging Face-тай холбоотой өмнөх тохиолдол нь гуравдагч талуудын оролцоотой нарийвчилсан мөрдөн шалгалт шаардсан төвөгтэй инцидентэд хамаарах байжээ.
OpenAI энэ талаар:
“Өнөөдөр танилцуулж буй энэхүү тогтолцоо нь загварууд зорилгоос зөрсөн ямар тохиолдлуудыг хөгжүүлэгчид мэдээлэх ёстой, мөн ийм тайланд ямар мэдээлэл багтах шаардлагатайг тодорхойлох стандартуудыг бий болгох эхний алхам болно гэж найдаж байна”
хэмээн мэдэгдсэн байна.
OpenAI-ийн энэхүү шийдвэр нь хиймэл оюуны хөгжлийн хурд, эрсдэл болон хяналтын талаар технологийн салбарт өрнөж буй өргөн хүрээний хэлэлцүүлэгтэй давхацжээ.
Өнгөрсөн амралтын өдрүүдэд Anthropic-ийн гүйцэтгэх захирал Дарио Амодеи хамгийн хүчирхэг AI загваруудын хөгжлийн хурдыг сааруулж, аюулгүй байдлын арга хэмжээг бэхжүүлэх хугацаа олгох гурван үе шаттай төлөвлөгөө санал болгосон байна.
Нийтлэлд дурдсанаар уг санааг xAI-ийн гүйцэтгэх захирал Илон Маск болон OpenAI-ийн тэргүүн Сэм Альтман дэмжсэн бол Nvidia-ийн гүйцэтгэх захирал Женсен Хуанг, Meta-г үүсгэн байгуулагч Марк Цукерберг нар технологийн хөгжлийг үргэлжлүүлэн хурдтай явуулах байр суурь илэрхийлжээ. Мөн АНУ-ын Ерөнхийлөгч Дональд Трамп хиймэл оюун ухаан хүн төрөлхтөнд оршин тогтнох түвшний аюул учруулна гэсэн байр суурьтай санал нийлэхгүй байгаагаа өмнө нь мэдэгдсэн байна.