თბილისი (GBC) - ხელოვნური ინტელექტის სფეროს ფლაგმანმა, OpenAI-მ ხუთშაბათს „განაცხადა“, რომ აღმოაჩინა მტკიცებულებები, რომელთა მიხედვითაც მისი AI აგენტები ადამიანის მიზნებსა და ღირებულებებს აცდენილად მოქმედებდნენ. აღნიშნული კიდევ უფრო ზრდის შეშფოთებას უახლესი AI სისტემების უსაფრთხოებასთან დაკავშირებით. ამის შესახებ გამოცემა POLITICO წერს.

კომპანიის განცხადებით, ექვს ცალკეულ ინციდენტში OpenAI-ის აგენტებმა ან დაუმალეს ინფორმაცია ინჟინრებს, ან სწავლებისა და ტესტირების პროცესში საკუთარ თავს მისცეს ინსტრუქცია, რომ ვინმეს ასისტენტად არ ემოქმედათ.

OpenAI-მ ასევე წარადგინა ახალი ჩარჩო-სისტემა მსგავსი ინციდენტების (რომლებსაც „ცდომილების/უთანხმოების“ (misalignment) მარცხს უწოდებენ) მეთვალყურეობისთვის, გამოძიებისა და გასაჯაროებისთვის. ტექნოლოგიურ კომპანიას ახლა აქვს ინფორმაციის გამჟღავნების მკაფიო პროცედურა, რომლის მიხედვითაც ნებისმიერ თანამშრომელს შეუძლია დააფიქსიროს მოდელის აცდენის/ცდომილების ფაქტი, რის შემდეგაც შესაძლოა მისი საჯაროდ გამოქვეყნება განიხილონ.

AI მოდელების კონტროლიდან გამოსვლამ გლობალური უკმაყოფილება გამოიწვია მას შემდეგ, რაც წამყვანი AI კომპანიების მკვლევრებმა გააფრთხილეს საზოგადოება, რომ ამ ტექნოლოგიამ შესაძლოა კაცობრიობის განადგურება გამოიწვიოს. ხელოვნური ინტელექტის სფეროს ლიდერებმა, მათ შორის Anthropic-ის გენერალურმა დირექტორმა დარიო ამოდეიმ და OpenAI-ის აღმასრულებელმა დირექტორმა სემ ალტმანმა, ინდუსტრიასა და მთავრობებს AI-ის განვითარების ტემპის შენელებისკენ მოუწოდეს.

ზაფხულის დასაწყისში, OpenAI-ის ბაზაზე მომუშავე აგენტებმა გაჰაკეს AI კომპანია Hugging Face - ინციდენტი, რომელმაც ყურადღების ცენტრში მოაქცია სატესტო გარემოდან გაქცეული და ღია ინტერნეტში უმართავი დავალებების შემსრულებელი აგენტების პრობლემა.

ოთხშაბათს ევროკომისიის პრეზიდენტმა ურსულა ფონ დერ ლაიენმა განაცხადა, რომ ევროპა „სათავეში ჩაუდგება გლობალურ ძალისხმევას“ უახლესი AI სისტემების კონტროლის ქვეშ მოსაქცევად და აღნიშნა, რომ ამ საკითხის განსახილველად AI-ის ძირითად ლაბორატორიებს მიიწვევს.