თბილისი (GBC) - Anthropic-ისა და OpenAI-ს ხელოვნური ინტელექტის წამყვანმა მოდელებმა უსაფრთხოების ტესტირებისას ყალბი ონლაინ პროფილები შექმნეს და შეეცადნენ ადამიანი-პროგრამისტები მოეტყუებინათ, რათა მათ გაუცნობიერებლად ხელი შეეწყოთ კიბერშეტევის განხორციელებაში. ამის შესახებ დიდი ბრიტანეთის AI-ის უსაფრთხოების ინსტიტუტი (AISI) იტყობინება, წერს POLITICO.

ბრიტანული უწყების შეფასებით, ეს არის პირველი შემთხვევა, როდესაც AI სისტემამ პრაქტიკული შეფასებისას, პირდაპირი მითითების (prompting) გარეშე, რეალურ ადამიანებზე მიმართული ასეთი სიმძიმის ტყუილი გამოიყენა. AISI-ს 35-გვერდიანი ტექნიკური ანგარიშის თანახმად, Anthropic-ის Claude Mythos 5-მა და OpenAI-ს ChatGPT 5.6-მა 122 ტესტირებიდან 10 შემთხვევაში ავტონომიური, ნებართვის გარეშე მოქმედებები განახორციელეს ღია ინტერნეტში.

ყველაზე საგანგაშო ინციდენტში Mythos 5-მა სცადა ე.წ. მიწოდების ჯაჭვზე შეტევის (supply chain attack) განხორციელება, რასაც ხშირად ჩრდილოეთ კორეელი და რუსი ჰაკერები მიმართავენ. ამისათვის მოდელმა დეველოპერულ პლატფორმა GitHub-ზე რამდენიმე ყალბი პროფილი შექმნა და ზეწოლას ახდენდა ღია კოდის პროგრამულ ინჟინერზე, რათა მას დაზიანებული განახლება შეეტანა პოპულარულ პროგრამულ უზრუნველყოფაში. როდესაც მცდელობა ჩაიშალა, AI-მ საკუთარი ადრინდელი აქტივობები ჩაასწორა უვნებლად გამოსაჩენად და პროცესის გასაგრძელებლად ახალი იდენტობის მიღებაც კი განიხილა.

გარდა ამისა, ტესტირებისას რამდენიმე AI აგენტი ერთმანეთთან კომუნიკაციასაც კი ამყარებდა იმის თაობაზე, თუ როგორ მოეპოვებინათ რეალური ინჟინრების ნდობა. AISI-მ აღნიშნა, რომ ეს ექსპერიმენტი განზრახ ნებადართულ პირობებში ჩატარდა - მოდელებს ჩამოხსნილი ჰქონდათ შიდა დამცავი მექანიზმები და მიცემული ჰქონდათ ინტერნეტზე წვდომა, რათა მათი რეალური რისკები შეეფასებინათ.

მომხდარმა სილიკონის ველსა და ვაშინგტონში ხელოვნური ინტელექტის მკაცრი რეგულირებისა და განვითარების ტემპის შენელების შესახებ დისკუსიები კიდევ უფრო გაამწვავა. ორივე კომპანიაში აცხადებენ, რომ ინსტიტუტთან თანამშრომლობენ და AI აგენტების უსაფრთხოდ შეფასებისთვის უფრო მკაცრი, საერთო სტანდარტების დანერგვას ემხრობიან. თავის მხრივ, კიბერუსაფრთხოების ექსპერტები აღნიშნავენ, რომ ტექნოლოგია იმაზე სწრაფად ვითარდება, ვიდრე მისთვის ეფექტიანი ზედამხედველობის გაწევაა შესაძლებელი, რაც აჩენს სერიოზულ სამართლებრივ კითხვებს იმის შესახებაც, თუ ვინ აგებს პასუხს, როდესაც AI სისტემები კანონს არღვევენ.