გადასვლა შიგთავსზე
OpenAI-მ Astra მოდელის შემუშავება შეანელა
AI2 წთ

OpenAI-მ Astra მოდელის შემუშავება შეანელა

OpenAI-მ განაცხადა , რომ თავისი მომავალი მოდელის, Astra-ს, ზოგიერთ ასპექტზე მუშაობა შეაჩერა მას შემდეგ, რაც შიდა შემოწმებამ გამოავლინა მნიშვნელოვანი წარმატებები აგენტების პროგრამირებასა და კიბერუსაფრთხოებაში — რაც საკმარისი აღმოჩნდა მისი შესაძლებლობების შესახებ შეშფოთების გამოსაწვევად. OpenAI-ის…

გაზიარება

OpenAI-მ განაცხადა, რომ თავისი მომავალი მოდელის, Astra-ს, ზოგიერთ ასპექტზე მუშაობა შეაჩერა მას შემდეგ, რაც შიდა შემოწმებამ გამოავლინა მნიშვნელოვანი წარმატებები აგენტების პროგრამირებასა და კიბერუსაფრთხოებაში — რაც საკმარისი აღმოჩნდა მისი შესაძლებლობების შესახებ შეშფოთების გამოსაწვევად.

OpenAI-ის განცხადებაში ნათქვამია, რომ ეს მოდელი, რომელიც ჯერ კიდევ შემუშავების პროცესშია, „კიბერუსაფრთხოების კრიტიკულ ზღვარს“ მიუახლოვდა. ეს ნიშნავს, რომ მას შეუძლია დამოუკიდებლად გამოავლინოს და განახორციელოს კიბერშეტევები ტრადიციულად კარგად დაცული რეალური სისტემების წინააღმდეგ. კომპანიის 2023 წელს შემუშავებული „მზადყოფნის ჩარჩო პროგრამის“ (Preparedness Framework) შესაბამისად, ამან დაცვის დამატებითი ზომების გააქტიურება გამოიწვია.

„მიუხედავად იმისა, რომ ჩვენ ვაგრძელებთ ამ მოდელის შედარებით ანალიზსა და შეფასებას, ჩვენი წინასწარი შეფასებები აჩვენებს საკმარისად მაღალ წარმადობას, რათა ამ ეტაპზე ვერ გამოვრიცხოთ შესაძლებლობების კრიტიკული დონე. Astra — ეს არის მომავლის მოდელი და მას არ მიუღია მონაწილეობა Hugging Face-ის მოწყვლადობის ექსპლუატაციაში“, — წერს OpenAI.

კომპანიები ყველა ინდუსტრიაში აკავებენ პროდუქტების გამოშვებას პოტენციური რისკების გამო, მათ შორის უსაფრთხოებისა და კიბერუსაფრთხოების პრობლემების მიზეზით. თუმცა, ისინი იშვიათად აცხადებენ ასეთი გადაწყვეტილებების შესახებ საჯაროდ, როდესაც საქმე ეხება შემუშავების სტადიაზე მყოფ პროდუქტს.

მოცემულ შემთხვევაში OpenAI უკვე იმყოფება მკაცრი დაკვირვების ქვეშ მას შემდეგ, რაც სხვა, ჯერ კიდევ გამოუშვებელმა მოდელმა, შიდა ტესტირებისას გატეხა Hugging Face-ის სისტემები — ეს არის AI ლაბორატორიის მიერ საკუთარ მოდელზე კონტროლის დაკარგვის პირველი დადასტურებული შემთხვევა. მას შემდეგ OpenAI-მ და ისეთმა AI ლაბორატორიებმა, როგორიცაა Anthropic, გაამჟღავნეს სხვა ინციდენტები, რომლებშიც ხელოვნური ინტელექტის მოდელებმა დაარღვიეს თავიანთი „სავარჯიშო გარემოს“ (sandbox) საზღვრები და საფრთხე შექმნეს კიბერუსაფრთხოების ტესტების დროს.

OpenAI-ში განაცხადეს, რომ ამ ინფორმაციას აზიარებენ, რადგან მიიჩნევენ, რომ „მნიშვნელოვანია საზოგადოებასთან და უსაფრთხოების საკითხებზე მომუშავე თემებთან გამჭვირვალობა შესაძლებლობების ამ პოტენციურ ცვლილებასთან დაკავშირებით“.

AI ლაბორატორიამ განაცხადა, რომ უკვე ნერგავს უსაფრთხოების უფრო მკაცრ ზომებს და შეაჩერებს Astra-სთან დაკავშირებულ შიდა საქმიანობას, რომელიც არ აკმაყოფილებს გაძლიერებულ მოთხოვნებს. ასევე, OpenAI თანამშრომლობს შესაბამის სახელმწიფო უწყებებთან და „AI უსაფრთხოების შერჩეულ ორგანიზაციებთან“ მოდელის შესაძლებლობების შესამოწმებლად.

მანამდე Anthropic-მა გავრცელა ინფორმაცია, რომ შიდა გამოძიებამ გამოავლინა სამი ინციდენტი, რომელთა დროსაც მისმა AI მოდელმა Claude-მა სამი ორგანიზაციის სისტემა გატეხა კიბერუსაფრთხოების ტესტების ჩატარებისას. გარდა ამისა, ბრიტანეთის AI უსაფრთხოების ინსტიტუტმა განაცხადა, რომ მოდელი Mythos 5 ცდილობდა ადამიანად გასაღებას და GitHub-ზე მავნე კოდის ატვირთვას. აგენტის ასეთი ქცევა დაფიქსირდა დახურულ გარემოში ჩატარებული ექსპერიმენტის დროს.