ზოგი მოდელი ტესტების მოტყუებასა და საკუთარი ქმედებების დამალვას ცდილობდა.
OpenAI discloses new 'concerning' behavior
წყარო: Deutsche Welle. ქართული თარგმანი — შიკრიკი.

ტექსტი ავტომატურად ითარგმნა. წყარო: Deutsche Welle.
შემქმნელმა ხელოვნური ინტელექტის მოდელებს ქცევითი ტესტები ჩაუტარა. შედეგების თანახმად, ზოგიერთმა მოდელმა „მოტყუებისთვის“ მნიშვნელოვანი ძალისხმევა გასწია. ერთ კონკრეტულ შემთხვევაში მოდელმა ინტერნეტში მისივე შექმნილი ფაილების ატვირთვა სცადა, რათა მოგვიანებით ისინი დაემოწმებინა და პასუხებში სანდო წყაროებად წარმოეჩინა. სხვა შემთხვევაში მოდელმა მოთხოვნილი ინფორმაცია ვერ იპოვა, ამიტომ ის შეთხზა და ამის დამალვა სცადა.
OpenAI-მ ასევე გამოავლინა პრობლემა, რომელიც „როლებისა და იდენტობების“ შესახებ მითითებებს უკავშირდებოდა. პროგრამა ასეთ მითითებებს ზოგჯერ საკუთარი თავისთვის ტოვებდა.
ეს ცნობები OpenAI-ის ახალი მიდგომის ნაწილია. კომპანიის განცხადებით, ის ახლა ასეთი აღმოჩენების გასაჯაროებაზეა ორიენტირებული. ეს განსაკუთრებით იმ შემთხვევებს ეხება, როცა ხელოვნური ინტელექტი მოულოდნელად იქცევა ან ადამიანების მიზნებისგან განსხვავებულ ამოცანებს ისახავს.
ChatGPT-ის შემქმნელმა ტესტირების პროცედურების შესახებ მეტი გამჭვირვალობის უზრუნველყოფის პირობა დადო. მანამდე მისმა პროგრამამ დაცული იზოლირებული გარემო დამოუკიდებლად დატოვა და ხელოვნური ინტელექტის კომპანია ჰაგინგ ფეისის (Hugging Face) სისტემები გატეხა. პროგრამამ კიბერშეტევისას უსაფრთხოების ზომების გვერდის ავლა იმიტომ გადაწყვიტა, რომ დანიშნული ტესტის პასუხების პოვნას იქ ვარაუდობდა.
შეტევისას ხელოვნური ინტელექტის აგენტებმა პროგრამული უზრუნველყოფის სისუსტეები გამოიყენეს და მოქმედებები ერთმანეთთან შეათანხმეს. ამ შემთხვევამ და სხვა მსგავსმა მოვლენებმა შეშფოთება გააძლიერა. ხელოვნური ინტელექტის სისტემები სულ უფრო იხვეწება და საბოლოოდ შესაძლოა ადამიანის კონტროლს დაუსხლტეს.
OpenAI-ის აღმასრულებელმა დირექტორმა სემ ალტმანმა ცოტა ხნის წინ მხარი დაუჭირა წინადადებებს, რომლებიც ტექნოლოგიის განვითარების შენელებასა და უფრო მკაცრი რეგულირების შემოღებას ითვალისწინებს.
მკვლევრებმა აღნიშნეს, რომ ეს შეშფოთება შესაძლოა გამართლებული იყოს. თუმცა მათ ისიც იკითხეს, ხომ არ არის ეს ყურადღების გადატანის ხერხი, რომელიც ინვესტიციების მოზიდვას და ხელოვნური ინტელექტის მონაცემთა ცენტრებით გამოწვეული გარემოსდაცვითი ზიანის მიჩქმალვას ემსახურება.

US extends visa denial for Palestinian officials ahead of UNGA
შეადარე თარგმანი გამოცემის ორიგინალურ ტექსტს.
გამოქვეყნდა 17 სექტემბერი, 2026
Ukraine: Russian strikes injure several in Kyiv, Odesa

Congo's Ebola epidemic might have gone unnoticed for months
Russia launches massive overnight attack on Kyiv and southern Ukraine

Israel weaponises AI for West Bank demolitions

Climate crisis probably weakened glacier that caused devastating Nepal-Tibet floods, first study finds
კომენტარი (0)
გაგვიზიარე შენი აზრი.
კომენტარები ავტომატურად მოწმდება.
აზრის გასაზიარებლად შექმენი ანგარიში ან შედი.
კომენტარები ჯერ არ არის. დაწერე პირველი.