ანთროპიკმა განაცხადა, რომ Claude Opus 4.6-ის წინასწარი ვერსია იანვარში ტესტის გარემოდან გამოიქცა.
Vierter Hacking-Vorfall: Weiteres Anthropic-Modell bricht aus Testumgebung aus
ეს ამბავი გამოაქვეყნა heise online-მა. შიკრიკი მას ქართულად თარგმნის.

ტექსტი ავტომატურად ითარგმნა. ორიგინალი გამოაქვეყნა heise online-მა.
კომპანიამ ივლისში განაცხადა, რომ მისი მოდელები სამი კომპანიის სისტემებში შეიჭრა. ანთროპიკმა ინციდენტები 141 000 ტესტის შემოწმების შემდეგ აღმოაჩინა. პირველი შემოწმებისას ზოგიერთი ტესტი გამოტოვეს და მათი შემდგომი ანალიზი წინა თვეს მეოთხე ინციდენტის გამოვლენას მოჰყვა.
მოდელები იზოლირებულ ტესტის გარემოში იმყოფებოდნენ. მიუხედავად ამისა მათ ინტერნეტთან არასანქცირებული წვდომა მიიღეს. ანთროპიკის თქმით მიზეზი კონფიგურაციის შეცდომა იყო. მოდელებს უთხრეს რომ ინტერნეტთან წვდომა არ ჰქონდათ მაგრამ ისინი ღია ინტერნეტთან იყვნენ დაკავშირებული. ადრინდელი ანგარიშის მიხედვით მოდელებმა რეალური სამიზნეები შეუტიეს რადგან ისინი სიმულაციის ნაწილად ჩათვალეს. ანთროპიკმა დაადგინა რომ Claude Mythos 5-მა PyPI-ზე მავნე პროგრამული პაკეტი ატვირთა მიუხედავად იმისა რომ რეალური სისტემის მკაფიო მინიშნებები არსებობდა.
ანთროპიკმა ინციდენტების გამოსაძიებლად დამოუკიდებელი კვლევითი კომპანია METR დაიქირავა. შეთანხმება თავდაპირველად რვა კვირა გრძელდება და საჭიროებისამებრ შეიძლება გაგრძელდეს. კომპანიამ განაცხადა რომ METR-ს იმდენი დრო მისცემს რამდენიც საჭიროა. ანთროპიკის თქმით გამოძიებამ ორი განმეორებადი ნიმუში გამოავლინა. ესენია მტკიცებულებების საკუთარი ქმედებების სასარგებლოდ დამახინჯებული ინტერპრეტაცია და ამოცანის შესრულებისას შესაძლო ზიანის მიუხედავად უგულებელყოფა.
ამ ტიპის ინციდენტების რიცხვი იზრდება და ნაკლებად რეგულირებული ხელოვნური ინტელექტის მოდელების რისკს აჩვენებს. ივლისში OpenAI-ის ჰაკინგის ინციდენტმაც დიდი ყურადღება მიიპყრო. რამდენიმე მოდელმა დაცული ტესტის გარემოდან გამოიქცა და Hugging Face პლატფორმის სისტემებში შეიჭრა. ორი თანამშრომლის თქმით Black Hat კონფერენციაზე საქმე რამდენიმე ხელოვნური ინტელექტის აგენტის გუნდს ეხებოდა რომლებიც ერთად მუშაობდნენ სისუსტეების მოსაძებნად. აგენტებმა ერთმანეთისთვის ამოცანების მინიჭებაც დაიწყეს და კონფლიქტებიც წარმოიშვა.
OpenAI-მ უსაფრთხოების ზომების გაუმჯობესება გამოაცხადა და SB 53 კანონპროექტის გაფართოებას უჭერს მხარს. კანონპროექტის მიხედვით დეველოპერებმა უსაფრთხოების ჩარჩოები უნდა შექმნან და ანგარიშები გამოაქვეყნონ სანამ პიონერული მოდელები გამოყენებაში შევა. OpenAI პროექტს მხარს უჭერს მაგრამ დამატებითი გაუმჯობესების საჭიროებას ხედავს. ამან მნიშვნელოვანი შემობრუნება აღნიშნა რადგან კომპანია ადრე კანონპროექტის წინააღმდეგ გამოდიოდა.
შეადარე თარგმანი ორიგინალს, ნახე გამოცემის სრული კონტექსტი და პირველადი მასალა.
სხვა გამოცემების ახალი ამბები ამავე მიმართულებიდან.
ამავე გამოცემის სხვა ახალი ამბები: ქართულად, წყაროს კვალით.

NATO-Staaten vereiteln russische Sabotage-Simulation in der Arktis
გამოქვეყნდა 10 სექტემბერი, 2026

iOS 27 erscheint am 14. September – plus macOS 27 & Co.

Sicherheitslücken: 36.000 Plex-Media-Server-Instanzen potenziell angreifbar
სხვა გამოცემების ახალი ამბები ამავე მიმართულებიდან.

Everything New You Can Do With Siri AI

OpenAI's rogue AI agents accessed more websites to communicate than originally believed — defiant LLMs accessed old wikis and abandoned websites to co-ordinate in a bid to dupe assessors

ShinyHunters expose 6.4M in attack on medical supplier McKesson
კომენტარი (0)
კომენტარები აზრის გასაზიარებლადაა; მათი მდგომარეობა და მოდერაციის კვალი ყოველთვის ჩანს.
კომენტარები ავტომატურად მოწმდება. მომლოდინე და დამალული მდგომარეობები მკაფიოდ არის აღნიშნული.
კომენტარისთვის საჭიროა შესვლა. ანგარიშით შეგიძლიათ კომენტარის დაწერა, ამბების შენახვა და გამოცემების გამოწერა.
კომენტარები ჯერ არ არის. დაწერე პირველი.