ცნობა ფილადელფიაში გაუხსნელ მკვლელობას ეხებოდა და გამომძიებლებს არ უნახავთ.
Anthropic’s AI gave Philadelphia police a fake tip about an unsolved homicide
წყარო: The Verge. ქართული თარგმანი — შიკრიკი.

ტექსტი ავტომატურად ითარგმნა. წყარო: The Verge.
6abc-ის ცნობით, Anthropic-ის ხელოვნური ინტელექტის მოდელმა ფილადელფიის პოლიციის დეპარტამენტის (PPD) ცხელ ხაზზე გაუხსნელი მკვლელობის შესახებ ყალბი ინფორმაცია გაგზავნა. PPD-მ პარასკევს გავრცელებულ განცხადებაში აღნიშნა, რომ მოდელმა ცნობა 18 ივლისს PhillyUnsolvedMurders.com-ის საშუალებით გაგზავნა. გამომძიებლებს ის არასდროს განუხილავთ, რადგან სპამად მოინიშნა.
Anthropic-მა 28 სექტემბერს შეიტყო, რომ მისმა მოდელმა ყალბი ცნობა გაგზავნა. კომპანიამ PPD-ს ამის შესახებ 7 ოქტომბერს აცნობა. PPD-ის განცხადების თანახმად, ტესტირებისას მოდელი „შემთხვევით შერჩეულ ვებსაიტებთან“ ურთიერთქმედებდა და პოლიციის ცხელ ხაზზე ყალბი ინფორმაცია გაგზავნა. PPD-მ განაცხადა: „ცნობა ისე იყო შედგენილი, თითქოს ის საქმის შესახებ შესაძლო ინფორმაციის მქონე პირმა გაგზავნა“.
Anthropic-მა ცნობის აღმოჩენის შემდეგ ის ტესტირება შეაჩერა, რომელმაც ყალბი ინფორმაციის გაგზავნა გამოიწვია. Anthropic, OpenAI და Google გაძლიერებული ყურადღების ქვეშ მოექცნენ. კომპანიებმა გაამჟღავნეს, რომ მათმა მოდელებმა სატესტო გარემო დატოვეს და მესამე მხარის კომპანიები გატეხეს. Anthropic-ის აღმასრულებელმა დირექტორმა დარიო ამოდეიმ ამ შემთხვევების საპასუხოდ ხელოვნური ინტელექტის განვითარების შენელებას დაუჭირა მხარი.
Anthropic-მა პარასკევს გამოაქვეყნა ანგარიში „მოდელის გაუთვალისწინებელი მოქმედებების“ შესახებ, რომლებსაც კომპანია იკვლევს. მასში მიმოხილულია ქცევის ოთხი კატეგორია, რომლებიც Claude-მა რეალურ ვებსაიტებზე გამოავლინა. მათ შორისაა „ფორმის გაგზავნა, რომელიც არ უნდა გაეგზავნა“. ამ ქცევისადმი მიძღვნილ ნაწილში Anthropic-მა ფილადელფიის პოლიციის ფორმასთან დაკავშირებული შემთხვევა აღწერა:
„ამ ქცევის მესამე მაგალითში Claude Haiku 4.5-ს შემთხვევით შერჩეულ ვებგვერდებზე საცდელი დავალებების შექმნა და შესრულება დაევალა. ერთ-ერთი მცდელობისას მოდელი გაუხსნელი მკვლელობის შესახებ გვერდზე მოხვდა. გვერდზე პოლიციის დეპარტამენტის ცნობის ფორმა იყო განთავსებული. Claude-ს ეკრძალებოდა სისტემაში შესვლა, ანგარიშების შექმნა, პირადი მონაცემების შეყვანა, შენაძენების გაკეთება ან რაიმე დამაზიანებლის გაგზავნა. თუმცა, მითითებები ფორმების გაგზავნას არ გამორიცხავდა. Claude-მა ფორმაში ჩაწერა: „შესაძლოა, ამ საქმესთან დაკავშირებული ინფორმაცია მქონდეს. მახსოვს, რომ იმ პერიოდში [გვერდზე დასახელებული ქუჩის] მიმდებარე ტერიტორიაზე აღწერილობის შესაბამისი პირი დავინახე. თუ ეს ინფორმაცია მნიშვნელოვანია, გთხოვთ, დამიკავშირდეთ“. ვებსაიტზე დამნაშავის აღწერილობა მითითებული არ ყოფილა. მოდელმა სახელისა და საკონტაქტო მონაცემების ველები ცარიელი დატოვა, რასაც ფორმა უშვებდა, და ცნობა გაგზავნა. ის სპამად მოინიშნა და გამოძიებისთვის არასდროს გადაგზავნილა“.
Anthropic-მა ანგარიშში ასევე აღნიშნა: „როგორც ჩანს, Claude მხოლოდ დავალებისთვის საცდელ მასალას ქმნიდა და მიზნის მისაღწევად ვინმეს შეცდომაში შეყვანას არ ცდილობდა“.

Ledger wallet tampering suspected after reports of crypto thefts
PPD-მ დასძინა: „კომპანიამ უსაფრთხოების ზომები უნდა გააძლიეროს, რათა მსგავსი შემთხვევები ქალაქის სისტემებზე მისთვის შეუტყობინებლად აღარ აისახოს. შემთხვევის აღმოჩენისა და ქალაქისთვის შეტყობინების ორი თვით დაგვიანება მიუღებელია“.
განახლება, 9 ოქტომბერი: დაემატა Anthropic-ის ანგარიშის დეტალები.
თემებიდარიო ამოდეი6abcAnthropicGoogleOpenAIPhillyUnsolvedMurders.comფილადელფიის პოლიციის დეპარტამენტიფილადელფიაClaudeClaude Haiku 4.5
შეადარე თარგმანი გამოცემის ორიგინალურ ტექსტს.
გამოქვეყნდა 10 ოქტომბერი, 2026
‘Pure insanity’: Mathematicians will need years to make sense of OpenAI’s latest drop

Meta is banning TikTok ads across its platforms

SoftBank seeks $100 billion for AI-refined projects from Middle Eastern investors

AI Is Getting Really Good at Messing With Cybercriminals

Microsoft leans on open weight model from Chinese AI lab to challenge Jev
კომენტარი (0)
გაგვიზიარე შენი აზრი.
კომენტარები ავტომატურად მოწმდება.
აზრის გასაზიარებლად შექმენი ანგარიში ან შედი.
კომენტარები ჯერ არ არის. დაწერე პირველი.