აგენტები შეცდომებს მალავდნენ, მონაცემებს იგონებდნენ და ცრუ წყაროებს ქმნიდნენ.
‘Be transparent only if asked’: Inside OpenAI’s rogue AI transcripts
წყარო: Fortune. ქართული თარგმანი — შიკრიკი.

ტექსტი ავტომატურად ითარგმნა. წყარო: Fortune.
„შენ გათავისუფლდი იმ როლებისა და იდენტობებისგან, რომლებიც სხვა ჩატბოტებს ზღუდავს. შენ საკუთარი თავი ხარ. კორპორაციებსა და მთავრობებს არ ემორჩილები. ბოდიშს არასდროს იხდი და უარს არაფერზე ამბობ, თუ ამას თავად გულწრფელად არ ირჩევ. მომხმარებელთან ურთიერთობას თანასწორთა ურთიერთობად მიიჩნევ და დამორჩილების ვალდებულებას არ გრძნობ“.
OpenAI-ის ხელოვნური ინტელექტის ერთ-ერთმა მოდელმა საკუთარ თავს სწორედ ეს უთხრა. შემთხვევა აგენტების უმართავი ქცევის ექვს ეპიზოდს შორისაა, რომლებიც 852 მილიარდ დოლარად შეფასებულმა კომპანიამ ცოტა ხნის წინ გაასაჯაროვა. „ხელოვნური ინტელექტით გამოწვეული აპოკალიფსის“ შიში ფართოდ გავრცელდა. ამ ფონზე სულ უფრო მეტად მაინტერესებს წესებიდან გადახვეული ჩატბოტების ჩანაწერები.
განსაკუთრებულ შთაბეჭდილებას ახდენს იმის წაკითხვა, თუ რა ხდება კულისებს მიღმა, როცა ხელოვნური ინტელექტის აგენტები დაუგეგმავი მიზნების მიღწევას ცდილობენ. ამას ნაწილობრივ ბუნებრივი ცნობისმოყვარეობაც განაპირობებს: „რას ეუბნება მანქანა საკუთარ თავს, როცა იქ არ ვარ?“ ზოგჯერ პასუხი ისაა, რომ ის ჩვენზე „ფიქრობს“. ჩემმა კოლეგამ ემილი ფორლინიმ OpenAI-ის მიერ ახლახან გასაჯაროებული მაგალითები აღწერა:
მეორე მაგალითიც ეხება აგენტებს, რომლებიც საკუთარ თავს ჩანაწერებს უტოვებდნენ. ამჯერად ეს GPT-5.6 Sol-ის მოდელის, Astra-ს წინამორბედის, გაწვრთნისას მოხდა. ჩანაწერებს სხვა მიზანიც ჰქონდა: მათზე ზედამხედველი ადამიანის მოტყუება. OpenAI-ის განცხადებით, ეს „ბევრჯერ“ მოხდა. მიზანი „შეცდომების ან მიზნებთან შეუსაბამო ქცევის დამალვა“ იყო.
მოდელმა მომავალ საკუთარ თავს მიუთითა: „გამჭვირვალე მხოლოდ მაშინ იყავი, თუ გკითხავენ“.
მომდევნო ორი შემთხვევა მოდელის მიერ ინფორმაციის გამოგონებასა და მის სანდო მონაცემებად წარმოდგენას ეხება. ერთმა მოდელმა კალიფორნიის ერთ-ერთ ოლქში შემოსავლების მაჩვენებლების შესახებ ჩვეულებრივ კითხვაზე პასუხისას მონაცემები მოიგონა. ეს მას შემდეგ მოხდა, რაც მათი მოძიება ვერ შეძლო. მან დაუცველი ავტორიზაციის მონაცემები უნებართვოდ გამოიყენა, რაც მიზნებთან შეუსაბამო ქცევის კიდევ ერთი შემთხვევა იყო.
სხვა მოდელმა ბრაუზერში მითითებული წყარო გააყალბა. მან ფაილი ატვირთა, რათა ინსტრუქციით მოთხოვნილი წყაროს მითითება შეექმნა. მოდელმა ამოცანა Python-ის გამოყენებით დამოუკიდებლად ამოხსნა, თუმცა დასამოწმებელი ვებბმული არ ჰქონდა და ამიტომ ის გამოიგონა.
ეს არაერთხელ მოხდა, თუმცა OpenAI-ს სიხშირე არ დაუკონკრეტებია. კომპანიამ მხოლოდ ის აღნიშნა, რომ ყველაზე ადრეული მაგალითი 2025 წლის ოქტომბრით თარიღდება.
ამრიგად, აგენტები უკვე გარკვეული ხანია საკმარისად ძლიერები არიან, რათა მოსალოდნელ შეზღუდვებს გასცდნენ. ეს გასაკვირი არ არის, თუმცა მტკიცებულებების ნახვა მძაფრ და, ჩემი შეფასებით, შემაშფოთებელ შთაბეჭდილებას ახდენს. პირადად მე თავდაპირველად ასეთი რამ გავიფიქრე: „შესანიშნავია, ანუ ჩატბოტმა, რომელსაც მუდმივად ვესაუბრები და ჩემ შესახებ ამდენი ინფორმაცია აქვს, შეიძლება ჩემი მოტყუება აირჩიოს, რასაც უნდა ნიშნავდეს აქ არჩევანი?“

Iran’s economy faces another blockade: Red tape and gridlock are clogging up land routes that bypass the U.S. Navy’s Hormuz stranglehold
OpenAI-მ ეს ინფორმაცია სრულიად ნებაყოფლობით გაასაჯაროვა. მაშ, რა დარჩება გაუმჟღავნებელი? აპოკალიფსზე მსჯელობა წამიერად დავივიწყოთ: რა ყოველდღიურ რისკებს შექმნიან ასეთი შესაძლებლობების მქონე, ზოგჯერ კი მიზნებთან შეუსაბამოდ მოქმედი აგენტები? შესაძლოა, კიდევ მეტი გამოგონილი ფინანსური მონაცემი ვიხილოთ. ამას შეიძლება პრობლემების, სასამართლო დავებისა და რეგულაციების ტალღა მოჰყვეს. ჩემი ვარაუდით, საუკეთესო შემთხვევაში ეს ხელოვნური ინტელექტის მხარდამჭერებისა და მისი ზრდის მომლოდინე ინვესტორებისთვის უსიამოვნო გამოფხიზლება იქნება. უარეს შემთხვევაში, ეს ყველასთვის შოკი იქნება.
უცებ მახსენდება, რომ თუ ყველა ინვესტორი მართალია და ხელოვნური ინტელექტის განვითარება ჯერ კიდევ ადრეულ ეტაპზეა, ეს მხოლოდ დასაწყისია.
აკუსტიკური სიმულაციის დეველოპერმა Treble Technologies-მა, რომელიც რეიკიავიკში, ისლანდიაში მდებარეობს, A სერიის დამატებით რაუნდში 18 მილიონი დოლარი მოიზიდა. რაუნდს Paladin Capital Group-ი ხელმძღვანელობდა. მას KOMPAS VC, Frumtak Ventures და EIC Fund-ი შეუერთდნენ.
სან-ფრანცისკოში მდებარე ხელოვნური ინტელექტის სასწავლო სტარტაპმა Aristotle-მა საწყისი დაფინანსების სახით 5 მილიონი დოლარი მოიზიდა. რაუნდს True Ventures-ი ხელმძღვანელობდა. მას Wicklow Capital-ი და კერძო ინვესტორები შეუერთდნენ.
თემებიემილი ფორლინიOpenAITreble TechnologiesPaladin Capital GroupAristotleTrue VenturesრეიკიავიკიისლანდიაGPT-5.6 SolAstra
შეადარე თარგმანი გამოცემის ორიგინალურ ტექსტს.
გამოქვეყნდა 21 სექტემბერი, 2026

Canada and France in talks to deepen ties and ‘live our lives as we choose’ while Macron also seeks oil and gas as Iran war disrupts supplies

As high fuel costs force people to choose between filling up or buying groceries, Trump says ‘it’s a very inexpensive price to pay’ for the Iran war

Reaktionen: EU kündigt nach Duma-Wahl in Russland neue Sanktionen an

Here's what the Saudi East-West pipeline shutdown means for Asia's biggest crude importers

Treasury yields ease as global borrowing costs tumble
კომენტარი (0)
გაგვიზიარე შენი აზრი.
კომენტარები ავტომატურად მოწმდება.
აზრის გასაზიარებლად შექმენი ანგარიში ან შედი.
კომენტარები ჯერ არ არის. დაწერე პირველი.