თებერვალში დამოუკიდებლად შესრულებული კვლევითი სამუშაოს წილი 1%-ზე ნაკლები იყო.
Anthropic: Claude übernimmt immer mehr Arbeit an eigener Weiterentwicklung
წყარო: heise online. ქართული თარგმანი — შიკრიკი.

ტექსტი ავტომატურად ითარგმნა. წყარო: heise online.
Anthropic ამისთვის AL0-დან AL5-მდე სკალას იყენებს, სადაც AL ავტომატიზაციის დონეს აღნიშნავს. AL3-ის დონეზე ხელოვნური ინტელექტი ადამიანთან მჭიდროდ თანამშრომლობს. Anthropic-ის ცნობით, შესწავლილი სამუშაოს 90%-ზე მეტი უკვე სულ მცირე ამ დონეს აღწევს. AL4 ნიშნავს, რომ Claude-ს ზოგადი დავალების საფუძველზე სამუშაოს უმეტესი ნაწილის თავიდან ბოლომდე დამოუკიდებლად შესრულება შეუძლია. ამ დონეს უკვე 26% აღწევს. უმაღლესი, AL5 დონე სრულად ავტონომიურ მუშაობას ნიშნავს. Claude ამ დონეს ჯერჯერობით არცერთ გაზომილ სფეროში არ აღწევს.
Anthropic ამ საზომ მეთოდს „კვლევისა და განვითარების ავტომატიზაციის ინდექსს“ უწოდებს. მას 2026 წლის ივლისის შერჩევიდან დაახლოებით 15 000 კვლევითი და განვითარების დავალება უდევს საფუძვლად. დავალებები საქმიანობის სახეების მიხედვით კატეგორიებად დაყვეს და თითოეული მათგანი AL0-დან AL5-მდე დონეს მიაკუთვნეს. კატეგორიებს, რომლებზეც ადამიანები მეტ სამუშაო დროს ხარჯავენ, უფრო დიდი წონა ენიჭება. შედეგად მიიღება შეწონილი სამუშაო კალათა, რომელმაც Anthropic-ში კვლევისა და განვითარების საქმიანობა უნდა ასახოს.
ამიტომ AL4-ის 26% არ ნიშნავს, რომ Claude აღრიცხული დავალებების 26%-ს ასრულებს. ეს მაჩვენებელი შეწონილი სამუშაო კალათის იმ წილს ეხება, რომელიც Anthropic-ის შეფასებით AL4 დონეს აღწევს. გასათვალისწინებელია ისიც, რომ მონაცემების შეგროვების, სტრუქტურირებისა და შეფასებისთვის Anthropic საკუთარ Claude-ის მოდელებს იყენებს. კომპანია ინდექსს პროტოტიპს უწოდებს და მეთოდის დამოუკიდებელ შემოწმებას მიზანშეწონილად მიიჩნევს.
Anthropic-ის სტატიაში სხვა მაჩვენებლებიცაა წარმოდგენილი. აგვისტოში ყველაზე ხშირად გამოყენებულ შიდა პლატფორმაზე დროის გარკვეულ მონაკვეთებში ერთდროულად დაახლოებით 30 000 კვლევისა და განვითარების აგენტი მუშაობდა. მათ მოქმედებებს შესრულებამდე ავტომატურად ამოწმებენ. კომპანიის ცნობით, მილიარდზე მეტი შემოწმებული გადაწყვეტილებიდან სისტემა დაახლოებით ყოველ 47 000-ში ერთს ბლოკავდა. Anthropic-მა უსაფრთხოების სამუშაოებისთვის საჭირო გამოთვლითი რესურსიც შეაფასა. ივლისის ერთ შერჩევით კვირაში ხელოვნური ინტელექტის კვლევასა და განვითარებაზე გამოყენებული გამოთვლითი სიმძლავრის დაახლოებით 6% უსაფრთხოების ამოცანებს მოხმარდა. ხელოვნური ინტელექტის დახმარებით შესრულებულ კვლევასა და განვითარებაში ეს წილი დაახლოებით 12% იყო.
Anthropic ამ მაჩვენებლებით აკვირდება, რამდენად სწრაფად ავტომატიზდება ხელოვნური ინტელექტის კვლევა და რამდენად უახლოვდება მისი სისტემები სრულ რეკურსიულ თვითგაუმჯობესებას. იგულისხმება სცენარი, როდესაც ხელოვნური ინტელექტის სისტემები საკუთარ მომდევნო ვერსიებს სრულად ავტონომიურად ქმნიან. კომპანია მხარს უჭერს მსგავსი მაჩვენებლების რეგულარულ გამოქვეყნებასა და დამოუკიდებელ შემოწმებას.

Laut Theorien unmöglich: Mit Abstand jüngster Exoplanet gefunden
Anthropic-მა ჯერ კიდევ ივნისში განაცხადა, რომ Claude განვითარების სამუშაოს უკვე მნიშვნელოვან ნაწილს ასრულებდა. კომპანიის მაშინდელი მონაცემებით, მაისში საწარმოო კოდების ბაზაში დამატებული კოდის სტრიქონების 80%-ზე მეტი Claude-ს მიეწერებოდა.
ავტომატიზაციის ზრდასთან ერთად ჩნდება კითხვა, რამდენად სწრაფად უნდა განვითარდეს ასეთი სისტემები. Anthropic-ის ხელმძღვანელმა დარიო ამოდეიმ ცოტა ხნის წინ ტემპის შენელებისკენ მოუწოდა. მან სულ უფრო ავტონომიურ სისტემებზე კონტროლის შესაძლო დაკარგვის შესახებ გააფრთხილა.
შეადარე თარგმანი გამოცემის ორიგინალურ ტექსტს.
გამოქვეყნდა 18 სექტემბერი, 2026

Jahrhundertfund: Größter neuer Krater des Sonnensystems auf dem Mond entdeckt

Google DeepMind: Wie KI-Modelle ihre eigene Unsicherheit einschätzen

ASML snubs Elon Musk-backed particle accelerator chipmaking tech — firm doubles down on 1,000W laser-produced plasma systems for chipmaking tools

He Won the Nobel Prize for Protein Design. Now He Uses AI to Create Molecules Not Found in Nature

Microsoft AI chief warns Anthropic not to put ideas in Claude's head
კომენტარი (0)
გაგვიზიარე შენი აზრი.
კომენტარები ავტომატურად მოწმდება.
აზრის გასაზიარებლად შექმენი ანგარიში ან შედი.
კომენტარები ჯერ არ არის. დაწერე პირველი.