Mozilla-ს თანახმად, ზოგი მოდელი კვლავ ჩამორჩება, თუმცა მათი გამოყენება მკვეთრად იაფია.
China's open-weight AI models are now just 4 months behind frontier US offerings, Mozilla report claims — models still lag in some benchmarks but are drastically cheaper to use
წყარო: Toms Hardware. ქართული თარგმანი — შიკრიკი.

ტექსტი ავტომატურად ითარგმნა. წყარო: Toms Hardware.
Mozilla არაკომერციული ორგანიზაციაა, რომელიც Firefox-ის ბრაუზერს ავითარებს. მან პერიოდული შეფასების პირველი ვერსია 14 ივლისს Mozilla-ს ბლოგზე გამოაქვეყნა. ანგარიში Mozilla-სა და SlashData-ს მიერ დაახლოებით 1 400 დეველოპერის გამოკითხვის შედეგებს, OpenRouter-ის ტრაფიკის მონაცემებსა და სხვა ორგანიზაციების საორიენტაციო ტესტების მაჩვენებლებს ეყრდნობა. Mozilla ღია მოდელებს უჭერს მხარს. TIME-მა 14 ივლისს დაწერა, რომ Mozilla-ს ტექნოლოგიურმა დირექტორმა რაფი კრიკორიანმა (Raffi Krikorian) ანგარიში ნაწილობრივ ამ პოზიციის ადვოკატირებად აღწერა. ამ შემთხვევაში „ღია წონები“ ჩამოსატვირთ წონებს ნიშნავს და არა სასწავლო მონაცემებს ან კოდს. ანგარიშში 16 მნიშვნელოვანი ღია მოდელია შეტანილი. თუმცა, არცერთი მათგანი არ იძლევა მონაცემთა იმ სრულ აღწერას, რომელსაც Open Source Initiative-ის განსაზღვრება მოითხოვს.
ოთხთვიანი მაჩვენებელი METR-ის მონაცემებს ეყრდნობა. ეს კვლევითი არაკომერციული ორგანიზაცია მოდელებს იმის მიხედვით აფასებს, თუ რა ხანგრძლივობის ამოცანებს ასრულებენ ისინი შემთხვევათა ნახევარში. ხანგრძლივობა ადამიანის სამუშაო დროით იზომება. Mozilla-ს გამოთვლით, დახურული მოდელები იმ ამოცანებს უმკლავდებიან, რომელთა შესრულებასაც ექსპერტები 8-დან 12 საათამდე ანდომებენ. ღია მოდელები ამ დონეს დაახლოებით ოთხი თვის შემდეგ აღწევენ. Mozilla-ს გამოთვლით, ღია მოდელების შესაძლებლობა ყოველ 3,9 თვეში ორმაგდება, ხოლო დახურული მოდელებისა ყოველ 5,5 თვეში.
Mozilla-მ vals.ai-ს Terminal-Bench 2.1-ის შედეგებიც გამოსახა. ეს ტესტი ყველა მოდელს ერთი და იმავე პროგრამული შრის მეშვეობით ამუშავებს, რომელიც მოდელს საჭირო ხელსაწყოებს აწვდის. ამ რეიტინგში Z.ai-ს GLM-5.2-მა Claude Opus 4.7-ზე ერთი ქულით ნაკლები მიიღო. ის Opus 4.8-ს დაახლოებით ოთხი ქულით ჩამორჩა, თუმცა თითოეული ტესტის ღირებულება მისი ფასის მეხუთედზე ნაკლები იყო. OpenRouter არის ბაზარი, რომელიც დეველოპერების მოთხოვნებს ასობით მოდელს შორის ანაწილებს. Mozilla-ს დათვლით, აგვისტოში ტოკენების მოცულობით ათი ყველაზე პოპულარული მოდელიდან რვა ღია წონების მოდელი იყო. მათგან შვიდი ჩინეთში შეიქმნა. მიუხედავად ამისა, Linux Foundation-ის ცნობით, 2025 წლის მაისიდან სექტემბრამდე OpenRouter-ზე მოდელებისგან მიღებული შემოსავლის 96% დახურული მოდელების მომწოდებლებმა მიიღეს. კრიკორიანმა Ars Technica-ს ელექტრონული ფოსტით განუცხადა: „ჩვენი შეფასებით, დახურული მოდელებისთვის გადახდის გადაწყვეტილება კონკრეტულ სამუშაო დატვირთვაზეა დამოკიდებული და არა ორგანიზაციაზე“.
გასათვალისწინებელია, რომ ოთხთვიანი სხვაობა და ტოკენის 30%-იანი ფასი განთავსებული მოდელების API-ების შედარებით გამოითვალა. ამასთან, ანგარიშში ოფიციალური ფასებია გამოყენებული. ანგარიშის აპარატურული უზრუნველყოფის ცხრილში ერთ სერვერზე მოთავსებულმა საუკეთესო ღია მოდელმა 52,6 ქულა მიიღო, ხოლო ერთ გრაფიკულ პროცესორზე მოთავსებულმა მოდელმა 40 ქულა. საუკეთესო შედეგთან სხვაობა, შესაბამისად, 10 და 23 ქულაა. ეს ანგარიშში დასახელებულ ოთხთვიან სხვაობაზე მეტია. Kimi K3-ის მშობლიური MXFP4 საკონტროლო ვერსია 96 ნაწილადაა დაყოფილი და დაახლოებით 1,56 ტბ-ს იკავებს. Mozilla-ს კონფიგურაციაში მის გასაშვებად სულ მცირე 64 ამაჩქარებელია მითითებული. vLLM კი მინიმუმ რვა GB300 გრაფიკულ პროცესორს მოითხოვს, ხოლო საწარმოო ტრაფიკისთვის რამდენიმე კვანძია საჭირო. ანგარიშის აღწერით, მოდელი ღიაა, თუმცა მისი მქონე ადამიანების უმეტესობა მას ვერ გაუშვებს. Tom’s Hardware-მა ივლისში მეხსიერების საჭიროება თითქმის 1,5 ტბ-ად შეაფასა. გამონაკლისის ერთ-ერთი მაგალითი Thinking Machines-ის Inkling-Small მოდელია, რომელიც Apache 2.0 ლიცენზიით ვრცელდება. მისი NVFP4 ვერსია ერთ B300-ზე თავსდება და მინიმუმ 180 გბ მეხსიერებას მოითხოვს.

Chinese state media counters Anthropic's call to put brakes on AI development — paper says move is ‘a response to Chinese competition’
ანგარიშის მონაცემები 1 სექტემბრით მთავრდება. მას შემდეგ Artificial Analysis-მა ინდექსი სხვა შეფასებების ნაკრების მქონე 4.3 ვერსიაზე გადაიყვანა. მიმდინარე რეიტინგში მაქსიმალური გამოთვლითი ძალისხმევის რეჟიმში Claude Fable 5.1-ს 53 ქულა აქვს, ხოლო Kimi K3-ს 44. ეს შედეგები Mozilla-ს მიერ გამოყენებულ 4.1.1 ვერსიის მაჩვენებლებს ვერ შეედრება. vals.ai-ს Terminal-Bench 2.1-ის რეიტინგს, რომელიც 11 სექტემბერს განახლდა, GPT-6 Astra 87,27%-ით ლიდერობს. Fable 5.1-ს 85,02% აქვს. Mozilla-ს გრაფიკის წარწერაში ნათქვამია: „ყოველი ახალი ვერსიის გამოშვებისას სხვაობის ათვლა თავიდან იწყება“.
K3-ს 8 სექტემბრის NSA-ს, CISA-სა და გამოძიების ფედერალური ბიუროს (FBI) ერთობლივ გაფრთხილებაში AA26-251A ბრალდებაც უკავშირდება. Mozilla-ს ანგარიშში ეს მტკიცება „გამოთქმულ, მაგრამ დაუსაბუთებელ“ ბრალდებადაა აღწერილი. ბრალდების თანახმად, Moonshot-მა K3-ის დისტილაციის მეთოდით გასაწვრთნელად Claude Fable 5-ის მონაცემები მოიპოვა. დისტილაცია ერთი მოდელის მეორე მოდელის შედეგებზე გაწვრთნის მეთოდია. 17 ივლისს Artificial Analysis-ში K3-ს 57 ქულა ჰქონდა, ხოლო Fable 5-ს 60. 1 სექტემბერს Mozilla-ს მონაცემებში K3 მას ორი ქულით ჩამორჩებოდა.
თემებირაფი კრიკორიანიMozillaOpenRouterMETRArtificial AnalysisLinux FoundationMoonshotThinking Machinesჩინეთიაშშ
შეადარე თარგმანი გამოცემის ორიგინალურ ტექსტს.
გამოქვეყნდა 16 სექტემბერი, 2026

AWS tells clients to abandon Middle East data centers six months after Iranian drone strikes — Amazon offers no recovery timeline as UAE mulls underground data centers

ChatGPT transcripts are reportedly read by humans to improve responses, including those with personal information — 'Project Lilly' has seen OpenAI hire hundreds of contractors to manually review logs

China Isn’t Buying Silicon Valley’s Call for an AI Slowdown

AI networking startups race to replace Nvidia's NVLink

‘Smart’ Nanoparticles Deliver mRNA Directly to Tumors in New Cancer Therapy
კომენტარი (0)
გაგვიზიარე შენი აზრი.
კომენტარები ავტომატურად მოწმდება.
აზრის გასაზიარებლად შექმენი ანგარიში ან შედი.
კომენტარები ჯერ არ არის. დაწერე პირველი.