გამოვიდა Anthropic-ის Claude Opus 5: კოდინგი, აგენტებთან მუშაობა და ფასები

გამოვიდა Anthropic-ის Claude Opus 5: კოდინგი, აგენტებთან მუშაობა და ფასები

Anthropic-მა წარადგინა Claude Opus 5 — Claude-ის ოჯახის უფროსი მოდელის ახალი ვერსია. მოდელი უკვე ხელმისაწვდომია მომხმარებლებისთვის და API-ს მეშვეობით, ხოლო ხარისხით რიგ ამოცანებში მიუახლოვდა Claude Fable 5-ს, ამასთანავე ორჯერ იაფი დარჩა. Opus 5-ისთვის შენარჩუნდა ძველი ფასები: $5 ყოველ მილიონ შემავალ ტოკენზე და $25 ყოველ მილიონ გამომავალ ტოკენზე.

Anthropic-ის განცხადებით, Opus 5 გახდა ახალი state-of-the-art კოდინგისა და ცოდნაზე დაფუძნებული მუშაობის (knowledge work) ამოცანებში: კომპანია ეყრდნობა Frontier-Bench-სა და GDPval-AA-ს. წერენ, რომ მოდელი ასევე გაძლიერდა აგენტურ სცენარებში და უფრო ეფექტური გახდა ყოველდღიურ გამოყენებაში. Opus 5 დაინიშნა ნაგულისხმევ მოდელად Claude Max-ისთვის და პოზიციონირებს, როგორც ყველაზე ძლიერი არჩევანი Claude Pro-სთვის.

რელიზის მთავარი პრაქტიკული აქცენტი პროგრამული უზრუნველყოფის შემუშავებაა. Anthropic იტყობინება, რომ Frontier-Bench v0.1-ზე Opus 5 უსწრებს ყველა დანარჩენ მოდელს, ხოლო CursorBench 3.2-ზე max effort რეჟიმში ის აჩვენებს Fable 5-ის პიკური მაჩვენებლის 0,5%-ის ფარგლებში არსებულ შედეგს, თუმცა ამავე დროს თითოეულ ამოცანაზე ორჯერ იაფი ჯდება. კომპანია ასევე აცხადებს უფრო მაღალ ეფექტურობაზე აგენტურ სამუშაო პროცესებში (agentic workflow): ნაკლები ზედმეტი ნაბიჯი, უკეთესი დაგეგმვა და უფრო სტაბილური ქცევა მოქმედებების გრძელ ჯაჭვებზე.

ამასთან, Anthropic არ ცდილობს წარმოაჩინოს Opus 5, როგორც უნივერსალური ჩემპიონი ყველა სფეროში. ოფიციალურ პოსტში პირდაპირ არის ნათქვამი, რომ მოდელი არ უსწრებს Mythos 5-ს კიბერუსაფრთხოებაში. მეტიც, კომპანია ცალკე აღნიშნავს, რომ Opus 5 არ ავითარებს რისკის შემცველ ორმაგი დანიშნულების (dual-use) შესაძლებლობებს: ბიოლოგიისა და offensive cybersecurity-ს შეფასებებში ის კვლავ ჩამოუვარდება Mythos 5-ს, თუმცა მოწყვლადობების აღმოჩენაში საგრძნობლად მიუახლოვდა მას.

ყურადღებას იმსახურებს თავად მოდელის უსაფრთხოებაც. Anthropic წერს, რომ Opus 5-მა აჩვენა საუკეთესო ქცევა შიდა ქცევითი აუდიტის (behavioral audit) მიხედვით თავის ბოლოდროინდელ მოდელებს შორის და უკეთ მიჰყვება კომპანიის „კონსტიტუციას“ (Constitution), ვიდრე Opus 4.8, Sonnet 5 და Fable 5. ამავდროულად, უსაფრთხოების ზომების (safeguards) სექციაში კომპანია მიუთითებს, რომ Opus 5-ისთვის შენარჩუნებულია შეზღუდვები კიბერ-ამოცანების ნაწილზე: მოდელს შეუძლია იპოვოს მოწყვლადობები საწყის კოდში, მაგრამ იბლოკება binary-based სკანირების, შეღწევადობის ტესტირებისა (penetration testing) და ექსპლოიტების გენერირებისთვის.

ჯამში, რელიზი გამოიყურება როგორც Anthropic-ის ძალიან პრაგმატული ნაბიჯი: ეს არ არის მორიგი „საოცრება-მოდელის“ დემონსტრირება, არამედ იმ სცენარების გაუმჯობესების მცდელობა, რომლებშიც კომპანიები რეალურად იხდიან ფულს — კოდინგი, აგენტები, მონაცემთა ანალიზი და დოკუმენტებთან პროფესიონალური მუშაობა. იმ ფონზე, როდესაც საჯარო დისკუსია ხელოვნური ინტელექტის შესახებ სულ უფრო ხშირად დადის კითხვამდე „მივაღწიეთ თუ არა AGI-ს“, Anthropic კვლავ ფსონს დებს უფრო მიწიერ მეტრიკაზე: რამდენად ეხმარება მოდელი გამოყენებითი ამოცანების უფრო სწრაფად და საიმედოდ შესრულებაში.

გაზიარება:

დაკავშირებული პოსტები

წარმოგიდგენთ Bonsai 27B-ს: პირველი 27B კლასის მოდელი, რომელიც მუშაობს ტელეფონზე
AI

წარმოგიდგენთ Bonsai 27B-ს: პირველი 27B კლასის მოდელი, რომელიც მუშაობს ტელეფონზე

NotebookLM-ს ამიერიდან Gemini Notebook-ი ჰქვია
AI

NotebookLM-ს ამიერიდან Gemini Notebook-ი ჰქვია

ათეისტი ევოლუციონისტი მეცნიერი Anthropic-ის Claude-ს 72 საათის განმავლობაში ესაუბრა და ახლა სჯერა, რომ ის ცნობიერია
AI

ათეისტი ევოლუციონისტი მეცნიერი Anthropic-ის Claude-ს 72 საათის განმავლობაში ესაუბრა და ახლა სჯერა, რომ ის ცნობიერია

სემ ალტმანის პროექტი World ვერიფიკაციის ტექნოლოგიას გაცნობის აპლიკაციებში ნერგავს
AI

სემ ალტმანის პროექტი World ვერიფიკაციის ტექნოლოგიას გაცნობის აპლიკაციებში ნერგავს

Telegram-მა მესამე მხარის კლიენტების მომხმარებლების მონიშვნა დაიწყო. ასევე, მესენჯერმა მიიღო ხელოვნური ინტელექტის რედაქტორი და ბოტების ფაბრიკა
AI

Telegram-მა მესამე მხარის კლიენტების მომხმარებლების მონიშვნა დაიწყო. ასევე, მესენჯერმა მიიღო ხელოვნური ინტელექტის რედაქტორი და ბოტების ფაბრიკა

CERN-ში მონაცემთა მასივების გასაფილტრად ჩიპებში ინტეგრირებულ სპეციალურ AI-მოდელებს იყენებენ
AI

CERN-ში მონაცემთა მასივების გასაფილტრად ჩიპებში ინტეგრირებულ სპეციალურ AI-მოდელებს იყენებენ

კომენტარები

ახალი კომენტარის დაწერა