Anthropic-მა წარადგინა Claude Opus 5 — Claude-ის ოჯახის უფროსი მოდელის ახალი ვერსია. მოდელი უკვე ხელმისაწვდომია მომხმარებლებისთვის და API-ს მეშვეობით, ხოლო ხარისხით რიგ ამოცანებში მიუახლოვდა Claude Fable 5-ს, ამასთანავე ორჯერ იაფი დარჩა. Opus 5-ისთვის შენარჩუნდა ძველი ფასები: $5 ყოველ მილიონ შემავალ ტოკენზე და $25 ყოველ მილიონ გამომავალ ტოკენზე.
Anthropic-ის განცხადებით, Opus 5 გახდა ახალი state-of-the-art კოდინგისა და ცოდნაზე დაფუძნებული მუშაობის (knowledge work) ამოცანებში: კომპანია ეყრდნობა Frontier-Bench-სა და GDPval-AA-ს. წერენ, რომ მოდელი ასევე გაძლიერდა აგენტურ სცენარებში და უფრო ეფექტური გახდა ყოველდღიურ გამოყენებაში. Opus 5 დაინიშნა ნაგულისხმევ მოდელად Claude Max-ისთვის და პოზიციონირებს, როგორც ყველაზე ძლიერი არჩევანი Claude Pro-სთვის.
რელიზის მთავარი პრაქტიკული აქცენტი პროგრამული უზრუნველყოფის შემუშავებაა. Anthropic იტყობინება, რომ Frontier-Bench v0.1-ზე Opus 5 უსწრებს ყველა დანარჩენ მოდელს, ხოლო CursorBench 3.2-ზე max effort რეჟიმში ის აჩვენებს Fable 5-ის პიკური მაჩვენებლის 0,5%-ის ფარგლებში არსებულ შედეგს, თუმცა ამავე დროს თითოეულ ამოცანაზე ორჯერ იაფი ჯდება. კომპანია ასევე აცხადებს უფრო მაღალ ეფექტურობაზე აგენტურ სამუშაო პროცესებში (agentic workflow): ნაკლები ზედმეტი ნაბიჯი, უკეთესი დაგეგმვა და უფრო სტაბილური ქცევა მოქმედებების გრძელ ჯაჭვებზე.
ამასთან, Anthropic არ ცდილობს წარმოაჩინოს Opus 5, როგორც უნივერსალური ჩემპიონი ყველა სფეროში. ოფიციალურ პოსტში პირდაპირ არის ნათქვამი, რომ მოდელი არ უსწრებს Mythos 5-ს კიბერუსაფრთხოებაში. მეტიც, კომპანია ცალკე აღნიშნავს, რომ Opus 5 არ ავითარებს რისკის შემცველ ორმაგი დანიშნულების (dual-use) შესაძლებლობებს: ბიოლოგიისა და offensive cybersecurity-ს შეფასებებში ის კვლავ ჩამოუვარდება Mythos 5-ს, თუმცა მოწყვლადობების აღმოჩენაში საგრძნობლად მიუახლოვდა მას.
ყურადღებას იმსახურებს თავად მოდელის უსაფრთხოებაც. Anthropic წერს, რომ Opus 5-მა აჩვენა საუკეთესო ქცევა შიდა ქცევითი აუდიტის (behavioral audit) მიხედვით თავის ბოლოდროინდელ მოდელებს შორის და უკეთ მიჰყვება კომპანიის „კონსტიტუციას“ (Constitution), ვიდრე Opus 4.8, Sonnet 5 და Fable 5. ამავდროულად, უსაფრთხოების ზომების (safeguards) სექციაში კომპანია მიუთითებს, რომ Opus 5-ისთვის შენარჩუნებულია შეზღუდვები კიბერ-ამოცანების ნაწილზე: მოდელს შეუძლია იპოვოს მოწყვლადობები საწყის კოდში, მაგრამ იბლოკება binary-based სკანირების, შეღწევადობის ტესტირებისა (penetration testing) და ექსპლოიტების გენერირებისთვის.
ჯამში, რელიზი გამოიყურება როგორც Anthropic-ის ძალიან პრაგმატული ნაბიჯი: ეს არ არის მორიგი „საოცრება-მოდელის“ დემონსტრირება, არამედ იმ სცენარების გაუმჯობესების მცდელობა, რომლებშიც კომპანიები რეალურად იხდიან ფულს — კოდინგი, აგენტები, მონაცემთა ანალიზი და დოკუმენტებთან პროფესიონალური მუშაობა. იმ ფონზე, როდესაც საჯარო დისკუსია ხელოვნური ინტელექტის შესახებ სულ უფრო ხშირად დადის კითხვამდე „მივაღწიეთ თუ არა AGI-ს“, Anthropic კვლავ ფსონს დებს უფრო მიწიერ მეტრიკაზე: რამდენად ეხმარება მოდელი გამოყენებითი ამოცანების უფრო სწრაფად და საიმედოდ შესრულებაში.