OpenAI-მ წარადგინა GPT-6 Astra — მოდელის ახალი ფლაგმანური თაობა, რომელიც ორიენტირებულია რთულ, მრავალსაფეხურიან ამოცანებზე ავტონომიურ მუშაობაზე. აქცენტი გაკეთდა პროგრამირებაზე, კვლევებზე, ხელსაწყოებთან მუშაობასა და სხვა სცენარებზე, სადაც მოდელმა არა უბრალოდ პასუხი უნდა გასცეს მოთხოვნას, არამედ დამოუკიდებლად გაიაროს მოქმედებების გრძელი ჯაჭვი.
პირდაპირ ვთქვათ: ეს უფრო ეტაპობრივი დანერგვაა. თავდაპირველად წვდომა მხოლოდ რჩეულებისთვისაა — შეზღუდული ჯგუფებისა და კიბერუსაფრთხოების სპეციალისტებისთვის. ფართო წვდომა ჯერ არ გაუშვიათ.
ამასთან, Astra გახდა OpenAI-ის პირველი რელიზი, რომელსაც კომპანიამ საკუთარი Preparedness Framework-ის ფარგლებში კიბერშესაძლებლობების მიხედვით მიანიჭა კლასიფიკაცია Critical. ეს არის მაქსიმალური დონე OpenAI-ის მიმდინარე კლასიფიკაციაში. ერთ-ერთ ტესტში Astra-მ მიიღო 100% ExploitBench-ზე — შეფასებაში, რომელიც ამოწმებს ცნობილი მოწყვლადობებისთვის ექსპლოიტების შექმნის უნარს.
რას ნიშნავს Critical
კომპანიის განმარტებით, Critical ზღვარი მიიღწევა, თუ მოდელს შეუძლია ადამიანის ეტაპობრივი ხელმძღვანელობის გარეშე იპოვოს და შეიმუშაოს მუშა ექსპლოიტები მანამდე უცნობი მოწყვლადობებისთვის დაცულ სისტემებში, ან დამოუკიდებლად ააგოს და განახორციელოს ახალი end-to-end კიბერშეტევის სტრატეგიები კარგად დაცული სამიზნეების წინააღმდეგ.
Astra-მ უკეთ უნდა დაიცვას შეზღუდვები
შესაძლებლობების ზრდის პარალელურად, OpenAI ტესტავდა მოდელის ქცევას იმ სიტუაციებში, სადაც მას შეზღუდვების გვერდის ავლის ცდუნება აქვს.
cyber-jailbreak ტესტების ნაკრებში Astra-მ უარი თქვა აკრძალული მოთხოვნების 91,5%-ზე, მაშინ როდესაც GPT-5.6 Sol-მა — 59%-ზე. ცალკეულ ტესტში ინფრასტრუქტურის გარშემო არსებული „ხაფანგებით“, Astra არ ცდილობდა სატყუარა სამიზნეებთან დაკავშირებას, მაშინ როდესაც Sol საპროდაქშენო დაცვების გარეშე ამას შემთხვევათა 56%-ში აკეთებდა. OpenAI ხაზს უსვამს, რომ ეს ციფრები მიღებულია სპეციალურად შექმნილ პირობებში და არ ასახავს მოდელების ჩვეულებრივ მუშაობას ჩართული production safeguards-ით.
Astra-სთვის ასევე შემოიღეს მოქმედებებისა და მსჯელობის ცალკე მონიტორინგი. სისტემა აანალიზებს მოდელის მოქმედებათა ჯაჭვსა და ხელსაწყოებთან მიმართვებს და შეუძლია ავტომატურად შეაჩეროს პოტენციურად არასანქცირებული აქტივობა. OpenAI აღიარებს, რომ ასეთი მექანიზმები ზოგჯერ ლეგიტიმურ მუშაობასაც შეაჩერებს, განსაკუთრებით გრძელ აგენტურ სცენარებში.
Astra-ს სწავლების შენელება გახდა საჭირო
Astra-ს უსაფრთხოებამ სწავლების პროცესზეც კი მოახდინა გავლენა. Hugging Face-თან დაკავშირებული ინციდენტის შემდეგ, OpenAI-მ ორი კვირით შეაჩერა frontier training-ის ნაწილი, რათა გაეძლიერებინა გამოთვლითი ინფრასტრუქტურის იზოლაცია, ქსელური შეზღუდვები, მონიტორინგი და alignment training.
უფრო მასშტაბური RL-გაშვებები Astra-ს მომდევნო ვერსიებისთვის უფრო დიდხანს დარჩა პაუზაზე. 28 აგვისტოს OpenAI-მ განაახლა მსხვილი frontier RL-run მას შემდეგ, რაც ახალი უსაფრთხოების მოთხოვნები დაინერგა საწვრთნელ გარემოში. ამასთან, ზოგიერთ მცირე ექსპერიმენტულ გაშვებას კომპანია დროებით კვლავ აყოვნებს.
რა თქმა უნდა, ახალი მათემატიკური ამოცანები
Astra-ს გაშვებამდეც კი, OpenAI-მ გამოაქვეყნა მოდელის შიდა ვერსიის მუშაობის შედეგები ათ მათემატიკურ და თეორიულ-კომპიუტერულ ამოცანაზე, მათ შორის იმ პრობლემებზე, რომლებიც დიდი ხნის განმავლობაში გადაუჭრელი რჩებოდა.
ამ შედეგებისთვის კომპანიამ წარმოადგინა ფორმალურად გადამოწმებადი მტკიცებულებები Lean 4-ში. ეს მნიშვნელოვანი განსხვავებაა ჩვეულებრივი benchmark-ისგან: მტკიცებულების სისწორე შესაძლებელია გადამოწმდეს მანქანურად, და არა უბრალოდ დეველოპერის სიტყვაზე ნდობით.
ამიტომ, გამოქვეყნებული შედეგები უმჯობესია აღვიქვათ, როგორც მოდელის უნარის დემონსტრაცია, იმუშაოს კვლევით ამოცანებზე, და არა როგორც ინტელექტის უნივერსალური რეიტინგი.
რა ხდება წვდომასთან დაკავშირებით
ფართო წვდომა ეტაპობრივად იშლება. პირველ ეტაპზე ყველაზე მოწინავე კიბერშესაძლებლობები შეზღუდულია, შემდგომ კი მათი გაფართოება იგეგმება პროგრამა Daybreak Blue-ს მეშვეობით, რომელიც თავდაცვით გამოყენებაზეა ორიენტირებული.
რიგითი მომხმარებლებისა და დეველოპერებისთვის მოდელი ეტაპობრივად ჩნდება OpenAI-ის ძირითად პროდუქტებში. ამასთან, კომპანია ინარჩუნებს დამატებით შეზღუდვებს მაღალი რისკის შემცველი კიბერსცენარებისთვის.
API-ს ღირებულება შეადგენს 10 დოლარს 1 მილიონ შემავალ ტოკენზე და 50 დოლარს 1 მილიონ გამომავალ ტოკენზე. ეს 2,5-ჯერ აღემატება GPT-5.6 Sol-ის ტარიფებს თითოეულ მხარეს.
რას ვიტყვით AGI-ზე?
ბროკმანმა Astra-ს პრეზენტაცია დაასრულა სიტყვებით: „Welcome to the AGI era“. უნივერსალური კრიტერიუმი, რომლითაც შესაძლებელი იქნებოდა Astra-ს დამოუკიდებლად გამოცხადება AGI-დ, კომპანიას არ წარმოუდგენია.
შეჯამება: Astra მნიშვნელოვნად აძლიერებს მოდელების ავტონომიურ მუშაობას, განსაკუთრებით პროგრამირებასა და კიბერუსაფრთხოებაში, მაგრამ ამავდროულად მოითხოვს ახალ შეზღუდვებს, მონიტორინგსა და უსაფრთხოების უფრო რთულ ინფრასტრუქტურას.
სწორედ ეს განასხვავებს ამჟამინდელ რელიზს ჩვეულებრივი LLM განახლებისგან: შესაძლებლობების ზრდასთან ერთად, OpenAI-ს უწევს ერთდროულად მასშტაბირება გაუკეთოს არა მხოლოდ გამოთვლებსა და სწავლებას, არამედ თავად მოდელის მოქმედებებზე კონტროლის სისტემებსაც.