მთავარი
კატეგორია
TV ლაივი მენიუ
Loading data...

OpenAI-მ რეკორდული შესაძლებლობების ხელოვნური ინტელექტი GPT-6 Astra წარადგინა

GPT 6 Astra

ხელოვნური ინტელექტის წამყვანმა დეველოპერმა სტარტაპმა, OpenAI-მ ახალი ფლაგმანური მოდელი GPT-6 Astra ოფიციალურად წარადგინა. სისტემამ კომპლექსური ამოცანების გადაჭრის, პროგრამული ინჟინერიის, სამეცნიერო კვლევებისა და კომპიუტერის მართვის მიმართულებით ახალ ისტორიულ მაქსიმუმს მიაღწია. კომპანიის განცხადებით, ახალმა მოდელმა აბსტრაქტული ლოგიკისა და მათემატიკის ურთულეს ტესტებში ადამიანურ საუკეთესო მაჩვენებლებს პირველად გადააჭარბა.

მოდელმა აბსტრაქტული აზროვნების ტესტში ARC-AGI-3 უპრეცედენტო 99.9%-იან შედეგს მიაღწია. შედარებისთვის, წინა თაობის სისტემამ GPT-5.6 Sol-მა მხოლოდ 7.8% დააგროვა, ხოლო მეტოქე Claude Opus 5-ის მაჩვენებელი 30.2%-ით განისაზღვრა. ამას გარდა, უმაღლესი სირთულის მათემატიკურ ტესტში FrontierMath Tier 4 მოდელმა 97.6%-იანი სიზუსტე დააფიქსირა და ღია სამეცნიერო პრობლემების გადაჭრაში მკვლევრებს მნიშვნელოვანი დახმარება გაუწია.

სამეცნიერო კვლევების სიმულაციურ პლატფორმა Terminal-Bench Science-ზე კი Astra-მ 64.6% მიიღო, რაც Claude Fable 5.1-ის მაჩვენებელს 12%-ით აღემატება და დაახლოებით 31%-ით ნაკლებ საოპერაციო ხარჯს მოითხოვს. საბუნებისმეტყველო მეცნიერებათა სადოქტორო დონის გამოცდაში GPQA Diamond მოდელმა 96.0%-იანი შედეგი დააფიქსირა.

ახალი AI მოდელის წარდგენასთან ერთად OpenAI-მ კომპიუტერისა და ბრაუზერის დამოუკიდებლად მართვის შესაძლებლობები საგრძნობლად გააუმჯობესეს. პროფესიული ამოცანების ტესტში Agents' Last Exam-ის სისტემამ 59.3%-იანი სიზუსტით იმუშავა და Claude Opus 5-თან შედარებით 65%-ით ნაკლები ტოკენი გამოიყენა. კომპიუტერული გარემოს მართვის ტესტში OSWorld 2.0 მოდელმა დავალებები GPT-5.6 Sol-ზე 47%-ით სწრაფად შეასრულა. ამას გარდა, საინჟინრო პლატფორმაზე BenchCAD სისტემამ გეომეტრიული თანხვედრის 95.9%-იან ნიშნულს მიაღწია. პროგრამული ინჟინერიის ტესტში Terminal-Bench 4.0 მოდელის სიზუსტე 57.9%-ს გაუტოლდა.

დეველოპერულ გარემო Codex-ში კომპანიამ დანერგა კონტექსტის მართვის ახალი მექანიზმი, რომლის ფარგლებშიც ინფორმაციის შეკუმშვის ნაცვლად სისტემა წინა სამუშაო ფანჯრებიდან დეტალურ ჩანაწერებს ინახავს.

რაც შეეხება კიბერუსაფრთხოებას, მოდელმა კომპანიის უსაფრთხოების ჩარჩოს კრიტიკულ ზღვარს მიაღწია. პროგრამული დაუცველობის ტესტში ExploitBench სისტემამ მაქსიმალური 100%-იანი შედეგი დააფიქსირა. სატესტო რეჟიმში მოდელმა მანამდე უცნობი ორი კიბერხარვეზიც კი აღმოაჩინა. ამასთან, პროგრამული კოდის რევერსული ინჟინერიის ტესტში SRE-Bench Astra-მ დავალებების 88.0% პირველივე მცდელობაზე ამოხსნა.

გაზრდილი შესაძლებლობების ფონზე შემქმნელებმა უსაფრთხოების მექანიზმებიც გააძლიერეს. სპეციალურ ტესტებში მოდელმა ავტორიზებულ საზღვრებს მიღმა მოქმედებაზე სრული უარი თქვა და 0%-იანი გადაცდომა დააფიქსირა, მაშინ როდესაც GPT-5.6 Sol-ის შემთხვევაში ეს მაჩვენებელი 48.2%-ს აღწევდა. ჰალუცინაციების ალბათობამ კი მხოლოდ 4.2% შეადგინა.

არსებული ინფორმაციით, GPT-6 Astra-ზე წვდომა ეტაპობრივად გაიხსნება. სისტემა ხელმისაწვდომი უახლოეს დღეებში ChatGPT-ის Plus, Pro, Business და Enterprise მომხმარებლებისთვის გახდება.

დეველოპერებისთვის მოდელი OpenAI-ის პროგრამულ ინტერფეისში, ასევე Microsoft Azure-ისა და Amazon Bedrock-ის პლატფორმებზე გამოჩნდება. სტანდარტული ტარიფის მიხედვით, ერთი მილიონი შემავალი ტოკენის ფასი $10, ხოლო ერთი მილიონი გამომავალი ტოკენის ღირებულება $50 იქნება. მომხმარებლებს ასევე შეეძლებათ გამოიყენონ რეჟიმი Fast mode-ი, რომელიც ორმაგი ტარიფის სანაცვლოდ მონაცემთა ორჯერ სწრაფ დამუშავებას უზრუნველყოფს.

ცნობისთვის, OpenAI-მ წინა თაობის მოდელი GPT-5.6 Sol ბაზარზე რამდენიმე თვის წინ გამოუშვა. ახალი თაობის სისტემა ხელოვნური ინტელექტის განვითარებაში მნიშვნელოვან ნახტომად ფასდება, რადგან ის კომპლექსური გადაწყვეტილებების მიღებას ადამიანის ჩარევის გარეშე, დამოუკიდებლად ახერხებს.

გამოწერეთ ჩვენი სიახლეები

მიიღეთ დღის მთავარი სიახლეები