GPT-6 Astra: قوی تو کدنویسی، گرون تو بقیه
خلاصهٔ کاملتر
به گزارش آرتیفیشال آنالیسیس، GPT-6 Astra دو داستان کاملا جدا داره. تو Artificial Analysis Coding Agent Index (یعنی شاخصی که مدل رو داخل یه ایجنت واقعی کدنویسی میسنجه) با هارنس Codex امتیاز ۶۷ گرفته که تقریبا برابر Claude Opus 5 و Fable 5 توی Claude Code هست. صدرنشین جدول همچنان Fable 5.1 با امتیاز ۷۰ هست.
چیزی که این امتیاز رو ارزون میکنه مصرف توکنه. Astra تو هارنس Codex یکسوم توکن GPT-5.6 Sol و یکپنجم توکن Claude Opus 5 رو مصرف میکنه. یعنی تو حالت max با تقریبا همون هزینهٔ GPT-5.6 Sol دو امتیاز بالاتر میگیره، و هزینهٔ هر تسکش کمتر از نصف Fable 5 با امتیاز برابره.
تو Intelligence Index ماجرا برعکسه. امتیاز ۶۱ یعنی همسطح نسل قبل و ۵ امتیاز پایینتر از Claude Fable 5.1، در حالی که از Muse Spark 1.3 متا هم عقبتره. مصرف توکن خروجی حدود ۱۰٪ کم شده، ولی چون قیمت از ۴ و ۲۰ دلار به ۱۰ و ۵۰ دلار بهازای هر میلیون توکن ورودی و خروجی رفته، هر تسک ۷۵٪ گرونتر تموم میشه.
بهترین خبر جای دیگهست. تو AA-Omniscience که دانش و توهم مدل رو میسنجه، نرخ توهم تو حالت max از ۹۲٪ به ۵۱٪ رسیده و برخلاف خیلی از مدلها این بار دقت هم ۴ امتیاز بالا رفته. تو AA-Briefcase (کار دانشی چندهفتهای با هزاران فایل منبع) حدود ۸۰ امتیاز Elo جلو زده، ولی تقریبا همونقدر تو GDPval-AA v2 عقب رفته و تو τ³-Banking و SciCode و AA-LCR هم ۲ تا ۳ امتیاز افت داشته.
نکات کلیدی:
- قیمت جدید: ۱۰ دلار ورودی و ۵۰ دلار خروجی بهازای هر میلیون توکن، ۲.۵ برابر GPT-5.6 Sol
- امتیاز ۶۷ در Coding Agent Index با هارنس Codex؛ صدر جدول Fable 5.1 با ۷۰
- امتیاز ۶۱ در Intelligence Index، برابر نسل قبل و ۵ امتیاز پایینتر از Fable 5.1
- کاهش نرخ توهم از ۹۲٪ به ۵۱٪ همراه با ۴ امتیاز رشد دقت
- تخفیف ۹۰٪ برای خواندن کش و ۲۵٪ اضافهبها برای نوشتن کش دستنخورده مونده




