اوپنایآی سرعت GPT-5.6 Sol رو ۱۴ برابر کرد
خلاصهٔ کاملتر
اوپنایآی یه پیشنمایش محدود از Ultrafast رو باز کرده؛ یه تایر تازه تو API که GPT-5.6 Sol رو تا ۱۴ برابر سریعتر از حالت Standard اجرا میکنه. این سرعت با کمک زیرساخت Cerebras به دست میاد و میتونه تا ۷۵۰ توکن در ثانیه تولید کنه. دسترسی فعلاً فقط برای یه گروه خاص از مشتریهاست و اوپنایآی گفته با افزایش ظرفیت، دسترسی رو گسترش میده.
به گفتهٔ اوپنایآی، تا حالا برای رسیدن به سرعت واقعی-زمانی (real-time) تیمها مجبور بودن یه مدل کوچیکتر یا تخصصیتر انتخاب کنن. Ultrafast میخواد همون مدل قوی و باهوش رو تو تنظیمات کمتاخیر (low-latency) هم در دسترس بذاره، بدون اینکه لازم باشه از دقت مدل بزرگ بگذری. کاربردهای اصلیای که هدف قرار گرفتن شامل رسیدگی به حوادث امنیتی، حوزهٔ مالی، پشتیبانی مشتری، سیستمهای صوتی، فروشگاههای آنلاین و پژوهشه.
خود اوپنایآی هم از این تایر تو کارهای داخلی استفاده میکنه؛ مثلاً موقع رسیدگی به حوادث، برای بررسی لاگها، تریسها، گفتگوهای تیمی و آمادهسازی و اعتبارسنجی راهحلها ازش کمک میگیره، هرچند تصمیم نهایی همچنان با مهندسهاست. تیمهای پژوهشی هم برای جستجو تو منابع دانشی و سازماندهی یافتهها ازش استفاده میکنن، تا جایی که بعضی چرخههای آزمایشی که قبلاً یه شب طول میکشید، حالا تو یه روز کاری چندبار قابل تکرارن.
چند شرکت اولیه هم Ultrafast رو امتحان کردن: Jane Street، Podium، Basis و Rogo. بازخوردشون بیشتر دربارهٔ جلسات کدنویسی متمرکزتر، تماسهای صوتی پیچیدهتر با تاخیر کمتر، اپلیکیشنهای کمتاخیر ساختهشده روی یه مدل قدرتمند، و پژوهش مالیای بوده که حس نزدیکتری به یه بازار زنده میده. Ultrafast در واقع ادامهٔ همکاری اوپنایآی با Cerebras هست که زیرساختش پشت این سرعته. فعلاً قیمتگذاری و زمان دسترسی عمومی اعلام نشده و اوپنایآی داره از مشتریهای اولیه بازخورد جمع میکنه.
نکات کلیدی:
- Ultrafast مدل GPT-5.6 Sol رو تا ۱۴ برابر سریعتر از Standard اجرا میکنه
- سرعت تولید تا ۷۵۰ توکن در ثانیه، با زیرساخت Cerebras
- اولین تسترها: Jane Street، Podium، Basis و Rogo
- دسترسی فعلاً محدود و پیشنمایشیه؛ قیمت و زمان دسترسی عمومی هنوز اعلام نشده




