اپل سراغ استارتاپی رفته که مدلهای بزرگ AI رو تو آیفون جا میده
خلاصهٔ کاملتر
به گزارش CNBC، اپل با یه شرکت کوچیک تو سیلیکونولی در حال گفتوگوئه که ادعا میکنه میتونه مدلهای قدرتمند هوش مصنوعی رو اونقدر کوچیک کنه که مستقیم روی آیفون اجرا شن. بابک حسیبی، مدیرعامل PrismML، به CNBC گفته اپل و چند شرکت دیگه دارن سرعت، بهرهوری انرژی و کارایی مدلهاشون رو روی دستگاه اندازه میگیرن. به گفتهٔ خودش این گفتوگوها خیلی ابتداییه، ولی «خوب پیش میره». اپل به درخواست اظهارنظر پاسخ نداده.
این استارتاپ که یه اسپینآف از کلتک و مورد حمایت Khosla Ventures هست، نسخههای فشردهٔ مدل متنباز Qwen از علیبابا رو عمومی کرده. به گفتهٔ شرکت، مدل از حدود ۵۴ گیگابایت به کمتر از ۴ گیگابایت رسیده و همهٔ ۲۷ میلیارد پارامترش روی آیفون ۱۵ یا جدیدتر اجرا میشه. فناوری از گروه پژوهشی حسیبی تو کلتک بیرون اومده، دانشگاه مالک پتنتهاست و در مارس هم یه راند seed حدود ۱۶.۲۵ میلیون دلاری جذب کردن.
روش کار به گفتهٔ PrismML اینه که نحوهٔ ذخیرهٔ اطلاعات داخلی مدل رو بهشدت ساده میکنه — هر مقدار از ۱۶ بیت به فقط یک یا سه حالت ممکن کاهش پیدا میکنه. حسیبی این کار رو با حرکت صنعت تراشه از محاسبات هشتبیتی به چهاربیتی مقایسه کرده، منتها یه قدم جلوتر. عددهایی که شرکت میده: ۱۰ تا ۱۵ برابر حافظهٔ کمتر، پاسخدهی ۶ تا ۸ برابر سریعتر و مصرف انرژی ۳ تا ۶ برابر کمتر.
حسیبی خودش هزینهٔ این کار رو هم پذیرفته: مدلهای فشرده معمولاً چند واحد درصد از کارایی کلی رو از دست میدن و اولین چیزی که ضعیف میشه، یادآوری حقایقه — پیش از مهارتهایی مثل استدلال، ریاضی و کدنویسی. دو نسخهٔ فشرده رایگان منتشر شدن تا روی آیفون، مکبوک و کامپیوترهای مجهز به انویدیا اجرا شن.
زمانبندی این خبر برای اپل معنادار بود: یه روز قبلش نسخهٔ بتای عمومی iOS 27 باز شده بود و کاربرها اولین دسترسی گسترده رو به بازطراحی سیری پیدا کردن. اجرای بیشتر AI روی خود دستگاه هم تأخیر رو کم میکنه، هم هزینهٔ ابری رو، هم با وعدهٔ حریم خصوصی اپل جور درمیاد و هم بعضی قابلیتها رو بدون اینترنت ممکن میکنه.
کارولینا میلانزی از Creative Strategies میگه مدلهای کوچیکتر به اپل اجازه میدن قابلیتهای سنگینتر مثل عکاسی محاسباتی، تولید ویدیو و ابزارهای سلامت رو روی خود آیفون ببره — همون دادههایی که کاربر بیشتر دلش میخواد خصوصی بمونه. هوراس دِدیو از Asymco هم معتقده مزیت اصلی صرفاً حافظهٔ کمتر نیست، بلکه جا دادن یه مدل تواناتر تو همون محدودیت فیزیکیه. اپل چون تراشه و نرمافزار آیفون رو با هم طراحی میکنه، تو این کار دست بازتری داره.
ولی تحلیلگرها هشدار میدن که این ادعاها هنوز باید بیرون از نمایشهای کنترلشده اثبات شن. تارون پاتاک از Counterpoint میگه آزمون واقعی، میلیونها پرسوجو و هزاران ترکیب دستگاهه؛ کارایی روی پرامپتهای طولانی و مصرف باتری موقع چندکاره بودن حیاتیه. فیل سولیس از IDC هم مصرف انرژی رو بزرگترین سؤال باز میدونه: مدلی که بهقدر کافی توانا باشه ممکنه مدام یا در پسزمینه اجرا شه و باتری رو خالی کنه، حتی اگه حافظهٔ کمتری بخواد.
این انتشار وسط یه بحث داغ دیگه هم اومده: اینکه آیا بهبود بهرهوری AI در نهایت تقاضای تراشهٔ حافظه و زیرساخت دیتاسنتر رو کم میکنه یا نه. مورگان استنلی تخمین زده هزینهٔ حافظهٔ اپل تو سال مالی ۲۰۲۷ بهشدت بالا بره و قیمت پایهٔ آیفون ۱۸ حدود ۲۰۰ دلار گرونتر شه. در مقابل، گیل لوریا از D.A. Davidson میگه کوچیک شدن مدلها نیاز به پردازنده و حافظه رو حذف نمیکنه، فقط تراشهها رو از دیتاسنتر به گوشیها منتقل میکنه.
نکات کلیدی:
- اپل طبق گفتهٔ مدیرعامل PrismML در حال ارزیابی فناوری فشردهسازی این استارتاپه
- مدل Qwen از حدود ۵۴ گیگابایت به زیر ۴ گیگابایت رسیده و روی آیفون ۱۵ به بعد اجرا میشه
- روش کار: کاهش هر مقدار از ۱۶ بیت به یک یا سه حالت ممکن
- ادعای شرکت: ۱۰ تا ۱۵ برابر حافظهٔ کمتر، ۶ تا ۸ برابر سریعتر، ۳ تا ۶ برابر کممصرفتر
- هزینهش چند درصد افت کاراییه که اول روی یادآوری حقایق اثر میذاره
- تحلیلگرها روی مصرف باتری و آزمون در مقیاس واقعی تردید دارن




