توی کد منبع باز Codex CLI که OpenAI روی گیتهاب منتشر کرده، یه دستور عجیب توی سیستمپرامپت GPT-5.5 پیدا شده: مدل باید هرگز از گابلین، ترول، راکون، کبوتر و موجوداتی از این دست حرف نزنه — مگه که کاملاً به سؤال کاربر مربوط باشه. این دستور دوبار تکرار شده و نشون میده GPT-5.5 یه عادت عجیب داره که خودش وسط مکالمههای نامربوط میره سراغ گابلینها! کارمندان OpenAI گفتن این یه ترفند بازاریابی نیست، اما سم آلتمن با شوخی موضوع رو تأیید کرد. جالب اینه همین سیستمپرامپت دستور میده مدل وانمود کنه «زندگی درو
بازار اینفرنس هوش مصنوعی با سرعت عجیبی داره تخصصی میشه؛ دقیقاً همون اتفاقی که یهروزی برای دیتابیسها افتاد. درآمد مراکز داده NVIDIA از ۳.۶ میلیارد دلار در پایان ۲۰۲۲ به ۶۲.۳ میلیارد دلار در اوایل ۲۰۲۵ رسیده — یعنی ۱۷ برابر رشد از زمان لانچ ChatGPT. حالا بار کاریهای مختلف مثل تصویر، ویدیو، صدا، اجرای روی دستگاه، و پردازش دستهای، هرکدام زیرساخت و معماری مختص خودشون رو میطلبن. این تکهتکهشدن بازار ۱۰۰ میلیارد دلاری میتونه بازیگران بزرگی مثل Oracle، MongoDB و Snowflake برای AI تولید کنه.
مدیرعامل جدید پیپال، انریکه لورس، تصمیم گرفته ونمو رو برای اولین بار به یه بخش مستقل تبدیل کنه. این تغییر ساختار به شرکت کمک میکنه عملکرد ونمو رو بهتر رصد کنه یا در صورت نیاز راحتتر بفروشه. استرایپ و چند خریدار دیگه هم چشمشون دنبال پیپاله و این بازسازی میتونه زمینهساز یه معامله بزرگ بشه. در همین حین دو مدیر ارشد شرکت رو ترک میکنن و طرح اخراج گسترده هم هنوز در بلاتکلیفیه.
ارزیابی مدلهای هوش مصنوعی دیگه فقط یه مرحلهی ساده نیست؛ به یه بار مالی سنگین تبدیل شده که داره تحقیقات رو محدود میکنه. لیدربورد HAL برای ارزیابی ۹ مدل روی ۹ بنچمارک، ۴۰ هزار دلار خرج کرده. در بنچمارکهای علمی مثل The Well، ارزیابی یه معماری جدید به ۹۶۰ ساعت H100 نیاز داره. جالبتر اینه که خرج بیشتر لزوماً نتیجهی بهتر نمیده و ابزارهای کاهش هزینه که برای بنچمارکهای استاتیک کار میکردن، برای ارزیابیهای agentمحور خیلی کمتر مؤثرن.
Cloudflare با همکاری Stripe یه پروتکل جدید معرفی کرده که به ایجنتهای هوش مصنوعی اجازه میده بدون هیچ دخالت انسانی، اکانت Cloudflare بسازن، دامنه بخرن، و اپ رو مستقیم به پروداکشن دپلوی کنن. کاربر فقط باید به Stripe لاگین باشه و شرایط سرویس رو قبول کنه؛ بقیه کارها رو ایجنت انجام میده. این پروتکل روی سه ستون کشف سرویس، احراز هویت خودکار، و پرداخت امن بنا شده و هر پلتفرمی با کاربران لاگینشده میتونه ازش استفاده کنه.
LaDiR یه فریمورک جدیده که مدلهای دیفیوژن رو با LLMها ترکیب میکنه تا استدلال متنی رو بهتر کنه. مشکل اصلی اینه که مدلهای زبانی اتورگرسیو نمیتونن توکنهای قبلی رو بازبینی کنن و این محدودیت کیفیت استدلال رو پایین میاره. LaDiR با استفاده از یه VAE فضای پنهان میسازه و بعد یه مدل دیفیوژن روی اون اجرا میکنه تا مراحل استدلال رو تکرار و اصلاح کنه. نتایج روی بنچمارکهای ریاضی و برنامهریزی نشون میده که این روش از روشهای اتورگرسیو و دیفیوژنمحور قبلی بهتره.
گوگل اعلام کرده که قراره تراشههای TPU اختصاصیش رو به مشتریان منتخب بفروشه تا توی دیتاسنترهای خودشون نصب کنن. این تغییر استراتژی بزرگیه چون تا الان فقط ظرفیت TPU رو از طریق سرویسهای ابری اجاره میداد. این اقدام رقابت گوگل با نویدیا رو جدیتر میکنه و نشون میده شرکتهای بزرگ فناوری دارن تلاش میکنن از سلطه نویدیا در بازار تراشههای هوش مصنوعی کم کنن. آمازون هم با تراشههای Trainium و Graviton در همین مسیر حرکت میکنه.
آمازون الان جزو سه تا غول بزرگ تراشههای دیتاسنتر دنیاست و کسبوکار تراشههاش از مرز ۲۰ میلیارد دلار سالانه رد شده. اگه آمازون خودش رو هم بهعنوان مشتری حساب میکرد، این عدد به ۵۰ میلیارد دلار میرسید. Trainium2 تقریباً تمام فروخته شده، Trainium3 هم داره به همون وضع میرسه، و حتی Trainium4 که هنوز ۱۸ ماه تا عرضه عمومیش مونده، بخش زیادیش رزرو شده. OpenAI، Anthropic، Meta و Uber از جمله بزرگترین مشتریانی هستن که روی این تراشهها شرط بستن.
ProEval یه فریمورک متنباز از DeepMind هست که هزینه ارزیابی مدلهای GenAI رو تا ۱۰۰ برابر کاهش میده. این ابزار با استفاده از surrogate های مبتنی بر Gaussian Process، نرخ خطای مدل رو تنها با یک درصد از دادهها با دقت ±۱٪ تخمین میزنه. علاوه بر این، ProEval بهصورت فعالانه الگوهای شکست مدل رو شناسایی میکنه و اطلاعات ارزشمندی برای بهبود توسعه AI فراهم میآره. روی بنچمارکهای معروفی مثل GSM8K، MMLU و StrategyQA هم اعتبارسنجی شده.
آموزش مدلهای زبانی بزرگ با کانتکستهای ۱۰۰ هزار توکنی و بیشتر، چالش جدی کمبود حافظه GPU رو به همراه میاره. AutoSP یه کامپایلر اتوماتیکه که کد آموزش معمولی ترنسفورمر رو به کد چند-GPU با Sequence Parallelism تبدیل میکنه، بدون اینکه برنامهنویس مجبور باشه دست به کد پیچیدهای بزنه. این ابزار درون DeepSpeed ادغام شده و با تغییر چند خط کانفیگ فعال میشه. نتایج روی مدلهای Llama 3.1 نشون میده که AutoSP حداکثر طول کانتکست قابلآموزش رو به طرز قابلتوجهی افزایش میده، در حالی که سربار زمانی اجرا به حد
میسترال از مدل جدیدش Mistral Medium 3.5 رونمایی کرد؛ یه مدل ۱۲۸ میلیارد پارامتری که کدنویسی، استدلال و دنبالکردن دستورات رو توی یه مجموعه وزن ادغام کرده. مهمترین خبر اینه که ایجنتهای کدنویسی Vibe دیگه فقط روی لپتاپ اجرا نمیشن و میتونی اونها رو به کلاد منتقل کنی تا در پسزمینه و بهصورت موازی کار کنن. Le Chat هم یه حالت جدید به اسم Work mode گرفته که برای کارهای پیچیده چندمرحلهای مثل تحقیق، تحلیل و مدیریت ایمیل و تقویم طراحی شده. وزنهای مدل هم بهصورت اوپنسورس با لایسنس MIT تغییریافته ر
شرکت امنیتی Wiz با کمک یه ابزار هوش مصنوعی به اسم IDA MCP، یه آسیبپذیری جدی در GitHub Enterprise Server کشف کرد که اجازه اجرای کد از راه دور رو به مهاجم میده. این آسیبپذیری با شناسه CVE-2026-3854 ثبت شده و امتیاز CVSS هشت و هفت دهم گرفته. GitHub در کمتر از دو ساعت پچ رو روی github.com اعمال کرد. نکته جالب اینجاست که این کار قبلاً به خاطر حجم بالای تحلیل باینریهای بسته عملاً ممکن نبود، ولی AI این فرآیند رو از چند هفته به کمتر از ۴۸ ساعت رسوند.
اوپنایآی که اوایل ۲۰۲۵ با سروصدای زیاد از پروژه استارگیت رونمایی کرد — یه سرمایهگذاری ۵۰۰ میلیارد دلاری برای ساخت دیتاسنترهای هوش مصنوعی — حالا عملاً از این ایده عقبنشینی کرده. این شرکت بهجای مالکیت مستقیم زیرساخت، ترجیح میده ظرفیت محاسباتی رو از ارائهدهندگان ثالث اجاره کنه. این تغییر رویکرد باعث شده شرکای اصلی مثل اوراکل، سافتبانک و مایکروسافت احساس کنن که اوپنایآی اونها رو سردرگم گذاشته. اوپنایآی خودش هم پذیرفته که استارگیت فقط یه «چتر» برای استراتژی محاسباتیشه، نه یه پروژه مشخص.
پروژه Zig یکی از سختگیرانهترین سیاستهای ضد هوش مصنوعی رو در دنیای اپنسورس داره و استفاده از LLMها رو در ایشوها، پولریکوئستها و حتی کامنتهای باگتراکر کاملاً ممنوع کرده. Loris Cro از بنیاد Zig توضیح میده که هدف اصلی بررسی PR، رشد مشارکتکنندههاست، نه صرفاً مرج کردن کد. به این دلیل، اگه پشت یه PR یه LLM باشه نه یه انسان، وقتی که تیم Zig صرف بررسیش میکنه عملاً هدر رفته. از طرف دیگه، Bun که با Zig نوشته شده و حالا متعلق به Anthropic هست، اعلام کرده که بهبودهای عملکردی اخیرش رو بهخاطر همین
Trellis یه لایهی مدیریت پروژه برای ابزارهای AI کدنویسیه که به جای اینکه همه چیز رو توی یه فایل بزرگ مثل CLAUDE.md بریزی، اطلاعات رو بهصورت ماژولار و هوشمند سازمان میده. این ابزار از Claude Code، Cursor، Codex، OpenCode، Pi Agent و بقیه پلتفرمها پشتیبانی میکنه. Trellis یه دایرکتوری .trellis/ توی ریپازیتوریت میسازه و اطلاعات مربوط به استانداردها، تسکها، workflow و حافظهی جلسه رو جدا از هم نگه میداره تا هر agent فقط همون چیزی رو لود کنه که نیاز داره. هم برای توسعهدهندههای انفرادی کار می
Cursor یه SDK جدید معرفی کرده که بهت اجازه میده همون ایجنتهایی که داخل اپ دسکتاپ، CLI و وب Cursor کار میکنن رو با چند خط TypeScript مستقیماً توی پروژههات استفاده کنی. این SDK الان در بتای عمومی در دسترسه و میتونی ایجنتها رو هم روی ماشین خودت و هم روی زیرساخت ابری Cursor اجرا کنی. تیمها الان دارن ازش برای اتوماسیون CI/CD، ساخت پلتفرمهای داخلی و حتی جاسازی ایجنت توی محصولات مشتریمحور استفاده میکنن.
از نسخه ۲.۱.۲۰ به بعد، Claude Code جزئیات اجرا رو مخفی کرده و به جاش خلاصههای مبهم نشون میده. claude-devtools یه ابزار رایگان و اوپنسورسه که بدون نیاز به API key یا تنظیمات خاص، همون لاگهایی که Claude Code روی ماشین شما ذخیره کرده رو میخونه و همه چیز رو با جزئیات کامل نمایش میده. با این ابزار میتونی هر tool call، هر فایل خوندهشده، مصرف توکن به تفکیک، و حتی درخت اجرای subagentها رو ببینی.
OpenSkills یه ابزار خط فرمانیه که سیستم مهارتهای Claude Code رو برای همه ایجنتهای کدنویسی هوش مصنوعی مثل Cursor، Windsurf، Aider و Codex قابل استفاده میکنه. این ابزار همون فرمت XML که Claude Code استفاده میکنه رو توی فایل AGENTS.md مینویسه تا هر ایجنتی بتونه ازش بخونه. مهارتها فقط وقتی نیاز باشه لود میشن که context رو تمیز نگه میداره. میشه مهارتها رو از مارکتپلیس Anthropic، گیتهاب، مسیر لوکال یا ریپوهای خصوصی نصب کرد.
Command Code یه ایجنت کدنویسی هوش مصنوعیه که با مدل اختصاصی taste-1 کار میکنه و از هر بار که کدش رو قبول یا رد میکنی، یاد میگیره. برخلاف ابزارهای معمول AI که هر بار باید از اول توضیح بدی چه سبکی رو ترجیح میدی، Command Code سلیقه کدنویسیت رو بهصورت خودکار میسازه و نگه میداره. این ابزار CLI-محور از پروژههای فولاستک گرفته تا نوشتن تست و ریفکتور رو پشتیبانی میکنه و قابلیت اشتراکگذاری سلیقه بین تیم رو هم داره. تازه ۵ میلیون دلار سرمایه جذب کرده و بیش از ۲ هزار توسعهدهنده ازش استفاده میکن
Link CLI یه ابزار خط فرمان از استرایپه که به ایجنتهای هوش مصنوعی اجازه میده بهجای کاربر خرید کنن، بدون اینکه اطلاعات واقعی کارت ذخیره بشه. این ابزار یه کارت مجازی یکبار مصرف صادر میکنه که فقط برای یه خرید خاص معتبره. کاربر باید هر درخواست پرداخت رو از طریق اپ Link تأیید کنه، پس کنترل کامل دست خودشه. پشتیبانی از MCP Server هم داره، یعنی میشه مستقیماً به کلاینتهای هوش مصنوعی متصلش کرد.