کارخونهٔ نرمافزار ایجنتی OpenAI از داخل
خلاصهٔ کاملتر
Gergely Orosz تو نیوزلتر The Pragmatic Engineer، بعد از گفتوگو با هفت مهندس و مدیر OpenAI، نوشته که Codex (ایجنت کدنویسی OpenAI) از حدود ژانویه همهچیز شرکت رو گرفته. تو چهار ماه، تیمهای غیرمهندسی مثل مالی، استخدام و حقوقی از تقریباً ۰٪ به ۹۰٪ استفاده رسیدن. اپ Codex برای Mac فوریه و برای Windows مارس اومد، و ChatGPT Work هم ژوئیه منتشر شد که روی همون harness ساخته شده (یعنی لایهای که مدل رو به ابزارها وصل میکنه).
به گفتهٔ تیم Codex، چند چیز این رشد رو سریع کرد. قابلیت /goal اضافه شد که یه هدف براش تعیین میکنی و ایجنت تا تموم شدن کار ادامه میده؛ بین آوریل و مه استفاده از ۶۰٪ به ۹۰٪ رسید و بعضیها روزها روی یه thread کار میکنن. تیمها هم workflowهای مخصوص نقش خودشون رو به شکل plugin پخش کردن. البته نسخهٔ داخلی Codex به تقریباً همهٔ سیستمهای OpenAI وصله و از نسخهٔ عمومی قویتره.
از ژانویه استفاده از IDE تو OpenAI کم شده. تیم دسامبر ۲۰۲۵ مطمئن نبود اپ دسکتاپ Codex رو منتشر کنه یا مثل Antigravity یه fork از VS Code بسازه، ولی شرط بست که با بهتر شدن ایجنتها IDE کماهمیتتر میشه. در عوض بار زیرساخت منفجر شده: Venkat Venkataramani، معاون مهندسی Applied Infra، میگه تعداد PR هر مهندس با سرعت زیادی بالا میره و بعضی سیستمها تو حدود شش ماه ۱۰ برابر بار گرفتن.
Venkat معتقده روش فعلی code review و pull request داره بیمعنیتر میشه. الان چند ایجنت ریویو، هر کدوم با تنظیمات یه متخصص حوزه (مثلاً زیرساخت ابری یا امنیت)، هر تغییر رو بررسی میکنن. تغییرها بر اساس ریسک دستهبندی میشن: پرریسکها ریویوی بیشتر یا انسانی میگیرن و بعضی بخشهای کد میتونن PRهای کمریسک رو خودکار تأیید کنن. گلوگاه تازه اپ موبایله، چون هر آپدیت iOS و Android ساعتها یا روزها منتظر بررسی Apple و Google میمونه.
خط تولید این شکلیه: یه آدم نتیجهٔ دلخواه رو تعریف میکنه، Codex از Git، Slack، Notion، Databricks و Datadog اطلاعات جمع میکنه (همهٔ مستندات هم رفته داخل سورسکد)، کد رو مینویسه، تستها رو اجرا میکنه، PR میسازه و تا سبز شدن CI حواسش بهش هست. بعد از تأیید انسانی، هر تغییر یه ایجنت دیپلوی میگیره که محل feature flag رو پیدا میکنه، سیگنالهای موفقیت و شکست رو انتخاب میکنه و حتی داشبورد مانیتورینگ خودش رو میسازه.
بعد از دیپلوی، Perf Factory با ایجنتها هشدارها و داشبوردها رو میگرده، سیگنالهای تکراری رو کنار میذاره، کندیهای واقعی رو پیدا میکنه و راهحل پیشنهاد میده. برای قطعیها هم Sevbot هست که اطلاعات حادثه رو جمع میکنه، راههای کم کردن آسیب رو پیشنهاد میده و تو Slack جواب سؤالها رو میده، ولی خودش چیزی اجرا نمیکنه مگه مهندس بگه. هدف OpenAI اینه که Sevbot قطعیهای معمولی رو خودش حل کنه، ولی فعلاً oncall هنوز سر جاشه.
نکات کلیدی:
- تیمهای غیرمهندسی OpenAI تو چهار ماه از حدود ۰٪ به ۹۰٪ استفاده از Codex رسیدن.
- بار بعضی سیستمهای build و CI/CD تو حدود شش ماه ۱۰ برابر شده.
- ریویوی کد با چند ایجنت متخصص انجام میشه و PRهای کمریسک میتونن خودکار تأیید بشن.
- هر تغییر یه ایجنت دیپلوی داره که داشبورد مانیتورینگ خودش رو میسازه.
- Sevbot فعلاً فقط پیشنهاد میده و بدون دستور مهندس کاری اجرا نمیکنه.




