آندری کارپاتی به Anthropic پیوست
خلاصهٔ کاملتر
آندری کارپاتی این هفته رسماً به Anthropic پیوست. اون در پست خودش نوشت که چند سال آینده در مرز فناوری مدلهای زبانی بزرگ (LLM) فوقالعاده سرنوشتسازه و خوشحاله که به این تیم برگشته.
کارپاتی در Anthropic زیر نظر نیک جوزف روی pre-training کار میکنه؛ یعنی همون مرحلهای که طی اون مدل Claude با اجرای رانهای آموزشی عظیم، دانش و تواناییهای پایهایاش رو به دست میاره. این مرحله از گرانترین و محاسبهبَرترین بخشهای ساخت یه مدل زبانی پیشرفتهست.
یه سخنگوی Anthropic به TechCrunch گفته که کارپاتی قراره تیمی بسازه که هدفش استفاده از Claude برای تسریع تحقیقات pre-training باشه. این یعنی بهجای صرفاً ریختن پول بیشتر روی سختافزار و محاسبات، از هوش مصنوعی برای بهتر کردن خود فرآیند تحقیق استفاده بشه — رویکردی که Anthropic رو در مقابل غولهایی مثل OpenAI و Google متمایز میکنه.
کارپاتی یکی از معدود محققینیه که هم تئوری LLMها رو عمیقاً میدونه هم تجربه عملی آموزش در مقیاس بزرگ داره. پیش از این، در OpenAI روی یادگیری عمیق و بینایی ماشین کار میکرد، بعد به Tesla رفت و برنامههای Full Self-Driving و Autopilot رو رهبری کرد. در ۲۰۲۴ هم استارتاپ Eureka Labs رو با تمرکز بر آموزش با کمک هوش مصنوعی راه انداخت، هرچند بهنظر میرسه فعالیت اون فعلاً متوقف شده.
کارپاتی گفته که به آموزش علاقه داره و میخواد در آینده به اون برگرده. او دوره آنلاین «Neural Networks: Zero to Hero» رو هم تدریس کرده که به دانشجوها یاد میده از صفر شبکه عصبی بسازن.
در کنار این خبر، Anthropic یه استخدام مهم دیگه هم داشته: کریس رولف، متخصص امنیت سایبری با بیش از ۲۰ سال سابقه (از Yahoo و Meta)، به تیم «red team» مرزی Anthropic پیوسته؛ تیمی که مدلهای پیشرفته رو در برابر تهدیدات جدی تست میکنه.
نکات کلیدی:
- کارپاتی از این هفته در Anthropic مشغول به کاره و روی pre-training مدل Claude کار میکنه
- هدف: ساختن تیمی که از Claude برای شتابدهی به تحقیقات pre-training استفاده کنه
- این رویکرد نشوندهنده استراتژی Anthropic برای رقابت با کمک هوش مصنوعی، نه صرفاً محاسبات بیشتره
- کریس رولف هم به عنوان متخصص امنیت سایبری به تیم red team پیوسته
- آینده Eureka Labs، استارتاپ آموزشی کارپاتی، نامشخصه




