وقتی رفتار یه ایجنت رو میشه با یه پاراگراف متن عوض کرد، تأیید هویتش هیچی رو تضمین نمیکنه. راهحل اینه که اصلاً چیزی دستش نباشه.
تیمهای تکنفره دارن با ایجنت صوتی روی Twilio زنگ میزنن و پادکست و ویدیوی کوتاه ماشینی منتشر میکنن؛ همون مدلهایی که محصول رو میسازن، حالا فروشش رو هم میبرن جلو.
تولید ویدیو با مدلهای دیفیوژن کند و پرهزینهست. انویدیا روشی معرفی کرده که بهجای فشردهکردن چند گام توی یه گام بزرگ، چند گام رو همزمان پیشبینی میکنه.
پستهاگ یه چارچوب ساده معرفی کرده که فقط با دو سؤال — چککردن کار و برگردوندنش — مشخص میکنه هر تسک رو تا کجا میشه دست ایجنت سپرد.
یه نویسنده تعریف میکنه موقع یادگیری نحوهٔ کار مدلهای زبانی چطور از هوش مصنوعی استفاده کرده: نه برای گرفتن جواب آماده، بلکه برای پیدا کردن اصطلاح درست و بیرون کشیدن شکافهای فهم خودش.
یه پروژهٔ متنباز روی n8n هر هفته کاتالوگ آسیبپذیریهای در حال سوءاستفادهٔ CISA رو میخونه و برای هر CVE تازه یه قانون تشخیص آمادهٔ تحویل به تیم امنیت میسازه.
یه بنچمارک ۴۶ تسکی جدید، ایجنتهای الالام رو تو ترمینال و در طول صدها قدم میسنجه؛ قویترین مدل فقط ۲۸٪ تسکها رو کامل میبنده.
بنچمارکهای رسمی این مدل open weight رو همردهٔ مدلهای گرانقیمت نشون میدن، ولی یه تست دستی روی یه مخزن واقعی نشون داد فاصله دقیقاً کجا خودش رو نشون میده.
گوگل توی اپ Gemini قابلیتی اضافه کرده که با یه کوییز تشخیصی میفهمه کجای یه موضوع لنگ میزنی و بعد فقط برای همون شکافها درس کوتاه میسازه؛ رایگان و با یه اکانت معمولی گوگل.
کاربرهایی که Ask Photos رو روشن کرده بودن، برای برگشتن به جستوجوی معمولی باید میرفتن سراغ تنظیمات؛ حالا یه کلید بالای صفحهٔ نتایج این کارو یهضرب انجام میده.
ساباستک یه ابزار تشخیص متن AI رو تو اپش گنجونده تا خوانندهها بفهمن یه نوشته رو ماشین نوشته یا آدم.
یه توسعهدهنده رفته سراغ خودِ مخزن Bun و اعداد رو شمرده؛ شش هفته بعد از مرج شدن بازنویسی، هنوز خبری از ریلیز تگ نیست و PRهای باز از ۱۲۷۷ به ۲۴۷۵ رسیده.
هر موج تکنولوژی اصطلاحهای بصری خودشو جا میذاره؛ حالا نوبت افکت درخشش، متن استریمی و آیکونهای ریزیه که دارن از اپهای هوش مصنوعی به بقیهٔ نرمافزارها سرریز میکنن.
گوگل داره تبهای تولید تصویر و ویدیو، پیوست دوربین و پشتیبانی از سرورهای MCP سفارشی رو به اپ دسکتاپ اضافه میکنه؛ فعلاً فقط تو بیلدهای تستر مورد اعتماد.
بعد از موفقیت Kimi K3، استارتاپ چینی مونشات دنبال دسترسی به انبوه پردازندههای بلکول انویدیاست تا مدل بعدیشو آموزش بده — حتی اگه معنیش زیر پا گذاشتن محدودیتهای صادراتی آمریکا باشه.
نویسنده میگه ماههاست بهجای پرامپت تایپی، بلندبلند برای ایجنت حرف میزنه؛ چون همون تناقضها و تردیدهای وسط حرف زدن، دقیقاً چیزیه که ایجنت بهش نیاز داره.
نویسنده میگه توهم ایجنتهای هوش مصنوعی معمولاً تقصیر خود مدل نیست، بلکه از یکی از چهار مشکل تو نحوهی چیدمان دادهی کانتکست میاد.
یه لندینگ که با اسکرول جلو و عقب میره، در واقع یه کلیپ کوتاهه که فریمبهفریم به اسکرول گره خورده؛ حالا یه نفر تنها با چند دلار میسازتش.
جو لیزر و شین اسنو پنج ایدهای رو باز کردن که امسال بیشتر از همه ذهنشون رو درگیر کرده؛ از پسزدن راحتی افراطی تکنولوژی تا اینکه چرا اینترنت همهمون رو به یه آدم واحد تبدیل کرده.
۱۲۲۴ نفر از کارکنان شرکتهای پیشروی هوش مصنوعی، از جمله مدیران ارشد OpenAI و Anthropic و گوگل، از دولت آمریکا خواستن یه تلاش بینالمللی برای تنظیم سرعت پیشرفت راه بندازه.