هشدار کلاهبرداری واتساپ، بدون اینکه پیامت رو ببینه
خلاصهٔ کاملتر
تو مقالهٔ مهندسی متا اومده که واتساپ داره روی Scam Alert کار میکنه؛ یه قابلیت اختیاری که وقتی روشنش کنی، یه مدل کوچیک یادگیری ماشین روی خود گوشی دانلود میشه و پیامهای غریبهها — یعنی کسایی که تو مخاطبات نیستن — رو با الگوهای شناختهشدهٔ کلاهبرداری مقایسه میکنه. اگه مدل پیامی رو مشکوک ببینه، هشدار فقط تو چت خودت نشون داده میشه و طرف مقابل چیزی نمیبینه. بعدش خودت تصمیم میگیری: بلاک، گزارش، یا ادامهٔ گفتگو.
ادعای اصلی نویسنده اینه که این کار رمزنگاری سرتاسری رو نمیشکنه: هیچ محتوای پیامی برای طبقهبندی از دستگاه بیرون نمیره و هیچ چیزی خودکار گزارش نمیشه. اگه هشدار اشتباه بود، میتونی چت رو مورد اعتماد علامت بزنی تا دیگه فلگ نشه؛ و فقط تو همون حالت، کاملاً اختیاری، میتونی ۵ پیام آخر رو برای بهتر شدن دقت مدل با واتساپ به اشتراک بذاری.
برای اینکه بفهمن قابلیت واقعاً جواب میده، فقط دو عدد جمع میشه: تعداد هشدارها و تعداد واکنشهای کاربر. اینها اول روی خود گوشی جمعبندی میشن، بعد از یه رله OHTTP که IP فرستنده رو حذف میکنه رد میشن و به TEE میرسن — یعنی یه محیط اجرای امن سختافزاری که حتی متا هم نمیتونه توش سرک بکشه. خروجی نهایی با differential privacy نویزدار میشه؛ یعنی بود و نبود دادهٔ یه نفر عملاً روی عدد نهایی اثری نداره.
برای اینکه کسی نتونه یه مدل خاص رو به یه کاربر خاص برسونه، هش SHA-256 هر نسخهٔ مدل قبل از سرو شدن روی یه ledger عمومی و فقط-افزودنی ثبت میشه — دفترچهای که فقط میشه بهش اضافه کرد و چیزی توش پاک یا عوض نمیشه. امضای manifest هم دست Cloudflare با کلید Ed25519 هست، نه متا. کلاینت قبل از لود کردن مدل امضا و هشها رو چک میکنه و اگه یکی نخوره، مدل رو بالا نمیاره. حتی گروهبندی آزمایشها هم با تصادف محلی روی خود دستگاه انجام میشه.
نویسنده میگه وزنهای مدل منتشر میشه تا محققها مطمئن بشن مدل فقط برای تشخیص کلاهبرداری ساخته شده، و کاربر هم از بخش Account و بعد Request Info و بعد Scam Alert Activity میتونه لاگ شفافیت خودش رو ببینه. قابلیت فعلاً تو بتای محدوده و دامنهٔ Bug Bounty متا هم قراره همین سیستم رو پوشش بده.
نکات کلیدی:
- مدل کاملاً روی دستگاه اجرا میشه و هیچ محتوای پیامی برای طبقهبندی به سرور نمیره.
- فقط پیامهای غیرمخاطب بررسی میشن و هشدار فقط برای گیرنده دیده میشه.
- تلهمتری محدوده به دو شمارندهٔ جمعی: تعداد هشدار و تعداد واکنش کاربر.
- هش SHA-256 هر نسخهٔ مدل قبل از انتشار روی ledger عمومی ثبت و با کلید Ed25519 توسط Cloudflare امضا میشه.
- کاربر میتونه هر چت رو مورد اعتماد علامت بزنه و اختیاری ۵ پیام آخر رو برای بهبود مدل بفرسته.
- قابلیت اختیاریه و فعلاً فقط تو بتای محدود عرضه شده.




