فیبل ۵.۱ در ساخت سایت از فیبل ۵ جلو زد
خلاصهٔ کاملتر
یه تست مقایسهای بین دو نسخه از مدل فیبل (Fable) آنتروپیک نشون میده که نسخه ۵.۱ تو ساخت سایت با یک پرامپت (one-shot، یعنی بدون هیچ اصلاح یا ادیت بعدی) از نسخه ۵ بهتره. یه تستر همون ۵۰ پرامپت رو با هر دو مدل اجرا کرده و خروجیها رو بدون اینکه بدونه کدوم مال کدومه بهصورت کور مقایسه کرده.
تو رایگیری انسانی، فیبل ۵.۱ با ۳۰ رای در برابر ۱۷ رای فیبل ۵ (و ۳ تای مساوی) برنده شده. یه داور هوش مصنوعی که کیفیت بصری رو میسنجه حتی فاصله بیشتری گذاشته: ۴۰ به ۷. دلیل اصلیش بهتر شدن فاصلهگذاری و سلسلهمراتب بصریه (یعنی تشخیص واضحتر بین تیتر، دکمه و متن معمولی) و همچنین کیفیت بهتر SVG و آیکونها تو نسخه جدید.
از نظر عملکرد فنی اما تقریبا هیچ فرقی نکرده؛ هر دو نسخه ۴۷ از ۵۰ تست کارکردی رو رد کردن. یعنی اگه فقط دنبال درست کار کردن دکمهها و فرمهاست، این آپدیت چیز زیادی بهت نمیده و بیشتر ارتقاش تو ظاهر و طراحیه، نه تو درست کار کردن کد.
وقتی فیبل ۵.۱ رو با Astra (مدل ساخت سایتِ مبتنی بر GPT-5.1) مقایسه کردن، نتیجه برعکس شده و فیبل فقط ۱۵ از ۵۰ رای انسانی رو گرفته، در برابر ۳۵ تای Astra؛ داور هوش مصنوعی حتی تا ۴۸ به ۲ به نفع Astra رای داده. با اینحال فیبل تو دستههای خلاقانهتر مثل رابطهای موزیک یا سایتهای تجربی هنوز حرف برای گفتن داره.
نکات کلیدی:
- فیبل ۵.۱ تو رای انسانی ۳۰ به ۱۷ (۳ مساوی) از فیبل ۵ جلو زد
- داور هوش مصنوعی با فاصله بیشتر ۴۰ به ۷ به فیبل ۵.۱ رای داد
- هر دو مدل ۴۷ از ۵۰ تست عملکردی رو رد کردن، یعنی آپدیت بیشتر بصریه نه فنی
- در برابر Astra (مبتنی بر GPT-5.1)، فیبل ۵.۱ فقط ۱۵ از ۵۰ رای انسانی رو برد
- بهبود اصلی نسخه جدید: فاصلهگذاری، سلسلهمراتب بصری و کیفیت SVG




