آنتروپیک از مدل هوش مصنوعی جدید Claude Fable 5.1 رونمایی کرد؛ مدلی که به گفته این شرکت برای انجام کارهای پیچیده و طولانی طراحی شده که ممکن است تا ساعتها زمان ببرند. همزمان، نسخه ویژهای از این مدل با نام Mythos 5.1 نیز برای سازمانهای حوزه امنیت سایبری و علوم زیستی عرضه شده است.
Claude Fable 5.1 نسخه عمومی مدل جدید آنتروپیک است و از طریق API، پلتفرمهای ابری و اپلیکیشن دسکتاپ Claude در دسترس قرار گرفته است. این مدل برای کارهایی فراتر از پاسخگویی به یک درخواست ساده یا تولید یک قطعه کد طراحی شده و تمرکز ویژهای روی وظایف چندمرحلهای و Agentic دارد.
آنتروپیک میگوید Fable 5.1 در پروژههای نرمافزاری، بررسی کد در سراسر یک اپلیکیشن، پیدا کردن مشکلات موجود در کتابخانههای خارجی و انجام تحقیقات علمی چندمرحلهای عملکرد بهتری دارد. این مدل همچنین میتواند در طراحی آزمایشها، شبیهسازی نتایج احتمالی و تحلیل جداول و نمودارهای پیچیده مورد استفاده قرار گیرد.
یکی از اهداف اصلی Fable 5.1 این است که بتواند کار بیشتری را با تعداد توکن کمتر انجام دهد؛ موضوعی که برای شرکتهایی که از ایجنتهای هوش مصنوعی در بازههای زمانی طولانی استفاده میکنند اهمیت زیادی دارد.

جهش چشمگیر عملکرد Fable 5.1 در بنچمارکهای مختلف
آنتروپیک اعلام کرده Fable 5.1 در برخی آزمونها نسبت به نسل قبلی پیشرفت قابلتوجهی داشته است. این مدل در Terminal-Bench 4.0 که توانایی انجام وظایف برنامهنویسی از طریق خط فرمان را ارزیابی میکند، امتیاز 55.8 درصدی به دست آورده است؛ در حالی که Fable 5 به امتیاز 42 درصد رسیده بود.
نسخه Mythos 5.1 نیز با تنظیمات ایمنی بازتر توانسته امتیاز 60.9 درصد را کسب کند. در Terminal-Bench-Science 0.1 که برای سنجش توانایی ایجنتهای هوش مصنوعی در تحقیقات علمی طراحی شده است، Fable 5.1 به امتیاز 52.6 درصد رسیده؛ رقمی که بیش از دو برابر امتیاز 24.7 درصدی Fable 5 است.
البته این نتایج توسط خود آنتروپیک منتشر شدهاند و بهتنهایی نمیتوانند برتری Fable 5.1 نسبت به تمام مدلهای رقیب را ثابت کنند. با این حال، این نتایج با ادعای آنتروپیک درباره توانایی بهتر مدل جدید در دنبال کردن یک مسئله، استفاده از ابزارها و بازگشت به مراحل قبلی کار همخوانی دارد.
بر اساس گزارش techspot آنتروپیک قیمت استاندارد استفاده از API را برای Fable 5.1 تغییر نداده است. هزینه استفاده از این مدل همچنان 10 دلار به ازای هر یک میلیون توکن ورودی و 50 دلار به ازای هر یک میلیون توکن خروجی است.
تغییر اصلی در هزینه Cache Read رخ داده است. قیمت خواندن توکنهای کششده اکنون 0.25 دلار به ازای هر یک میلیون توکن است که نسبت به قیمت قبلی یک دلار، 75 درصد کاهش پیدا کرده است. هزینه نوشتن اطلاعات در کش همچنان 12.50 دلار به ازای هر یک میلیون توکن برای کش پنجدقیقهای و 20 دلار برای کش یکساعته باقی مانده است.
آنتروپیک میگوید در برخی وظایف طولانی، اطلاعات کششده میتواند نیمی از کل مصرف توکن یا حتی بیشتر را تشکیل دهد. این شرکت انتظار دارد قیمتگذاری جدید هزینه مؤثر اجرای Fable 5.1 را در استفادههای معمول حدود 25 درصد و در برنامههای بهشدت Agentic تا 45 درصد کاهش دهد.
در کنار Fable 5.1، مدل Mythos 5.1 نیز معرفی شده که بر پایه همان مدل اصلی ساخته شده اما محدودیتهای کمتری برای برخی فعالیتهای پرریسک در حوزه امنیت سایبری و تحقیقات علمی دارد. با این حال، دسترسی به Mythos 5.1 عمومی نیست و تنها سازمانهایی که در برنامه دسترسی مورد اعتماد آنتروپیک تأیید شدهاند میتوانند از آن استفاده کنند.
Fable 5.1 و Mythos 5.1 همچنین نخستین مدلهای جدید Claude هستند که واترمارک نامرئی را در خروجیهای متنی و فایلها به کار میگیرند. این واترمارک با تأثیرگذاری روی انتخاب کلمات در شرایطی که چند گزینه منطقی وجود دارد ایجاد میشود و قرار است حتی پس از کپی، پیست یا ویرایشهای جزئی نیز قابل شناسایی باقی بماند؛ هرچند برای خواننده قابل مشاهده نیست.













نظر خود را اضافه کنید.
برای ارسال نظر وارد شوید
ارسال نظر بدون عضویت در سایت