آنتروپیک از مدل هوش مصنوعی جدید Claude Fable 5.1 رونمایی کرد؛ مدلی که به گفته این شرکت برای انجام کارهای پیچیده و طولانی طراحی شده که ممکن است تا ساعت‌ها زمان ببرند. هم‌زمان، نسخه ویژه‌ای از این مدل با نام Mythos 5.1 نیز برای سازمان‌های حوزه امنیت سایبری و علوم زیستی عرضه شده است.

Claude Fable 5.1 نسخه عمومی مدل جدید آنتروپیک است و از طریق API، پلتفرم‌های ابری و اپلیکیشن دسکتاپ Claude در دسترس قرار گرفته است. این مدل برای کارهایی فراتر از پاسخ‌گویی به یک درخواست ساده یا تولید یک قطعه کد طراحی شده و تمرکز ویژه‌ای روی وظایف چندمرحله‌ای و Agentic دارد.

آنتروپیک می‌گوید Fable 5.1 در پروژه‌های نرم‌افزاری، بررسی کد در سراسر یک اپلیکیشن، پیدا کردن مشکلات موجود در کتابخانه‌های خارجی و انجام تحقیقات علمی چندمرحله‌ای عملکرد بهتری دارد. این مدل همچنین می‌تواند در طراحی آزمایش‌ها، شبیه‌سازی نتایج احتمالی و تحلیل جداول و نمودارهای پیچیده مورد استفاده قرار گیرد.

یکی از اهداف اصلی Fable 5.1 این است که بتواند کار بیشتری را با تعداد توکن کمتر انجام دهد؛ موضوعی که برای شرکت‌هایی که از ایجنت‌های هوش مصنوعی در بازه‌های زمانی طولانی استفاده می‌کنند اهمیت زیادی دارد.

fable-2.jpg

جهش چشمگیر عملکرد Fable 5.1 در بنچمارک‌های مختلف

آنتروپیک اعلام کرده Fable 5.1 در برخی آزمون‌ها نسبت به نسل قبلی پیشرفت قابل‌توجهی داشته است. این مدل در Terminal-Bench 4.0 که توانایی انجام وظایف برنامه‌نویسی از طریق خط فرمان را ارزیابی می‌کند، امتیاز 55.8 درصدی به دست آورده است؛ در حالی که Fable 5 به امتیاز 42 درصد رسیده بود.

نسخه Mythos 5.1 نیز با تنظیمات ایمنی بازتر توانسته امتیاز 60.9 درصد را کسب کند. در Terminal-Bench-Science 0.1 که برای سنجش توانایی ایجنت‌های هوش مصنوعی در تحقیقات علمی طراحی شده است، Fable 5.1 به امتیاز 52.6 درصد رسیده؛ رقمی که بیش از دو برابر امتیاز 24.7 درصدی Fable 5 است.

البته این نتایج توسط خود آنتروپیک منتشر شده‌اند و به‌تنهایی نمی‌توانند برتری Fable 5.1 نسبت به تمام مدل‌های رقیب را ثابت کنند. با این حال، این نتایج با ادعای آنتروپیک درباره توانایی بهتر مدل جدید در دنبال کردن یک مسئله، استفاده از ابزارها و بازگشت به مراحل قبلی کار همخوانی دارد.

بر اساس گزارش techspot آنتروپیک قیمت استاندارد استفاده از API را برای Fable 5.1 تغییر نداده است. هزینه استفاده از این مدل همچنان 10 دلار به ازای هر یک میلیون توکن ورودی و 50 دلار به ازای هر یک میلیون توکن خروجی است.

تغییر اصلی در هزینه Cache Read رخ داده است. قیمت خواندن توکن‌های کش‌شده اکنون 0.25 دلار به ازای هر یک میلیون توکن است که نسبت به قیمت قبلی یک دلار، 75 درصد کاهش پیدا کرده است. هزینه نوشتن اطلاعات در کش همچنان 12.50 دلار به ازای هر یک میلیون توکن برای کش پنج‌دقیقه‌ای و 20 دلار برای کش یک‌ساعته باقی مانده است.

آنتروپیک می‌گوید در برخی وظایف طولانی، اطلاعات کش‌شده می‌تواند نیمی از کل مصرف توکن یا حتی بیشتر را تشکیل دهد. این شرکت انتظار دارد قیمت‌گذاری جدید هزینه مؤثر اجرای Fable 5.1 را در استفاده‌های معمول حدود 25 درصد و در برنامه‌های به‌شدت Agentic تا 45 درصد کاهش دهد.

در کنار Fable 5.1، مدل Mythos 5.1 نیز معرفی شده که بر پایه همان مدل اصلی ساخته شده اما محدودیت‌های کمتری برای برخی فعالیت‌های پرریسک در حوزه امنیت سایبری و تحقیقات علمی دارد. با این حال، دسترسی به Mythos 5.1 عمومی نیست و تنها سازمان‌هایی که در برنامه دسترسی مورد اعتماد آنتروپیک تأیید شده‌اند می‌توانند از آن استفاده کنند.

Fable 5.1 و Mythos 5.1 همچنین نخستین مدل‌های جدید Claude هستند که واترمارک نامرئی را در خروجی‌های متنی و فایل‌ها به کار می‌گیرند. این واترمارک با تأثیرگذاری روی انتخاب کلمات در شرایطی که چند گزینه منطقی وجود دارد ایجاد می‌شود و قرار است حتی پس از کپی، پیست یا ویرایش‌های جزئی نیز قابل شناسایی باقی بماند؛ هرچند برای خواننده قابل مشاهده نیست.

نظر خود را اضافه کنید.

ارسال نظر بدون عضویت در سایت

0
نظر شما پس از تایید مدیر منتشر خواهد شد.
  • هیچ نظری یافت نشد

ورود به شهرسخت‌افزار

ثبت نام در شهر سخت افزار
ورود به شهر سخت افزار

ثبت نام در شهر سخت افزار

نام و نام خانوادگی(*)
لطفا نام خود را وارد کنید

ایمیل(*)
لطفا ایمیل خود را به درستی وارد کنید

رمز عبور(*)
لطفا رمز عبور خود را وارد کنید

شماره موبایل
Invalid Input

جزو کدام دسته از اشخاص هستید؟(*)

لطفا یکی از موارد را انتخاب کنید