شرکت OpenAI از مدل هوش مصنوعی GPT-6.1 Sol رونمایی کرده که عملکردی نزدیک به GPT-6 Astra دارد اما هزینه استفاده از آن به‌مراتب کمتر است. OpenAI می‌گوید Sol مناسب برنامه‌نویسی ایجنتی، کنترل کامپیوتر و اجرای کارهای اداری طراحی شده است.

OpenAI برای GPT-6.1 Sol به‌ازای هر 1 میلیون توکن ورودی 2 دلار و برای هر 1 میلیون توکن خروجی 10 دلار دریافت می‌کند. به این ترتیب، هزینه استفاده از این مدل در مقایسه با GPT-6 Astra حدود یک‌پنجم است.

قیمت ورودی‌های کش‌شده نیز تنها 0.10 دلار به‌ازای هر 1 میلیون توکن تعیین شده که 95 درصد کمتر از ورودی استاندارد Sol و 50 درصد کمتر از هزینه ورودی کش‌شده GPT-6 Sol است. کاهش هزینه ورودی‌های کش‌شده می‌تواند برای ایجنت‌هایی که در درخواست‌های متعدد از یک زمینه مشترک استفاده می‌کنند اهمیت زیادی داشته باشد.

sol-2.jpg

عملکردی نزدیک به GPT-6 Astra

یکی از مهم‌ترین نتایج GPT-6.1 Sol در آزمون DeepSWE v1.1 دیده می‌شود؛ بنچمارکی که توانایی مدل‌ها در انجام وظایف پیچیده مهندسی نرم‌افزار روی کدهای واقعی را بررسی می‌کند.

براساس نتایج منتشرشده از سوی OpenAI، Sol تقریباً به سطح عملکرد GPT-6 Astra رسیده، درحالی‌که هزینه اجرای آن حدود یک‌پنجم Astra است. امتیاز این مدل نیز نسبت به بهترین نتیجه GPT-6 Sol حدود 6.4 واحد درصد افزایش یافته است.

در آزمون GDP.pdf برای ارزیابی توانایی مدل‌ها در پاسخ‌گویی به پرسش‌های حرفه‌ای براساس اسناد پیچیده شامل جدول، نمودار و دیاگرام، GPT-6.1 Sol در تنظیمات آزمایش‌شده عملکرد بهتری از Claude Opus 5.5 داشته و هزینه هر وظیفه برای آن کمتر از نصف بوده است. عملکرد Sol در این ارزیابی نیز به GPT-6 Astra نزدیک شده است.

در AutomationBench که توانایی ایجنت‌ها در اجرای گردش‌کارهای چندمرحله‌ای کسب‌وکار را می‌سنجد، GPT-6.1 Sol در سطح استدلال متوسط 2.2 واحد درصد بالاتر از Opus 5.5 قرار گرفته و هزینه اجرای وظایف نیز حدود یک‌سوم آن اعلام شده است. Sol همچنین در مقایسه با GPT-6 Sol در همین سطح استدلال، 4.8 واحد درصد پیشرفت کرده است.

GPT-6.1 Sol در آزمون OSWorld 2.0 نیز عملکرد بهتری نسبت به نسل قبلی دارد. براساس داده‌های OpenAI، مدل جدید در این آزمون 7 واحد بالاتر از GPT-6 Sol قرار گرفته و تنها 2.1 واحد با Astra فاصله دارد. هزینه اجرای Sol در این ارزیابی تقریباً یک‌هفتم Astra بوده است.

در Terminal-Bench Science 0.1 نیز امتیاز GPT-6.1 Sol در بالاترین سطح استدلال بیش از دو برابر GPT-6 Sol شده است. میانگین هزینه اجرای هر وظیفه با Sol 5.47 دلار اعلام شده، درحالی‌که این رقم برای Claude Opus 5.5 برابر 23.21 دلار و برای GPT-6 Astra برابر 23.80 دلار بوده است.

با این حال، Astra همچنان در این آزمون با امتیاز 68.1 درصد بالاتر از Sol قرار دارد و OpenAI آن را برای دشوارترین کارهای پژوهشی پیشنهاد می‌کند. GPT-6.1 Sol از امروز برای کاربران Plus، Pro، Business، Enterprise و Edu در ChatGPT Work و Codex در دسترس قرار گرفته است.

بر اساس گزارش techcrunch این مدل فعلاً در بخش چت معمولی ChatGPT ارائه نشده است. توسعه‌دهندگان نیز می‌توانند از طریق API از آن استفاده کنند. OpenAI همچنین اعلام کرده نسخه GPT-6.1 Sol Ultrafast طی روزهای آینده به Codex اضافه می‌شود.

نظر خود را اضافه کنید.

ارسال نظر بدون عضویت در سایت

0
نظر شما پس از تایید مدیر منتشر خواهد شد.
  • هیچ نظری یافت نشد

ورود به شهرسخت‌افزار

ثبت نام در شهر سخت افزار
ورود به شهر سخت افزار

ثبت نام در شهر سخت افزار

نام و نام خانوادگی(*)
لطفا نام خود را وارد کنید

ایمیل(*)
لطفا ایمیل خود را به درستی وارد کنید

رمز عبور(*)
لطفا رمز عبور خود را وارد کنید

شماره موبایل
Invalid Input

جزو کدام دسته از اشخاص هستید؟(*)

لطفا یکی از موارد را انتخاب کنید