شرکت OpenAI از مدل هوش مصنوعی GPT-6.1 Sol رونمایی کرده که عملکردی نزدیک به GPT-6 Astra دارد اما هزینه استفاده از آن بهمراتب کمتر است. OpenAI میگوید Sol مناسب برنامهنویسی ایجنتی، کنترل کامپیوتر و اجرای کارهای اداری طراحی شده است.
OpenAI برای GPT-6.1 Sol بهازای هر 1 میلیون توکن ورودی 2 دلار و برای هر 1 میلیون توکن خروجی 10 دلار دریافت میکند. به این ترتیب، هزینه استفاده از این مدل در مقایسه با GPT-6 Astra حدود یکپنجم است.
قیمت ورودیهای کششده نیز تنها 0.10 دلار بهازای هر 1 میلیون توکن تعیین شده که 95 درصد کمتر از ورودی استاندارد Sol و 50 درصد کمتر از هزینه ورودی کششده GPT-6 Sol است. کاهش هزینه ورودیهای کششده میتواند برای ایجنتهایی که در درخواستهای متعدد از یک زمینه مشترک استفاده میکنند اهمیت زیادی داشته باشد.

عملکردی نزدیک به GPT-6 Astra
یکی از مهمترین نتایج GPT-6.1 Sol در آزمون DeepSWE v1.1 دیده میشود؛ بنچمارکی که توانایی مدلها در انجام وظایف پیچیده مهندسی نرمافزار روی کدهای واقعی را بررسی میکند.
براساس نتایج منتشرشده از سوی OpenAI، Sol تقریباً به سطح عملکرد GPT-6 Astra رسیده، درحالیکه هزینه اجرای آن حدود یکپنجم Astra است. امتیاز این مدل نیز نسبت به بهترین نتیجه GPT-6 Sol حدود 6.4 واحد درصد افزایش یافته است.
در آزمون GDP.pdf برای ارزیابی توانایی مدلها در پاسخگویی به پرسشهای حرفهای براساس اسناد پیچیده شامل جدول، نمودار و دیاگرام، GPT-6.1 Sol در تنظیمات آزمایششده عملکرد بهتری از Claude Opus 5.5 داشته و هزینه هر وظیفه برای آن کمتر از نصف بوده است. عملکرد Sol در این ارزیابی نیز به GPT-6 Astra نزدیک شده است.
در AutomationBench که توانایی ایجنتها در اجرای گردشکارهای چندمرحلهای کسبوکار را میسنجد، GPT-6.1 Sol در سطح استدلال متوسط 2.2 واحد درصد بالاتر از Opus 5.5 قرار گرفته و هزینه اجرای وظایف نیز حدود یکسوم آن اعلام شده است. Sol همچنین در مقایسه با GPT-6 Sol در همین سطح استدلال، 4.8 واحد درصد پیشرفت کرده است.
GPT-6.1 Sol در آزمون OSWorld 2.0 نیز عملکرد بهتری نسبت به نسل قبلی دارد. براساس دادههای OpenAI، مدل جدید در این آزمون 7 واحد بالاتر از GPT-6 Sol قرار گرفته و تنها 2.1 واحد با Astra فاصله دارد. هزینه اجرای Sol در این ارزیابی تقریباً یکهفتم Astra بوده است.
در Terminal-Bench Science 0.1 نیز امتیاز GPT-6.1 Sol در بالاترین سطح استدلال بیش از دو برابر GPT-6 Sol شده است. میانگین هزینه اجرای هر وظیفه با Sol 5.47 دلار اعلام شده، درحالیکه این رقم برای Claude Opus 5.5 برابر 23.21 دلار و برای GPT-6 Astra برابر 23.80 دلار بوده است.
با این حال، Astra همچنان در این آزمون با امتیاز 68.1 درصد بالاتر از Sol قرار دارد و OpenAI آن را برای دشوارترین کارهای پژوهشی پیشنهاد میکند. GPT-6.1 Sol از امروز برای کاربران Plus، Pro، Business، Enterprise و Edu در ChatGPT Work و Codex در دسترس قرار گرفته است.
بر اساس گزارش techcrunch این مدل فعلاً در بخش چت معمولی ChatGPT ارائه نشده است. توسعهدهندگان نیز میتوانند از طریق API از آن استفاده کنند. OpenAI همچنین اعلام کرده نسخه GPT-6.1 Sol Ultrafast طی روزهای آینده به Codex اضافه میشود.













نظر خود را اضافه کنید.
برای ارسال نظر وارد شوید
ارسال نظر بدون عضویت در سایت