علیبابا از جدیدترین مدل هوش مصنوعی خود برای تولید ویدیو با نام Wan 3.0 رونمایی کرده است. این مدل با پشتیبانی از ورودیهای متنوع میتواند ویدیوهای 30 ثانیهای واقعگرایانه و پرجزئیاتی تولید کند و قابلیتهایی مانند تبدیل متن به ویدیو، تولید فریم و استفاده از محتوای مرجع را در اختیار کاربران قرار میدهد.
بر اساس اعلام Alibaba Cloud، مدل Wan 3.0 قادر است با دریافت اسناد متنی، صفحات گسترده، اسلایدها و صفحات وب، محتوای ویدیویی تولید کند. همچنین کاربران میتوانند برای هدایت بهتر خروجی، حداکثر 10 تصویر، 5 ویدیو و 5 فایل صوتی را بهعنوان محتوای مرجع در اختیار مدل قرار دهند.
یکی از قابلیتهای مهم Wan 3.0، حفظ ویژگیهای ظاهری شخصیتها در صحنههای مختلف است. به این ترتیب میتوان از یک شخصیت ثابت در موقعیتها و داستانهای متفاوت استفاده کرد. علیبابا همچنین میگوید خروجی این مدل از نظر جزئیات و واقعگرایی پیشرفت قابلتوجهی داشته است.

پشتیبانی هوش مصنوعی Wan 3.0 از حالت Thinking
Wan 3.0 از حالت Thinking نیز پشتیبانی میکند که برای پردازش پرامپتهای پیچیده و پروژههایی با چند ورودی مختلف طراحی شده است. علیبابا اعلام کرده نسخه بتای عمومی این مدل از 15 مرداد در حوزههایی مانند تولید فیلمهای کوتاه، تبلیغات، بازاریابی، گردشگری و ساخت موزیکویدیو مورد استفاده قرار گرفته است.
یکی از پژوهشگران تیم توسعه Wan درباره کیفیت بصری مدل جدید میگوید همکاری با متخصصان زیباییشناسی و مشاوران حوزه خلاقیت و همچنین استفاده از مجموعه دادههای گستردهتر در مرحله پیشآموزش، به بهبود تواناییهای بصری Wan 3.0 کمک کرده است.
عرضه رسمی Wan 3.0 تنها یک روز پس از اعلام فروش 10 میلیارد دلار از سهام علیبابا انجام شده است. این معامله بزرگترین عرضه ثانویه سهام یک شرکت پذیرفتهشده در بورس هنگکنگ محسوب میشود و علیبابا قصد دارد از منابع حاصل برای تأمین هزینههای فزاینده خود در رقابت جهانی هوش مصنوعی استفاده کند.
علیبابا هفته گذشته نیز از کاهش 75 درصدی سود سهماهه خود نسبت به سال گذشته خبر داده بود؛ افتی که عمدتاً به افزایش چشمگیر هزینههای سرمایهای این شرکت در حوزه هوش مصنوعی نسبت داده شده است.













نظر خود را اضافه کنید.
برای ارسال نظر وارد شوید
ارسال نظر بدون عضویت در سایت