در تاریخ 3 آگوست، MiniMax به طور رسمی اولین مدل تولید چندوجهی خود، MiniMax H3 را متنباز کرد. در همان روز اعلام خبر، MoLeThread با بهرهگیری از کارت محاسبات هوشمند یکپارچه آموزش و استنتاج هوش مصنوعی خود، MTT S5000، و پشته نرمافزاری MUSA، به سرعت سازگاری سریع و عملکرد کارآمد این مدل را به اتمام رساند.
H3 به عنوان یک شاهکار جدید از MiniMax در زمینه چندوجهی، مرزهای سنتی تکوظیفهای را میشکند، نیت خلاقانه را در زمینههای متنوع به دقت درک میکند و به طور جامع از ورودیهای متن، تصویر، صدا و ویدئو پشتیبانی میکند. طبق معرفی رسمی، این مدل میتواند محتوای صوتی و تصویری بومی با وضوح 2K و حداکثر طول 15 ثانیه را مستقیماً تولید کند و از نظر عملکرد و کاربردی بودن، قابلیتهای تولید چندسناریویی در سطح تجاری را داراست.
قابل ذکر است که H3 در رتبهبندی مدلهای ویدئویی Artificial Analysis، بالاترین امتیاز جهانی را برای «قابلیت ویرایش ویدئو» کسب کرده است. هزینه تولید ویدئو با وضوح 2K تنها 0.8 یوان در ثانیه است که مقرونبهصرفگی تجاری بالایی را ارائه میدهد. در همین حال، ماهیت متنباز آن به طور قابل توجهی موانع کاربرد را کاهش میدهد، از استقرار محلی انعطافپذیر و دادههای سفارشی برای شرکتها پشتیبانی میکند، به طور موثر الزامات امنیتی و انطباق را برآورده میسازد و پذیرش گسترده بهرهوری چندوجهی را تسریع میکند.
در مواجهه با انتشار جدید این مدل، تیم MoLeThread کارایی پاسخگویی بسیار بالایی را از خود نشان داد. در همان روزی که مدل متنباز شد، تیم تحقیق و توسعه آن به سرعت به تحلیل معماری مدل، بررسی فناوریهای اصلی و دستهبندی اپراتورهای معمول پرداخت و مسیر کامل سازگاری را از چارچوب استنتاج SGLang-MUSA تا کتابخانههای اپراتور با کارایی بالا MATE و muDNN را تنها در 3 ساعت به اتمام رساند و به استقرار سریع و عملکرد پایدار H3 بر روی MTT S5000 دست یافت.
MoLeThread اعلام کرد که در آینده همکاری خود را با MiniMax تعمیق خواهد بخشید و به طور مشترک قابلیتهای درک زمینه قویتر و مقیاسهای مدل بزرگتر را در زمینه چندوجهی بررسی خواهد کرد و نوآوری و صنعتیسازی فناوری AGI را به طور کامل تسریع خواهد بخشید.
