برای اولین بار، قدرت محاسباتی داخلی به طور قاطع از مدلی با تریلیونها پارامتر پشتیبانی کرده است. شرکت هایگوانگ اینفورمیشن (Hai Guang Information) اعلام کرد که سازگاری کامل پشتهای و تأیید عملکرد Kimi K3 را بر روی پلتفرم DCU خود به اتمام رسانده است – این بدان معناست که اجرای چنین مدلهای عظیمی دیگر تنها به چند تراشه پرچمدار خارجی محدود نمیشود.
Hygon DCU از اپراتورهای زیربنایی تا موتور استنتاج بهینهسازی شده است و به کد مدل اجازه میدهد بدون هیچ گونه تغییری مستقیماً اجرا شود، که تقریباً هزینه مهاجرت را از بین میبرد. توسعهدهندگان میتوانند به محض دسترسی به قدرت محاسباتی، مدل را مستقر کنند و سازگاری بسیار روان است. برای مکانیزم توجه KDA و معماری MoE متشکل از 896 متخصص، هایگوانگ سفارشیسازی در سطح اپراتور انجام داده است؛ حتی زمانی که 896 متخصص به صورت موازی اجرا میشوند، استنتاج در سناریوهای سنگین با میلیونها زمینه، بدون تأخیر، کارآمد و پایدار باقی میماند.

در سناریوهای عملی، K3 بر روی Hygon DCU میتواند از برنامههای پیشرفتهای مانند پروژههای عامل هوشمند دوربرد، ایجاد حلقه بسته بصری و حتی تراشههای طراحیشده داخلی پشتیبانی کند. کاربران قدرت محاسباتی داخلی بالاخره میتوانند مدلهای متنباز با تریلیونها پارامتر را خودشان اجرا کنند. لازم به ذکر است که قبل از انتشار K3، Yueling Dark Face قبلاً با هایگوانگ و CAS Sustech همکاری کرده بود تا بهینهسازی سازگاری کامل را به اتمام برساند: Sustech، بر اساس پشته سختافزاری Hygon DCU، زنجیره آموزش توزیعشده و استنتاج موازی چندکارتی را برای معماری Kimi MoE یکپارچه کرد؛ Hygon DCU از طریق بهینهسازی مشترک پشتههای سختافزاری و نرمافزاری در سطح پایین، استنتاج پایدار متن بلند را بر روی خوشه Sustech 8000 به دست آورد.
آزمایشات رسمی اطمینان خاطر دادهاند: افت عملکرد کارتهای داخلی در محدوده 12% کنترل شده است که به آستانه استقرار تجاری رسیده است. در حالی که شکافی بین مدلهای تریلیون پارامتری و پردازندههای گرافیکی داخلی وجود داشت، چشمانداز قدرت محاسباتی در عصر هوشمند به آرامی در حال تغییر است.
