Day-0対応:Moore ThreadsはMiniMax M3大規模言語モデルの適応を完了

2026-06-15半導体業界動向半導体中国国産化

6月12日、MiniMaxの次世代ネイティブマルチモーダルモデル「M3」が正式にオープンソース化された。同日、Moore Threads(ムーアスレッズ)のフラッグシップAI学習・推論一体型コンピューティングカード「MTT S5000」が、本モデルに対するDay-0での即時適応を完了した。これは、中国国産大規模言語モデルと中国国産演算チップの適応が実現したまた一つの事例で、同時にMoore Threadsが、ネイティブFP8演算基盤と高効率なMUSAソフトウェアエコシステムにより、最先端の大規模言語モデルニーズに即座に対応し、安定したサポートを提供できる能力を証明している。



▼ MiniMax M3 オープンソースURL:



https://huggingface.co/MiniMaxAI/MiniMax-M3



▼ 開発者は以下のイメージをダウンロードしてすぐに体験可能:



registry.mthreads.com/mcconline/inference/vllm:v0.20.0-ph1-4.3.5-torch2.9-20260605-mtcc51



MiniMax M3は、中国国内で唯一、最先端のCoding & Agentic能力、超長文コンテキスト、ネイティブマルチモーダルを同時に備えたオープンソース大規模言語モデルで、完全なフロンティア能力をオープンワールドに初めて持ち込んだモデルでもある。本モデルは、自社開発のMSA(MiniMax Sparse Attention)アーキテクチャを基盤とし、コンテキストウィンドウを1Mトークン(100万トークン)レベルまで拡張可能だ。また、BrowseComp、SWE-Bench Proなどの国際的な権威あるベンチマークにおいて最先端レベルに達している。ネイティブマルチモーダルモデルとして、M3はデータパイプライン全体を再構築し、ゼロステップからマルチモーダル訓練を実施することで、テキストと視覚の意味空間を高度に位置合わせしている。



image.png


図:MiniMax M3のCoding & Agentic能力は、ソフトウェアエンジニアリング、端末実行、ツール呼び出しなど複数次元の権威ある評価において最先端レベルを達成した。



MiniMax M3の中核技術的特徴に対して、MTT S5000はハードウェア演算力、ソフトウェアスタック、オープンソースフレームワークにわたって、エンドツーエンドの精密なマッチングと深層最適化を実施した:



▼超長コンテキストの対応:高密度演算力と大容量ビデオメモリがサポート



MSAアーキテクチャによる超長コンテキストウィンドウは、推論フェーズにおけるKVキャッシュの保存とメモリアクセス帯域幅に対して極めて高い要求を突き付ける。MTT S5000は、ハードウェアレベルのネイティブFP8アクセラレーションにより、単カードのAI演算性能(密結合)は最大1000 TFLOPSを達成している。同時に、80GBの大容量ビデオメモリと1.6TB/sの超広帯域幅を備え、100万トークンレベルの長いシーケンスに対して十分なキャッシュ領域と優れたデータスループット能力を提供する。さらに、MUSA C++やTriton-MUSAなどの抽象化レイヤーにより、M3の新しいオペレータ構造は迅速な移行が可能で、Moore Threadsプラットフォームでのアーキテクチャ適応を短期間で実現する。



▼最先端のCodingとAgentic能力を強化:低遅延・高スループットの推論最適化



M3が重点的に強化するプログラミング・エージェントシナリオに向け、Moore Threadsは、これまでのDeepSeek-V4、MiniMax M2.7、GLM-5.1など複数の中国国産モデルに対するDay-0適応の経験を活かし、複雑な推論タスクに対する効率的かつ体系的な最適化手法を確立している。今回の適応では、ネイティブオペレータのカスタマイズにより、モデルの精度を損なうことなく、推論スループットを大幅に向上させ、応答遅延を低減した。同時に、Moore ThreadsはvLLMとSGLangという2つの主流推論フレームワークの同時立ち上げを完了し、MUSAのオープンアーキテクチャによってオープンソースエコシステムを受け入れ、開発者に柔軟で多様なデプロイ選択肢を提供する。



▼ ネイティブマルチモーダル推論の推進:全精度対応と全シーンでのシームレスな運用



M3はStep 0からマルチモーダル混合訓練を行うモデルとして、現在のAgentic AIの多様なシーンのニーズに適しており、同時に演算基盤にも多様な演算力が求められる。MTT S5000コンピューティングカードは、FP8からFP64までの全計算精度をカバーし、モデル研究開発から商業化までの完全なチェーンにシームレスに適応し、国産大規模言語モデルのエコシステム普及を迅速に支援する。



MiniMax M3がMTT S5000上で適応を完了したことにより、開発者は今すぐMUSAソフトウェアスタックとvLLM/SGLangデュアルフレームワークに基づいてデプロイを実行でき、オペレータレベルの性能最適化を継続的に受けられる。MUSAアーキテクチャによる主流AIエコシステムへの深い互換性と継続的な進化を背景に、Moore Threadsは最先端モデルの「適応—デプロイ—最適化」をカバーする完全なエンジニアリング能力を備えており、開発者がより迅速な応答、より安定した動作、より低い移行コストで最新モデル機能を活用し、大規模言語モデルのイノベーションの実用化とスケール適用を加速することを可能にする。







(原文:https://www.icsmart.cn/106160/)

[注] 新闻内容由AI翻译生成,如有表述不尽完善之处,敬请谅解!
Please note: This news article was translated by AI. We apologize for any imperfections in the translation.
前の記事:
中国証券監督管理委員会(CSRC):長鑫科技(CXMT)の科創板IPO登録申請を承認
次の記事:
BYDやNIO、中国EV大手が米「中国軍事企業リスト」入り 各社が反論