中国GPUメーカー「摩爾線程(モアースレッド)」、次世代モデル「GLM-5.1」に対応 長期的タスクとコード生成を効率的にサポート

2026-04-09半導体AI半導体中国国産化

4月8日、モアースレッド(Moore Threads)は、同社のフラッグシップ級AI学習・推論統合型フル機能GPU「MTT S5000」において、智譜AI(Zhipu AI)の次世代モデル「GLM-5.1」に対するDay-0(リリース予定)の迅速な対応を実現した。推論のデプロイメントから学習の再現に至る全プロセスをサポートする。



MUSAソフトウェアスタックの強力なエコシステム互換性を活かし、モアースレッドの技術チームは、高性能なSGLang-MUSA推論エンジンおよびTileLang-MUSA演算子プログラミング言語をベースに、PD分離アーキテクチャを採用した深いチューニングを実施している。MTT S5000上でGLM-5.1の高効率かつ高精度な推論を実現した。この成果は、国産の計算インフラが最先端のSOTAモデルに迅速に対応できる能力を示すとともに、複雑なAI推論シナリオにおいてソフトウェアとハードウェアが連携する新たなベンチマークを業界に打ち立てたものだ。



GLM-5.1は、Zhipuにとってこれまでで最もインテリジェントなフラッグシップモデルで、現時点で世界最強のオープンソースモデルだという。GLM-5.1はコード生成能力が大幅に向上しており、実際のソフトウェア開発に最も近いベンチマークテスト「SWE-bench Pro」において、GPT-5.4やClaude Opus 4.6を上回り、世界最高記録を更新した。特筆すべきは、モデル全体の性能が大幅に向上したことに加え、GLM-5.1が長期的タスク(Long Horizon Task)処理能力においても著しい進歩を遂げている点だ。現在主流の分単位でのインタラクションを行うモデルとは異なり、GLM-5.1は、単一のタスクにおいて8時間以上にわたって自律的に継続的に作業を行い、その間に自己計画、実行、自己進化を実現し、最終的に完全なエンジニアのランクの成果を提供する。



image.png



GLM-5.1の長期的タスクとコード生成特性に対応するため、モアースレッドは、自社開発のMUSAアーキテクチャ、ならびにSGLang-MUSA、TileLang-MUSAなどの主要技術に基づき、体系的な演算子の対応と推論パフォーマンスのチューニングを完了した。MTT S5000は、単一カードで最大1000 TFLOPSのAI演算性能(密結合)を実現し、FP8からFP64までの全精度計算をサポートする。ネイティブのFP8アクセラレーションにより推論効率を大幅に向上させる。また、効率的なKVキャッシュ管理と組み合わせることで、非常に長いコンテキストに伴うメモリ要件を効果的に満たす。さらに、PD分離アーキテクチャはPrefillフェーズとDecodeフェーズをさらに切り離し、長いシーケンス生成における干渉を低減し、持続的なタスクにおける高いスループットと低レイテンシーを保証する。それに加え、MTT S5000はカード間相互接続帯域幅784GB/sを提供し、大規模デプロイメントにおける柔軟なスケーラビリティを実現する。ソフトウェアとハードウェアの協調最適化により、MTT S5000はGLM-5.1の長期的タスクのスループットとエンジニアリングレベルのコード生成推論を安定的に支える。



GLM-4.7からGLM-5.1に至るまで、モアースレッドはリリース当日の即日対応を継続して実現した。これは、MUSAアーキテクチャが主流のAIエコシステムに対して深い互換性を持つことを示すとともに、中国国産のフル機能GPUが大規模モデルにおける「対応からデプロイメントまで」の全チェーンをサポートする能力を備えていることを示すものだ。モアースレッドは引き続き計算インフラを強化し、開発者が最先端モデルを迅速に応用できるよう支援するとともに、より成熟した国産AIエコシステムの構築に貢献していく。







(原文:https://www.icsmart.cn/103635/)

[注] 新闻内容由AI翻译生成,如有表述不尽完善之处,敬请谅解!
Please note: This news article was translated by AI. We apologize for any imperfections in the translation.
Previous Article
半固体電池で活路 中国広汽系、587Ah大容量セル発表と6.5GWh量産体制を本格構築
Next Article
アリババ、AI強化へ組織再編 技術委員会新設と「通義」事業部格上げで体制刷新