中国チップ開発企業「東方算芯」、独自開発の3Dニアメモリチップで国産計算力の新たな道を切り開く

2026-07-30エレクトロニクス全般AI半導体中国国産化

0730-1.jpg



このほど、中国のチップ開発企業である東方算芯(Shanghai Dongfang Suanxin Technology Co., Ltd.)は新製品「DF1000」の発表会を開催した。同社が独自開発したソフトウェア定義型3DニアメモリAIインテリジェント計算チップが正式に発表された。これにより、東方算芯社が海外の汎用GPUとは一線を画す、完全自社開発の技術路線を歩んでいることが示された。会場には業界主管部門、高校・研究機関の研究チーム、ならびに産業チェーンの川上・川下企業の代表が集まり、複数の産業協力に関する意向がその場で確認された。業界関係者は、中国国産の基盤となる演算チップが商用化へ向けて前進する重要な瞬間をともに見届けた。



その後、東方算芯はハードウェア製品一式を携えて2026世界人工知能大会(WAIC 2026)にも出展し、フルスタックの計算力製品群を実機で全面的に展示した。大規模言語モデル開発企業、科学技術研究機関、ならびに情報技術アプリケーションイノベーション分野の政府・企業顧客に向けて、チップ、アクセラレータカードからサーバー、さらに大規模クラスターに至るまでの一体型計算力ソリューションを直観的に示した。



現段階において、人工知能産業は急速な発展を遂げており、自主的かつ制御可能な基盤計算力は、中国国内デジタルインフラにおいて早急に補うべき中核的な弱点となっている。現在の主流計算力ソリューションの多くは海外製GPUを前提に二次開発を行っており、業界のボトルネックは極めて顕著だ。高性能チップの製造供給には不確実性があり、CUDAの閉鎖的エコシステムは長期的な技術ロックインを形成しているため、中国国内産業は発展の主導権を握りにくい状況にある。こうした業界課題に対し、上海・東方算芯は単純な互換改造路線を捨て、基盤からのフルスタック自社開発を堅持してきた。ハード・ソフト一体の体系はすでに複数回にわたり商用導入の検証を終えている。



二十年をかけて磨いた剣――独自コア技術体系



東方算芯は2024年5月に上海・浦東に拠点を構え、ソフトウェア定義型リコンフィギュラブル技術と3Dニアメモリコンピューティングの二大分野に注力している。主力事業は、中国国産AI計算力チップの研究開発およびフルスタックのシステムソリューション提供だ。その中核技術は清華大学の魏少軍チームによる20年にわたる研究蓄積に由来し、複数回のエンジニアリング検証を経て、完全な自主知的財産権を有する技術体系を構築した。国家級プロジェクトの支援とトップクラス産業資本の後押しを受け、同社は複数拠点協調型の研究開発ネットワークを整備しており、北京、西安、南京、蘇州、成都に拠点を展開、さらに深センと華中地域での研究開発拠点設置も計画している。



2006年以降、同チームは正式にリコンフィギュラブル・コンピューティング分野に深く取り組み、核高基(核心的な電子デバイス・ハイエンド汎用チップ・基礎的なソフトウェア製品)、863計画、国家重点研究開発計画などの国家級プロジェクトを相次いで担ってきた。2014年から2023年にかけては、リコンフィギュラブル・プロセッサー、AIチップ、3Dハイブリッドボンディング型ニアメモリ計算チップに至るまで、全工程のプロトタイプ開発を段階的に完了した。関連成果は国家技術発明賞二等賞、中国特許金賞を受賞し、中国国内外で100件超の特許を保有、300本超のハイレベルな学術論文を発表している。2024年の東方算芯設立により、長期検証を終えたこの技術体系は正式に産業化段階へ移行した。今回のDF1000発表と、その後のWAICでの実機展示は、技術が商業市場へ進出するうえでの重要な一歩となった。



同社は「ソフトウェアデファインドアーキテクチャ+3Dハイブリッドボンディング」という二本柱の基盤技術体系を構築し、海外GPUの技術路線への依存から脱却した。中国国内の成熟した製造プロセスを活用し、チップ、ボード、サーバー、クラスターに至るまで、一貫した国産化ソリューションを提供することで、業界に差別化された計算力整備の道筋を示している。



(i)ソフトウェア定義型リコンフィギュラブル・コンピューティング・アーキテクチャ



従来のGPUやASICはハードウェア構造が固定化されており、急速に進化するAIアルゴリズムの変化に追随することが難しい。その結果、ハードウェア利用率の低さや、アルゴリズム移植・改修コストの高さといった問題が広く生じている。東方算芯が独自開発したリコンフィギュラブル・アーキテクチャは、TensorTileを基本ユニットとして非同期データフレームワークを構築し、ハードウェア資源とデータパスをタスクに応じて動的に調整できるようにした。空間並列と時分割多重を組み合わせることで計算資源の利用効率を高め、先端製造プロセスへの過度な依存を抑えている。



DF1000は中国国内の成熟プロセスで製造され、BF16演算性能はピーク時520TFLOPSに達する。多精度テンソルユニットとTransformer専用加速モジュールを内蔵し、FP32、FP16、BF16、FP8、FP4の各種精度演算をネイティブにサポートする。大規模言語モデルの中核演算子であるAttentionに対して深い最適化を施しており、市場で主流のオープンソース大規模言語モデルへの適応が可能だ。ソフトウェア面では、独自命令セット、コンパイラ、完全な演算子ライブラリを自社開発し、CUDAに依存しない中国国産開発体系を構築した。現在、演算子対応能力はモデル学習、通常推論、分散分離推論の各シーンをカバーしており、サードパーティーAIフレームワークへの対応も引き続き進めている。



(ii)3D積層ハイブリッドボンディング型ニアメモリ計算技術



従来のフォン・ノイマン型アーキテクチャには、本質的に「メモリウォール」という顕著な課題が存在する。大量の計算資源、消費電力、時間がデータ往復転送の過程で失われ、計算製品のエネルギー効率向上を継続的に制約してきた。東方算芯は3Dハイブリッドボンディング工法を採用し、論理計算層とDRAMメモリ層をバンプレスで垂直接続することで、接続ピッチをサブミクロン級にまで縮小した。同一プロセス条件下では、帯域密度において業界主流の2.5D HBM方式より優位性を持つとしている。



チップ内部のデータ伝送経路は大幅に短縮され、オンチップのメモリアクセス帯域は最大6.4TB/s、単一カードのScale-up相互接続帯域は900GB/sに達する。これは大規模なマルチカード並列学習タスクを十分に支える水準だ。このソリューションは輸入HBMメモリチップに依存せず、中国国内14nm成熟ラインを活用することで高性能計算ハードウェアの量産を可能にする。これにより、海外の高性能メモリ部品への依存を効果的に低減し、外部サプライチェーンのリスクを相殺できるとしている。



(iii)ネイティブ分散型マルチカード相互接続実行アーキテクチャ



超大規模パラメータモデルの学習や大型インテリジェント計算クラスターの構築では、マルチカード間通信の遅延やシステム安定性に対する要求が極めて厳しい。東方算芯は、チップ、サーバー、ソフトウェアの三層からなる分散協調体系を構築した。チップには独自開発の通信プロセッサーを内蔵し、サーバーにはネイティブなスーパーノード用ハードウェアを組み合わせ、専用の分散プログラミング環境も提供する。TY64を基盤とすることで、64カードのノンブロッキング結合を実現し、マルチカード同期通信の損失を大幅に低減しながら、超大規模パラメータモデルの並列学習ニーズに対応する。ハードウェアは動的電圧・周波数制御にも対応しており、推論と学習という異なる負荷に応じて動作状態を自動で切り替えられる。このため、高密度インテリジェント計算センターにも、軽量計算拠点の配備にも対応可能だ。



フルスタック標準化製品群で中国国産代替の加速を後押し



3つの基盤技術を土台に、東方算芯は多層的な完全製品ラインを形成した。今回の発表会では全ハードウェアシリーズの詳細が公開され、関連設備はWAIC会場でも実機展示された。ソリューションは単体マシンでの研究開発・デバッグから、1万カード級の大規模クラスター構築まで、全シーンをカバーしている。



①DF1000チップ、巓峯DF1000 OAM2.0アクセラレータカード

OAM2.0規格に準拠し、単一カードでBF16演算性能520TFLOPS、最大6.4TB/sのメモリ帯域を実現する。空冷と液冷の2形態を提供し、単体推論や中小規模パラメータモデルのファインチューニングに対応する。



②擎元QY100サーバー

QY100-P空冷モデルは一般的な汎用データセンター向け、QY100X-S液冷モデルは極限の計算性能を引き出せる構成となっている。完成品として一体納入されるため、顧客側の二次的なハードウェア調整作業を大きく減らせる。



③拓域TY64液冷スーパーノード

単体で最大8カードの搭載を支援し、64カード規模のScale-up相互接続ドメインを構築可能だ。大規模言語モデルの事前学習や強化学習など、高負荷シーンを対象としている。



④慧算クラスターシリーズ

HS64標準スーパーノード、128カード相互接続クラスター、HS512大型計算力クラスターを含み、大規模な水平方向の弾力的拡張をサポートする。独自開発のクラスター運用保守プラットフォームも備え、都市インテリジェント計算センターや国家級科研シミュレーションプロジェクトの構築に適している。



付随する独自ツールチェーンは、命令システム、コンパイラ、演算子ライブラリ、分散フレームワーク、運用保守プラットフォームを網羅しており、基盤チップから上位アプリケーションまでの全工程で自主的かつ制御可能な体制を実現している。



基盤自社開発が生む3つの差別化競争優位



現段階では、中国国内の少なくない国産計算力製品が海外GPUアーキテクチャの改造に基づいており、エコシステムへの拘束、高度プロセスへの依存、ソフト・ハード体系の分断という三つの弱点を抱えている。東方算芯はフルスタック自社開発を貫くことで、独自の競争優位を築いた。



第一に、ハード・ソフトの基盤を完全に自主化している点だ。チップアーキテクチャ、命令セット、コンパイルツールはすべて独自設計であり、独立した国産ソフトウェア・エコシステムを構築しながら、主要AIフレームワークとの互換性拡大を継続している。



第二に、高度サプライチェーン制約を弱めている点だ。リコンフィギュラブル技術と3Dニアメモリという二重のアーキテクチャ革新により、中国国内の成熟ラインを活用しながら高性能計算力の出力を実現し、海外高性能メモリ部品への依存を効果的に低下させている。



第三に、ワンストップで完成機を納入できる点だ。業界に見られる、チップ、サーバー、ソフトウェアを別ベンダーから寄せ集めて統合する方式とは異なり、東方算芯は全工程の製品開発と共同最適化を一体で進めており、顧客プロジェクトへの適応期間を大幅に短縮できる。



4つのアプリケーション分野を全面カバー



同社の全製品群はAI学習と推論業務に焦点を当てており、信創適合も成熟段階にある。主に次の四大市場を重点的にカバーする。



①汎用大規模モデル分野:各種オープンソースモデルの単体・分散学習および推論を支え、国産の学習・推論基盤を構築する。



②AI for Science分野:気象シミュレーション、新材料開発、バイオ医薬シミュレーションなど、高精度な科学研究計算を支援する。



③政府・企業向け情報革新シーン:行政プラットフォーム、金融リスク管理クラスター、エネルギー配分、中央企業データセンターの国産化改造に対応する。



④産業・スマートシティ分野:画像検査、設備故障予測、デジタルツイン、都市インテリジェント分析などのデジタル化業務に展開する。



製品ポートフォリオの階層は明確で、DF1000は単体の軽量計算需要を満たし、TY64やHS512は超大規模・高同時並行の計算シーンに対応する。研究室レベルの開発から商用大型クラスターまで、すべてのレイヤーの需要を網羅している。



結び



DF1000の正式発表とWAIC 2026での一斉展示は、東方算芯が独自開発計算力の産業化・商用化を推進するうえでの重要なマイルストーンとなった。長年にわたり、中国国内の高性能計算力産業は発展経路が比較的単一であり、海外の基盤アーキテクチャ、閉鎖的エコシステム、サプライチェーン変動の制約を受け続けてきた。東方算芯は、リコンフィギュラブル技術と3Dニアメモリ計算を中核に据え、従来とは異なる国産計算力イノベーションの道を切り開いた。



フルスタック一体型ソリューションは、各業界における国産化改造コストの低減に寄与し、中国国内のAIインフラの弱点を補うと同時に、産学研連携の成果を商用化へ転換するモデルケースにもなり得る。今後、東方算芯は基盤技術の継続的な高度化と製品エコシステムの充実を進め、国産計算力インフラの自主的かつ制御可能な発展を引き続き後押ししていく考えだ。







(原文:https://www.icsmart.cn/108139/)

[注] 新闻内容由AI翻译生成,如有表述不尽完善之处,敬请谅解!
Please note: This news article was translated by AI. We apologize for any imperfections in the translation.
Previous Article
『フォーチュン』世界500社、中国車メーカー10社がランクイン
Next Article
世界最大級AIモデル「Kimi K3」を生んだ男 創業者・楊植麟氏