研究者による新たなインサイトの発見を支援するAIシステム。リアルタイムの状況に適応する物流ネットワーク。シミュレーションを活用してより優れた製品を設計するエンジニア。そのすべての活動基盤となるのが、卓越したパフォーマンスとさらなる効率性を同時に実現しなければならないデータセンターです。AIが実験段階から本番稼働へと移行し、単純なクエリ応答から、自律的に推論、計画、行動する継続的なエージェント型システムへと進化するにつれて、その基盤となるインフラに課せられる要件は、劇的に高度化しつつあります。
業界における議論の多くは、プロセッサーを中心とするものでした。例えば、高度化するAIワークロードに追いつくために競合するGPUやカスタムシリコンです。しかし、プロセッサーは全体の一部に過ぎません。これらのプロセッサーを支えるメモリシステムも同様に重要ですが、その実態については、あまり理解されていない可能性があります。メモリは、データが演算エンジンに到達する速さ、モデルの作業用データセットの即時可用性の程度、そしてサーバーが消費する1ワットあたりの電力利用の効率性を決定します。AIインフラストラクチャの経済性は、事業者が電力、冷却能力、資本投資を利用可能な演算リソースにどれほど効率的に変換できるかによって決まる傾向を強めています。メモリは、その効率性を高めるための主要な手段の一つになりつつあります。
こうした背景から、長らくモバイルデバイス向けとして知られてきた低電力メモリテクノロジーであるLPDDRが、データセンターをめぐる議論に登場しています。AIが断続的なトレーニング実行から継続的な推論へと移行するにつれ、電力効率に優れたメモリは、単なるモバイル機器の設計における優位性にとどまらない存在になっています。メモリはインフラの優位性に直結するからです。
最新のAIシステムで最も重要とされる特性の中でも、エネルギー効率は、推論およびエージェント型AIのワークロードにおいて特に重要性を増しています。データセンターのアーキテクチャーでLPDDRの果たす役割が拡大している理由の一つです。
データセンター事業者にとって朗報と言えるのは、メモリのイノベーションがかつてないほど活発化していることです。大容量サーバーメモリから、低電力メモリアーキテクチャー、AIアクセラレーター向けに設計された高帯域幅メモリに至るまで、業界にはかつてないほど多くのツールが登場し、適切なワークロードに適切なメモリを採用することが可能になっています。その進化の中心にあるのがLPDDRです。推論やエージェント型AIによって最新のインフラに課されるワットあたりのパフォーマンスの要件を満たすべく、専用に設計されたテクノロジーです。LPDDRは長年にわたり、消費電力を最小限に抑えつつパフォーマンスを最大化することが不可欠なモバイルデバイスで、主に使用されてきました。AIインフラにおける電力と冷却の制約が大きくなるにつれ、データセンターでも、同じ設計原則が新たな意義を見出しています。多くのAI環境で、効率性はパフォーマンスを語る上で欠かせない要素となっています。その理由を理解することが、AIインフラの進化を理解するための鍵になります。
高速道路網になぞらえる
最新のAIシステムで、メモリアーキテクチャーがこれほどまでに重要である理由を理解するために、身近な例として、大規模な24時間稼働の製造プラントに物資を供給する高速道路網について考えてみましょう。
製造プラントはプロセッサーにたとえられます。強力で生産的ですが、どれほど有効であるかは、搬入口に届く原材料次第です。高速道路網はメモリシステムに相当します。データが存在する場所から必要とされる場所へ、可能な限り迅速かつ効率的にデータを移動させるためのインフラです。
製造プラントが稼働を始めた当初、生産量を増やすための解決策は単純明快でした。より広い高速道路を建設し、トラックをより速く走らせることです。これは長い間、うまく機能していました。しかし、製造プラントが複雑化し、何百もの生産ラインを同時に稼働させ、絶えず変動する在庫を管理し、24時間体制で操業するようになると、もはやスループット(処理能力)だけでは十分ではなくなりました。
製造プラントにとって真に必要だったのは、よりスマートな物流ネットワークでした。高速道路の拡幅はもちろん、道路そのものを増やし、配送センターをより近くに配置し、より効率的な車両を導入する必要がありました。あらゆる製造プラントに適合する単一の物流計画が存在しないのと同様に、あらゆるワークロードに対応できる単一のメモリテクノロジーも存在しません。現代のAIインフラも同様です。
推論とエージェント型AIによって方程式が変わる理由
AIの黎明期には、大規模かつ単発的なワークロード、すなわち、ある程度の非効率性が許容されるトレーニング実行やバッチ処理が主流でした。その前提が変わりました。大規模な推論やエージェント型AIシステムは、継続的に稼働し、ユーザーとリアルタイムで対話し、ミリ秒単位で応答する必要があります。しかも、これらはハイパースケールデータセンターだけでなく、分散型クラウドリージョン、エッジロケーション、そしてエンタープライズ環境全体に展開されています。
この変化は、メモリにも現実的な影響を及ぼします。
- 推論ワークロードは、メモリによる制約を受けます。計算能力による制約だけではありません。純粋な推論ワークロードでは、モデルは学習済みです。現時点で重要なのは、何千人もの同時ユーザー向けに、パラメータ、コンテキスト、中間状態をいかに迅速に読み込んで、アクセスと更新を繰り返せるかということです。
- エージェント型システムは、メモリ負荷を増大させます。より長い会話コンテキストの保持、マルチステップ推論チェーンの実行、外部データソースとのやり取りの調整を、すべて同時に行うためです。
- レイテンシーがユーザーエクスペリエンスを左右する変数になります。エージェント型AIでは、応答の遅さは単にユーザーを苛立たせるだけでなく、対話の整合性を損なうおそれがあります。高速かつ一貫した応答を支えるメモリアーキテクチャーは、製品の品質とユーザー満足度に直結します。
AIデータセンターで最も重要なメモリ特性とは?
最新のAIインフラで、戦略的に重要になりつつあるメモリ特性が4つあります。帯域幅、エネルギー効率、容量、応答性です。各種のメモリテクノロジーは、こうした課題にそれぞれ異なる方法で対処します。まさにこの理由から、最先端のAIサーバーでは、複数の異なるメモリテクノロジーが採用されています。
- 帯域幅:大規模なデータ供給
最も強力なプロセッサーでも、その能力は、データが供給される速さでしか発揮されません。AIシステムでは、メモリ帯域幅(メモリと演算ユニットとの間でデータが移動する速度)が、プロセッサーが次の命令を待機してアイドル状態になる頻度を左右します。
帯域幅が不十分であれば、プロセッサーは有益な処理を実行するのではなく、データ待ちに時間を費やすことになります。データの並列転送を増大させるアーキテクチャーアプローチは、システム全体のスループットの最大化に貢献します。
- エネルギー効率:ワットあたりの処理能力を最大化
AIシステムは、継続的な稼働、より多くのユーザーへの同時サービス提供、より大量のデータ処理をますます要求されるようになっています。このような環境で、エネルギー効率とは、単なる消費電力の削減だけではありません。利用可能な1ワットの電力を使って、インフラが実行できる有用な仕事の量を最大化することを意味します。
ワットあたりのパフォーマンスを向上させるメモリテクノロジーにより、サーバーは同じインフラ規模で、より多くの要求を処理し、より速く応答し、AIを活用したより多くのエクスペリエンスを支えられるようになります。AIの利用が拡大するにつれ、効率性は、インフラで達成できることの幅を広げる手段となります。
- 容量:より多くのデータを利用可能な状態に保つ
どれだけ多くのデータをコンピューティング目的で即座にアクセス可能な状態に保てるかは、容量によって決まります。AIモデルが大型化し、その動作状態がますます複雑になるにつれ、演算処理を行う場所の近くに大量のデータを保持することで、処理の中断を減らし、パフォーマンスを維持することが可能になります。
- 応答性:ユーザーが体感する速度
AIシステムの応答性は、モデルが必要とする特定のデータを、必要なタイミングでどれだけ迅速に提供できるかを決定します。ユーザーエクスペリエンスがミリ秒単位で測られるリアルタイムAIアプリケーションでは、これが特に重要です。アクティブなデータセットを即時にアクセス可能な状態に保ち、データ取得の遅延を最小限に抑えるメモリアーキテクチャーは、エンドツーエンドのシステム応答性、例えばAIサービングの品質を評価する指標として近年重視されているTime-to-First-Token(TTFT、最初のトークンを提供するまでの時間)などに直結します。
要するに、単一のメモリテクノロジーであらゆるAIワークロードに対応すべきではありません。AIインフラには、より専門化されたメモリ階層が必要であり、高帯域幅メモリ、DDR5、LPDDR、高速ストレージ(SSD)が、それぞれ異なるシステムニーズに対応します。
あらゆる領域を網羅するポートフォリオ
今日のデータセンターのメモリ環境は、ワークロードの要件、システムアーキテクチャー、実装コンテキストに基づいて、異なるテクノロジーがそれぞれ異なる役割を果たす補完的なエコシステムです。マイクロンのポートフォリオは、この全領域に対応するように設計されています。
高帯域幅メモリは、パフォーマンススタックの頂点に位置し、大規模な学習や高性能な推論など、最も負荷の高いAIワークロード向けに設計されています。プロセッサーの隣に積層されているため、既存のメモリの中で最大の帯域幅を実現します。マイクロンの高帯域幅メモリは、革新的なプロセステクノロジーと設計により、業界最高水準の電力効率を実現しています。
DDR5は、実績のある大容量サーバーメモリの基盤です。幅広い互換性を備え、エンタープライズ環境やクラウド環境でその信頼性が証明されており、AIと並行して継続的に実行される広範囲の汎用ワークロード向けに最適化されています。AIエージェントがデータベースタスクや要求を実行する際、その多くは従来のサーバーに送信されています。DDR5の果たす役割が低下しているわけではありません。むしろ、AIインフラの規模拡大が、DDR5の容量に対する継続的かつ莫大な需要を牽引しています。
LPDDRは、AIアーキテクチャーでますます戦略的かつ独自の位置を占めています。DDR5が依然として多くの汎用的かつ容量集約型のサーバーワークロード向けに好まれる選択肢である一方、LPDDRは、電力効率が設計上の主な考慮事項となる、推論負荷の高い環境で特に魅力的です。高性能と卓越した効率性を追求してゼロから設計されたLPDDRは、継続的なAIサービングやエージェント型ワークロードに特に適した、ワットあたりの帯域幅特性を提供します。AIがモデル開発の段階から実環境への実装へ移行すると、推論ワークロードは数千ものユーザーやシステム向けに継続的に稼働するようになります。その結果、ワットあたりのパフォーマンスは、インフラ設計においてますます重要な要因になっています。
SOCAMM2モジュールは、サーバー向けに特別に設計された保守可能なフォームファクタで複数のLPDDRパッケージを提供し、エンタープライズ環境に期待されるRAS(信頼性・可用性・保守性)特性を支えつつ、LPDDRの効率性と高密度という利点をより幅広いデータセンターアーキテクチャーにもたらします。
これらのテクノロジーを組み合わせることで、計算負荷が極めて高い学習ジョブから、エージェント型AI時代を象徴する低レイテンシーかつ継続的な推論処理に至るまで、あらゆるAIワークロードに対応可能なメモリポートフォリオが成立します。
マイクロンの役割:LPDDRにおけるリーダーシップと、幅広く充実したポートフォリオ
この市場環境におけるマイクロンの立ち位置は、数十年に及ぶメモリテクノロジーへの投資、ハイパースケーラーやテクノロジーリーダーとの深い関わり合い、そしてAIインフラを世界規模で支えるために構築された製造体制を反映しています。
この幅広さが重要です。AIシステムでは、複数のメモリテクノロジーが連携して機能することが要求されます。顧客は、パフォーマンス、効率、品質、そして長期的な供給をスタック全体にわたって実現できるパートナーを必要としています。DDR5やHBM4からLPDDR、SOCAMM2に至るまで、マイクロンのポートフォリオは、最新のAIインフラの多様な要件に対応できるように設計されています。
電力効率がAIの決定的な制約要因となる情勢の中で、低電力メモリにおけるマイクロンのリーダーシップは、とりわけ重要な意味があります。LPDDRアーキテクチャー、製造、規格策定に対する長年の投資により、マイクロンは、データセンターで新たな重要性を帯びつつあるテクノロジーの最前線に立つことができています。SOCAMM2の導入はその進化を物語る一例であり、LPDDRによる効率性の利点を、より幅広いサーバーアーキテクチャーに適したモジュラーフォームファクタへ拡張するものです。
全体像
AIネイティブなインフラへの移行は、まだ初期段階にあります。エージェント型AIシステムの能力が向上し、継続的に稼働するようになり、またAIネイティブなアプリケーションの規模が拡大し続ける状況の中で、電力効率は最新のインフラにおける決定的な制約要因の一つになりつつあります。
継続的に稼働し、多数のユーザーに同時にサービスを提供し、リアルタイムで応答するシステムを、画一的なメモリ戦略に基づいて構築することはできません。大規模なAI運用の経済性(消費電力、冷却能力、インフラ利用率、総所有コストの観点で測定される)によって、メモリアーキテクチャーは単なる技術的な選択肢ではなく、競争を左右する変数となっています。
このような環境で、LPDDRはより戦略的な役割を担いつつあります。元々は効率性が重視される環境向けに開発されたものですが、ワットあたりパフォーマンスという特性は、最新の推論やエージェント型AIワークロードが求める要件に極めてよく適合しています。プロセッサーに自然と注目が集まる昨今の状況で、効率よくプロセッサーにデータを供給するメモリアーキテクチャーも、同じように重要な意味を持つ可能性があります。
メモリは全体の半分に過ぎない
メモリはAIシステムのパフォーマンスの中核をなすものですが、インフラという大きな方程式の一部分に過ぎません。推論とエージェント型AIの時代、すなわちシステムが膨大なデータを継続的に取得し、それに基づいて推論し、アクションを実行しなければならない時代には、ストレージも同じく重要な役割を担います。永続ストレージとアクティブメモリ階層との間でデータを効率的に移動させる能力は、AIシステムの応答速度だけでなく、大規模運用におけるコスト効率をも左右します。世界で最も洗練されたメモリアーキテクチャーであっても、その能力は、それを支えるストレージインフラの能力によって左右されます。AIデータセンターを形作るインフラストラクチャの制約について、より詳しく知るには、液冷と電力効率に関する関連記事をご覧ください。