AIエージェント向けサーバーでは、GPUの推論速度だけでなく、ツールの実行や作業環境の起動を担うCPUも処理量に関わります。IntelはXeon 6搭載のAWSインスタンスを使った比較試験を公開し、第5世代AMD EPYC搭載機に対して最大1.66倍の作業処理量を記録したと発表しました。本記事では公表値を分野別に整理し、どこまでをCPU選定の材料にできるか、測定方法から読み解きます。
Intelが公開した3分野の処理量
Intelの発表では、医療、金融、製造を模したエージェント作業を同じ条件で繰り返し実行しています。評価指標は60分間に完了したタスクの数です。Xeon 6搭載機を基準にしたIntelの公表倍率は次の通りです。
| 作業分野 | 第5世代EPYC搭載機に対する倍率 | Arm搭載機に対する倍率 |
|---|---|---|
| 医療 | 1.66倍 | 4.50倍 |
| 金融 | 1.64倍 | 4.57倍 |
| 製造 | 1.58倍 | 4.24倍 |
医療分野には診療記録の整理、資料検索、監査ログの処理などを想定したタスクが含まれます。金融はリスク分析や本人確認、製造は設備の異常検知や需要予測などの作業を模しています。3分野のすべてでXeon 6搭載機が最も多くのタスクを処理した、というのがIntelの報告です。
比較したAWSインスタンスの構成
Intelは各インスタンスを48 vCPU、利用可能メモリ185GB、Ubuntu 26.04という条件で揃えました。比較したEC2インスタンスと搭載CPUは次の組み合わせです。
| EC2インスタンス | 搭載CPU |
|---|---|
m8id.12xlarge |
Xeon 6 |
m8a.12xlarge |
第5世代EPYC |
m9gd.12xlarge |
Graviton5 |
同じ48 vCPUでも、各CPUの物理コアとvCPUの対応、クロック、メモリの実効速度、仮想化環境には差があります。比較対象は、同規模のEC2インスタンスにおける作業処理量です。費用対効果を算出するには、各インスタンスの料金も必要になります。サーバーの運用費を基準にする場合は、今回の処理数と料金を組み合わせた評価が次の段階です。
再生方式が測っている作業
IntelはTerminal-Bench 2.0の作業を基に、エージェントの実行経路を記録して再生する方式を採用しました。同じ指示でもAIが毎回違う道筋を選ぶ揺れを抑えるためです。24個の作業環境を同時に走らせ、各タスクを物理コアに固定。60分間、空いた枠へ次の作業を投入して処理数を数えています。
公表された測定方法によると、記録の再生時はLLMの推論とネットワーク通信を行わず、事前に用意したコンテナを使います。表の倍率は、ツール実行や作業環境の管理、検証処理など、CPU側で反復する部分の処理量を示します。元のTerminal-Benchはエージェントが課題を解けたかを評価しますが、Intelの比較で主要指標になったのは完了タスク数でした。
この違いは導入時の判断に直結します。推論サービスを外部で動かし、大量のサンドボックスやツール呼び出しを自社サーバーで処理する構成なら、今回の測定は参考になります。モデル推論を同じサーバーで動かす構成では、推論器やメモリ容量も含めて別の測定が必要です。Intelが示した医療や金融の作業名は、ベンチマーク上の想定例です。
作業カテゴリごとの内訳
Intelは三つの分野をさらに「分析・推論」「安全なデータ処理」「制御」に分け、カテゴリ別の倍率も掲載しました。第5世代EPYC搭載機を1とした場合のXeon 6搭載機の処理量は次の通りです。
| 分野 | 分析・推論 | 安全なデータ処理 | 制御 |
|---|---|---|---|
| 医療 | 1.67倍 | 1.63倍 | 1.61倍 |
| 金融 | 1.66倍 | 1.61倍 | 1.59倍 |
| 製造 | 1.59倍 | 1.55倍 | 1.55倍 |
3カテゴリすべてでXeon 6搭載機の処理量が上回りました。Intelの分類では、ログの暗号化や圧縮を含む安全なデータ処理、検証や手順の制御にも差が出ています。実際の業務でどのカテゴリを多く走らせるかにより、全体処理量へ効く部分は変わります。
測定条件と導入時の計算
Intelの詳細条件では、コンテナのイメージを試験前に用意し、各コンテナのスレッドを1本に制限しました。タスクは一つの物理コアへ固定し、処理が終わると空いた枠へ次のタスクを投入しています。検証器は有効で、三つのEC2インスタンスはいずれも全タスクを失敗なく実行したと記載されています。この設定により、60分で完了した数の差を比較しやすくしています。
1.66倍は同じ60分に完了したタスク数の比です。たとえばEPYC搭載機がある条件で100件を終えるなら、同じ比率ではXeon 6搭載機が166件を終える計算になります。完了件数の倍率と1件の応答時間は別の指標です。同じ通貨で表示されたEC2の1時間料金で完了件数を割れば、通貨単位当たりの処理量を比較できます。
まとめ
Intelの比較では、24並列・60分の再生試験でXeon 6搭載EC2が第5世代EPYC搭載EC2を1.58〜1.66倍上回りました。推論を外部で処理し、CPU側の作業処理量を重視する構成で参考になる結果です。サーバーCPUの用途を広く見たい方は、EPYC 9006の構成を整理した記事も併せてご覧ください。
