AI 基礎設施的每週溫度計。我們追蹤全球算力供給、雲端資本支出、資料中心建設與能源基礎設施的關鍵指標,以圖表與數據呈現 AI 運算基建的脈動。
封面圖片:用戶自行提供
本週總覽
2026年6月第一週(6月1日至6月7日),AI 基礎設施投資與部署進入加速期。NVIDIA Blackwell B200 GPU 出貨量創新高,三大雲端資本支出持續攀升,推理算力需求首次超越訓練。以下是本週關鍵指標一覽:
| 指標 | 本期數據 | 較上月變動 | 年初至今 |
|---|---|---|---|
| NVIDIA B200 GPU 月出貨量 | 120萬顆 | +33% | 410萬顆 |
| 三大雲 AI 資本支出 (Q2預估) | 580億美元 | +85% YoY | 1,120億美元 |
| 推理算力佔總算力比 | 52% | +8pp | — |
| 全球新建資料中心 (規劃中) | 47座 | +5 | 312座 |
| AI 資料中心用電預估 | 62 GW | +9 GW | — |
| AI 晶片初創融資 | 12.3億美元 | +4.1億 | 47.8億美元 |
一、算力供給:Blackwell 量產爬坡
1.1 GPU 出貨量
NVIDIA Blackwell B200 在 5 月達到月出貨 120 萬顆的里程碑,較 4 月的 90 萬顆增長 33%。台積電 CoWoS-L 先進封裝產能在 5 月擴張至每月 45 萬片 12 吋晶圓等值(12-inch equivalent),仍是整個供應鏈中最緊繃的環節:
| 封裝類型 | 月產能 (12吋等效) | 利用率 | 瓶頸等級 |
|---|---|---|---|
| CoWoS-L (Blackwell) | 45萬片 | 98% | 高度瓶頸 |
| CoWoS-S (H100/B200) | 32萬片 | 95% | 中度瓶頸 |
| InFO (邊緣AI) | 28萬片 | 82% | 輕度 |
| SoIC (3D堆疊) | 12萬片 | 91% | 中度瓶頸 |
CoWoS-L 的產能缺口約為需求的 15-20%,NVIDIA 已向台積電追加 2026 下半年的產能預訂,目標是年底前將月產能提升至 65 萬片。
1.2 競爭格局
AMD MI400 系列在 5 月出貨約 18 萬顆,主要供應微軟和 Meta 的內部集群。Google TPU v7 在 5 月開始大規模部署,規劃 2026 年底前部署超過 100 萬顆。AWS Trainium3 晶片量產時間表推遲至 Q3 2026,原因是設計變更帶來的回片延遲。
| 晶片 | 5月出貨 | Q2累計 | 主要客戶 |
|---|---|---|---|
| NVIDIA B200 | 120萬顆 | 270萬顆 | 全雲端+企業 |
| AMD MI400 | 18萬顆 | 38萬顆 | 微軟、Meta |
| Google TPU v7 | 內部部署中 | 30萬顆 | Google 內部 |
| AWS Trainium3 | 延遲至Q3 | — | AWS 內部 |
二、雲端資本支出:三大巨頭競賽升級
2.1 2026 Q2 預估資本支出
三大雲端服務商在 2026 年第二季度的合計 AI 資本支出預計達到 580 億美元,同比增長 85%。其中超過 70% 用於伺服器和 GPU 採購,其餘用於資料中心基礎設施建設:
| 雲端商 | Q2 AI CapEx 預估 | YoY 增長 | 主要投入方向 |
|---|---|---|---|
| Microsoft Azure | 230億美元 | +92% | 全球資料中心擴建,OpenAI 專用集群 |
| Amazon AWS | 190億美元 | +78% | Trainium 基礎設施,Bedrock 推理集群 |
| Google Cloud | 160億美元 | +84% | TPU v7 部署,Gemini 訓練集群擴容 |
2.2 資料中心建設
全球在建或規劃中的大型 AI 資料中心(>100MW)在 5 月新增 5 座,累計達 47 座。主要分佈在北美(28座)、歐洲(9座)、亞太(10座)。值得注意的趨勢是液冷方案的快速滲透——新建資料中心中 78% 已採用直接液冷(DLC)或浸沒式液冷方案,高於 2025 年的 52%。
三、推理與訓練:算力需求結構性轉變
3.1 推理超越訓練
OpenAI 和 Anthropic 的 API 調用量數據顯示,推理計算消耗的算力在 5 月首次超過訓練計算,佔總算力需求的約 52%。這一轉折點比業界預期提早了 6-9 個月到來,主要由以下驅動:
- ChatGPT / Claude 月活躍用戶總計突破 8 億
- AI Agent 自動化工作流的推理調用次數爆炸式增長
- 企業級推理部署(RAG、文件分析、客服)加速落地
| 算力類別 | 佔比 | 月增長率 | 年初佔比 |
|---|---|---|---|
| 推理算力 | 52% | +18% | 41% |
| 訓練算力 | 38% | +7% | 47% |
| 研發/測試 | 10% | +5% | 12% |
3.2 推理硬體趨勢
推理算力需求的爆發正在改變硬體採購格局。NVIDIA 預估其資料中心部門收入中,用於推理的 GPU 出貨佔比將在 2026 年底達到 60%。同時,專用推理晶片(Groq LPU、Cerebras Wafer-Scale、D-Matrix)的訂單在 Q2 環比增長了 140%。
四、能源與電力:AI 用電壓力持續升溫
4.1 用電概況
全球 AI 資料中心總用電需求在 5 月達到 62 GW 的運行功率,年化用電量約 543 TWh,約佔全球總發電量的 1.8%。預計到 2027 年,AI 資料中心用電將達到 150 GW,超過瑞典全國總用電量。
| 地區 | AI 資料中心用電 (GW) | 佔該地區總發電比 | 主要能源 |
|---|---|---|---|
| 美國 | 28.5 GW | 3.2% | 天然氣+核能+再生能源 |
| 歐洲 | 14.2 GW | 1.9% | 核能+風電 |
| 亞太 | 16.8 GW | 1.5% | 煤炭+天然氣 |
| 其他 | 2.5 GW | 0.3% | 混合 |
4.2 能源解決方案
Microsoft 與 Constellation Energy 合作重啟 Three Mile Island 單元 1(835 MW)的協議已進入聯邦監管審查,預計 2028 年投產。Google 與 Kairos Power 簽署的小型核反應爐(SMR)購電協議(6座×50 MW)已啟動選址評估。AWS 則繼續大規模採購風電和太陽能,2026 年在再生能源領域的投資已達 45 億美元。
五、本週重點事件
5.1 OpenAI 正與甲骨文討論超大規模 AI 集群
OpenAI 據報導正與 Oracle 就建設一個包含 200 萬顆 GPU 的超大規模訓練集群進行談判,預計總投資超過 500 億美元。該集群若建成,將是目前已知最大單一訓練集群的 5 倍規模。
5.2 美國商務部強化 AI 晶片出口管制
BIS 在 6 月 2 日發布新的出口管制修訂,將算力密度限制從 200 PFLOPS 下調至 150 PFLOPS,進一步壓縮非盟友國家的 AI 算力獲取空間。NVIDIA 表示新規對其 B200 出貨影響有限,因主要客戶集中在美國和盟友。
5.3 Anthropic 與 CoreWeave 續簽 40 億美元算力合同
Anthropic 與 GPU 雲服務商 CoreWeave 簽署為期 5 年、總值 40 億美元的算力租賃合同,保障 Claude 下一代模型的訓練與推理算力。CoreWeave 同時宣布將在挪威建設第 12 座資料中心,利用北歐水力發電降低碳足跡。
六、AI 晶片初創融資
5 月 AI 晶片初創企業完成 12.3 億美元融資,主要交易包括:
| 公司 | 輪次 | 金額 | 核心技術 |
|---|---|---|---|
| Groq | Series E | 4.5億美元 | LPU 推理晶片,估值提升至 85億美元 |
| MatX | Series C | 2.8億美元 | 邊緣 AI 推理 SoC |
| d-Matrix | Series D | 2.5億美元 | 數位存內計算推理晶片 |
| Etched | Series B | 1.5億美元 | Transformer 專用 ASIC |
| Tenstorrent | Series D | 1億美元 | RISC-V 架構 AI 加速器 |
下週關注
- NVIDIA GTC Taipei 2026(6月10日)是否公佈下一代 Rubin 架構細節
- 美國聯邦能源監管委員會(FERC)對 AI 資料中心電網連接申請的審批進度
- 台積電 6 月 CoWoS-L 產能擴張是否達標
- OpenAI 與 Oracle 的集群合約正式公告
- 歐盟 AI 法案對大規模訓練集群的能源效率要求配套細則
免責聲明:本週報中的數據和預測來自公開資訊和行業估算,不構成任何投資建議。POC.HK 力求數據準確,但部分前瞻性指標基於模型推估,實際數字可能有所偏差。