資料中心
為滿足 AI 需求,AWS 與 NVIDIA 深化 AI 技術堆疊的整合,提供額外 200 萬顆 GPU 以及適用於代理 AI 與實體 AI 的次世代基礎設施。
代理式 AI
Perplexity Computer 現已可在 NVIDIA DGX Spark 上使用,支援持續運作的 AI 代理,並快速執行本機 AI 工作。
NVIDIA Groq 3 LPX 透過代理式 AI 的超高速 Token 生成,擴展 NVIDIA Vera Rubin 平台。
隨著 SpaceXAI 將 Vera Rubin AI 基礎架構從地球延伸至軌道,NVIDIA Vera 將加速代理式 AI 應用。
NVIDIA Vera Rubin NVL72 的效能比 GB300 NVL72 高出 30 倍,Token 成本降低 35 倍。
在 Hot Chips 2026 上,NVIDIA 將極致協同設計從晶片延伸至網路與 Token 工廠。
AWS 與 NVIDIA 擴大戰略合作
Perplexity Portable Computer 採用 NVIDIA 技術
具備世界級速度的 Groq 3 LPX 全面量產
SpaceXAI 採用 NVIDIA Vera CPU,加速代理式 AI
每瓦運算量提升 30 倍:Vera Rubin 樹立 AI 代理效率標準
隨著 Grok 3 LPX 全面量產,NVIDIA 擴展 Vera Rubin 的代理推論能力