英伟达新一代算力平台补齐拼图 结合 DeepSeek 模型 Token 成本可降 35 倍
11 小时前
英伟达当地时间 8 月 24 日宣布推理加速器 Groq 3 LPX 机架进入全面量产阶段,该机架将与 Vera 中央处理器、Rubin 图形处理器一同部署于新型云服务商 Nebius 的数据中心,今年晚些时候上线。此外,英伟达公布 Vera Rubin NVL72 在真实智能体工作负载下的新测试结果,基于 SemiAnalysis 的 AgentX 工作负载、采用 DeepSeek V4 Pro 模型,其每兆瓦吞吐量最高达上一代 GB300 NVL72 的 30 倍,每 Token 成本最高降低 35 倍,能让运营商在固定电力和基础设施预算下支持更高交互式代理容量,或以更低成本提供相同容量。
英伟达新一代算力平台补齐拼图 结合 DeepSeek 模型 Token 成本可降 35 倍
ITBear 科技资讯/金融界/格隆汇
2026-03-11
英伟达将向 Nebius 投资 20 亿美元2026-01-06
英伟达推出新一代人工智能平台 Vera Rubin2025-07-15
英伟达推出中国市场专属计算卡 B30:性能妥协,市场需求旺盛2025-05-21
英伟达:DeepSeek 将人工智能计算需求提高了 100 至 1000 倍2025-04-17
黄仁勋与 DeepSeek 创始人梁文锋会面,讨论如何为中国设计芯片2025-03-28
DeepSeek 带动算力需求急涨,英伟达大陆特供 GPU「爆单」2025-03-19
英伟达 GTC2025:黄仁勋宣布 2026 年下半年将推新一代以太网芯片查看更多
体验专业版特色功能,拓展更丰富、更全面的相关内容。