今日 1 条头条 + 4 条备选
今日核心信号:英伟达首次公布Vera Rubin实测数据,DeepSeek吞吐量暴涨30倍,同时宣布旗舰芯片涨价17%,并以投资换绑定加固AI霸主地位。另一边,OpenAI被曝解散风险团队、人才流失,IPO前暗流涌动。存储涨价潮席卷全球,三星、SK海力士加码中国NAND产能,DRAM价格飙升。字节跳动加入企业办公Agent大战,发布“豆包工作”。
🌟 今日精选
1. 英伟达Vera Rubin首测:DeepSeek吞吐量暴涨30倍,Token成本暴降35倍
[AI 算力 / 半导体] · ⭐⭐⭐⭐⭐ · 华尔街见闻
英伟达首次公布Vera Rubin NVL72片上实测数据,搭配DeepSeek-V4-Pro跑Agent编码任务,较GB300每兆瓦吞吐量最高飙升30倍,Token成本暴降35倍。同日,专为Agent设计的Vera CPU已被SpaceXAI规模化部署,并计划2028年送上太空。
| ✅ 已确认 | ⚖️ 尚属判断 |
|---|---|
| 英伟达首次公布Vera Rubin NVL72片上实测数据,搭配DeepSeek-V4-Pro跑Agent编码任务。 | Vera Rubin的实际量产时间表尚未明确。 |
| 较GB300每兆瓦吞吐量最高飙升30倍,Token成本暴降35倍。 | 30倍吞吐量提升是否能在真实负载下复现,仍需第三方验证。 |
| 专为Agent设计的Vera CPU已被SpaceXAI规模化部署。 | SpaceXAI部署的具体规模和应用场景未披露。 |
| Vera CPU计划2028年送上太空。 |
📖 主编点评
你应该关注Vera Rubin的架构创新,特别是其针对Agent任务的优化。这可能是下一代推理芯片的标杆,对你做Agent产品有直接参考价值。建议仔细研究其技术博客,理解其如何实现如此大的吞吐量提升,或许能启发你在RAG或推理优化上的思路。
📺 打开原文
📋 备选阅读
- Nvidia AVO scores 100% on the ARC-AGI-3 interactive reasoning benchmark —— 英伟达AVO在ARC-AGI-3上取得100%成绩,但该基准的权威性存疑,且尚未有第三方验证。 NVIDIA AI
- Nvidia customers notified about AI-related price hikes above 15% —— 英伟达通知客户涨价超15%,影响Grace Blackwell和Vera Rubin系统,反映存储成本压力。 Reuters
- Hot Chips 2026: Intel Xeon 7 'Diamond Rapids' comes with up to 256 P-cores, 1.28 GB of last-level cache —— Intel下一代Xeon Diamond Rapids曝光,256核和1.28GB缓存,但离上市还早,适合关注。 Tom's Hardware
- SK hynix pushes hybrid bonding to HBM5 as AI memory hits 775-micron ceiling —— SK海力士将混合键合推迟到HBM5,HBM4E仍用MR-MUF,影响AI内存路线图。 Tom's Hardware
💬 觉得 AI 算力 / 半导体 这期怎么样?
提一条反馈 Issue 让 Agent 下次调整。