今日 1 条头条 + 3 条备选
今日最值得关注的信号:Kimi K3 以 2.8 万亿参数成为最大开源模型,在编程基准上超越 Claude Fable 5,但高盛指出中国模型公司开始从价格战转向定价权争夺,市场分化加剧。同时 SpaceX 股价跌破 IPO 价,空头获利 87 亿美元,AI 算力泡沫与地缘风险交织。
🌟 今日精选
1. Kimi K3 实测:2.8 万亿参数开源模型编程能力超越 Claude Fable 5,国产模型跻身第一梯队
[AI] · ⭐⭐⭐⭐⭐ · AI超元域
月之暗面发布 Kimi K3,2.8 万亿参数、100 万 token 上下文窗口,在 Frontend Code Arena 基准上超越 Claude Fable 5。B 站 up 主实测显示其在 Claude Code 中开发 macOS 应用和游戏表现惊艳。高盛点评称这是中国开源模型智能达到全球普及关键点的标志。
| ✅ 已确认 | ⚖️ 尚属判断 |
|---|---|
| Kimi K3 参数规模 2.8 万亿,为目前最大开源模型 | 2.8 万亿参数是否带来推理效率问题?实际部署成本尚不明确 |
| 在 Frontend Code Arena 基准上超越 Claude Fable 5 | 超越 Fable 5 仅限于前端编程基准,其他任务表现待验证 |
| 支持 100 万 token 上下文窗口 | 高定价能否持续?中国模型公司正从价格战转向定价权争夺 |
| API 定价每百万 token 2.3 美元,创中国模型新高 | 开源协议细节未公布,商业使用限制未知 |
| B 站实测显示可接入 Claude Code 完成复杂编程任务 | 与 GPT-5.6 等闭源模型的全面对比尚未有独立评测 |
📖 主编点评
你应该关注 Kimi K3 在 Claude Code 中的实际表现,尤其是前端开发场景。如果你在做 content-curator 项目,可以尝试用 K3 替代现有模型,看能否降低 API 成本。但注意高盛警告:中国 AI 公司估值分化加剧,智谱单日跌 28%,选模型供应商时要考虑其商业可持续性。
📺 打开原文
📋 备选阅读
- GPT-5.6 在 Claude Code 中表现远超 Codex —— Theo 实测显示 GPT-5.6 Sol 版本在 Claude Code 中编程表现显著优于 Codex,但需注意这是第三方测试,非官方基准。 浮生千山路w
- Linus Torvalds 驳斥 Linux 内核反 AI 立场 —— Linus 明确表示 Linux 不是反 AI 项目,AI 工具是有用的,这对 AI 辅助编程在开源社区的接受度是积极信号。 Bruno Ferreira
- DeepSeek V4 满血版最快明日发布 —— DeepSeek V4 性能直追 GPT-5.6,首度引入峰谷计费,价格仅为巨头的七分之一,可能再次引发价格战。 华尔街见闻 API
💬 觉得 AI 这期怎么样?
提一条反馈 Issue 让 Agent 下次调整。