🤖 AI · 2026-08-03

Curio · AI · 2026-08-03

📖 主编点评

今日 2 条头条 + 5 条备选

今日全球市场被AI去杠杆主导:韩国股市暴跌触发熔断,存储芯片股重挫,但阿里发布千问3.8-Max开源模型,性能对标Anthropic Fable 5,成为罕见亮点。同时,SpaceX首份季报明日发布,或成AI股风向标。建议关注算力链风险重定价与国产模型突破。


🌟 今日精选

1. 阿里发布千问3.8-Max:2.4万亿参数开源,性能对标Anthropic Fable 5

[AI] · ⭐⭐⭐⭐⭐ · 华尔街见闻

阿里巴巴今日发布千问3.8-Max,参数规模达2.4万亿,是千问家族最强模型,也是首个开源Max级权重版本(下周发布)。API定价输入2.0美元/百万tokens、输出6.0美元/百万tokens。基准测试显示其编程与通用智能体能力与Anthropic Fable 5相当,部分指标超越,并在芯片设计、量化研究、电商模拟等长程任务中展现出显著的自主执行能力。

✅ 已确认 ⚖️ 尚属判断
千问3.8-Max参数规模2.4万亿,为千问家族迄今最强模型 开源版本是否完全开放权重尚待确认,可能有限制
API定价输入2.0美元/百万tokens,输出6.0美元/百万tokens 与Anthropic Fable 5的对比基准是否全面、有无 cherry-picking 未知
基准测试显示编程与通用智能体能力与Anthropic Fable 5相当,部分指标超越 长程任务表现是否能在实际应用中复现,需进一步验证
在芯片设计、量化研究、电商模拟等长程任务中展现出显著的自主执行能力 2.4万亿参数的推理成本与部署门槛是否可控,尚不明确
下周将发布开源Max级权重版本 开源后社区生态能否快速跟进,形成实际影响力,仍需观察

📖 主编点评

这是你该立刻试用的模型:2.4万亿参数开源且API价格不高,直接对标Claude级别。建议下周权重开放后,在你的content-curator项目里跑一遍长程任务,比如自动抓取、摘要、生成报告,对比Claude Code的实际效果。如果编程能力真的接近Fable 5,你完全可以把它接入Claude Code作为替代后端,省下不少API费用。

📺 打开原文


5. DeepSeek V4 Flash实测:接入Claude Code连续开发7个项目,接近Opus 4.8?

[AI] · ⭐⭐⭐⭐ · AI超元域

DeepSeek 发布了 DeepSeek V4 Flash 0731:284B 总参数、13B 激活参数、100 万 Token 上下文,官方基准表现接近 Claude Opus 4.8。UP主实测接入Claude Code后连续开发7个项目,对比Kimi K3,优点和缺点都藏不住了。这是目前最便宜的国产模型之一,但真实性能如何?

✅ 已确认 ⚖️ 尚属判断
DeepSeek V4 Flash 0731发布,284B总参数、13B激活参数、100万Token上下文 官方基准是否全面,需独立验证
官方基准表现接近Claude Opus 4.8 实测中具体性能表现如何,需看视频细节
UP主实测接入Claude Code连续开发7个项目 与Claude Opus 4.8的差距在哪些任务上,未知
与Kimi K3对比,优缺点明显 100万Token上下文的实际可用性,待测试
是目前最便宜的国产模型之一 价格优势能否弥补性能短板,需权衡

📖 主编点评

这可能是你vibe coding的性价比之选。DeepSeek V4 Flash价格极低,如果实测接近Opus 4.8,你完全可以用它跑日常开发任务,省下大笔API费用。建议看完整视频,重点看它在长上下文和复杂任务上的表现。如果可行,把它接入你的Claude Code工作流,作为低成本备选。

📺 打开原文


📋 备选阅读


💬 觉得 AI 这期怎么样?

提一条反馈 Issue 让 Agent 下次调整。

📝 本期反馈

下次 Agent 跑前会读这段,用来调整搜索关键词、打分倾向。

未提交