AI 周报 · 自动抓取生成
Yunumi AI 周报
每周从技术社区(掘金 · CSDN · 知乎 · Hacker News · arXiv)与「全球12亿文献知识库」学术文献库自动抓取,经智能筛选后整合为结构化周报,推送给订阅用户。
本周要点
一眼看本周发生了什么
01
后训练成为新杠杆:DeepSeek-V4-Flash 正式版架构一字未改,仅重做后训练,Terminal Bench 2.1 得分从 61.8 跃至 82.7。
02
价格进入正面战场:OpenAI 将 GPT-5.6 Luna 下调 80%,DeepSeek 用 98% 缓存命中折扣把单任务成本再压低约 60%。
03
全模态生成同日开火:MiniMax H3 与字节 Seedance 2.5 同天发布,2K 视频价格降至同类旗舰的三分之一。
04
开源边界从权重扩到训练系统:Kimi 把 MoonEP、FlashKDA、AgentEnv 一并放出,训练门槛整体下移。
分类速览
新闻 · 技术 · 论文
每条均附一句话价值与原文链接。本期论文侧来自 arXiv 公开检索,「全球12亿文献知识库」因凭证未绑定暂未接入,下期恢复。
新闻动态
模型
DeepSeek-V4-Flash 正式版上线,Agent 能力大幅跃升
2840 亿总参数、130 亿激活、1M 上下文,架构与预览版完全一致,仅重新后训练便在 9 项 Agent 基准整体超过 GLM-5.2 并逼近 Opus 4.8。
阅读原文
商业
OpenAI 降价 80%,月活破 10 亿、7 月 ARR 创新高
GPT-5.6 Luna 价格下调 80%、Terra 下调 20%;平台活跃用户达 10 亿、服务超 200 万家企业,第三方测算 7 月 29 日 ARR 约 426 亿美元。
阅读原文
融资
月之暗面完成 35 亿美元 F 轮,G 轮提前启动
投后估值 350 亿美元,因超募三倍提前关轮,Pre-IPO 轮投前估值升至 500 亿美元,开源模型开始反向定价一级市场。
阅读原文
多模态
MiniMax H3 与字节 Seedance 2.5 同日发布
H3 是 MiniMax 首款开源多模态生成模型,2K 视频 0.8 元每秒约为同类旗舰三分之一;Seedance 2.5 单次直出 30 秒连贯长视频。
阅读原文
技术实践
基础设施
Kimi K3 同步开源三项训练 Infra
MoonEP 解决超大细粒度 MoE 的不均衡专家并行通信,FlashKDA 在 H20 上把 prefill 提速 1.72 至 2.22 倍,AgentEnv 提供可快照、可分叉的 Agent 训练沙箱。
阅读原文
蒸馏
DeepSeek V4 蒸馏进 GPT-OSS-120B,性能保留
金融推理基准 FinanceReasoning 拿到 83.61% 超过同类,实验还发现教师模型的审查特性并未随能力一起迁移,为自建垂直小模型提供新路径。
阅读原文
具身智能
Gemini Robotics 2 控制人形机器人全身运动
控制范围从上半身扩展到脚尖与指尖,配合 ER 2 强化物理世界理解、多步骤规划与工具调用,大模型开始直接接管连续控制回路。
阅读原文
论文精选 来源:arXiv 公开检索
鲁棒性
扩散语言模型的鲁棒性被高估(arXiv:2607.27386)
DLM 天然抵抗梯度对抗后缀,却对自然噪声毫无保障且系统性过度自信;错误根源被定位到解码器路由失败,提示词层面的补丁无效。
阅读原文
失效机理
大模型翻车是可预见的工程风险(arXiv:2607.25279)
把有害与重复输出解释为 token 间多体相互作用引发的首次通过跃迁,给出有限层阈值预测,为 AI 事故的责任认定提供可建模依据。
阅读原文
Agent 记忆
MemHarness:记忆靠重构,不靠回放(arXiv:2607.28272)
把 Agent 长期记忆从检索回放改为按需重构,为长时程任务的记忆一致性给出新的评测框架与实现路径,呼应本站「AI Agent 编排」模块。
阅读原文
历史归档
往期周报
第 32 期
2026-07-28 ~ 2026-08-03
当前一期
第 31 期
2026-07-21 ~ 2026-07-27
阅读
第 33 期
2026-08-04 ~ 2026-08-10
生成中…
每周日 20:00,自动推送新一期
留下邮箱,周报与新课提醒准时送达。随时退订,绝不打扰。
我们重视你的隐私,邮箱仅用于周报与课程通知。