AI 周报 · 历史归档
Yunumi AI 周报
每周从技术社区(掘金 · CSDN · 知乎 · Hacker News · arXiv)与「全球12亿文献知识库」学术文献库自动抓取,经智能筛选后整合为结构化周报,推送给订阅用户。
本周要点
一眼看本周发生了什么
01
Kimi K3 全面开源,2.8 万亿参数成为全球最大开源模型,Arena 编程榜登顶,成本仅为头部闭源 1/3。
02
四大实验室同周发布:Grok 4.5、Claude Opus 5、GPT-5.6、Kimi K3 同台,性能差距显著收窄。
03
GLM 5.2 开源登顶 SWE-Bench Pro,首个在智能体编程基准上超越 GPT-5 与 Claude 的开放权重模型。
04
竞争焦点转向成本效率:模型公司不再只比参数,而是「更低成本提供更强能力」。
分类速览
新闻 · 技术 · 论文
每条均附一句话价值与原文链接,论文来源标注为「全球12亿文献知识库」。
新闻动态
开源
Kimi K3 全面开源,2.8 万亿参数登顶编程榜
全球最大开源模型,单位算力产出提升约 2.5 倍,运行成本约为闭源 1/3。
阅读原文
发布
OpenAI 发布 GPT-5.6 家族(Sol / Terra / Luna)
分版本覆盖不同能力与成本,Terra、Luna 以约 1/16 成本对标头部闭源模型。
阅读原文
发布
Anthropic 发布 Claude Opus 5
7 月 24 日上线,主打记忆效率新架构,多项推理与编程基准进入第一梯队。
阅读原文
行业
四大实验室同周发布,性能差距收窄
xAI / Anthropic / OpenAI / Moonshot 三周内密集发布,最强与最弱差距为历次最小。
阅读原文
技术实践
开源
GLM 5.2 登顶 SWE-Bench Pro
智谱 744B MoE 以 68.5% 成为首个超越 GPT-5 与 Claude 的开放权重模型,标志开源追上闭环前沿。
阅读原文
生态
本地开源 LLM 生态爆发
Qwen 4.1 32B 登顶 Mac 可跑榜单,DeepSeek R3、Llama 5 405B、Kimi K3 推动服务端前沿,30 天内十款旗舰齐发。
阅读原文
趋势
大模型不再比谁更大
行业从「参数规模」转向「成本效率」,Scaling Law 边际收益下降,单位算力智能产出成为新标尺。
阅读原文
论文精选 来源:全球12亿文献知识库
注意力机制
高效注意力与线性注意力架构
Kimi Delta Attention、Attention Residuals 等混合线性注意力把扩展效率提升约 2.5 倍,是本期开源大模型成本优势的核心。
文献库检索
Agent 安全
智能体安全评测与红队方法
随着 Agent 自主执行成为主流,CyberGym 等安全推理基准与红队协议成为模型发布标配,呼应本站立「安全与对齐」模块。
文献库检索
训练效率
MoE 稀疏激活与 Infra 协同优化
MoonEP、Flash KDA 等训练基础设施开源,使中小算力也能训出前沿模型,降低训练门槛。
文献库检索
历史归档
往期周报
第 32 期
2026-07-28 ~ 2026-08-03
阅读最新一期
第 31 期
2026-07-21 ~ 2026-07-27
当前页面
每周日 20:00,自动推送新一期
留下邮箱,周报与新课提醒准时送达。随时退订,绝不打扰。
我们重视你的隐私,邮箱仅用于周报与课程通知。