值得读的 7 条
2026 年 8 月 23 日 · 周日 · 第 475 期 · 约 2 分钟
本期头条
8.17—8.23|本周 AI 论文精选
给做智能体训练的人:七篇里只有第 1 篇给了可复现的省钱路径(3500 行代码、6K 样本、41.8%→56.4%),其余是基准刷分;周报本身不筛,得自己翻。
微软提出端点代理方案,用约 3,500 行代码将任意框架接入强化学习,在 SWE-bench Verified 上将 Qwen3.5-9B 从 41.8% 提升到 56.4%;论文指出技能触发瓶颈,56,804 个公共技能争夺不到 100 个触发槽位。
万字长文|Codex 从入门到精通
给第一次用 Codex 的人:界面四区、三种工作区、Plan 与权限的取舍都讲清了,但正文在权限三档处截断,后半的扩展功能部分看不到;适合第一次打开 App 的人按图索骥。
Codex 斜杠命令完全指南:别再只会 /model 和 /status
给重度使用 Codex CLI 的人:19 条里真正值得记的是 /goal 和 /memories,其余多是菜单操作。
给我 10 分钟,我教你掌握 Claude Code 的 80%。
给非技术背景的内容创作者:作者是营销人员而非开发者,173 天实践后给出的是内容业务工作流。
从零开始,搭建你的 Harness,定制化懂你的 Agent
给想自建 Harness 的人:better 的 34 项体检和可复制修复提示词是唯一硬交付物,其余两个 Skill 是常规脚手架。
从零开发一个 DeepSeek Harness 插件
给想给 dsh 写插件的人:教程给了可直接复制的代码和命令,但正文在打包步骤处截断,发布部分看不到;配置化那段「fail loud」的坑值得记。
第一性原理拆解:生图提示词究竟该怎么写?
给常做一次性配图的人:9 维排查表是核心交付物,但作者明说多数场景先补 5 项即可;反推提示词的提示词可直接复制,适合想复刻别人图的人。
这一期的 7 条,到这儿全了
顺着这一期的「Claude Code」,共学里有一篇
《从 0 到 1 手搓一个 Claude Code:核心机制、版本演进与 Skill 实战拆解》→