值得读的 8 条
2026 年 3 月 28 日 · 周六 · 第 336 期 · 约 2 分钟
本期头条
3 月 28 日直播回放 + 纪要|未来硅世界第 13 期:对谈 Happycapy 创始人,从创意到推广的心路历程
Happycapy 14 天上线、99% 代码由 AI 编写;产品使用 Quark 内核,内置 30 万 + skills,支持 Connect My Mac 云端操作 Mac。
甲木:飞书 CLI 开源了,我用 Claude Code 玩转几大企业级场景
飞书 CLI 于 3 月 28 日开源,支持 npm 安装与 skills 配置;Claude Code 等 Agent 可原生操作飞书日历、文档、群聊与任务。
52 天 74 个发布!Anthropic 打造出了 AI 时代最疯狂的团队!
52 天内发布 74 次,含两个新模型、桌面 Agent 平台 Cowork 及二十多个 Claude Code 功能更新;Anthropic 工程师 60% 的工作由 Claude 完成,Cowork 从零到发布仅用 10 天。
Notion 联合创始人 Simon Last:我从去年夏天起就没写过一行代码了
Notion 的 AI harness 约每六个月推倒重写一次;Simon Last 个人纪录是一个编码 Agent 连续运行 13 天。
Cognition 联合创始人:AI Agents 如何创造 12 倍的生产力提升丨 Joe Lonsdale
Cognition 工程师已不打代码,管理 Devon 一小时抵得上亲自干六到十二小时;客户今年前两个月 Devon 使用量超过去年全年。
10 个 Claude 工作流,每周为我节省 10 多个小时。
每周可节省 11.4 小时,每月超过 45 小时;工作流基于 Claude 网页端 Pro 版,不使用 API 或 Claude Code。
我们如何为 Deep Agents 构建评估体系
评估体系以准确性为先、效率次之,用理想执行路径对比实际轨迹;评估在 CI 中用 pytest 与 GitHub Actions 运行,并已随 Deep Agents 仓库开源。
从 Prompt 到 Context 到 Harness:AI 工程的三次范式转移,第三次正在发生
Anthropic 用评估器 Agent 迭代 5-15 轮,6 小时 200 美元交付完整游戏;OpenAI 五个月零手写构建百万行代码,依赖分六层用 linter 强制。