跳到正文

值得读的 8

2026 年 8 月 9 日 · 周日 · 第 463 期 · 约 2 分钟

本期头条

GOAI开源项目

500 万奖池,AI 开源玩家集合!GOAI 世界人工智能开源大赛已开启

想冲奖的 AI 开发者报名截止 8 月 16 日,距今天只剩一周;四赛道里 Agent 基础设施和具身智能的竞争密度通常低于应用层,冲奖可优先考虑。

总奖池 500 万元,四大赛道覆盖 Agent 基础设施、智能体应用、AI for Research 与具身智能;初赛作品提交截至 8 月 16 日。

CY:从零训练到真板运行:我们怎样把中文模型放进 ESP32

想在 ESP32 上跑端侧模型的人从随机参数到真板跑通的全链路教程,含数据组织、量化、C 运行时细节;质量检查 34/41,属开发验证版,正式发布前可先收藏。

783 万参数模型在 8 MB PSRAM 的 ESP32-S3 上离线运行,真板生成回答耗时 1.5–2.25 秒;训练数据 5,920 条,覆盖 55 条原子事实,质量检查 34/41 通过。

领域开发形态教程

8.3—8.9|本周 AI 论文精选

做智能体训练的人七篇里只有 Harness-R1 给了可复现的省钱路径,其余是基准刷分或成本警示。

本周论文覆盖智能体评测、记忆栈、反思采样、运行壳工程等方向;Harness-R1 用 9B 工程师模型将 Qwen3.5-9B 在 WebShop 等基准上从 44.3% 提升到 53.6%。

领域行业动态形态合集

一晚两场,H3 技术团队和全球开发者聊了什么?

用 H3 做长视频的人官方首次正面承认 Ref2VA 对 reference 质量敏感,这是长视频续写最硬的短板。

H3 稀疏注意力接近 MoBA,默认只对视频 token 做 3D sparsification;Ref2VA 对 reference 质量敏感,长视频续写依赖 reference-conditioning。

领域大模型形态活动署名MiniMax

阿 K:开源 4 天就被“速通”?MiniMax H3 这场 Reddit AMA 到底聊了啥?

本地跑 H3 的开发者AMA 里官方承认长视频续写未解决,2K 是再生成而非超分;社区蒸馏 LoRA 已把步数压到 1/5,但 4 步牺牲稳定性。

H3 权重开源后社区 4 天即出现蒸馏 LoRA,采样步数从约 20 步压到 4~8 步;官方确认 2K 版本将开放,并透露正基于 H3 底座开发统一图像模型。

领域大模型署名阿k灵感库

小歪:阿里 Wan3.0 来了,我立马测了 5 大类场景,丢文档、网页居然也能生视频

做办公素材转视频的人公测通稿的实测续篇,5 类场景里网页和 Excel 输入是别家没有的差异点;但正文只给了提示词和成片,没有失败案例,别当评测看。

单条最长 30 秒,可直接读取网页链接及 Word、Excel、PPT、PDF、Markdown 文件生成视频;实测覆盖网页科普、Excel 数据汇报、产品演示、多图参考等 5 大类场景。

近 7 天另有 1 条提到「Wan3.0」,在 08-06

领域视频生成署名教AI的尹小歪
Hell GrindHiggsfield开源项目

小歪:95 分钟 AI 电影,把每个镜头的提示词都公开了(附电影级提示词 Skill)

做 AI 视频的人公开的提示词和 Skill 可抄,但别整段复制,挑运镜、灯光、动作三句换内容;22 节课是官方配套,值得看。

项目公开了 11 万多条生成记录,每个镜头的提示词和参数都可查看;官方附带了 CINEDANCE HIGGSFIELD SKILL.md 提示词规范。

领域视频生成形态教程署名教AI的尹小歪

我用 AI 做了一款可以玩的文物游戏,并分享完整工作流

想做 AI 互动游戏的人最值钱的是「部署选腾讯云 CloudBase 免费额度」这个踩坑结论。

游戏基于真实文物参考生成题目图片,部署从 Cloudflare 迁移到腾讯云 CloudBase 免费额度;开场视频用 Seedance 2.0 生成,音乐用 flow music 生成。

近 7 天另有 2 条提到「Seedance 2.0」,分别在 08-0708-05

领域产品署名沉默者之二

这一期的 8 条,到这儿全了

更新的一期在 08-10