跳到正文

值得读的 8

2026 年 7 月 31 日 · 周五 · 第 454 期 · 约 2 分钟

本期头条

上个周末,我们和全国 52 城小伙伴们在博物馆玩 AI

想带孩子玩 AI 的家长真正的交付物是线上展厅链接,想学技术路线可看《无锡宝藏》那条。

全国 52 城同步举办,收到 160 多件作品并上线线上展厅;最小创作者 5 岁,作品涵盖网页、视频、海报与 3D 交互。

即梦 Seedance 2.5 视频模型全量上线,周一晚 20:00 锁定 #通往 AGI 之路视频号直播间,来看超全玩法!

做视频生成的人官方通稿,参数与承诺都在;真正的变量是 API 何时上火山方舟,以及 30 秒是否经得起实测。

单段视频生成从 15 秒提升至 30 秒,支持最长 3 分钟超长视频与多轮延长;单次最多支持 50 个多模态参考素材(30 张图片、10 条视频、10 条音频)。

领域视频生成形态新品
MiniMax H3开源项目

MiniMax H3 发布:一款通用的全模态生成模型

自建推理的团队「开源」目前只是一句承诺,权重还没放;可以先记档,现在就改架构为时过早。

全模态生成模型,支持文本、图像、视频、声音统一理解,输出原生双声道音视频,最高 15s 2K;2K 分辨率下每秒价格不到主流模型的 1/3,计划未来几天开放模型权重。

领域大模型形态新品署名BigOnion

DeepSeek-V4-Flash 正式版发布

用 Codex 接 API 的人九项测试全超 V4 Pro Preview 是官方口径,但正文自认与顶级模型仍有巨大差距。

九项 Agent 测试全部超过 V4 Pro Preview,DeepSWE 得分提升 7.5 倍;原生支持 Responses API,并针对 Codex 做了适配优化。

领域大模型形态新品

刘聪 NLP:开源 awesome-open-llms!全网开源模型,一网打尽!

关注开源模型选型的人本月真正值得单独点开的是腾讯混元 Hy3 正式版——295B/21B/256K,尺寸对齐 DeepSeek-V4 Flash 但实测更好。

7 月开源模型以 Kimi-K3 为焦点,具身相关模型明显增多;腾讯混元 Hy3 正式版总参数 295B、激活 21B、上下文 256K。

领域大模型形态合集署名刘聪NLP

向阳乔木:一个产品经理读完 200 篇 AI 论文后,看见了别人看不见的边界

想系统读 AI 论文的产品经理最锋利的一句是「如果你模仿人类,AI 的上限就是人的上限」,其余是深度学习史串讲;三个读论文框架是作者自述,没有方法论细节。

以深度学习发展史为线索,从 GPU、AlexNet 讲到 Transformer 与 AlphaGo Zero;作者提出历史、范式变迁、人的视角三个读论文框架。

领域大模型形态观点署名向阳乔木
awplanet开源项目

awplanets/awplanet:AI 原生 3D 导演工作台与场景创作工具

做 3D 场景或虚拟拍摄的人三种导演模式里手机虚拟拍摄是独一份,浏览器端就能当取景器;但许可证卡得死,商业用要单独授权,先确认用途再动手。

基于 React、Three.js、Vite 与 Electron 构建的 AI 原生 3D 导演工作台;支持游戏、FPV 无人机运镜和手机虚拟拍摄三种导演模式。

领域产品形态新品

Blue:质检 Skill 开源:你的 Listing 在亚马逊眼里,到底能打几分?

亚马逊卖家开源 Skill 直接可用,但打分依赖后台数据,前台跑会降级;作者自述 3 分钟出报告,需自行验证。

基于 CDQ/A9/COSMO/Alexa 四底座给 Listing 打分并输出诊断报告;已开源至 GitHub,支持卖家精灵 MCP 即插即用。

领域Agent形态教程署名Buluu

这一期的 8 条,到这儿全了

更新的一期在 08-01