卡尔:告别 AI 视频反复抽卡,Seedance 2.5 + 3D 预演台才是正确的打开方式
updream 预演台可上传参考图自动生成带深度的 3D 白模,支持人物、机位、轨迹与关键帧调度;粗粒度白模用于控空间与运镜,细粒度白模可把视频模型当渲染器。
updream 预演台可上传参考图自动生成带深度的 3D 白模,支持人物、机位、轨迹与关键帧调度;粗粒度白模用于控空间与运镜,细粒度白模可把视频模型当渲染器。
网站收录三年上千条带完整提示语的生成案例,并跨模型交叉验证后抽象成 Skill;首轮横测用 10 万积分对比 Seedance 2.0 Fast、MiniMax H3、Wan 3.0 三个模型。
正文罗列了 Atoll、DockDoor、Raycast、Pearcleaner、Thaw、KeyCastr、Rectangle 等 10 个开源 Mac 工具;每个工具都给出了用途与使用体验。
300 多个 Skill 中仅 22 个需全局常驻,其余降为项目级或触发级;触发态单个 Skill 可省约 89% 启动上下文,最终实际删除 0 个。
搭子 2.0 将 Claude Code 与 Codex 整合为三种身份,支持跨项目模型混编;新增 Goal 哈希校验与证据链小票,两周内将 API 成本压缩一半。
筛选了 GitHub 上 9 个学术科研类 Skill 并分五档评价;其中 Academic Research Skills 可交叉验证引用防幻觉,Claude Scholar 支持 Zotero 批量文献管理。
开源 TODO Skill「阿福」可扫描 Markdown 任务卡、批量排期并同步 Mac 与飞书日历;支持 DeepSeek 分组建议合并相似选题,安装只需一条命令。
GPT-5.6 分 Sol/Terra/Luna 三档,Sol 上下文 372k、定价比 Fable5 便宜 43.5%;OpenAI 将 Codex 并入 ChatGPT,并计划跳过 5.x 直接发布 GPT-6。
Anthropic 通过时区与 ANTHROPIC_BASE_URL 识别中国用户,7 月 2 日新版本将删除检测代码但部署更强缓解措施;Sonnet5 新 Tokenizer 使 token 数增至上一代 1.4 倍,实际使用更贵。
新增自媒体分区,按热度与时间轴双视图展示某书某音某站某 X 一周热门;官方源头、GitHub 更新日志与 HN 热议合并进同一页面,支持移动端与暗色界面。
Bugu 是 macOS 菜单栏应用,通过音效提示 Agent 的 Accept、Running、Done 等五种状态,支持合盖不休眠;开发中改用 Kimi Code 接手 Codex 未完成项目,利用其六倍速与 goal 模式。
KroWork 可将 Skill 工作流打包为本地 Mac App,支持定时任务与 Siri 配音;作者用其复刻了 Prompt Organizer 和 Daily Trend Brief 两个应用。
Humanize PPT v0.9 将素材按 AST 逻辑编排并输出结构化 JSON 与 Markdown,再交给下游 Skill 渲染;新增演讲模式与质检环节,可修复页码遮挡正文等渲染问题。
ClawHunt 用 Manifest 目录文件规定交付物、输入输出与验收命令,解决 Agent 交付的验证问题;作者实测 Problem #196 任务时踩了四次坑,发现生成结果但未走完验证是 Agent 交付的主要困境。
Claude Fable 5 上线,订阅用户可用至 6 月 22 日;作者用它打磨出开源「鲁班」Skill,并公开了评分回测工具与算法。
OpenSquilla 用 YAML 定义 Meta Skill 步骤与依赖,并在 Runtime 层硬校验,坏依赖会在 Plan Validation 阶段拦截且不产生 API 调用;实测同一任务下输入 Token 压到 67%,成本不到 OpenClaw 的 1/9。
基于微信读书原子能力重组出 carl-weread,按当前问题推荐单章节阅读并生成行动卡片;支持命令行直接打开对应章节,配套 carl-skills 合集一并开源。
开源伯乐 Skill,可判断信息源是否值得追更并选择最稳定的接入方式;支持九类信源类型,默认收录 22 个信息源,7 天观察期内与现有源差异大于 65% 才保留。
整理出 10 个 Claude Code 内置命令与技巧,含 /powerup、/btw、双击 ESC、Hook、/loop 等;/btw 复用提示缓存几乎不耗 token,/loop 任务七天后自动过期。
给出 OpenClaw 安全加固与 Skills 安装清单,含端口 18789 封禁与 GATEWAY_TOKEN 设置;推荐 tavily-search、self-improving、qmd 等 10 余个 Skills 及安装命令。
总结 Seedance 2.0 的 9 种商用玩法,含追热点、商业广告、穿搭变装、直播带货等;提示语已整理成文档,公众号回复 S2 获取。
KimiClaw 提供一键部署与关联已有 OpenClaw 实例两种接入方式,自动配好 K2.5 Thinking 与 Kimi Search;正文给出 YouTube 定时抓取、目标管理、邮件过滤等 5 类可复制的提示词与配置。
Seedance 2.0 支持图像、视频、音频、文本四种模态输入,混合输入上限 12 个文件;仅提供图片参考时消耗积分比同时提供图片和视频素材少一半。
推荐用 Parallels Desktop 装 macOS 虚拟机部署 Clawdbot,避免 Mac Mini 与云服务器成本;安装后接飞书需改长连接并添加四个事件。
OpenRouter 的 API 可用支付宝购买,支持将 OpenAI、Anthropic 的 Key 存入使用;Claude Code 的安装与配置可交给豆包助手完成。
CES 2026 最佳 AI 奖颁给英伟达 Rubin GPU,3360 亿晶体管,同等延迟下每百万 token 成本降至十分之一;榜单还涵盖摩托罗拉 Qira、Pebble Index 01 录音戒指等 24 个产品。
给出可复制的 Grok 定时任务提示词,按点赞数筛选 X 平台 24 小时高互动帖子;支持在 Grok Tasks、元宝和 Manus 上定时运行。
作者统计全年 AI 工具花费近十万,列出年度爱用模型、生图、视频、编程等各领域工具;Gemini 3.0 Pro、GPT 5.2 Thinking、DeepSeek 等被重点提及。
12 个场景横测 GPT Image 1.5 与 Banana2,中文与知识类任务明显落后;生成速度提升四倍,但风格化与多图融合表现平平。
GPT-5.2 在 AIME 2025 满分、ARC-AGI-2 达 52.9%,API 涨价 40%;实测中 thinking 与 pro 后缀存在降智现象,无后缀版抽卡效果更佳。
Nano Banana Pro 可通过 Discord 频道 lyra-chat 免费体验,Gemini 3 Pro 需 Pro 账号并打开 Canvas;Gemini 3 Pro 在 MathArena Apex 从 0.5% 涨至 23.4%,LiveCodeBench Pro Elo 达 2439 超过 GPT-5.1。
Veo3.1 新增首尾帧与多图参考功能,可迁移创意玩法;作者在 lovart.ai 薅到一个月免费 Veo3.1 fast 和 Sora2 额度,跑了一百多个视频总结出 10 种玩法。
内置 POINT、GROUNDING、ZOOM、ROTATE 四种图像工具,支持八倍放大与二次裁剪;与 GPT5-thinking 对比,在找不同、旋转文字识别等任务上准确率更高。
Sora2 输出 10 秒 360p 视频,支持图片输入但不支持参考视频;Cameo 身份验证可用中文念数字通过。
实测 8 个场景,微表情、大动作与运镜均一条过;新增 2-8 秒时长自由选择,支持闪电大片与电影大片两种模式。
原生 4K 直出中文海报,复杂排版与高密度信息下文字位置准确;支持风格复刻、批量生成同风格海报与产品一致性广告图。
Seedream 4.0 支持中文提示语、2K 输出与比例自定义,人脸一致性表现突出;与 Nano Banana 同提示语对比,中文海报与多图参考能力更优。
Nano Banana 已正式改名自 Gemini 2.5 Flash image,API 价格便宜;文章汇总 10 种配合首尾帧视频的玩法,并给出 7 种免费使用方式中成功率最高的一种。
新 R1 在代码生成、中文写作、思考时长上明显提升,性能达 Claude3.7 水准;OpenRouter 已上线免费 R1-0528,无需担心服务器繁忙。
Claude4 发布会实测:Opus4 编程跑分超 o3 与 GPT-4.1,API 价格不变;Claude Code 支持本地命令行与 GitHub 运行,API 提示语缓存延长至 1 小时、成本降 90%。
Gemini 2.5 Pro 新增 Deep Think 模式,Ultra 用户可用;Veo3 支持原生音频,仅限 Ultra 用户。