跳到正文

领域

大模型

321 条 · 2025 年 5 月 5 日 2026 年 9 月 3 日

这个领域还有 夜校 2 讲

夜校课2 讲全部课程 →

第一课

从会用 AI 到会造 AI:第一课,先搞懂 AI 是怎么帮你干活的

这是「AI 开窍计划」系列的第一课。讲师天锦从普通人使用 AI 的真实困惑出发,讲清楚提示词、上下文、模型、智能体这些概念到底是什么,以及它们如何帮你真正把活儿干成。课程还给出了一个写提示词的五步框架、一套让 AI 写稿的完整流程,以及课后作业:找出你所在行业里想用 AI 解决的 5 个问题。

直播回放 · 章节跳转

第二课

从写好一段提示词开始,成为你行业里的 AI 专家

这节课讲清楚了三件事:提示词分哪几种、系统提示词怎么写、以及如何科学地迭代它。讲师给出了可直接套用的写作模板和迭代方法,也解释了为什么“懂行业 + 会 AI”的人在未来最值钱。听完你能带走一套写提示词的具体步骤,以及一个判断自己是否在进步的标准。

直播回放 · 章节跳转

日报条目321 条

2026-08-23

8.17—8.23|本周 AI 论文精选

微软提出端点代理方案,用约 3,500 行代码将任意框架接入强化学习,在 SWE-bench Verified 上将 Qwen3.5-9B 从 41.8% 提升到 56.4%;论文指出技能触发瓶颈,56,804 个公共技能争夺不到 100 个触发槽位。

2026-06-07

5.31-6.7|本周顶尖 AI 论文

MIT 提出范畴论框架将发现定义为表征体系修订,388 个候选仅 25 个被接受;Google LEAP 在 Putnam 2025 解出全部 12 题,Lean-IMO-Bench 单次形式化解题率从低于 10% 提升到 70%。

2026-04-07

解码 Transformer 架构

逐块拆解 Transformer 的编码器与解码器,覆盖 Tokenization、Embedding、Positional Encoding、Attention 与前馈网络;以 Q、K、V 点积与缩放点积注意力解释注意力机制。

2026-04-05

本周 AI 论文精选

Anthropic 在 Claude Sonnet 4.5 中识别出 171 个情绪概念向量,可因果影响模型行为;Google DeepMind 提出 AI Agent 陷阱框架,隐藏式 prompt 注入在 86% 场景可部分劫持 agent。

2025-10-01

DeepSeek 又一次引领世界

V3.2-Exp 通过 DSA 稀疏注意力将推理成本从平方级降至接近线性,H800 集群测试成本曲线斜率仅为平方级的 1/20;对比 Gemini 2.5 Pro 与 Claude Sonnet 4.5 对超长上下文加价,DeepSeek 实现了顶级模型未做到的线性成本推理。

2025-08-08

GPT 5 共测

旗舰版 gpt-5 在 SWE-bench Verified 得分 74.9%、Aider polyglot 88%,支持 40 万 token 上下文;gpt-5-mini 成本为旗舰版 1/5,SWE-bench 71.0%。

2025-06-18

xbench 评测集正式开源

红杉中国开源 xbench-ScienceQA 与 xbench-DeepSearch 两个评测集,前者平均正确率仅 32%,后者专测 Agent 深度搜索能力;均采用黑白盒机制防过拟合,每季度更新。

2025-05-26

今天,我们推出 xbench

红杉中国推出双轨评估体系,分 AGI Tracking 与 Profession Aligned 两条主线;首期发布 xbench-ScienceQA 与 xbench-DeepSearch 两个评估集,并给出综合排名。

2025-05-17

Grok 系统提示词

xAI 于 5 月 16 日开源 Grok 全系系统提示词,涵盖聊天助手、DeepSearch 与 X 平台分析模块;提示词仓库地址为 github.com/xai-org/grok-prompts。