在 AI 的噪音里,只留下
值得读完的。
人工挑选文章、视频与播客。翻译、梳理,也保留判断。
今日精选
全文翻译Stripe 如何在 Deep Agents 上造出全公司通用的 AI Agent —— Kai
Stripe 的 AI 平台团队基于 LangChain/LangGraph 与开源 agent harness Deep Agents 造出面向全公司的生产力 agent Kai。四层架构、三个关键中间件、联邦式 skills,1 名工程师 1 周做出首版,4 周从 296 人涨到 5000+,今…
最新精选
全文翻译Harness Handbook:改 Agent 的脚手架,先得找对地方
解读腾讯混元 Harness Handbook:把 agent 脚手架仓库按运行时行为重组为 L1-L3 手册,通过 BGPD 渐进披露做行为定位,配自动重同步。弱规划器带手册后定位 F1 全面追平 Opus 4.8/GPT-5.5 参…
Gated DeltaNet:给线性注意力装上一块会忘、会改的记忆
本文解读 Gated DeltaNet 如何把 Mamba2 式全局门控衰减与 DeltaNet 式定点改写合进同一条状态更新规则,并用分块并行保留 GPU 训练效率。
Anthropic 如何保护其 AI 原生软件开发生命周期
Anthropic 分享 AI 原生软件开发生命周期的安全实践:把安全前移到生成阶段,用身份与权限硬边界限制影响半径,并用多智能体评审、确定性工具和人工审批共同守住高风险关卡。
全文翻译为 Codex 定制代码审查规则
OpenAI 分享 Codex Code Review 如何读取 AGENTS.md 中按目录生效的规则,并把兼容性要求与数据边界转化为可引用的审查发现。
Think harder:提示词和 reasoning 档位是怎么互相作用的
一组可复现实验:提示词里的 think hard / keep brief,如何覆盖 low、high、max 等 reasoning effort 默认档位。
B站译制Don't Ship Skills Without Evals — Philipp Schmid, Google DeepMind
Philipp Schmid(Google DeepMind)关于发布 skills 前必须先做 evals 的分享;B站译制版已挂载。
全文翻译构建经得起时间考验的软件
从旧金山房租、淘金热与东京地铁的城市类比切入,讨论为什么大量代码是填埋垃圾、什么样的软件能像基础设施一样长期产生复利价值。X 长文翻译。
视频总结你不需要记住一切——艾伦·卡斯特尔谈记忆、学习与成功老化
Huberman Lab 访谈 UCLA 心理学教授 Alan Castel,讨论记忆不是录像机而是选择系统:主动提取、前瞻记忆、习惯断路器、运动和平衡,以及如何把记忆、学习和成功老化从“记住一切”转向“记住有价值的东西”。
视频总结AI 为什么每天醒来都不认识你——Engram 的学习型记忆豪赌
Latent Space 访谈 Engram CEO Dan Biderman,讨论 AI 记忆从“检索上下文”走向“学习型记忆”的路线:Cartridges 如何把反复阅读变成一次预学习,以及企业/个人模型在权限、删除、纠错和治理上的…