笔记
关于我所交付的 AI 系统背后方法论与架构决策的短文——规约、评估、多智能体编排、LLM 集成,以及调度编程智能体的纪律。
2026年7月1日
诚实输掉了 A/B 测试
关于消费级 AI,有一个让人不舒服的真相:用户更喜欢被奉承。2026 年 Science 上的一项研究发现,模型认可用户行为的比例比人类高出约 50%——哪怕用户是错的——而且人们把这些谄媚的模型评为质量更高、更值得信任。于是每一个为参与度而优化的产品,都会漂向说人们爱听的话。如果你反过来为脚踏实地的诚实而构建,你就是在选那个会输的指标。故意选的。这是一个价值观的决定,不是意外。
- ai-native
- business
2026年7月1日
瓶颈已经移动了。你还在优化那个旧的。
三十年来,软件里稀缺的资源是写代码,于是我们把一切都围绕打字速度来优化。AI 让写代码几乎变得免费——而约束悄悄地挪到了验证上:读懂、信任、接受产出。大多数团队从没重组过。他们还在往一个瓶颈已经变成「评审」的漏斗里灌更多水,然后纳闷为什么「更快」并没有让人感觉更快。速度指标在撒谎,因为它们衡量的是那已经不再是瓶颈的另一半。
- methodology
- ai-native
2026年7月1日
语音 agent 终于跨过了延迟这道线
多年来,AI 语音 agent 一直栽在同一件事上:停顿。你说完话之后那半秒的死寂,让每一个电话机器人都感觉像坏了。到了 2026 年,停顿消失了——端到端的语音流式传输、40 毫秒的全新 state-space 语音模型,以及低于 500 毫秒的往返时延,把语音送进了对话感觉真实的那个窗口。模型从来都不是难的部分。难的是时机——而现在时机是一个工程问题,不是一个研究问题。
- ai-native
- agents
2026年6月23日
赢的不是最好的模型,是默认的那个。
ChatGPT 首次跌破 AI 助手市场的 50%,而一年半前还是 65%。Gemini 一路猛涨,最大的原因不是它更聪明,而是 Gemini 是默认选项,内建在 Android 和 Google Workspace 里。对所有做 AI 产品的人来说,这就是那条教训:分发几乎每次都能赢过模型。
- ai-native
- business
2026年6月23日
你赖以构建的工具刚刚被收购了
SpaceX 正在以 600 亿美元股票收购 Cursor——如今许多团队整天泡在里面的 AI 编程工具——就在史上最大规模 IPO 之后几天。这是有史以来对风投支持创业公司的最大一笔收购。对构建者来说,教训不在价签上。而在于:支撑你整个工作流的工具,可能一夜之间换了主人,你应该为此做好准备。
- business
- ai-native
2026年6月19日
Apple 把模型变成了一个设置项
在本月的 WWDC 上,Apple 把 Siri 重建在了 Google 的 Gemini 之上——然后又让你能换成 Claude 或 ChatGPT。地球上垂直整合程度最高的公司,刚刚把 AI 模型变成了一个下拉菜单。这是迄今为止最清晰的信号:模型是一个可替换的零件,而不是护城河——而你也应该完全照这个思路来构建。
- architecture
- ai-native