笔记
关于我所交付的 AI 系统背后方法论与架构决策的短文——规约、评估、多智能体编排、LLM 集成,以及调度编程智能体的纪律。
2026年6月19日
搜索不再给你送流量了
Google AI Mode 现在基于 Gemini 3.5 Flash 直接在页面里给出答案,点击正在蒸发:一项研究发现,在出现 AI 答案的访问中,人们只在大约 8% 的情况下点击链接,而没有 AI 答案时大约是 15%。如果没人点进来,排第一也没什么意义。游戏正在从「在页面上拿排名」转向「成为答案所依据的来源」。
- ai-native
- business
2026年6月19日
瓶颈搬到了电网
OpenAI 与 NVIDIA 敲定了 10 吉瓦、又与 AMD 敲定了 6 吉瓦;一座 Stargate 数据中心刚在密歇根获批 1.4 吉瓦,无视当地居民的强烈反对。AI 的约束早就不再是模型了。它是电力、土地,以及围绕二者的政治。这重新定义了效率值多少钱,而这正是支配着远比数据中心小得多的系统的同一条规律。
- architecture
- ai-native
2026年6月19日
你的模型只有六周保质期
本月在短短两周的窗口里,行业就发布了 Claude Mythos 5、GPT-5.6、Gemini 3.2,以及一整面墙的中国前沿模型——Qwen 3.7、DeepSeek V4.1、GLM-6 等等。新的前沿模型如今大约每六周就按节拍器般落地。如果你产品的优势是「我们用最好的模型」,那这个优势比一个季度还快过期。这篇讲讲如何为移动的靶子去搭建。
- ai-native
- architecture
2026年6月15日
一天烧掉 1500 万美元的应用
OpenAI 打造了史上炒作最猛的 AI 视频应用,半年后却悄悄把它关停。据报道,Sora 每天在算力上烧掉约 1500 万美元,而总收入只有约 210 万美元——不是每天,是总共。人们爱它,可它在每一个片段上都在亏钱。这是传统软件从没教过我们的一课:生成式功能每被人用一次都有真实成本,而「火爆」治不好「每次使用都亏钱」。这里教你在自己的 AI 功能重蹈覆辙之前先做一次检查。
- business
- ai-native
2026年6月15日
小众模型击败巨头
Salesforce 刚刚花 36亿美元 买下的那个智能体,跑的并不是花钱能买到的最大、最聪明的模型。它跑在 Apex 上——一个为单一任务(客户支持)打造的更小的模型,Salesforce 说它在真正解决工单这件事上胜过顶级的前沿模型。这个细节比那个价签更值钱。对于一个狭窄、定义明确的任务,专门为它训练的模型可以击败一个什么都懂、什么都不精的通用巨头。下面讲讲为什么伸手去抓最大的模型,通常是错误的本能。
- ai-native
- business
2026年6月14日
AI 智能体刚刚拿到了你的信用卡
2026 年 6 月 10 日,Visa 把自己的支付网络直接接进了 ChatGPT。现在,AI 智能体可以替你在任何接受 Visa 的商家购物并付款——挑选商品、走完结账、把账结清——用的是一份专门授权给该智能体的凭证,带着你事先设好的额度上限和商家限制。麦肯锡认为,到 2030 年,智能体驱动的购物可能占到一万亿美元的美国零售额。过去两年,智能体只能推荐;现在,它们能花钱了。当软件握住那张卡时,到底有什么变了,以及在你把卡交出去之前该问的那一个问题,本文一一道来。
- business
- ai-native