今天 a16z 投资合伙人 Fabrizio 的这篇长文很火,直译为《AI 现在能自如使用电脑了吗》。
他花了一年观察那些能真正“用电脑”的 Agent,比如开浏览器、点按钮、填表、跨系统搬数据等在真实企业里的落地情况,结论很明确:
这类 Agent 已经从演示走到了能规模化干活的阶段,成本甚至开始低于把后台业务外包给印度老哥了。
其中一个观点很有见地,模型不是护城河,真正的瓶颈是"上下文",agent 得先学会一家公司到底怎么干活。
买家几乎不关心底层用的是谁的模型,只关心能不能 7×24 稳定省人。
同时,这个文章的视角也很西方;和国内 AI 自动办公的生态,是两种完全不同的思路。
西方在做的更像是“外包替代”,即用 Agent 去取代原来外包给印度的那些重复点击工作;
在国内,这个场景更接近“原生嵌入”,自动化办公已经是一整条赛道。
比如,西方 agent 最大的痛点是"上下文",它得先搞懂一家公司的流程才能干活;
而中国的办公软件如钉钉、飞书、企微这些系统从第一天起就是结构化的,审批流、表格、数据库天然打通。
数据从第一天就在表格里,"上下文"成本或许比西方低一个数量级。一个更典型的例子是腾讯的 Workbuddy 打通自家的文档、微信分享、知识库管理等多种软件。
而Coze 等各种垂直办公 Agent也在快速追赶,方向也是类似的,即把“人在办公系统和 AI 之间当搬运工”这件事给彻底消掉。
在这个方向上,模型质量可能并不是唯一需要考虑的因素了,一个全家桶生态和友好容易上手的界面可能更关键。