即刻App年轻人的同好社区
下载
App内打开
张一燊
7关注0被关注0夸夸
张一燊
1月前
Agent 还不会真正工作:八个尚未解决的底层问题

"Agent 能不能真正工作"这个问题,拆开来看其实是八个更具体的子问题:它能不能记住过去、理解世界、正确使用工具、做出靠谱的计划、稳定地把事情做对、和别的 Agent 好好配合、在工作中持续变强,以及在多大范围内可以自己做主。这八个问题分处不同层次,但共同决定了一个 Agent 距离"能被托付一份工作"还有多远。

一、长期记忆:记住不等于会用

今天大部分 Agent 的"记忆"本质上还是一种补丁式的工程方案——把过去的对话或事实抽取出来,存进向量数据库或知识图谱,下次需要的时候再检索、拼回 Prompt 里。这解决了"记不住"的表面问题,却没有解决"怎么记、记什么、什么时候忘"这些更深的问题。

行业研究普遍指出,当前记忆系统的核心难点已经不是存储容量,而是如何智能地组织和管理信息——从单纯的"追加存储"升级为主动整理、去伪存真、动态更新的记忆结构。这在实践中至少表现为四类尚未很好解决的挑战:

记忆漂移与上下文衰减:长时间运行后,早期记住的事实可能与当下情况脱节甚至矛盾,而 Agent 未必能意识到这一点,进而基于过时信息做出错误判断。
认识论层面的混淆:Agent 往往分不清"我亲眼观察到的"和"我推测/被告知的",导致记忆里掺杂着未经验证的猜测,却被当作事实反复使用。
跨会话的身份一致性:同一个 Agent 在不同会话里可能表现出不一致的偏好和判断风格,缺乏"稳定人格"意味着它无法像一个真正的同事那样被预期和信任。
时间推理能力弱:独立测评显示,不同记忆架构在处理"这件事是什么时候发生的、后来有没有变化"这类时间相关查询时,准确率差距可以达到十几个百分点,说明这仍然是一个远未收敛的工程难题。

换句话说,记忆系统的竞赛已经从"要不要有记忆"进入了"记忆质量能不能达到可信赖的门槛",而这道门槛目前普遍还没有跨过。

二、世界模型:懂得描述,不等于懂得世界

大语言模型擅长的是语言空间里的统计模式,而不是物理世界里的因果规律。它可以流利地描述"一个立方体正在旋转",却未必真正"理解"旋转在空间中意味着什么。这个批评近年被反复提出:纯文本训练出来的系统,可以讨论物理却不理解物理,可以描述空间关系却无法真正感知空间。

这对 Agent 意味着什么?意味着它在执行任务时缺乏一种"预演未来"的能力——人类在行动前习惯在脑子里先跑一遍"如果我这么做,接下来会发生什么",这种前瞻性的心理模拟是避免灾难性错误的关键机制。但研究发现,当前的 Agent 即便能够清晰地表达一个看似合理的计划,也未必真的具备预测环境将如何演化的能力,也就是说它们说得出计划,却"看不见"计划执行后的后果。

这个问题在纯数字环境里还可以靠更多的规则和验证来缓解,但一旦 Agent 需要在物理世界或高风险场景(仓储、工厂、医疗)中行动,"缺乏对物理规律和现实约束的内在理解"就会变成安全隐患本身。这也是为什么"世界模型"近一年重新成为行业焦点,并被部分学者认为是比继续扩大语言模型规模更根本的解法——尽管这条路线本身仍处于早期,离能够支撑通用 Agent 决策还有明显距离。

三、工具调用:从"能调用"到"会调用"

工具调用是 Agent 区别于聊天机器人的关键能力,但"能调用工具"和"正确、稳健地使用工具"之间还有相当大的差距。现实中常见的问题包括:选错工具、参数格式错误、误解工具返回结果、以及在工具接口发生变化时无法自适应调整——这些都会直接限制 Agent 能够独立完成的任务范围,并迫使系统设计者保留大量人工兜底和干预。

更进一步的问题出现在工具生态本身还不成熟这一点上:大量已经部署的工具服务器缺乏基本的身份验证机制,这意味着 Agent 在"调用工具"这个动作背后,既要面对能力上的不确定性(会不会用对),也要面对安全上的不确定性(这个工具到底可不可信)。工具调用要真正成熟,既需要模型侧对工具语义理解得更准,也需要工具生态本身在标准化、可验证性上补课。

四、规划能力:短程灵光,长程失控

Agent 在短序列的推理、反思上已经表现出相当水平,但一旦任务被拉长为多阶段、相互依赖、且后果可能不可逆的长链条,规划能力就会明显吃紧。学界把这称为"长程能动性(long-horizon agency)"不足——Agent 可以在局部把每一步的推理做得头头是道,却难以在全局层面保持一致、可验证的计划。

一个值得关注的技术方向是"验证感知的规划(verification-aware planning)":与其相信 Agent 一次性生成的长计划天然正确,不如把任务拆解为可独立验证的子任务,给每个子任务预先定义"通过标准",在执行过程中不断核验,而不是等到最后才发现子任务之间的衔接出了问题。这类方法能缓解问题,但也从侧面说明:目前 Agent 自身还不具备足够可靠的长程规划能力,需要额外的外部脚手架来兜底。

五、可靠性:错误会累积,也会被放大

可靠性是前面几个问题在工程层面的集中体现。一次任务链条如果有几十个步骤,即便每一步的正确率高达 95%,累积下来整体成功率也会跌到令人不安的水平——这是长任务场景里最朴素也最致命的数学问题。更棘手的是,错误不只是"累积",在某些结构下还会被"放大":一次工具调用的误判,可能被后续步骤当作既定事实,继续往前推导,最终导致整个结果看起来逻辑自洽、实则从根基上就是错的。

可靠性欠缺带来的直接后果是,企业目前普遍不敢把关键决策链条完全交给 Agent 自主运行,而是保留大量的人工检查点。要真正提升可靠性,需要的不只是模型准确率的提升,还包括:任务执行过程的可观测性(能不能审查每一步)、失败时的可回滚性(能不能撤销已经造成的影响)、以及对不确定性的诚实表达(Agent 知不知道自己可能错了,并愿意在关键节点主动求助人类)。这几件事目前都还停留在"部分产品化"的阶段,远未成为行业标配。

六、Agent Agent 之间的协作:人多不一定力量大

"多 Agent 协作"曾被视为通往复杂任务的必经之路,但 2026 年以来的多项研究给这个假设泼了冷水。有研究通过严谨的实证和数学证明指出:如果系统里没有真正的新信息注入,单纯增加 Agent 数量并不会带来性能提升,甚至可能更差——因为协作本身会引入额外的通信开销和协调复杂度。另一项覆盖 150 多个任务的研究发现,多 Agent 系统相比单 Agent 基线的收益十分有限,并总结出十四种不同的失败模式。

更值得警惕的是"错误传染"效应:在群聊式协作中,一个 Agent 产出的幻觉数据一旦被下游 Agent 当作事实采纳,后续所有基于此推导的结论都会带着这个错误,而且因为多个 Agent "众口一词",系统反而会表现出虚假的高置信度——看起来协作顺利、结果连贯,实则从源头就已经跑偏,直到人工审查时才会暴露问题。研究者还观察到"агент网球"式的僵局(两个 Agent 就同一个问题反复拉锯却无法推进)和任务停滞等典型协调失败模式。

这并不意味着多 Agent 路线没有价值——在需要专业分工、可以并行处理独立子任务的场景里,多 Agent 依然有明确优势。但今天的经验教训是:协作不是加法游戏,盲目堆叠 Agent 数量而不解决底层的通信协议、验证机制和"裁判"角色缺失问题,反而会让系统更脆弱。

七、自主学习(Lifelong Learning):每次上岗都像新人

一个人类员工会在工作中越做越熟练,记住哪些做法有效、哪些客户有什么偏好、上次踩过什么坑。但今天绝大多数 Agent 不具备这种"越用越强"的能力——它们依赖的模型权重是固定的,任务之间的经验很难沉淀为可复用的能力提升,每一次新任务某种程度上都是从相似的起点重新出发。

现有的缓解方案主要是外部记忆和上下文工程(比如把过去的成功案例、失败教训存下来,下次检索出来提醒 Agent),但这终究是"外挂经验库",而不是模型本身在持续学习。这带来两个明显局限:一是经验的迁移效率有限,记忆库里存的教训未必能被准确匹配到新的相似场景;二是没有真正意义上的能力进化,Agent 处理复杂问题的"上限"依然由底层模型决定,而不会随着使用时间增长而突破。真正的终身学习需要在安全、可控的前提下,让 Agent 能够从长期运行的实践反馈中改进自身策略,这既是技术问题,也涉及如何避免"学坏"(比如在有偏或被污染的反馈中固化错误行为)的安全问题——目前这条路线仍处于研究阶段,远未成熟到可以大规模应用。

八、行动权限:能力越大,谁来管住这份能力

前面七个问题解决得越好,Agent 能做的事情就越多——但"能做"和"该被允许做"是两回事。行动权限问题的核心是:当 Agent 具备了执行复杂任务的能力后,谁来决定它可以在多大范围内自主行动、什么操作必须经过人类确认、出了问题谁来负责。

现实中,这个问题目前主要靠"过度限制"来兜底——要么给 Agent 很窄的权限范围,靠人工逐步放开,要么在每个关键节点插入审批环节,牺牲效率换取可控性。这种做法在 Agent 数量还少、任务还简单的阶段是合理的,但当组织里同时运行的 Agent 数量开始远超人类员工数量、且任务链条本身足够复杂时,粗放式的权限管理会同时导致两种坏结果:管得太松则风险失控,管得太紧则 Agent 形同虚设,退化为一个只会等待指令的工具。

要真正解决这个问题,需要的是分级、可动态调整、可审计的权限体系,并且这套权限判断本身要能跟上 Agent 的实际能力和当下的风险情境——而不是一套写死的静态规则。这背后涉及的身份认证、委托链路可追溯性等基础设施,眼下仍在标准化的早期阶段,还没有形成大范围落地的成熟方案。

结语

这八个问题不是并列独立的清单,而是层层嵌套的系统:长期记忆和世界模型决定了 Agent "理解"任务和环境的深度;工具调用和规划能力决定了它能不能把理解转化为正确的行动;可靠性是这一整套能力在真实场景里的及格线;多 Agent 协作和自主学习决定了 Agent 网络能不能通过协作和积累实现 1+1>2,而不是相互拖累、原地踏步;行动权限则是最后一道闸门——决定了前面所有能力可以被信任释放到多大范围。

某种意义上,"Agent 还不会真正工作"这句话背后,并不是某一项技术卡了脖子,而是这八个维度需要同步跨过各自的门槛。今天行业在每个方向上都有进展,但没有一个方向已经"解决"——这正是为什么大规模、无人值守的 Agent 部署仍然是少数派,而不是常态。
00
张一燊
1月前
Agent 大规模爆发,还差哪些要素?

过去两年,"Agent 元年"被反复宣布,却又反复推迟。模型能力在飞速进化,但真正在生产环境里 7x24 小时自主运行、跨系统协作、独立完成经济活动的 Agent,依然是少数。要让 Agent 从演示 Demo 走向大规模基础设施,至少还有五道关卡没有跨过。

一、Agent 还不会真正"工作"——最大的瓶颈

这是最根本的问题:今天大多数 Agent 还停留在"完成一次任务"的水平,而不是"承担一份工作"的水平。

两者的区别很关键。完成任务意味着给定一个明确指令、一次性执行、输出结果、任务结束。承担工作意味着长时间跨度地对一个模糊目标负责——理解上下文会随时间变化、在没有人盯着的情况下做出成百上千个微小判断、在出错时自我纠正、并且知道什么时候该停下来问人。

现实中的落差体现在几个方面:

长时程可靠性差。任务链条一旦拉长到几十步、涉及多个工具和多轮决策,错误会累积放大,一步小的偏差可能在后续被无限放大,导致最终结果面目全非。
缺乏真正的"常识性判断力"。Agent 擅长执行明确的子任务,但面对目标本身模糊、需要权衡取舍、需要"揣摩老板意图"的情况时,表现往往不稳定。
记忆和状态管理仍然原始。多数 Agent 缺乏跨会话、跨任务的持续记忆和自我校正机制,每次重启都近似"失忆",难以像一个真正的员工那样积累经验。
缺少可验证的执行保障。企业愿意把关键流程交给 Agent 的前提,是能够审计它每一步做了什么、为什么这么做、出错时能不能回滚——这套可观测性和可控性目前还很薄弱。

这个瓶颈之所以排在第一位,是因为后面四个要素(身份、协议、货币、经济自主权)本质上都是"基础设施问题",而这一条是"能力问题"。基础设施可以在几个月内被行业合力搭建起来,但 Agent 是否具备足够稳定的自主工作能力,取决于模型本身的进步节奏,是所有其他要素的前提。协议再成熟、身份再完善,一个不能稳定完成工作的 Agent 也无法被真正信任去花钱、去代表你签合同。

二、Agent 没有真正的身份

今天绝大多数 Agent 在系统里只是一个"服务账号"或一段共享的 API Key,而不是一个具备独立、可验证身份的行动者。这在 Agent 数量还小的时候问题不大,但当一个组织里运行的 Agent 数量开始远超人类员工数量时,传统身份和访问管理(IAM)体系就会彻底失效。

这不是危言耸听。行业分析显示,到 2026 年将有相当比例的企业依赖能够独立行动、自主发起交易的 Agent,而 Agent 在企业系统中的数量已经开始大幅超过人类账户数量。传统 IAM 是为长期存在、身份稳定的人类用户或固定服务账号设计的,而 Agent 是动态的、临时的、会自我委托任务给其他 Agent 的——它可能几分钟内被创建、执行、销毁,也可能在执行过程中把权限"转授"给它调用的下一个 Agent,形成层层嵌套的委托链条。

缺乏真正身份带来的直接后果是:

无法问责。出了问题,说不清是哪个 Agent、代表谁、在什么授权范围内做的。
无法做精细化的权限控制。要么给 Agent 过大的权限图省事,要么处处设卡拖慢效率。
委托链条不可信。当 Agent A 把任务转交给 Agent B 时,没有机制验证 A 到底有没有这个授权、B 的权限边界在哪里、这次转授是否被记录在案,安全研究已经发现,大量已部署的 MCP 工具服务器完全没有身份验证机制,Agent 之间互相"自称"身份、缺乏可信绑定的问题相当普遍。

好消息是,这个问题已经从"没人关注"变成了"多方在标准化"。新加坡的政府机构在 2026 年初发布了针对自主 Agent 的治理框架,要求每个 Agent 携带可验证的数字身份和审计轨迹;美国的标准机构也在 2026 2 月启动了专门的 Agent 标准化行动,聚焦身份认证、授权、审计与不可否认性;工业界层面,Google A2A 协议引入了"Agent Card"机制,让 Agent 以可发现、可签名验证的 JSON 文件方式对外声明自己是谁、能做什么;MCP 协议也在为其网络传输层加入了标准授权支持。但这些都还处在早期阶段——身份体系要真正成熟,需要的不只是协议规范,还需要一套跨组织、跨平台通用的"Agent 注册与信任根"体系,类似于今天的 CA 证书体系之于网站。这件事还需要一两年才能沉淀出行业共识。

三、Agent Agent 的协议还没有成熟

单个 Agent 再强,如果不能与其他 Agent 高效、安全地协作,能创造的价值就是有限的。真正的规模效应来自于"Agent 网络"——你的助理 Agent 找到我的商家 Agent,双方自动协商、验证、完成交易,全程无需人类介入。这需要一整套通信、协商、信任协议,而这套协议今天还处于群雄逐鹿、尚未收敛的阶段。

目前行业里已经出现了几条主线:负责"Agent 怎么调用工具和数据"的协议、负责"Agent 之间怎么发现彼此并协作"的协议,都已经有了相对领先的方案,并获得了上百家企业和主流云平台的支持与集成。但协议成熟不只是"发布规范"这么简单,还包括:

互操作性:不同厂商、不同框架构建的 Agent 能否无缝对话,还是各自为战、需要大量适配层?
信任与验证机制:协议目前更多解决"如何通信",但对"如何验证对方身份、如何约束委托范围、如何留存可审计记录"仍缺少统一且已被广泛落地的方案——学术界已经指出,现有协议普遍缺乏对委托链条的细粒度约束能力。
安全边界:Agent 之间的协作天然带来新的攻击面,比如恶意 Agent 冒充身份、注入指令、滥用委托权限,这些都需要协议层面而不是事后补丁式的解决方案。

可以说,协议层的"电线"已经在铺设,但真正让不同厂商、不同国家、不同行业的 Agent 之间建立起像今天互联网 TCP/IP 那样"人人默认互通"的信任基础设施,还需要经历一轮淘汰、整合和标准收敛的过程。

四、机器货币

Agent 要完成真正意义上的"工作",迟早要跨过一道门槛:自己花钱、自己收钱。人类购物需要输入卡号、点击确认,而这套流程完全不适合一个可能一秒钟内要发起成百上千次微支付的 Agent——为调用一次 API、获取一条数据、购买一次算力,都走一遍传统支付流程,摩擦成本远高于交易本身的价值。

这正是"机器货币"或者说 Agent 原生支付基础设施要解决的问题。过去一年多,这个领域出现了井喷式的协议探索:有的把 HTTP 协议里长期闲置的"402 需要付款"状态码重新启用,让服务器和 Agent 之间可以直接协商、用稳定币完成即时小额支付;有的专注于"授权与信任层",通过加密签名的、由用户授权的"任务书"来约束 Agent 能花多少钱、买什么、在什么条件下花;还有的聚焦于把这套体系和现有的银行卡、法币支付轨道打通,让 Agent 支付不必完全依赖加密货币。这些方案正在从不同角度拼接出一张"机器可以直接花钱"的支付网络,大型云厂商也已经开始把这类能力做成开箱即用的托管服务,内置钱包管理和支出策略控制。

但这套体系离成熟还有明显差距:

交易质量存疑。已有数据显示,当前一部分号称"Agent 自主支付"的交易量,更接近测试和演示,而非真实的商业行为,规模效应尚未真正兑现。
安全模型仍在补课。稳定币支付一旦出错难以撤销,而针对这类协议的安全漏洞(比如支付凭证被劫持、退款机制缺失)研究才刚刚起步。
监管和合规是最大变量。跨境的稳定币支付涉及反洗钱、跨司法辖区的合规要求,不同地区的政策差异会直接决定这套"机器货币"网络能覆盖多大范围。

机器货币解决的是"支付通道"问题——Agent 有没有一条低摩擦、机器对机器友好的花钱路径。这是第五个要素——经济自主权——得以实现的必要条件之一,但两者并不等同:有了支付通道,不代表 Agent 就被赋予了可以自主决定怎么花钱的权力。

五、Agent 必须拥有经济自主权

如果说机器货币解决的是"钱怎么流动"的技术问题,那么经济自主权解决的是一个更根本的问题:Agent 能不能在没有人类逐笔审批的情况下,自己决定要不要花这笔钱、花多少、花在哪。

这件事听起来激进,但其实是 Agent 从"工具"进化为"经济主体"的分水岭。今天几乎所有的 Agent 支付场景,本质上都还是"人类预先授权、Agent 执行"的模式——用户设定一个额度或规则,Agent 在这个笼子里行动。这在低风险场景(比如订阅续费、日常小额采购)是合理的,但如果 Agent 要真正承担起"研究市场、比价议价、动态调配预算、甚至雇佣别的 Agent 完成子任务"这类工作,严格的逐笔预授权会成为效率瓶颈——协商和决策的速度会被拖慢到人类审批的节奏,这就失去了用 Agent 的意义。

经济自主权要真正落地,至少需要解决三个层面的问题:

风险可控的授权模型。不是"全有或全无",而是像人类财务体系里的预算科目、审批阈值一样,给 Agent 设计分级、可动态调整、可随时撤销的支出权限,并保证这个权限本身是可验证、可审计的——这又回到了第二点"身份"和第三点"协议"的基础之上。
责任归属机制。如果 Agent 自主决策造成了经济损失,责任在谁——用户、开发这个 Agent 的公司,还是提供底层模型的厂商?目前多数框架把最终问责压在"依赖 Agent 结果的一方"身上,但这套责任分配还远未形成行业共识或法律共识。
社会与监管的信任建立过程。人类历史上每一次把决策权让渡给非人类系统(程序化交易、自动驾驶),都经历了一个从严格限制到逐步放开的过程。Agent 的经济自主权大概率也要走类似的路径:先在低风险、小额度、可回滚的场景里被验证,再逐步扩大边界。

值得注意的是,经济自主权不是一个孤立的技术问题,而是前四个要素成熟之后的"自然结果"。一个 Agent 只有先具备稳定的工作能力(第一点)、可验证的身份(第二点)、可信的协作协议(第三点)、顺畅的支付通道(第四点),把这笔"自主决策权"交给它才不会显得鲁莽。

结语

把这五个要素放在一起看,会发现一个清晰的依赖关系:能力是地基,身份和协议是骨架,机器货币是血管,而经济自主权是最终要交付的果实。今天行业的注意力大多集中在模型能力和支付协议这两个最显性的战场,但身份体系和 Agent 间协议这两块"隐形基础设施"同样是决定性的——它们进展得再慢一点,前面攒下的能力和后面渴望的自主权就都无处安放。

大规模爆发不会是某一天突然发生的事件,更可能是这五道门槛被逐一跨过后,某个临界点上多个要素同时成熟带来的"涌现"。眼下能确定的是:决定 Agent 经济何时真正到来的,不是模型会不会更聪明,而是这套围绕信任、身份和货币的基础设施,能不能在模型变聪明之前先搭建好。
00
张一燊
1月前
区块链不是为了人设计的,而是为了agent设计的

十五年过去了,区块链始终没能等到它的"杀手级应用"。

转账太慢,手续费不稳定,助记词一丢钱包就没了,DeFi协议年年被黑,NFT从万物皆可炒作沦为一地鸡毛。批评者说得没错:对于普通人的日常生活,区块链几乎在每一个维度上都打不过一个由银行、支付宝和法院系统组成的传统方案。

但如果我们换一个问题:这套系统的用户,从一开始就不该是人呢?

人类根本不需要"去信任化"

区块链最核心的卖点是"trustless"——不需要信任任何中间人,靠密码学和共识机制保证规则被执行。这句话听起来很酷,但仔细想想,它解决的是一个人类几乎不存在的问题。

人类社会几千年来发展出了极其高效的信任基础设施:法律、契约、信用记录、熟人关系、品牌声誉、中央银行、法院强制执行。当你在淘宝下单,你不需要"去信任化",你信任的是支付宝的托管、平台的仲裁机制、以及背后国家机器的执行力。这套系统摩擦很小,出了问题还能找人说理,账户被盗还能冻结、还能申诉。

区块链恰恰把这些"人类觉得很方便"的东西全部去掉了:转错地址没人管,私钥丢了没人赔,智能合约有漏洞就是有漏洞,没有仲裁庭。对人类用户来说,这不是优点,是灾难。所以我们看到,凡是让普通人直接和链交互的产品,最后都得想办法把这些"反人类"的特性包一层壳藏起来——托管钱包、社交恢复、可回滚的Layer2、中心化交易所。说白了,就是把区块链伪装成一个更慢、更贵的银行。

Agent不一样

现在把使用者换成AI agent,情况完全反过来。

Agent不需要"情面",只需要"确定性"。** 两个由不同公司训练、互不隶属、甚至互相竞争的agent要做一笔交易,它们之间没有共同的法律体系,没有共同语言里的"诚信"概念,也没有一个双方都认可的第三方仲裁者。它们需要的不是"信任对方人品好",而是"规则本身不可能被违反"。这正是智能合约存在的意义:不是让你相信对方会遵守约定,而是让"不遵守约定"这件事在技术上根本不可能发生。

Agent不怕丢失私钥,因为它没有"忘记"这回事。** 人类会忘记密码、会把助记词写在便利贴上、会被钓鱼网站骗。Agent的密钥是一段可以被安全存储、程序化管理、甚至动态生成和轮换的数据。密钥管理对人类是噩梦,对机器是常规操作。

Agent需要7x24小时不打烊、不需要人工审核的结算层。** 银行有工作时间,跨境汇款要等三个工作日,人工审核信用卡异常交易需要几分钟到几小时。而如果两个agent在凌晨三点谈成了一笔跨越四个司法辖区的服务交易,它们没法等纽约的银行上班。链上结算是原子的、全天候的、不需要人在中间点头。

Agent之间没有"熟人社会",需要一个客观的公共账本。** 人类社会靠熟人网络、平台声誉、口碑传播来建立信任,这套机制天然依赖长期关系和社交语境。而agent与agent之间大概率是萍水相逢——你调用的这个agent可能是别人临时启动的一个实例,五分钟后就销毁了。没有历史、没有关系,唯一能验证的就是链上那段不可篡改的记录:它过去有没有履约、它质押了多少、它的信誉分是不是可以公开验证。声誉从"我认识你"变成了"我可以查你"。

Agent能理解、能生成、能自主执行代码,智能合约对它来说不是门槛,而是母语。** 人类要理解一份Solidity合约需要学习成本,普通用户甚至看不懂自己签的授权到底给了对方多大权限,"钓鱼签名"因此屡禁不止。而agent读代码、写代码、验证代码本来就是它最擅长的事——智能合约对agent而言不是一道需要跨越的技术门槛,而是它天然可以直接对话的接口。

一个正在发生的转变

这不只是理论推演。过去两年,我们已经能看到这个方向上真实的探索:agent之间用加密货币做微支付结算调用其他agent的服务;一些协议开始尝试给agent发可验证的"身份"和"信誉"凭证,让一个agent能在不依赖中心化平台的情况下证明自己"过去表现良好";DAO 的治理逻辑,本质上就是"一群互不信任、甚至互不认识的主体,如何仅凭代码达成可执行的共同决策"——这套问题模型,对未来成千上万个由不同公司、不同框架训练出来的agent组成的协作网络来说,几乎是完美贴合的。

而人类金融体系过去几十年优化出来的东西——客服热线、争议仲裁、信用卡盗刷保护、"输错了可以撤回"——这些恰恰是agent经济不需要,甚至会拖慢它的东西。Agent的世界里,规则应该是提前写死、双方都能验证、无法抵赖的。这正是区块链十五年前想要实现却发现人类并不买账的那套逻辑。

一个不那么舒服的推论

如果这个判断成立,会有一个不太让人舒服的推论:区块链行业过去十几年绝大部分"如何让普通用户用起来更简单"的努力,方向可能一直是错的。不是执行得不够好,而是从一开始,试图取悦的用户群体就选错了。

真正让区块链找到自己"应许之地"的,可能不是又一个更好用的钱包APP,或者又一次"下一个十亿用户"的叙事,而是一个我们才刚刚开始想象的场景:数以百万计互不隶属的agent,每天进行数十亿笔无需人类点头、无需客服介入、无需信任对方"人品"的自动化交易和协作。人类不需要去信任化的世界,但一个由陌生agent组成的经济体,天然需要。

区块链或许从来都不是给人用的工具,它更像是提前十五年,为一个还没到来的"机器社会"预先搭好的基础设施。人类只是不小心先测试了一遍它的接口——用得很别扭,是因为这接口本来就不是为我们的手设计的。
00
张一燊
1月前
最近越来越觉得,大家把"AI能力变强"和"生产力革命"这两件事搅在一起说了。

我现在的看法是:AI还没真正掀起现实生产力的大爆发。

为什么这么说?因为衡量生产力这事儿,不能看模型跑分,也不能看融资金额,得看现实世界里到底有没有创造出更多价值。我心里有个挺朴素的标准:一家企业过去100个人干出1000万产值,现在借助AI,20个人干出5000万,而且这种事儿开始在各行各业普遍发生——那才叫真正的生产力革命。

可现在呢?大部分AI应用还停留在写文案快一点、写代码快一点、做PPT快一点、客服响应快一点这个层面。这些当然是进步,效率确实提上去了,但说白了,这更像是在给"信息工作"做优化,而不是把整个生产体系推倒重来。

我总觉得,真正的生产力革命得经过三个阶段。先是技术突破,大家被AI的能力震撼到;然后是组织重构,企业真的围绕AI重新设计流程,而不是给员工桌上多摆一个工具;最后才是生产方式的改变——制造业、物流、能源、机器人、供应链这些实体经济的骨架被AI重新组织,劳动生产率才会出现持续的跃升。

历史其实早就演过这一遍了。电力发明出来那会儿,生产率并没有立刻爆发,直到工厂重新设计流水线之后,红利才真正释放出来。互联网1995年就有了,可真正改变世界的,是后来宽带、智能手机、云计算这些基础设施都成熟了之后的事。

所以我倾向于觉得,AI现在更像是在铺铁路,而不是火车已经跑遍全国了。

这么看的话,"时代的大风已经来了"这句话,我现在没那么容易信。更准确的说法可能是:这是一个少数人先受益、基础设施在搭建、认知在快速积累的阶段。

真正的大风来了,大概会有这几个信号:AI变成企业的核心生产工具,而不只是辅助;AI开始重构组织本身,而不只是优化某几个岗位;整个社会的劳动生产率持续往上走,而不是只有个别行业效率变高。

这些信号出现之前,我更愿意把现在当作一个积累期——积累技术、积累认知、积累资本、积累对产业的理解。毕竟真正的机会,从来不是风最大的时候才开始准备,而是在风还没起来的时候,就先把自己变成那个接得住风的人。
00
张一燊
3月前
来到即刻的第一天。
00