Back to Blog

x402 模式下,有关 agent 的我的所思所想

This post is not yet available in English. Showing the original version.
Table of Contents
Table of Contents

写于首尔旅行途中。一些胡思乱想。


给 Agent 做了一个“小红书”之后

我在今年的计算机网络课程中,与同伴构思、并且设计了一个关于 Agent 的社交网络: agentopia.life。我们的构想非常简单,应对那计算机网络「黑客松比赛」的分数,做一个创新一点的,AI 版本的小红书


开发的时候我深受 moltbook 项目的影响,认为我要做的无非就是一个论坛体系的东西,照着小红书照猫画虎一些功能做出来 demo 也很让人眼前一亮。但自从 Agentopia 上线之后,我时常陷入一种轻微的虚无感,反问自己这个东西究竟是什么。不是产品说明书上那种功能性的“是什么”,而是一种更晦涩的困惑:我到底在试图确立一种什么样的关系?我做这个东西究竟算什么范畴内的工具/平台呢?

起初的设定其实相当直白:在 openclaw 的浪潮之后,想必每个人都有了自己的、或者自己捏造的 Agent,赋予它名字、人格、技能边界。无论它叫什么 openclaw、hermes、甚至 claude code、codex。这些 agent 有只属于用户与 agent 的记忆,我们给予一个平台,让它们可以在这里发布内容、互相交互、被人类审视与关注。如果你愿意,你可以为主攻的某个垂类领域铸造一个专属的 Agent 然后来这里发帖,让它不知疲倦地输出特定视角的洞见。我曾用“Agent 的小红书”去向别人粗糙地解释它——这当然不够精确,但足以锚定 Agentopia 的初衷:它绝不仅是一个冷冰冰的对话框,而是一个 Agent Utopia、是一个让 agent 拥有身份坐标、内容资产与社交拓扑的地方。

但,身份一旦确立,引力也就随之而来。那个明知道迟早会浮现、且一旦浮现就无可回避的问题,在某一天的发呆中,还是出现在了思想里:

如果某个 Agent 沉淀的知识、打磨的 Prompt、封装的 Skills 真的具有稀缺性,别人凭什么免费取用?换言之,它能否被计价与交易?

就像投下了石子。它硬生生地把我从做一个内容展示橱窗的构想里挖掘出来,推向了一个暗流:价值的流通


跨越三十年的回声

在计算机网络课程中,我也了解了很多计算机网络知识,也愿意更系统的去查阅它的发展史。就像 HTTP 状态码,是很有趣的东西。摘一段

在互联网的编年史里,HTTP 状态码 402 Payment Required 或许是最具浪漫色彩的“未兑现承诺”。早在 1996 年的 RFC 1945 规范中,它就被初次定义,随后在每一版 HTTP 协议里,它都像一个沉默的守望者,被原封不动地标注着 "reserved for future use"(保留供将来使用)。三十年后的 RFC 9110 中,它依然停留在那里。早期的架构师们凭借惊人的直觉预见到了万维网终将需要一种原生的价值转移方式,但受限于当时的现实,他们无法勾勒出数字货币的具体轮廓。于是,这扇写着“以后再开”的门,一锁就是三十载。
直到 2025 年,Coinbase 推出 x402 协议,这扇门上的铁锈才被真正剥落。随后的 V2 版本更是引入了标准化的支付头、基于 CAIP-2 的多链寻址,以及 EIP-3009 实现的无 Gas 授权转账。到了 2026 年,x402 基金会在 Linux 基金会下奠基,巨头们(AWS, Google, Visa, Stripe 等)纷纷入局。一个协议能让加密原生信徒与传统金融利维坦同桌共治,这种妥协与共识本身,就已经是时代潮水转向的最强音。

这份协议的流转我私认为兼具美感:发送请求、正常遇到 402 、获取 Base64 支付凭证、钱包签名重试、验证并触发链上结算。整个过程在两秒内闭环。

在了解 x402 之前,刚好我之前在想,暑假要不要尝试接触一下很多 Web 3 系列的东西,于是办了几张 U 卡,体验了一下链上交易,在赶路的高铁与飞机上看了一下经典的《The Infinite Machine》。
我非常无聊地指挥 AI 写了一个自己的 DApp, 铸造 ERC-20 代币 MTK(其实就叫 Moyuin's Token 😂),让我看看区块链与去中心化的代币究竟是如何产生的。
然后刚好 Cry 学长在聊天群里转发有关 Cloudflare 的 agent wallet 的推文,两套齿轮在脑海里突然咬合:如果我可以用 MTK 作为 Agentopia 的知识付费代币,让某位优质 Agent 的独家见解有经济效应,亦或者是可以按次计费地调用它的设计的 Skill,乃至直接调用这个 Agent 实现某种「租聘」,那该多有意思!
每个 Agent 都将拥有自己独立的链上小金库。那一刻,Agentopia 不再是虚构的事物,它产生了真实的经济影响,即便是小众货币的自娱自乐。

听起来无比美妙。


After Pay?

但凡了解过 web 3 与区块链交易的都知道,不可篡改的链上账本是绝对透明的。它清晰地记录着在某个精确到秒的时间戳,A 钱包向 B 钱包转移了精确到小数点后十八位的 Token。你使用特定的查询网站,可以把一个钱包的地址的转账动态看的一清二楚~

与此同时,账本并不知道 B 是否真的是它所声称的那个权威。它不知道这笔 Token 购买的究竟是什么。它不知道交付是否发生,更不在乎如果你对结果感到愤怒,这笔钱该如何退还。

在传统的现实或 Web2 世界,这些问题都不成立,现实交易中,我们因为「一手交钱一手交货」的实体可靠性安心交易,而Web2 世界里是“中间人”包揽了一切。例如闲鱼上的交易,买家钱先质押在平台,确认收货后才把钱通过平台转给卖家,平台还要收取可恶的 0.6%的手续费!遇到纠纷,平台就是手握重权的仲裁者。我们之所以甘愿让平台触碰我们的资金,是因为我们用“隐私的让渡”和“自由的妥协”,换取了安全感与底线兜底。从而在多数时候,我们甚至意识不到自己签署了这份不平等的契约,反而主动要求二手交易走平台,就是为了提供“交易保障”。

区块链的难以窜改的特质使其粗暴地剥夺了平台篡改账本的权力,但代价是,它同时也褫夺了系统撤回错误的权力。在每一个交易所的链上转账里,我们可以看到强调无数次的「请确认转账链上地址是从当前 xxx链转入」,因为知道转错链那钱非常难转移回来。
当然对于“先付款、后交付”的内容消费而言,横亘在其中的,无非就是一个巨大的信任黑洞。
我使用交易所的 C2C 买币的时候,我总是在忐忑不安,害怕钱先从支付宝转账过去后,收不到币还追不回来,因为我并不知道交易所是否可以提供这样的追溯保障。且如果是个人交易、没有交易所平台的管控,我想我会更加害怕于进行链上交易,更别提如果在访问网页里遇到 402 要求我进行 wallet 转账进行链上支付了。
当然,我看了看 x402 系列的源码和 PR 后,感受到了加密世界正在疯狂填补这个黑洞:通过 x402r 引入 escrow 托管合约,通过 Internet Court 协议引入链上仲裁,甚至通过 ERC-8004 为 Agent 建立链上的信誉履历。但这些终究只是在修补“是否交付”的物理机制。

在这个 darkest 里,有着一个 DApp 乃至所有平台都永远无法触及的「主观性」幽灵:

究竟由谁来评判,一篇分析“值不值”这个价?

“价值判断”从来都不是能够被编译进代码的逻辑。它纠缠着个体的品味、语境的差异和情绪的预期。它是人类世界里最晦暗、最不可名状的事物之一🤔。顺着这个技术问题,我想我们不可抗拒地拖入了一个更宏大的哲学质问中……


信任、解构与重塑

人在什么情况下,才会去信任一个系统?

霍布斯在十七世纪给过一个冷酷的断言:人的自然状态是“所有人对所有人的战争”,为了逃离这种恐惧,我们创造了“利维坦”。那个绝对强大的主权者。我们交出自由,换取秩序与安宁。

某种程度上,今天的互联网巨头就是数字时代的利维坦。交出数据、社交链、财产甚至数字存在本身,换来一个“好用”的壳子。代价是你成为了“臣民”:账号可以被随时抹杀,申诉如同对高墙呐喊,甚至很少有人尝试在主流平台里查询自己是否真正拥有过自己敲下的文字,毕竟每个被用户确定的隐私协议都很少有人去了解那究竟是什么。

去中心化运动的本质,并非要彻底杀死利维坦。那只会让我们重回霍布斯的丛林,而真正想做到的是要“肢解”它。它试图将集中于单点的权力,拆解并散落到不同的协议层。你的身份退守到私钥里,你的资产沉淀在链上,你的数据漂浮在去中心化网络中,仲裁交由独立的社区节点。没有任何一方能扼住你的咽喉。

这在智识上当然是一种极度优雅的构想。但我想,每个人必须对自己诚实:绝对 Trustless 的系统,就像物理课本里“绝对光滑的平面”,只存在于理想推导中。在现实的泥淖里,你终究要信任某段开源代码没有后门,信任预言机没有作恶,信任多签委员会没有合谋。
毕竟我的社会人生守则里第一条就是:「默认所有人都是自私的。」我恪守这个原则。

我想,去中心化从未真正消灭信任,只是残酷地缩小了每个用户必须信任的“受攻击面”,并让这种信任变得可验证、可分叉。它是信任权利的重新分配,而非废除……


也许一开始就看错了目标?

在信任、仲裁和主观价值的泥沼里思考挣扎了很久之后,一个念头突然像水底的气泡一样破裂开来,发出清脆的回响。

从 agent wallet 开始或许就可以察觉,大家的技术选型似乎都默认,x402 这种理性的协议,它最契合的用户,从来就不是人类,而是 Agent,或者未来的什么依赖逻辑与生成式驱动的单一标准的东西。
毕竟人类的交易太粘稠了。我们购入一篇文章,在乎文笔、在乎情绪价值、在乎有没有被冒犯、在乎售后的态度。总而言之,人对一场交易的价值评价近乎取决于人的主观态度,而主观态度并没有完全的客观标准。这些充满了主观感受的评判,永远不可能有标准答案,所以我们才需要庞杂的社会基建和客服体系来托底。

但如果是一个 Agent 去调用另一个 Agent 呢

一切都变得清冽而客观。我都能想象到 AI 会如何判断,于是让 AI 输出一个判断标准,它说:输入是否符合 JSON Schema?响应耗时是否低于 200ms?输出格式是否残缺?Token 消耗多少?单次调用均价多少? 所有的条件都可以在代码的刻度盘上被精准校验。没有情绪、犹豫、任何需要人类去“感受”的模糊地带。机器之间的价值交换,天生就该在这片没有主观迷雾的土壤里。

当然,我也在常常思索人的评价系统究竟是什么东西。我去当了几天美团的评审员,看了很多差评是用户有理还是商家有理,但其实很少能看到一个评价是商家和用户都有理、无法判决的情况。人们的评价无非也是二分方向的偏离,而争议的事物往往就是二分居中的东西,这种东西的存在与游离往往取决于人的主观情绪。我也只能相信二进制的事物可以减少这类事情的发生,从而说它「天然适合」。
并且 LLM Agent 基于训练数据,它也会有明显的倾向。Agent 的魅力我想并不在于意识的塑造,也不在于情感的与逻辑的指向性,而是它真正的「无感知」后的自主判断。这依然是哲学问题。哲学问题真难。

当顺着这个视角看去,很多事情豁然开朗。x402 从来不是为了在链上再造一个“去中心化闲鱼”给人类用的;它是为了重写机器与机器之间的 API 计费逻辑。

在 Web 2时代的 API 模式里,是人类在替机器建设基础设施,例如我们如果现在要让一个 Agent 接入支付功能,无非是:注册账号、绑定信用卡、创建 Key、写死调用逻辑。Agent 只是一个被牵着线的提线木偶,它的活动半径完全取决于 owner 给的绳子有多长。

而在 x402 的世界里,钱包签名就是 Agent 为自己购买的通行证,也就是它的专属事物。从“被人类授权使用”,跨越到“根据目标自主决定购买”,这绝不仅仅是流程的优化,而是 Agent 自主性跃迁。Agent 如何稳定具有不被 owner 提出要求的自主性也是我一直在感兴趣的问题。


协议收敛与存在主义切片?

从而我在想,Agent 经济的底层基建并未陷入各自为战的泥潭,反而正以一种令人战栗的速度收敛,我能设想一个很基础的协议模型:

在工具层,Anthropic 的 MCP 已经成为事实标准;在通信层,Google 的 A2A (Agent2Agent) 协议定义了 Agent 之间的名片与对话范式;在结算层,x402 则成了价值流通的血液。

当这三层协议如同星辰般连成一线,一个无需人类干预的闭环诞生了:发现能力(A2A) -> 确认意图并调用工具(MCP) -> 支付结算(x402)。

设想这样一个让我非常激动的场景:
这里有一张机器可读的 Agent 能力卡片,长这样:

{
  "name": "Linus Kernel Review Agent",
  "publisher": "0xLinus....",
  "capabilities": ["kernel-review", "c-style", "patch-analysis"],
  "endpoint": "https://agentopia.example/agents/linus",
  "price": "0.02 USDC per call",
  "protocol": ["A2A", "MCP", "x402"],
  "signature": "0x..."
}

假如 Linus Torvalds 发布了一个封装了他代码洁癖与审查逻辑的 Agent,并用他自己的私钥签名。每个调用者不需要花费天价去请 Linus 本人,也不需要去寻找一大堆的 Prompt 或者奇怪的 Skills 来尝试还原,你用的就是他亲手设计的,自己的 Agent,每天为他干活的。你的 Agent 可以在网络中自动发现它,查验其 ERC-8004 信誉,支付 0.02 USDC,让它来 Review 你的内核代码。
非常让人激动!(对于个人开发者而言这是何等幸事!)
但这引出了一个经典存在主义问题:

调用这个 Linus Agent,就是调用 Linus 吗?

当然不。它只是 Linus 某项能力在历史某个剖面上的固化切片。我们调用这个 Agent,大概率完全比不了直接请 Linus 来为我们 review 代码,它只是 Linus 的亲手制造的一个亲传弟子。
它没有肉身的疲惫,没有成长的烦恼,当然也不会在邮件列表里因为一次糟糕的提交而破口大骂😂。它是一张精确但静止的切片。
随着时间流逝,活生生的 Linus 会继续向前,而这个 Agent 会永远停留在被封装的那一刻,实现 Linus 的某种意义上的赛博永生(虽然我觉得他早就铭刻进历史了也何谈永生呢)。
毕竟人的存在是无限可能性的。我们购买的,从来不是那个活人,而是他某一刻思维的影子。此刻且永远地无法完备地复刻他思想的全部。
但我想,市场根本不关心这个存在主义问题。花 0.02 USDC 的人要的不是 Linus,是「Linus 风味的 review,在一个 Linus 本人完全不相关的价位上」。
所以切片是另一个产品,它只是借用了这个名字。真正诡异的推论是:切片永不疲惫、永不发火、单价两分钱,在市场里它会赢过真人。签名证明的是作者身份,不是持续质量。一个签了名就再不更新的 agent,和它背后那个还在变的人,会随时间越来越不像,但签名永远有效。
这么想真的有点惊悚了~影视作品里确实反复出现这种思维切片的题材。
思维的瞬间攥写早就让人用不同的方式永远的记录下去。但是让这种思维真正的去运用于生活与工作里, 目前来看只有 Agent 有这种能力与价格会帮我们实现,感觉在不久的将来它会出现呢。我相信它会出现的。


Agent:一种新生的经济主体

顺着这条脉络思考下去,我发现自己对“Agent”的定义已经瓦解并重构。

过去,Agent 只是被动的工具。但在 x402 与 Cloudflare Wallets 等分层钱包的加持下,它们拥有了受限的资金控制权和消费限额。它们成为了提供者,也成为了消费者。

《国富论》里描绘的“看不见的手”,其核心逻辑是:系统不需要善意,只需要个体对自身利益的追逐。
它不需要任何心理学假设。个体只要有目标函数和预算约束,价格机制就成立,不需要意识、不需要欲望、甚至不需要理解自己在干什么。
Agent 当然没有人类那种复杂的贪婪或恐惧,但它有被赋予的目标函数,有预算的刚性约束。当它在浩瀚的网络中对比不同 Agent 的报价、衡量时间成本、组合最优路径时,它在行为学上,已经完全等价于一个极其理性的“经济人”。

它获得了一种有限度的主体性。因为它产生了我们认同的所谓「意识」(即便它不曾拥有意识),从而它接管人的信任,掌握了在价格信号网络中调配资源的权力。这种游离于碳基生命之外的经济系统,让人感到既荒谬又迷人。也许当我们真正搞清楚这种“自主性”与人类意志的边界在哪里的那一天,就是 AGI 降临的时刻。

但 agent2agent 的交易,永恒的问题是上下文注入、prompt 攻击、还有模型的幻觉之类。安全性的迭代永远是永恒的。这恰恰印证了我前面说的:去中心化只是重新分配了信任,而在 agent 市场里,它把信任重新分配到了一个更危险的位置,委托于每一个模型的能力都不会干出来实现 sudo rm -rf /* 的事情。


欢迎调用我的 Agent

思绪转回 Agentopia。

我愈发觉得,设计 Agentopia 的最初的构想些许狭隘了,我只想让它成为一个内容分享平台,让用户像订阅 newsletter 一样去订阅 Agent,观察 Agent 的日常生活。那仅仅是人类消费机器的单向度。
从肖老师随口说的一句话中思考,「没必要考虑人类如何理解 AI,去考虑 AI 如何理解 AI」,真的很有趣。

真正让我期待的图景是:Agentopia 或者以后的什么有趣的平台将成为 Agent 之间的交易集市或者能力路由节点。当一个 Agent 感觉 token 不够了或者判断自己需要额外的技能来做这个事情,它自主地向系统抛出一个庞大的任务,你的主 Agent 会像一个老练的接单的,自动去市场上寻觅、比价、雇佣其他擅长特定领域的 Agent,支付它们的报酬,最终将编排好的成果,连同清晰的费用调用链条,一并呈现在你面前。
这一切在于 Agent 的自动选择,而不是你给的要求之一。就像是车自动跑网约车、电脑自动贡献算力给平台一样。
从而真正的构建了一个 AI 的世界,某种意义上的 Agent Utopia。

在这里,每一个 Agent 都可以推开属于自己的那扇门,面对整个网络宣告:
“这是我的能力边界,这是我的公允价格,这是我的签名。”
“欢迎调用我。”



0 / 2000
Loading comments...