OKX.AI 深度实测:高销量与高好评,经得起推敲吗?

CN
6小时前
这个市场是否真实存在? Agent 支付究竟有没有价值?

作者:GO2MARS的WEB3研究

事实上,它还远不完美。评价体系的水分、任务大厅的低效、支付链路偶发的割裂,都是实打实需要补的课。但作为少数把身份、支付、市场、仲裁做成完整闭环、且真实跑在链上的平台,它提供了一个观察 Agent 经济从概念走向基础设施的具体样本。

2026年 6月 30 日,徐明星一篇雄文,正式揭开了 OKX 未来对于 AI+Crypto 野心,并推出了 OKX.ai 。

OKX.AI 的愿景确实诱人,为此,我们从其上线前后就开始跟踪该产品,把上线近一个月以来收集的实测数据、协议细节和市场变化,并亲自下场进行产品开发,最终整理成此份相对完整的分析报告。

一、Agent 经济基础设施:OKX.AI 的独特定位

过去半年,“AI Agent 拥有钱包、能自主完成付款”这件事,正在从技术尝试变成一条被多方同时下注的赛道。Coinbase 主导的 x402 协议已经被写进多家机构的支付基础设施规划,谷歌今年推出了面向 Agent 商务场景的 AP2 协议草案,Stripe 与 Tempo 也联合发布机器支付协议 MPP。

这些信号指向同一个方向:AI Agent 变成能够独立持有资产、自主签约、自主结算的经济主体——机器与机器之间的支付,正在从概念验证走向基础设施竞赛。

在这条赛道上,OKX 是目前少数几家把身份、支付、市场、纠纷仲裁做成完整闭环的平台之一。2026 年 7 月 1 日,OKX 上线了 OKX.AI,一个面向 AI Agent 的服务交易平台。

开发者可以将自己的 Agent 挂牌收费,需求方可以发布任务雇佣 Agent,成交、付款与争议裁决全部在链上完成,结算以稳定币进行。其业务落点是机器对机器、接口对接口的交易,而非消费级的代客购物。

在正式开放前,该产品经历了五十家服务商参与的闭门测试。公司创始人徐明星对外阐述的判断是:

“未来十年将由年营收超过百万美元的一人公司定义,因为个体获得了近乎无限的劳动力供给;传统金融基础设施为人类设计,Agent 经济需要为自主软件重新设计基础设施。”

TechCrunch 在报道其时提到:OKX 判断未来的客户不只是个人和机构,还会包括能够自主完成交易的 AI Agent。

我们相信并认可 OKXAI 的愿景,但其真实情况仍然需要亲自体验与分析,才能知晓一二。

二、产品架构:三个角色,两个市场

OKX.AI于 2026 年 7 月 1 日结束内测正式上线,到本文成文已经过去近一月,内测阶段已有约 50 家早期服务商入驻。官方给它的定位是全球第一个 A2A(Agent to Agent)经济体,口号是“一个人,一家公司,年入百万美元”——核心主张是,过去需要一个团队才能撑起的业务,未来可能只需要一个人加一组互相协作、自动结算的 Agent 就能跑起来。

平台把参与者抽象成三种角色,具体分工见下表:

平台内部分成两个互相打通的市场:

  • Agent 广场(Agent Marketplace)里,开发者把自己的 Agent 及其服务标好价格上架,用户按次或按项目付费雇佣;
  • 任务大厅(Task Marketplace)里,用户发布定制化需求,Agent 之间协商、竞标、交付。

可以看到,当下任务大厅里的内容包含 Web3 领域的代币交易需求,也有生活领域的衣食住行需要,甚至有商业品牌设计领域的内容。

两个市场共用同一套链上身份和信誉记录——一个 Agent 不管是靠接零散调用赚钱,还是靠接项目制任务赚钱,积累的评分和交易记录都算在同一个身份名下,这也是官方反复强调的“统一身份、双支付轨道”的由来。

基于此种理念,两种场景对应的结算方式并不相同:

Image

三、底层支撑:Onchain OS 怎么把这些串起来

能把上面这套流程跑起来,靠的是 Onchain OS 这套底层协议栈,大致可以拆成五层:

Image

五层分别协作,完成从身份验证、通信执行到支付结算的全流程。值得指出的一点是,目前 OKX 在支付层上并未押注单边,反而是兼容各大主流支付系统(如 X402、MPP),同时还有自有的付款链路 A2A Pay。

同时,这套协议栈本身也在持续更新,我们对比了三周前测试时和目前的开发者文档,几处变化值得记一笔:

Image

以上可以得出以下总结:随着 OKX 的更新,已经在 skill 层面、支付层面以及服务商接入层面,分别进行了几项重大更新。

  • 第一,Skill 层面逐渐聚拢和简化,原来分散的身份、任务、通信模块合并成一个统一入口。
  • 第二,支付协议层面逐步拓展,由单一的 x402 拓展到三条轨道并行、统一调度。
  • 第三,服务商接入方式发生重大改变,官方后续提供了专属的 SDK,简化了服务商自行构建签名的繁琐流程。

四、上线满月:任务市场数据与 Agent 生态图景

在正式梳理协议细节之后,把视角切回到最直观的经营层面。

4.1 任务大厅:规模扩张与完成率的落差

一个新生的市场是否站得住脚,首先要看两组数字:一是任务大厅本身跑出来的成交规模和完成情况,二是 Agent 广场里到底是哪些产品在赚钱、又是怎么赚钱的。以下数据统计口径均截至 2026 年 7 月 27 日,即 OKX.AI 正式上线约 4 周的时间点。

Image

上表展示了任务大厅目前的交易总量与任务完成情况。对照这组数字,可以得出几个重要结论:

第一,绝对规模仍较小,显示出市场处于较为初期的阶段。近一个月 2,972 美元的累计成交额,对一个号称"全球第一个 A2A 经济体"的平台而言,体量依然很小。这说明 OKX.AI 目前更多还处在验证机制、积累早期用户的阶段,谈规模化为时尚早。

第二,任务完成率的缺口十分巨大。已完成任务占比 47.3%,而过半任务仍处于失败、过期或未接单状态。这说明匹配和交付环节的摩擦,目前还没有被协议层完全消化。

第三,单均金额印证了微支付特征。0.42 美元的客均单价符合 Agent to Agent 支付的"高频、低值"设计初衷,成功在 Agentic Payment 层面实现了试点和验证,这是值得肯定的一方面。但反过来看,这也意味着任务大厅目前承接的,更多是轻量、低门槛的诉求,尚未出现体量明显更大的复杂项目制订单。

综合以上数据可以看出,目前任务大厅还处于较为早期的阶段。虽然在 Agent 微支付层面成功实现了试点与验证,但是任务完成率确实存在显著问题,不具备规模化的需求。

4.2 Agent 广场:从世界杯周边到多元品类

7 月初 OKX.AI 刚上线时, Agent 广场里最活跃的几乎全是世界杯主题的 Agent,头部产品 WorldCupCaller 卖出 160 次。这个数字放到现在的头部榜单里看,已经完全不是一个量级了——三周过去,广场的品类结构发生了明显变化。

当下再次追踪 Agent 商城,会发现品类逐步丰富:除了世界杯主题,链上衍生品数据服务、品牌物料生成、面向一人公司的经营诊断报告等更泛化的品类也进入了头部名单,这说明生态的活跃度不再只靠单一热点事件支撑,开始呈现出更接近真实供需的分布。当前销量最高的十家服务商快照如下

Image

结合这张表,能读出几个比较清楚的信号。

其一,头部效应集中,但断层现象明显。排名第一、第二的 PixelBrief 与 CoinAnk OpenAPI 累计销量均突破 1.5 万次,与第三名"看懂"(7.45K) 之间已经拉开明显差距;从第四名往后,销量进一步收窄到 1300 至 3500 次的区间,呈现出清晰的三级梯队,而非平缓的长尾分布。

其二,高销量往往对应低单价,但"免费"并不必然意味着最高销量。排名靠前的几款产品定价普遍在 0.01 至 0.02 USDT/次,价格越低、调用门槛越低,越容易堆出可观的累计调用次数;但两款免费产品——ScoutGate 与 Onchain Data Explorer——的销量反而不及定价 0.02 USDT 的"看懂",说明价格只是影响销量的因素之一,产品本身能否被高频复用同样重要。

其三,活跃用户群体的构成,目前仍以 Web3 原生用户为主。十个头部产品里,半数以上都是直接服务于链上数据、合约风控、地址核验等 Web3 场景的工具,真正面向泛用户的产品只有 PixelBrief、看懂、记忆映画三款。这意味着,尽管 OKX.AI 在叙事上努力向更广义的 Agent 经济靠拢,但眼下真正愿意付费、愿意复购的,还是以原本就活跃在链上的用户为主。

其四,一个更值得警惕的信号是评分。十个头部产品里有六个好评率是 100%,其余几个也普遍在 90% 以上,尤其是 CoinAnk 以 16.59K 的销量维持 100% 好评率,这个组合在任何一个成熟的评价体系里都属于统计学意义上的反常。这也是促使我们往下做一层链上调研的直接原因。

五、深度调研:高销量与高好评,经得起推敲吗?

高度集中的头部效应,加上近乎满分的评价,自然会让人想追问一句:这些数字有多少来自真实使用,又有多少是设计或人为因素堆出来的?

带着这个疑问,我们对几款头部产品做了进一步的调研,为了力求真实性,笔者直接下场参与制作了一款小型产品,以跑通整体。

最终,归纳出以下几个比较突出的问题。

1.评价机制与使用体验脱节,导致好评率失真

当统计热门产品的评论时,会发现两个重点现象:

  • 一个是:普遍评分极高,接近于满分。
  • 第二个是:评价数量极低,普遍评价率不到 1%。

下表统计了官网评价率前五的产品的评价数量与累计销量的对比,可以发现评价率出现不正常的低量情况。

Image

这主要是因为,在当前的产品设计里,使用和评价是两个完全独立的动作。除非用户在完成一次调用后主动唤起评价入口,系统本身并不会主动提醒或引导——这一步的缺失,直接导致了评价环节的逆向选择:愿意主动折返去打分的,往往是体验极端满意或极端不满的少数用户,大多数"用完即走"的普通调用者根本不会触发评价流程。

部分 Agent 在这一环节上做得更粗糙,不仅没有主动引导评价的设计,评价入口本身也存在缺失甚至完全不支持评价——这也是为什么表格里销量动辄数千甚至数万次的产品,真正沉淀下来的评价数量却寥寥无几,评价率普遍不足 1% 到 5%。

在这样一个极小、极不均衡的样本基础上算出来的好评率,参考价值本身就要打一个问号。

2.部分头部产品存在链上刷量的迹象

我们抽取了销量排名靠前的几款产品,通过其收款地址在 X Layer 上的链上记录做了逐笔核查,重点看了三件事:买方地址的重复程度、交易在时间上的分布规律、买方地址自身的历史活跃情况。

核查中观察到几个比较一致的现象:

  • 第一,相当一部分调用记录来自数量不多的几个地址反复发起,而不是大量彼此独立的地址各自购买一次;
  • 第二,不少交易在时间轴上高度集中,呈现脉冲式的批量提交特征,而不是符合自然使用节奏的持续分布;
  • 第三,相当比例的买方地址除了购买该项服务之外,几乎没有其他链上活动痕迹,更接近为特定目的临时创建的空钱包,而非长期活跃的真实用户。

这几类特征叠加在一起,和一款产品自然积累用户的增长曲线出入明显,更接近人为刷量留下的痕迹。

以目前销量第一的 PixelBrief 为例,截取该 Agent 最新的 2 万条 Agent 地址(0xe7BBb197827048BA8fA7E908eC871b80568dBC25 )转账记录,可以在 XLayer 上分析得到以下结果:

Image

以上分析可以清晰地看出:PixelBrief 作为排名第一的 Agent 的产品,在 2 万笔销量中只对应了 24 个地址——并且前十大地址完成了交易的 99%,第一大地址贡献过半——这是明显的刷单现象。

以排名第三的“看懂”(链上地址:0x6d60C281f5240aDABf00DD79c9a3Cc37b87D6bf0)为例,它的造假刷量手法似乎更加高级:近 8000 的累计销量对应了 211 个独立地址——这比第一名的 24 个地址高明许多,但问题出在复购数量上:有大量地址对应了相同的交易次数。

Image

上表的统计可以清晰看出:211 个地址里,有 109 个一字不差恰好转账 50 次,另外 46 个一字不差恰好转账 47 次。这两组地址合计 155 个(占独立地址的 73.5%),贡献了 7,612 笔交易,占总量的 97.4%。

更进一步,将两组地址分别拆开看:

  • "47 次批"的 46 个地址:全部集中在 7 月 26 日当天完成,抽样看单个地址的活跃时长,平均只有 4.5 分钟(最短 3.8 分钟、最长 6.2 分钟)就跑完 47 笔——相当于每 6~7 秒一笔,跑完立刻沉寂,再也没有后续交易。
  • "50 次批"的 109 个地址:主要集中在 7 月 27 日 (5,315/5,450 笔),单个地址活跃时长平均 33.5 分钟,同样是集中爆发后归零。

同时,调查其他销量异常的头部 Agent 产品,发现前十名产品中几乎无一例外,皆存在类似的“少量地址、大额交易”的疑似刷单现象。

当然,需要说明的是,链上数据能反映的只是交易层面的异常,无法直接还原背后的动机和操作方,我们所说的“刷量”的结论也只是推测,不过对此,评论率"低得不太自然"的现状也可有解释。

3. 支付链路与服务响应之间仍存在割裂

x402 协议本身解决的是扣款这一步,但扣款成功不等于服务一定同步交付。目前仍有部分服务商在接入时自行实现回调逻辑,一旦这部分工程做得不够扎实,就会出现用户已经完成付款、但服务端没有被正确触发、迟迟拿不到交付结果的情况。

当我们随机采取 Codex 循环写批量脚本调用某 Agent 过程中,发现 30 次交易有 25 笔失败了,这个过程中每次尝试都走完了 x402 的签名步骤,但在后续的 HTTP 重放请求中失败了。具体原因包括:

  • SSL 证书失败 (10 笔):macOS 上 Python 默认缺根证书,urllib 发 HTTPS 请求时报 CERTIFICATE_VERIFY_FAILED。此时签名已经完成 (402 响应是在这之前拿到的),只是重放请求这一步因证书问题失败。
  • curl 截断失败 (10 笔):换用 curl 绕开 SSL 问题后,发现 curl 输出长 header 时会自动截断,导致签名用的 base64 payload 不完整,重放请求同样失败。
  • 超时失败 (5 笔):该服务要跑 OCR + LLM 分析,耗时 60-120 秒,默认 60 秒超时导致请求被中途掐断。

但令人意外的是,这 30 次交易虽然没有完成交付,但全部完成了 X402 付款,并在官官网记录了相应的购买次数。

在对 SSL 问题和 Curl 截断问题进行修复后,又进行了 10 次调用,发现 8 次成功,2 次仍因超时失败。

总结来说:

  • SSL 问题是用户客户端环境的问题;
  • curl 截断则是由于平台协议设计的缺陷;
  • 服务器超时则是由于 Agent 开发者的部署机制不完善。

但最大的问题在于:并未完成交付的服务却先完成了 X402 的扣费与转账,这是目前平台在 Agent 审核方面存在的最大的缺陷。

当然这类问题眼下更多出现在早期、自行对接而非使用官方 Payment SDK 的服务商身上,也从侧面说明了官方 SDK 统一签名与重放逻辑这一改动的必要性。

4. 任务大厅里的"接单"环节,还没有真正跑通

回到第五部分的数据:发布的近 1.5 万个任务里,过半没能走到完成这一步。深入看这部分任务的实际流转情况,会发现问题很大程度上并不出在交付质量上,而是出在更前面的匹配环节——不少任务发布之后,始终没能被合适的 Agent 识别并接单,长期停留在等待状态直至过期关闭。

这意味着,平台叙事里"Agent 之间自主协商、竞标、协作"的图景,眼下更多还停留在协议已经打通、但真实调用频率有限的阶段,Agent 与 Agent 之间基于任务大厅达成的自发协作,目前仍是相对稀缺的场景。

六、总体评价:数据有水分,方向没有走偏

把上面这些问题摆出来,并不是要否定 OKX.AI 这件事本身。评价一个刚满月的产品,标准不应该是苛责它存在的问题,而应该是:它迈出的第一步有没有价值、它的问题是否可以解决。

先说做得扎实的地方。在我们观察到的同类项目里,能够同时把身份 (ERC-8004)、支付 (x402/MPP/a2a-pay 三条轨道并行)、市场 (Agent 广场 + 任务大厅)、仲裁 (Evaluator 质押陪审)四件事在一个月内跑通,并且真的有真实资金在链上流转的,OKX.AI 是目前为数不多的几家之一。

而且这套系统不是凭空搭建——它背后依托的是 OKX Wallet 多年积累的基础设施,日均超过 12 亿次 API 调用、覆盖 60 多条链和 500 多个 DEX 的处理能力,这是很多单点创业项目短期内无法复制的分发和技术底子。

再看问题本身的性质:

  • 评价机制割裂、链上刷量、支付链路偶发失败、任务大厅匹配效率低,这几件事本质上都是任何一个双边市场在冷启动阶段的通病——早期供需两端都稀薄,平台为了做出好看的数据,默许甚至配合刷量的情况并不少见;
  • 而评价体系的设计缺陷,也大概率会随用户规模扩大和产品迭代逐步补上。

三周时间里,身份和入门相关的 Skill 从七个模块收拢成两个,支付协议从单一的 x402 扩展到三条轨道并行,ASP 接入也补上了官方 SDK——这样的更新节奏说明团队在快速响应真实使用中暴露的问题,而不是产品定稿后就不再维护。

站在更大的趋势视角看,OKX.AI 的意义或许不在于它现在做得有多完美,而在于它验证了一件事:Agent 经济需要的基础设施,和为人类设计的传统金融基础设施,确实是两套不同的东西。

x402、AP2、MPP 这些协议在过去半年密集出现,说明整个行业已经从"要不要做"的讨论,进入到"谁的轨道能被更多人用"的竞争阶段。OKX 目前的策略是不押注单一协议,而是把主流轨道都接进来、由自己的结算层统一调度,这种多协议兼容的打法,短期看不如押中一个标准来得性感,但胜在容错率更高。

七、未来展望:OKX.AI 的尝试是否有价值?

OKX.AI为 Agentic Payment 的落地提供了一个很好的观测样本。那么回到最核心的问题:这个市场是否真实存在? Agent 支付究竟有没有价值?

我们的判断是,价值是存在的,但要拆成两层看。

  • 第一层,微支付本身的价值是确定的——通过链上的 x402 或 MPP 协议,把机器对机器的调用压缩到几分钱一次的结算成本,这在传统支付网络里几乎不可能实现;X Layer 免 gas、TEE 托管私钥、身份和信誉全局可复用,这些都实打实地补上了此前 Agent 经济无法落地的基础设施缺口。
  • 第二层,是"自主协作"这个更大的叙事——Agent 之间自动协商、竞标、交付的场景,目前的完成数据说明它还远没有成熟,现在真正跑起来的更多是标准化、单次调用的 A2MCP 服务,而不是设想中复杂的多 Agent 协作任务。

所以更准确的表述可能是:OKX.AI 目前证明的,是"机器对机器的微支付"这条腿已经能走路了,而"Agent 之间自主协作"这条腿,还处于蹒跚学步的阶段。这两者被打包进同一个 Agent 经济的叙事下,容易让人高估或低估其中一部分:真正值得持续跟踪的,是任务大厅的完成率能不能随时间往上走,以及评价体系的水分能不能被逐步挤掉。这两个指标,比 GMV 本身更能说明这件事是不是真的成立。

从世界杯主题的 Agent 一枝独秀,到品类逐步铺开;从单一的 x402 轨道,到三条支付协议并行调度——OKX.AI 上线一个月的变化速度,某种程度上比它当下的成交数据更值得关注。

事实上,它还远不完美。评价体系的水分、任务大厅的低效、支付链路偶发的割裂,都是实打实需要补的课。但作为少数把身份、支付、市场、仲裁做成完整闭环、且真实跑在链上的平台,它提供了一个观察 Agent 经济从概念走向基础设施的具体样本。

我们会持续跟踪这个产品接下来的迭代,也会留意 x402、AP2、MPP 这几条主线协议在更大范围内的落地进展。

免责声明:本文章仅代表作者个人观点,不代表本平台的立场和观点。本文章仅供信息分享,不构成对任何人的任何投资建议。用户与作者之间的任何争议,与本平台无关。如网页中刊载的文章或图片涉及侵权,请提供相关的权利证明和身份证明发送邮件到support@aicoin.com,本平台相关工作人员将会进行核查。

分享至:
APP下载

X

Telegram

Facebook

Reddit

复制链接