心爱的蓝色大肥鱼,期许你能够不畏惧潮流的变化,轻快的悠游来去于时代之中。 小骄傲 (点击了解更多详细信息) Deepseek Harness (DSH)热热闹闹的,劲头也感染到我身上。 学了几天后,我发了一条 短评 ,简单谈谈一下为什么我认为 DSH 骨子里是一个很 Web3 的产品,以及 AI 和 Web3 你中有我我中有你不可分割。 过去有段时间,我一直在做 Web3 基础设施与自主 Agent 的交叉研究,之前在曼昆区块链、RWA 研究院等专栏发过几篇深度长文,文章也上过 ME 的 Banner。 早在 AI 进入大众视野前,Web3 就早早开始押注机器支付、Agent 交换协议、链上身份、零知识证明等概念。保持跟踪下来,我也从谷歌的 A2A 一直跟到 X402 ,再到现在的 AP2 ,以及阿里等大厂加入的战局。后续我会写一篇文章来讨论这件事。 也正因这种思维惯性,每次看到新的 AI 产品,我的第一反应总是: 这个 Agent 处在系统拓扑的什么位置?它的状态和权限归谁所有?它怎么和外面的世界打交道? 行业早早认定了 Agent 迟早会开始替人寻找服务、与别的 Agent 协商、调用付费能力,甚至在事先授权的范围内完成交易,成为字面意义上的智能代理,为人完成一系列的事情。今天的一切研究方向,以我们看,本质上都是朝着这个终局狂奔。 但在到达那一天之前,身份、通信、授权和支付等一堆工程硬伤会同时砸过来。偏偏各家巨头、地区和垂直行业绝无可能立刻坐到一张桌子上接受同一套方案。标准没共识,应用层没普及,老登们各自画地为牢的存量蛋糕还要分(MPP 就是个活生生的例子)。 经过多年的发展,机器支付以及 Agent 的概念大大方方地在大众面前驻足。但整体而言,仍然需要一套通吃的解决方案。让我们看看已有的工具:Claude Code 与 Codex 更侧重于编程,OpenClaw 是一个炒作,Hermes的开发者明显不关注这件事,他们作为 Agent 交互世界每个阶段的典范,都没有尝试进一步,去回应与世界交互之后的支付、分配、通讯,以及那个崭新世界留下的权力分配问题。 就在这个当口,DeepSeek Harness 出现了。它从理念到设计,让我觉得像一条鱼一样,在各个方案、生态和利益间游动,有着无限可能,就是行业要的答案。 “一切皆插件”看似是个老概念——早年的 Coze 也是打着插件市场的旗号拉拢开发者,但最终不得不困在中心化平台的一隅,死死按住了开发者的想象空间与商业闭环。DSH 会重蹈覆辙吗?我认为不会。 众多没有展开的讨论在我的短评中被忽略,跳了很多逻辑,最后写得很放松 “上个链就很好解决了。相信大鲸鱼,相信相信的力量。” 当然,文章已经发布评论区大家的批评很猛烈。有人问这连个 Token 都没有跟 Web3 有什么关系,有人说 Pi 早就在做高度可扩展的 Harness,也有人指出,协议终究会收敛,钱包和支付服务本来就应与 Agent 解耦,谁会把钱交给一个概率模型随便花。 所以我觉得有必要写一篇长评,来好好说说我的观点。 正巧,之前在我老师的介绍下,得以认识并加入到 ANP 开源技术社群的国内 Builder 群,这段时间有幸和 ANP 项目的负责人长山老师简单交流。 长山老师谈到,他们过去把产品接入 OpenClaw 和其他 Harness 时,总觉得配合别扭,换成 DeepSeek Harness 后却“简直飞起来”。 诶,我眼睛一下就亮了。 它正好击中了短评另一个属于工程的,没有想到却很重要的地方。现在的 Agent 几乎都能装插件、接 MCP、挂外部工具, 为什么协议开发者仍会明显感觉到,有些东西只是被塞进去了,有些东西却终于找到了自己的位置? 首先还是要回到实践上。模型和工具的关系不是随插随用的乐高,Harness 就是模型的“专武”。专武选得对不对,战斗力天差地别。同时,Harness 对于模型做什么能做得更好,也有着举足轻重的作用。基于这样的原因,目前大部分的 Harness 都被厂商善意地将技能点锁死并专精在编程,剩下一点还算的话就是创意写作了。环境、连接、流程的自主选择和控制没有留给用户,没有留给开发者的余地。也就 Pi 做得更好一些。 其次,我说它“很 Web3”,并不是因为它自带区块链、钱包或 Token。它没有这些东西。我说的是正是这样的一种结构: 底层保留一套较薄的共同语法,让不同主体实现、部署和组合上层能力,也让使用者保有替换、迁移和退出的余地。经济层面上,身份、支付和创作者关系将来有机会脱离单一平台继续存在。 两者互补,进而让长山老师觉得“飞起来”。 而 DSH 之所以会长出这种结构,我看了 Tianyi Cui 的推特,推断他们大概没有想到“要做 Web3”,是因为它面对的是同一时期从两个方向压向 Harness 的不确定性。上层的 Agent 协议和经济规则还没有答案,下层的企业与行业需求又高度分化。 夹在中间的运行时如果提前把某个模型、某条 Loop、某种会话、某套权限和一种支付逻辑写死,很可能在未来到来以前就先迅速老死在半路上了。 Claude Code 和 Codex CLI 不正面临着迅速老去的问题吗?行业已经不再需要被厂商规训好的预制菜,大家迫切需要的是把自己的行业经验,炼化成最趁手的兵器。 于是,这篇长评想找到的是这么一个 DeepSeek Harness 最值得讨论的地方——它主动选择了一个更薄、也更耐久的位置。 让我详细展开。 法无定法 要讲透这事,我们得先把思维拉回交易的原点,从一个极常见的场景聊起。 用户对 Agent 说:“帮我买两张演唱会门票,总价不要超过两千元。” 现在的模型听懂这句话毫无压力,但在真实世界里执行起来却步步维艰。原平台没票了,能不能跳到二级票务平台?票价符合预算,但加收 30 块手续费,要不要打断用户重新确认?位置极度靠后,Agent 有没有权自行放弃?购票需要实名,能向第三方披露身份证的哪些字段?付款失败后重试几次? 这一连串追问,直接撕开了意图表达、受限授权 [1] 、身份验真、长周期状态管理等一整套全新的交互模式。 Doc Searls 提出的「意图经济」将这套交易模式抽象并理论化,形成了这么一门站在买方角度,探讨怎样重新获得主动权的学问。 [2] 消费者可以直接告诉市场自己需要什么、接受什么条件、愿意付多少钱,供应方围绕这些明确意图作出响应,而不是被动等待中心化巨头通过爬取浏览、点击和定位数据,在算法黑盒里猜你的欲望。 到了我们所处的 Personal Agent 时代,Searls 与时俱进,将意图经济和交易模式的形态说明地更加清晰,指出替个人表达意图的 Agent 应当由个人拥有和运行。留在大型公司的封闭系统里、主要依靠监控数据推测用户的助理,很可能只是把注意力经济做得更精细,从而进一步加强垄断地位——这就是监控资本主义和平台资本主义的终极形态了。 [3] 理论很丰满,现实很骨感。刷过 OpenClaw、Hermes 几轮热潮之后,人们发现我们不会天然进入那套未来的交易模式,意图经济也不会自然而然地生长出来。平台自己的购物 Agent 也许比旧推荐算法更懂得诱导用户,甚至能在对话中即时修改报价、排序和表达方式。 〔注1〕 唯有当 Agent 能够跨平台行动,且用户死死握住数据权、授权凭据和迁移退出权时,真正的意图经济才有可能落地。 为了那个开放、光明的未来,我们需要落到工程上解决一些问题。 在 Agent 上,问题和解法很明确,我们需要一套分层协议。幸运的是解法已经有了很多。 A2A 是最先出现的分层协议,最早提出如何处理不同 Agent 怎样发现彼此、发布能力、交换消息并管理长时间任务。它的 Agent Card 类似一张机器可读名片,任务则具有状态,可以持续更新、等待输入或认证,也可以通过流式连接和推送通知跨越很长时间。 [4] AP2 关心的是用户究竟授权了什么。用户不在场时,可以事先签署带有价格、时间和其他条件的意图凭据,Agent 满足条件后再生成具体购物凭据。 [5] Google 在 2026 年把 AP2 捐赠给 FIDO Alliance,后续标准化也在尝试把安全委托、可验证授权和交易执行分开。 [6] MPP 与 x402 更靠近支付请求本身。两者都利用 HTTP 402 的挑战—凭据—重试流程,让软件在调用 API 或数字服务时直接完成付款并取得回执;MPP 把不同支付方式放进共同协议,x402 目前的实践则以按请求支付和稳定币结算最为突出。 [7] [8] ANP 的目标更宽。它试图为开放的 Agent 网络提供身份、发现、描述、安全消息和支付等协议, [9] 其 1.1 版本已经把消息能力拆成身份与发现、直接消息、群组消息、端到端加密、附件和跨域通信等多个配置层。 〔注2〕 显然,有的协议负责管路通信,有的负责能力背书,有的负责授权验真,有的负责账本清算。 未来几乎不可能出现一个大一统协议包揽全部环节。 面对这个判断,反方最有力的意见是,今天看上去纷繁的协议,往往会在竞争中收敛。 很有道理,开发者不会永远乐于为十套接口维护适配层,市场也会追求规模和网络效应。 但回顾计算机史,收敛通常发生在某一层,而不是提出一种万全法。 HTTP 的大一统没有干掉 DNS、TLS、OAuth 和底层的 TCP。同样,当机器支付进入个人零售、企业采购和跨国服务时,背后的合规、税务和授信逻辑也绝不可能收敛为单套代码。 更现实的情形,是某些层逐步稳定,另一些层继续竞争,旧协议与新协议在相当长时间内共存。 于是,从反面出发,这个方面的意见反而使得我们更加确定会有这么一个时期,多个协议会同时存在,仿佛一个电缆束一样要介入到我们的 Agent 中。 至于评论区提出的“钱包应与 Agent 解耦”,谷歌在推行 AP2 时就交过学费,把购物 Agent、凭据提供商和支付处理器从物理上切开,Agent 连银行卡号都摸不到。 但需要指出的一点是, 解耦不等于互不相干。 Agent 仍要读取授权条件、挑选服务、发起请求、等待确认、调用受限的支付能力、保存回执、处理失败,再把状态反馈给用户。钱包可以独立,支付服务可以独立,通信协议也可以独立,进入一项具体任务后,它们仍要被组织成一条可以恢复、取消和追踪的执行链。 如何组织,这便又为 Agent 提出了更高的要求。 〔注3〕 网络协议处理参与者之间怎样协作,Harness 处理单个参与者内部怎样行动。至少应当确认的是,前者越开放,后者越需要允许差异存在。否则所谓 Agent 网络最后仍会退化成一家平台,把所有参与者吸进同一套账户、数据和工作流中。 不确定性还从另一个方向涌来。 律师处理的基本对象是客户、案件、事项、证据、期限和利益冲突;工厂面对的是设备、工单、班组权限、安全联锁和异常升级;企业采购围绕供应商、预算、审批链、合同、交付和付款节点运转。不同行业的需求汇聚到一个工具上,开发者们再把这些内容都翻译成同一种 Thread、Session、Tool Result 和 Approval,短期能跑,长期会留下越来越厚的翻译层。 Claude Code、Codex、WorkBuddy 这类完成度很高的产品就是这样。它们并没有做错第一步,若用户安装以后还要自己挑选循环、存储、会话和沙箱,Agent 很难完成早期普及。 问题出现在它们进入千行百业之后。通用产品的默认逻辑越完整,行业灌输自身经验时就越容易碰到产品墙,转移其他工具方向上又是一笔成本。 上层协议还在生长,下层业务又拒绝统一。两股力量最后都落到 Harness 身上,成为目前一定要解决的问题: 究竟是替所有人给出一套完整答案,还是保留足够多的变化位置,让协议和行业各自把答案带进来? 势无定势 在这个时间点的这个问题下,DeepSeek 自觉或不自觉地,用新生的 DeepSeek Harness 的诞生交出一份答卷。 DeepSeek 对 DSH 的介绍很直接。Agent 等于模型加 Harness,模型、工具、技能、会话、沙箱、存储、循环、调度和界面都由插件提供,开发者可以通过配置选择、替换或扩展这些能力,无需修改 DSH 源码。系统提示词、推理、工具调用、子 Agent 调度和上下文注入则进入追加式会话日志,恢复、分叉、搜索与回放共享同一条事件流。 [10] [11] 所谓「一切皆插件」。 上述的那些宛如天书的文字已经让困于现有工具的开发者们兴奋不已,star数秒突破10万。而翻开架构文档,「一切皆插件」的原则和精神会更加清楚。简而言之,模型适配器、工具注册表、会话日志甚至连 Agent Loop 自己都在这套基于 Cordis 搭建的插件树中。插件向共享上下文提供服务、类型化事件和可回收的副作用,卸载时相应注册随生命周期撤销。具体到运行时,会话从空配置开始,依次叠加基础组合包、其他组合包、Profile 和本地 Patch,最终打印出的配置行都可以被上层覆盖,组合起来是相当方便随意的。 [12] [13] 如果你用过锤子手机,或者自定义模块类似的设计,你一定会担忧这个「不可能三角」,即组件自由替换,基础配置如服务接口、事件语义、依赖和生命周期和语言之间的矛盾。不过幸运的是,显然 Tianyi Cui 及其带领团队在语言的选择上足够老道,Cordis 留下的组成语法让所有模块运行的非常守规矩。这也就给了 DSH 放开的空间。 到了使用者手里时,循环如何推进、会话放在哪里、工具如何加载、状态如何更新、接口如何匹配、沙箱怎样执行、事件如何安排,以及界面最后长成什么样就变得如鱼入水一般自由畅快。 中国开发者就这样飞了起来。 这种自由放在普通工具上不一定醒目,但放在协议接入上更是明显。 DSH 的扩展手册专门定义了 external protocol driver。一个协议驱动可以创建或恢复 Agent,把远端请求映射为继续执行或取消,接入 Agent、Session 和持久化服务,并持续观察会话事件流。消息入口、长期状态、取消、回执与界面更新因此有了不同落点。 [14] 不过,只要目标是让两个 Agent 发出一条消息,DSH 并不构成必要条件。ANP 团队曾经用“一段 Prompt、一个 HTTP 函数”把 OpenManus 和 OWL 接进协议。事实证明,通信可以做得很轻,任何能够增加工具的 Agent 都有机会成为网络端点。 DSH 的优势从通信变成长期关系以后才逐渐显出来。 长山老师参与的 d


  • 情报分类:硬件与数码
  • 分类依据:内容涉及硬件、数码产品或通信卡
  • 信息来源:服务器 / LINUX DO - 最新话题
  • 发布时间:2026/10/4 22:08:33