Agentic Web:构建智能体原生网络的基础设施挑战与四大支柱
1. 从“被动网络”到“能动网络”一个正在发生的范式转移如果你最近关注AI和Web技术的前沿动态可能会频繁听到“Agentic Web”这个词。它不像“Web3”那样带着浓厚的金融色彩也不像“元宇宙”那样充满科幻感但它所描绘的未来可能比前两者更早、更深刻地渗透进我们的数字生活。简单来说我们正在从一个由人类点击、输入、拖拽来驱动的“被动网络”转向一个由无数自主或半自主的智能体AI Agents代表我们或独立执行任务的“能动网络”。想象一下这个场景你计划下个月去东京旅行。在今天的网络里你需要自己打开多个App——查机票、比酒店、看天气、排行程、订餐厅。而在Agentic Web的图景里你只需要对一个“旅行规划智能体”说“帮我规划一个五天的东京深度文化游预算中等避开人潮。”这个智能体便会像一位不知疲倦的私人助理自动穿梭于航空公司的API、酒店预订平台、天气预报服务、景点开放数据库、餐厅评价网站之间进行信息检索、比价、协商甚至讨价还价、预订支付最后将一份整合了机票、酒店、每日行程、餐厅预订甚至交通卡购买链接的完整方案呈现在你面前。整个过程你无需介入任何一个中间步骤。这不仅仅是“更智能的搜索”或“更好的推荐系统”。核心区别在于“能动性”Agency。传统的网络服务是工具需要你亲手去使用而Agentic Web中的智能体是“行动者”它们被赋予目标并能主动调用工具、操作数据、与其他智能体交互以达成目标。它们可以是你的个人数字分身也可以是电商的客服机器人、企业的数据挖掘员、开源项目的代码审查员甚至是物联网中管理家庭能源的管家。然而当无数这样的智能体开始在网络空间里自主运行、交互、甚至进行价值交换时我们立刻会撞上一堵墙我们现有的互联网基础设施从技术协议到社会规范几乎都是为“人类-服务器”或“人类-人类”的交互模式设计的。它缺乏让智能体可靠、安全、可信地大规模协作的“游戏规则”。这就是标题所指出的核心挑战能动网络The Agentic Web需要一套全新的规范性基础设施New Normative Infrastructure。没有这套基础设施Agentic Web要么无法实现要么会陷入一片混乱。2. 为什么现有互联网“规则”对智能体失灵了要理解为什么需要“新”基础设施我们得先看看“旧”的为什么不行。现有的Web规范体系大致可以分为技术协议层和社会/法律层它们在面对自主智能体时都显得捉襟见肘。2.1 技术协议层的“失语”以互联网的基石——HTTP协议为例。它是一个无状态的请求-响应协议核心交互模式是“客户端通常是浏览器请求 - 服务器响应”。这个模型简单、有效统治了Web三十年。但对于智能体呢一个智能体的任务往往是长期、多步骤、有状态的。例如上述旅行规划任务可能涉及十几个网站的数十次交互。在HTTP的无状态世界里智能体需要自己维护复杂的会话状态、处理登录态Cookie、Token、解析各种反爬虫机制如验证码、行为检测。这就像让一个外交官用摩尔斯电码去进行一场复杂的多边谈判效率低下且容易出错。更根本的是现有协议缺乏对“意图”和“承诺”的表达能力。当你的智能体向机票API发送一个请求时它只是在问“有没有票”。它无法在协议层面说“我‘意图’购买这张票这是我的支付承诺凭证请为我预留10分钟。” 现有的电商流程依赖于人类在网页表单上一步步点击确认这套UI流程对智能体极不友好。我们需要协议能直接传达“我想做什么”以及“我承诺做什么”而不仅仅是“给我数据”。2.2 身份、责任与信任的真空在社会和法律层面问题更为尖锐。身份问题在网上你怎么知道和你对话的是一个真人还是一个智能体现有的身份验证OAuth, 银行卡手机号大多最终锚定在“自然人”。那么一个由公司运营的客服智能体它的法律身份是什么一个由个人训练、代表其执行财务操作的私人智能体它的权限边界在哪里如果多个智能体协作完成了一项任务如A智能体找到优惠B智能体下单功劳或责任如何划分我们缺乏一套为智能体设计的、可验证的、分层的数字身份体系。责任与问责当智能体出错时——订错了日期、买贵了商品、甚至未经授权访问了数据——谁来负责是智能体的所有者、训练者、部署平台还是提供底层模型的AI公司现有的法律框架如产品责任法、侵权法在面对这种由复杂算法链驱动的自主行为时很难清晰界定责任链条。没有清晰的责任框架商业应用将畏首畏尾。信任与安全你如何信任一个陌生的智能体它会不会是恶意软件套取你的个人信息它声称提供的服务如“最优价格保证”如何被验证智能体之间的交易如何确保公平防止欺诈今天的信任机制如SSL证书、平台审核、用户评价主要服务于人类可读的网站和商家对于自主运行的代码实体我们需要新的信任根和验证机制。价值交换与支付智能体之间可能需要进行微支付例如A智能体向B智能体购买了一条数据或支付了一小笔计算资源费用。现有金融体系高昂的手续费和复杂的合规要求KYC无法支持这种高频、小额、自动化的价值流动。这呼唤着与智能体原生集成的、轻量级的支付和清算协议。简而言之现有基础设施假设交互终端是“理性的人”遵循社会规范和法律。但智能体是“遵循代码逻辑的实体”要让它们有序协作我们必须将部分关键的社会规范和法律逻辑以机器可读、可执行的方式编码进新的技术协议和平台规则中。这就是“规范性基础设施”的涵义它既是技术标准也内嵌了行为规范。3. 构建新规范性基础设施的四大核心支柱那么这套新的基础设施可能包含哪些构件我认为它需要围绕以下四个核心支柱来构建它们相互交织共同为Agentic Web奠定基石。3.1 智能体原生协议与通信层这是技术底座的革新。我们需要超越HTTP的、支持“能动性”的通信协议。这方面已经有一些前沿探索智能体协议像AI Agent Protocol这样的项目旨在为AI智能体提供一个标准化的方式来暴露其能力、接收任务、报告状态。它定义了智能体如何描述自己“我能做什么”、如何被调用标准化API、如何流式返回复杂结果。这类似于为智能体世界创建了一个“服务发现”和“远程调用”的标准。意图中心化网络这是更前瞻的理念。用户或智能体不再直接操作“点击这里填写那里”而是声明“意图”“我想用最优价格买X商品”。一个去中心化的网络可能基于区块链负责将意图与能实现它的服务可能是其他智能体进行匹配、协商并执行。Anoma等项目正在这方面进行探索。在这种网络里协议本身就能理解“交易意图”并确保其被满足。标准化动作与能力描述为了让智能体能跨平台操作我们需要一种标准化的语言来描述数字世界中的“动作”。例如“添加商品到购物车”、“预订下午两点的会议室”、“查询某股票过去一周的波动率”等。这类似于为智能体世界创建一套“标准操作指令集”。OpenAI的GPTs Actions和Meta的Tool Calling格式是朝这个方向的初步尝试但更通用、开放的行业标准也许基于OpenAPI规范的扩展是必需的。这一层的目标是让智能体之间的“对话”和“协作”像今天浏览器与服务器之间的HTTP通信一样顺畅、标准。3.2 去中心化身份与可验证凭证智能体需要一个在数字世界中唯一、持久且可验证的身份但这个身份不一定直接等同于其创造者。一个基于去中心化标识符DIDs和可验证凭证VCs的体系非常适合。DID每个智能体可以拥有一个或多个DID作为其根身份。这个身份由智能体的所有者控制不依赖于任何中心化机构如某家大公司颁发。VCs智能体的“能力”和“权限”可以通过可验证凭证来声明。例如一个“智能体工厂”可以给其生产的“旅行规划智能体”颁发一个VC证明它“已通过安全审计版本号v1.2”。一个用户也可以给自己的私人助理智能体颁发一个VC声明“此智能体被授权在预算5000元内为我进行酒店预订”。这些凭证可以被其他智能体或服务验证且无法伪造。这套体系解决了身份和信任问题。一个陌生的服务在接到智能体请求时可以先验证其DID和附带的VCs“哦这是一个由XX公司审计过的智能体并且有用户的消费授权凭证可信度较高。” 这为自动化信任奠定了基础。3.3 责任框架与链上溯源当事情出错时我们必须能追溯到底发生了什么。这需要将智能体的关键操作和决策点进行不可篡改的记录。区块链或分布式账本技术在这里可以扮演关键角色但不是为了炒币而是为了“审计溯源”。想象一个智能体执行任务的过程被记录在一个透明的日志中关键步骤如“接收用户指令”、“解析出预算5000元”、“选择A酒店”、“发起支付请求”及其上下文当时的数据输入、模型推理的置信度分数被生成哈希并锚定在一条公共链上。当出现纠纷时“我明明设了预算上限为什么它订了8000元的酒店”用户可以调用这个审计链清晰地看到任务执行的每一步判断是用户指令模糊、智能体理解错误、还是外部服务如酒店价格突然变动的问题。这为划分责任提供了客观证据。结合“可验证凭证”我们可以构建一个从“身份” - “授权” - “行动” - “结果记录”的完整责任链条。智能体的行为不再是黑箱其决策过程有了可审计的踪迹。3.4 机器驱动的市场与激励机制最后为了让智能体生态繁荣我们需要一个它们可以自由、高效地进行价值交换的“市场”。这个市场同样需要规范性基础设施机器可读的服务等级协议智能体在购买一项服务如数据查询、模型调用时需要能理解服务的SLA服务水平协议——延迟、准确率、价格。这些SLA需要用结构化的、机器可读的语言如基于XML或JSON的特定模式来描述以便智能体在决策时进行权衡。自动化支付与清算集成加密货币或央行数字货币CBDC的智能合约可以实现智能体之间的实时、小额、自动化支付。例如一个数据查询智能体在提供结果的同时自动触发支付合约从请求方智能体的钱包中划转0.001美元。这解决了微支付的可行性问题。声誉系统就像电商平台的卖家评分智能体也需要声誉。其他智能体在与某智能体交互后可以根据结果是否准确、及时、可靠向其DID关联的声誉地址提交评分。这个声誉是去中心化、可验证的并且跟随智能体身份而不是某个平台账户。高声誉的智能体更容易获得合作机会。这一支柱确保了Agentic Web不仅是一个能“干活”的网络还是一个能“交易”、能“进化”的经济生态系统。4. 面临的挑战与可能的演进路径构建这样一套宏伟的基础设施绝非易事我们面临着技术、治理和 adoption采用层面的多重挑战。技术复杂性将上述四大支柱整合成一个连贯、高效、安全的系统是巨大的工程挑战。性能、扩展性、安全性如何防止对智能体身份、凭证或审计链的攻击都是需要攻克的山头。标准化之争就像早期的互联网协议战争如Betamax vs. VHS一样很可能会有多个竞争性的智能体协议、身份标准、意图网络出现。行业需要经历一个痛苦的整合过程才能形成广泛接受的标准。大科技公司、开源社区、联盟链组织都可能成为主要的推手。治理与伦理谁来决定这些嵌入在基础设施中的“规范”例如在意图网络中哪些类型的意图是允许被执行的如何防止智能体被用于欺诈、骚扰或破坏这需要技术专家、法律学者、伦理学家和社会各界的共同参与形成多利益相关方的治理模式。中心化平台如OpenAI、Google可能推出自己封闭但高效的一套而开源社区则推动去中心化、开放的一套两者可能会长期并存竞争。渐进式采用我们不会一夜之间跳到完整的Agentic Web。更可能的路径是渐进式采用封闭花园阶段首先在单个平台或生态内部实现如ChatGPT的GPT Store或某个电商平台的内部智能体工作流使用平台自有的、相对封闭的协议和身份系统。用户已经在这里体验到初级形态的Agentic能力。联盟与互通阶段几个大的平台或行业联盟如金融、医疗开始合作制定特定垂直领域的智能体互操作标准实现跨组织但有限范围的智能体协作。开放协议涌现阶段经过实践检验一些通用的、优秀的开源协议和标准如在身份、支付方面获得广泛认可逐渐成为事实标准打破花园围墙。成熟生态阶段基于开放标准的基础设施层成熟催生出繁荣的、去中心化的智能体市场和应用生态。对于开发者和创业者而言当前的机遇在于关注和参与这些早期标准的形成在垂直场景中探索智能体的应用并思考如何将自己的服务“智能体化”——即提供机器友好、意图驱动的API而不仅仅是人类友好的GUI。5. 对开发者与企业的现实启示面对这个趋势坐等基础设施成熟并非上策。现在就可以开始行动为Agentic Web的未来做准备。对于开发者拥抱“智能体思维”设计API时不仅要考虑人类开发者更要考虑会被智能体调用。这意味着API需要更加稳定、版本化、提供清晰的机器可读文档如OpenAPI Spec并考虑如何表达错误和状态以便智能体能进行异常处理和重试。探索意图驱动设计尝试将你的服务重新设计为对“意图”的响应而不是对“具体操作”的响应。例如提供一个“满足出行意图”的端点接收出发地、目的地、时间、偏好和预算直接返回整合的出行方案而不是分别提供查航班、查火车、查酒店的独立API。关注相关协议和SDK密切关注像AI Agent Protocol、DID/VC标准W3C、以及各种意图网络的进展。尝试用这些新兴工具来构建你的智能体积累实践经验。对于企业评估内部工作流的“智能体化”潜力哪些重复性、规则清晰、涉及多系统操作的任务如报告生成、IT服务管理、客户询价处理可以交给智能体从小范围试点开始积累数据和经验。重新思考客户交互界面未来的客户入口可能不是一个App或网站而是一个对话界面或直接对接客户的智能体。你的产品和服务如何被智能体理解和调用开始构建面向智能体的“后台”例如提供产品目录、库存、定价的标准化数据接口。参与标准制定如果你是行业内有影响力的企业积极参与相关行业联盟和标准组织为你所在的垂直领域如金融、供应链、医疗的智能体互操作标准发声这有助于在未来的生态中占据有利位置。Agentic Web的到来不是要取代今天的Web而是在其之上增加一个强大的自动化层。就像移动互联网在桌面互联网之上开辟了新大陆一样Agentic Web将再次极大地扩展数字世界的边界和能力。而构建其规范性基础设施的过程将是一场融合了技术创新、协议设计、经济建模和治理哲学的深刻变革。这场变革的序幕已经拉开它的终点将是一个智能体像今天的人类用户一样自如、可靠、充满信任地穿梭和劳作于其中的数字新世界。