WorkBuddy、火山引擎与 openJiuwen:政务智能体的私有化、开源和落地边界
审核稿|资料核验日期:2026 年 7 月 24 日
本文把“已公开落地”“官方能力示例”“建议方案”分开标注。产品能力来自官方文档与代码仓库;政务案例优先采用政府网站。没有公开证据的地方,不替厂商下结论。
政务部门真正要选的,通常不是一个“大模型聊天框”,而是一套能进入现有组织、数据和责任体系的工作系统。WorkBuddy 的优势在“人怎样完成一件办公任务”;火山引擎把能力拆成 HiAgent、Coze Studio、Coze Loop、DataAgent 与方舟;华为路线则由商业平台 AgentArts 与其开源版 openJiuwen 构成,强调生产级运行、多智能体协同和开放 SDK。
因此,本文的核心结论不是简单的二选一:
若目标是让工作人员快速获得可交付的文档、表格、PPT、分析材料,WorkBuddy 更接近开箱即用的“桌面执行型助手”。
若目标是建设全市或全区共享的智能体平台,统一纳管模型、插件、知识库、流程与审计,HiAgent + Coze + 方舟的产品矩阵更完整。
若“源码可审、可二次开发、可在内网独立演进”是硬指标,当前公开证据对 Coze Studio / Coze Loop 更有利;WorkBuddy 企业私有版支持私有环境,但 WorkBuddy 本体不应被描述为开源。
政务项目最现实的形态往往是组合:WorkBuddy 作为工作人员入口,HiAgent 或 Coze 作为智能体与流程底座,DataAgent 处理指标问数,所有高风险动作经过人工复核。
openJiuwen 是本轮对比中开源工程覆盖最完整的路线之一:Python、Java、C++ 仓库覆盖核心 SDK、Agent Studio、运行时与 MCP/A2A 协议;但其政务落地同样需要以政府验收材料核实,不能直接由金融或科研案例外推。
图表说明:叠加雷达图用于观察产品轮廓,热力图用于读取准确分数,结论卡片用于快速选型。1–5 分是 AIKnow 编辑部根据公开材料做的相对判断,不是厂商性能测试,也不应直接作为招标评分。
一、先拆掉三个容易混淆的概念
1. 私有化部署不等于开源
私有化回答的是“系统运行在哪里、数据是否离开指定边界”;开源回答的是“源代码是否公开、采用什么许可证、能否自行修改和分发”。一个闭源商业软件可以部署到政务专有云,一个 Apache-2.0 项目也可能因为默认组件、外部模型 API、插件密钥或运维能力不足而不满足政务要求。
腾讯云公开页面显示,WorkBuddy 企业专享版可使用腾讯云专享 VPC、独享运行环境、租户数据隔离和企业插件;企业私有版面向金融、政府和信创环境,强调自备算力与模型、企业内网和组织管理。这里能确认的是私有化交付能力,不能据此推导 WorkBuddy 本体开源。
火山引擎 HiAgent 官方材料同样明确提供私有化部署、第三方模型和自有算力接入、模型防火墙、操作审计以及 MCP Gateway。与此同时,Coze Studio 与 Coze Loop 的官方 GitHub 仓库采用 Apache-2.0,支持 Docker 部署和二次开发。两者可以组合,但商业 HiAgent 和开源 Coze 仍是不同产品边界。
华为云官方页面把 openJiuwen 定义为 AgentArts 的开源版。openJiuwen 官方 GitHub 组织中的 Agent Core、Agent Studio、Agent Runtime、JiuwenSwarm、DeepSearch 与 Agent Protocol 多数采用 Apache-2.0,语言覆盖 Python、Java 与 C++。这给采购方提供了源码级审查和二开入口,但 AgentArts 商业交付中的组织、安全、运维和云服务能力不能自动视为已全部进入开源版。
2. “支持多模型”不等于“模型可替换无成本”
WorkBuddy 官方资料显示其支持多模型切换,企业私有版可使用客户自备模型;Coze Studio 可配置 OpenAI、火山方舟等模型服务,Coze Loop 通过 Eino 接入多种模型;openJiuwen 官方提供模型广场和模型接入层,其协议仓库公开 MCP 与 A2A 实现。真正实施时还要逐项验证:
- 工具调用协议和结构化输出是否一致;
- 国产模型是否覆盖长文、公文格式、图表和代码任务;
- 知识库召回、引用和权限过滤是否跟着模型切换保持一致;
- 推理服务是否支持政务专有云的芯片、操作系统和信创环境;
- 模型升级后,历史提示词、评测集和审批规则能否回归验证。
所以“兼容”至少要分成模型 API 兼容、工具兼容、数据兼容、运行环境兼容和运维治理兼容五层。
3. 智能体能生成结果,不代表可以替代行政责任
公文初稿、政策摘要、工单分类和指标解释适合让智能体提效;行政审批、执法裁量、应急指令、舆情公开回应则必须保留有权人员确认。完整链路应记录输入资料版本、检索证据、模型版本、工具调用、生成结果、修改轨迹和最终签发人。
二、WorkBuddy:优势是“把任务做完”,短板是平台开放证据不足
产品定位
WorkBuddy 是面向知识工作者的桌面智能体。官方产品介绍强调自然语言交互、自主规划、多步骤执行,以及文档、表格、PPT、数据分析和代码等交付物。它还能在用户授权的工作区内操作文件,并连接腾讯文档、腾讯乐享和“我的文件”等知识源。
这与传统问答机器人的差异很大:工作人员不是只得到一段回答,而是希望收到一份可继续编辑的会议材料、政策对比表、汇报 PPT 或统计分析。对政务办公而言,这种“交付物导向”尤其有价值。
私有化与组织能力
WorkBuddy 的企业路线已经出现三个清晰层次:
- 团队版强调成员权限、公共资产、用量追踪和企业 API 密钥;
- 企业专享版强调腾讯云专享 VPC、租户隔离与企业插件;
- 企业私有版强调企业内网、自备算力和模型、第三方 SSO、组织管理、安全审计与 OpenAPI。
如果这些能力在项目现场完成验证,WorkBuddy 可以成为政府工作人员的统一 AI 办公入口。但采购前不能只看“私有化”三个字,必须要求厂商提供部署拓扑、出网清单、升级机制、日志字段、备份恢复、灾备目标和漏洞响应承诺。
开源兼容性
截至资料核验日,没有发现 WorkBuddy 本体的官方开源仓库。因此更准确的表达是:WorkBuddy 可与开源模型、企业插件和内部系统集成,但本体不是已公开源码的平台。
腾讯另有开源的 Youtu-Agent 框架,可作为腾讯智能体生态的技术参考,但不能把它和 WorkBuddy 视作同一个产品,也不能据此宣称 WorkBuddy 已开源。若项目要求源码审计或自主维护,应在合同中明确可审范围、源代码托管安排、二次开发接口和退出迁移机制。
数据与隐私边界
WorkBuddy 海外版隐私政策显示,部分配置保存在本机,但输入输出可能被远程访问并按政策保留一定时间。这个政策不能直接代表国内政务私有版的数据处理方式,却提示采购方必须针对具体版本核对:
- 输入、附件、缓存和输出分别存放在哪里;
- 模型推理是否出域;
- 遥测、崩溃日志和更新检查是否出网;
- 文件删除后,索引、向量、备份和日志何时同步删除;
- 管理员和厂商运维人员可以看到什么。
适合与不适合
WorkBuddy 适合办公材料生成、跨文件整理、会议纪要加工、表格分析、汇报材料和个人知识工作台。它不应单独承担全市智能体资产治理、复杂多部门流程编排、城市级指标语义层或大规模模型评测平台;这些更适合由 HiAgent、Coze Loop、DataAgent 或既有政务中台承担。
三、火山引擎同类产品不是一个,而是一套矩阵
HiAgent:企业级智能体工作平台
HiAgent 官方产品页公开了三类核心能力:一是纳管 HiAgent、火山引擎和第三方智能体;二是通过 MCP Gateway 连接企业系统与工具;三是通过提示词、插件、MCP、知识库和工作流低代码构建智能体。它还强调评测、可观测、数据工程、权限和审计。
这使 HiAgent 更像“智能体操作系统”而不是个人助手。它适合建设统一入口、场景路由、资产目录和运营体系。例如市级平台可以把政策助手、12345 工单助手、城运事件助手和招商助手纳入统一门户,同时为每个部门划分知识、工具和数据权限。
官方页面还披露浙江大学依托 HiAgent 在 7 天内建设“浙大先生”应用体系,覆盖 5 万余名师生。本文把它标记为官方能力示例:它能说明组织级门户和多场景落地能力,但不是政务案例。
Coze Studio:开源智能体开发底座
Coze Studio 官方仓库采用 Apache-2.0,包含提示词、RAG、插件、工作流、知识库、数据库、API 与 SDK,并提供 Docker / Docker Compose 部署。公开仓库在核验时约有 2.12 万 Stars、3100 Forks,具备可见的社区规模。
它的主要价值不是“免费替代商业平台”,而是让政府或集成商拥有可审查、可改造的应用层代码。代价也很明确:官方快速开始文档提示了公网部署时的账号注册、Python 代码节点、SSRF 和部分越权风险。政务上线必须关闭默认开放面、隔离代码执行沙箱、接入统一身份、实施镜像与依赖扫描,并建立版本维护责任。
Coze Loop:评测、可观测与持续治理
Coze Loop 同样采用 Apache-2.0,覆盖提示词版本、评测集、自动评测、实验对比和链路追踪。对于政务项目,这一层往往比“再做一个聊天窗口”更重要:
- 政策问答要测试引用准确率、时效性和权限泄露;
- 公文辅助要测试格式、事实、敏感词和引用法规;
- 12345 分类要测试错派率、漏派率与人工改派率;
- 工具调用要追踪每一步参数、返回和异常;
- 模型或知识库更新后要自动回归。
公开仓库核验时约有 5600 Stars、778 Forks。开源版提供核心能力,但商业版差异、生产级高可用和持续运维仍需单独评估。
DataAgent:城市指标问数的专用角色
DataAgent 面向自然语言问数、分析和数据开发。官方私有化文档强调私有环境、项目和角色权限。它适合领导驾驶舱、经济运行专题分析、招商指标、民生服务量和城市运行数据的自然语言查询。
但问数产品的成败不由模型决定,而由指标口径决定。上线前必须建设语义层:指标名称、公式、单位、时间粒度、组织范围、数据血缘和敏感级别都要可追溯。任何自动生成的 SQL 都应经过只读账户、行列权限、查询限额和结果脱敏。
openJiuwen / AgentArts:开源生产级 AgentOS 路线
openJiuwen 官方定位是面向生产级 AI Agent 的开源平台。与偏应用搭建的 Coze Studio 相比,它公开的工程边界更接近一套 AgentOS:Agent Core 提供开发、运行、调优与演进 SDK;Agent Studio 提供零代码/低代码开发和模型、知识库、插件管理;Agent Runtime 负责把智能体从开发态带到生产态;JiuwenSwarm 处理多智能体协作;Agent Protocol 提供 MCP 与 A2A 协议实现。
华为云 AgentArts 则是对应的商业平台。官方材料强调事件驱动的多 Agent 控制、任务中断与恢复、多实例状态隔离、执行状态持久化、全链路调测和提示词优化。对政务项目而言,其优势是开源核心与商业交付之间有较清晰的对应关系,并能进入华为云、鲲鹏、昇腾等生态;需要核验的则是开源版与商业版实际功能差异、离线依赖、第三方模型适配、信创认证范围和升级路线。
openJiuwen 官方及华为云社区披露了邮储银行、中科大科研工具等生产案例线索,但这些不是政务验收材料。截至核验日,本次检索没有找到政府官网可确认的 openJiuwen 具名政务生产案例,因此本文只把它作为开源平台能力已公开、政务落地仍待核验的候选路线。
四、政务与智慧城市的建议部署架构
一个可控的组合架构可以这样划分:
入口层:WorkBuddy 承担工作人员桌面任务;统一门户或移动端服务公众和跨部门用户。
智能体平台层:HiAgent、Coze Studio 或 openJiuwen Agent Studio 管理智能体、工作流、知识库和工具。
模型与治理层:方舟、华为云或政务自建模型服务提供推理;Coze Loop 或 openJiuwen 的调优与追踪能力负责持续治理。
数据分析层:DataAgent 或既有数据中台提供指标语义和受控问数。
连接层:MCP Gateway / API 网关连接 OA、政务服务、12345、城市运行、企业服务等系统。
安全底座:统一身份、最小权限、国密、审计、脱敏、内容安全、密钥管理、备份和灾备。
人工复核层:对审批、执法、应急和公开发布设置不可绕过的确认节点。
五、八类场景方案:从低风险办公到城市运行闭环
场景 1:政策检索与惠企服务
建议方案。 用 HiAgent / Coze / openJiuwen DeepSearch 建政策智能体,以版本化政策库和企业画像为依据;WorkBuddy 为工作人员生成政策对比表、申报材料清单和走访纪要。所有答案必须显示政策名称、条款、发布日期、有效期和原文链接。推荐结果只能作为辅助,最终资格认定由业务人员完成。
场景 2:公文与综合材料
建议方案。 WorkBuddy 负责从会议纪要、历史材料和统计表生成初稿;Coze Loop 或 openJiuwen 调优链路用评测集检查格式、事实引用、敏感表述和法规时效。重庆公开的智慧城市场景清单已经把 15 类国标公文生成和政治审核列为明确需求,说明这不是想象场景。风险控制重点是资料权限、引用出处、模板版本和签发流程。
场景 3:12345 工单分拨与辅助答复
建议方案。 HiAgent 或 openJiuwen Runtime 编排分类、知识检索、部门路由和草拟回复;WorkBuddy 帮坐席整合附件与历史相似工单;Coze Loop 或 openJiuwen 链路追踪统计错派、退单和人工修正。高频但低风险问题可建议答复,涉及安全、群体事件和行政争议必须升级人工。
场景 4:招商与企业服务
建议方案。 DataAgent 分析产业、企业与空间数据,HiAgent 或 openJiuwen JiuwenSwarm 调度政策和项目智能体,WorkBuddy 形成企业画像、拜访提纲和项目汇报。北京经开区公开案例显示,迎商数字人把部分招商资源获取从天级缩短到分钟级,可作为场景成效参照,但不能归因于本文对比的某一产品。
场景 5:城市事件发现—处置—复盘
建议方案。 视觉系统发现事件后,经规则引擎确认事件类型,HiAgent 或 openJiuwen 多智能体控制器调用工单系统分派,工作人员在移动端确认,处置结果回写;治理平台记录模型和工具链路。智能体不应直接越权关闭事件。真正 KPI 应是有效发现率、误报率、平均派单时间、按期办结率和复发率。
场景 6:城市指标问数与专题分析
建议方案。 DataAgent 连接经过治理的指标语义层,提供自然语言查询、趋势解释和可视化;WorkBuddy 把结果编成日报或专题汇报。深圳“城市+AI”清单提出地铁客流智能问数和可视化看板,证明城市管理部门已有清晰需求。回答必须显示口径、时间范围、数据更新时间和查询血缘。
场景 7:舆情与应急辅助
建议方案。 平台汇总公开信息和内部报送,智能体做聚类、时间线和矛盾点提示,WorkBuddy生成态势摘要。任何对外回应、预警等级和调度指令都由有权人员签发。系统应特别防范不实信息被重复引用后形成“多数证据”的假象。
场景 8:跨部门知识与数据协作
建议方案。 以统一身份和授权目录为中心,不复制原始数据到一个“大知识库”。HiAgent 或 openJiuwen 路由到各部门智能体,MCP/API 网关执行授权查询,治理平台记录链路。WorkBuddy 只接收用户有权查看的结果,并把它整理成交付物。跨部门价值来自权限可计算,而不是把边界全部拆掉。
六、公开证据显示火山引擎已有城市级合作,WorkBuddy 与 openJiuwen 暂缺可核验的具名政务上线案例
已公开落地:上海杨浦“城市 AI 工厂”

图片说明:上海市杨浦区人民政府官方页面截图,截取于 2026-07-24。公开页面证明合作与案例叙述,但没有披露智能体后台或实际业务系统界面。
上海市杨浦区政府披露,杨浦区与火山引擎于 2025 年签署合作协议,共建政府主导的“城市 AI 工厂”;后续公开材料还介绍了面向外贸企业的报关单智能体,融合大模型、OCR 和多源数据。它证明了火山引擎参与城市级政企协同和产业智能体建设,但公开材料没有证明 HiAgent 或 Coze 是所有场景的唯一技术底座。
已公开合作:福州鼓楼“1164”AI 原生城市

图片说明:福州市鼓楼区人民政府官方页面截图,截取于 2026-07-24。该图属于官方证据页,不是系统产品界面。
福州市鼓楼区政府披露火山引擎东南总部落地,并提出 AI 基础资源服务、可信数据空间、多场景能力中枢,以及就业、养老、社区、体育等应用方向。它可作为城市级能力中枢规划案例,但“落地总部和规划架构”不等于所有场景已验收,应等待具体项目、指标和运营数据。
政务参照案例:北京经开区政务大模型中枢

图片说明:国家数据局典型案例页面截图,截取于 2026-07-24。若页面未显示业务系统 UI,不据此推断具体前端或底层厂商产品。
国家数据局公开的北京经开区案例采用“1 门户 + 3 中心 + 3 引擎”,覆盖智能问政、助民、决策、迎商、视觉治理、投诉客服和执法案卷。北京市政府后续披露部分指标:案件处理效率提升 3 倍以上,执法文书生成速度提升 15%,证据审核效率提升 12%,裁量标准一致性提升 20%。这组案例不是 WorkBuddy 或火山引擎产品案例,但它给出了政务智能体平台应有的组织方式和可量化指标。
WorkBuddy 政务案例的证据空白
截至 2026 年 7 月 24 日,本次检索没有找到由腾讯、政府网站或权威采购信息可核验的 WorkBuddy 具名政务上线案例。因此本文不把企业版能力包装成“已落地”。采购方可以把办公材料、公文辅助和知识检索作为试点,并用真实任务集验证,但应在正式选型前要求厂商提供可回访客户、验收范围和运行指标。
openJiuwen 政务案例的证据边界
openJiuwen 官方资料和华为云社区披露了邮储银行、中科大、OfficeAce 等生产使用线索,说明其已经越过纯概念阶段;但它们分别属于金融、科研和办公生态,不能代替政务验收证据。本次检索没有找到政府官网明确写出“某城市政务系统采用 openJiuwen 并完成上线验收”的材料,因此本文不把 openJiuwen 描述为已有具名政务标杆。
七、采购与验证:建议做一轮 8–12 周双轨 PoC
第一阶段用两周完成数据分级、场景边界、人工责任和接口清单;第二阶段用四周分别验证 WorkBuddy 办公交付、HiAgent / Coze 与 openJiuwen 智能体编排、DataAgent 问数;第三阶段用两周进行安全测试、模型切换、断网运行、备份恢复和压力测试;最后用两到四周做真实部门灰度。OpenJiuwen 还应单独验证 Python/Java 版本差异、MCP/A2A 互通、Agent Runtime 状态恢复与 AgentArts 商业版能力差异。
建议把验收指标写进合同:
- 任务完成率,而不是只看回答“像不像”;
- 引用准确率、过期政策识别率和越权拦截率;
- 工单错派率、人工修正率和闭环时间;
- 模型、工具、知识版本的全链路可追溯率;
- 断网可用性、RPO/RTO、升级回滚时间;
- 源码和依赖清单、漏洞修复 SLA、退出时数据与智能体迁移能力;
- 单任务综合成本,包括模型、平台、向量库、存储、人工复核和运维。
八、最终判断
WorkBuddy 最有竞争力的地方,是把 AI 从问答拉到桌面执行和交付物;它适合做政务人员的高频办公入口。它当前公开材料最需要补强的地方,是本体开源透明度、具名政务案例和复杂平台治理证据。
火山引擎的优势是产品分层完整:HiAgent 做企业级入口与纳管,Coze Studio 提供开源开发底座,Coze Loop 提供开源评测与可观测,DataAgent 处理问数,方舟承接模型服务。代价是系统复杂度更高,项目方必须明确每一层的责任和商业/开源边界。
openJiuwen / AgentArts 的优势是开源核心覆盖面广,并提供多语言 SDK、运行时、多智能体与协议层,适合重视信创生态、源码掌控和长期自主演进的建设方。它当前需要补足的是可由政府来源核验的政务生产案例、开源版与商业版清单式差异以及在目标环境中的完整兼容验证。
如果项目以“马上提升工作人员材料产出”为主,可先试 WorkBuddy 企业私有版;如果以“建设城市级智能体共性平台”为主,评估 HiAgent + Coze + 方舟和 openJiuwen + AgentArts 两条路线;如果强调源码可控、Java 技术栈与华为生态,openJiuwen 权重应提高。三条路线都必须用统一身份、审计、评测和人工复核连接到真实政务责任链。