ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

基于 OpenWorkBuddy 二次开发:Skills / MCP / Plugins / Engines 四个扩展点实操

基于 OpenWorkBuddy 二次开发:Skills / MCP / Plugins / Engines 四个扩展点实操 一、为什么值得拿它当二次开发底座评估一个开源 Agent 能不能当底座我的标准只有四条① 基础件是不是齐的你不需要从零写主循环、权限系统、记忆、审计——这些必须已经调过很久。② 有没有开放扩展点这是「拿来能用」和「拿来能改」的分界线。闭环项目你只能照它的方式用。③ 语言和构建成本高不高团队抽一两个人做二次开发时环境配置能力就是生死线。④ 授权边界清不清楚这一条最容易被忽略也最容易出事。用了半年才发现要授权那时候已经深度绑定换不了了。OpenWorkBuddy 四条都对得上所以这篇我讲具体怎么下手。二、动手之前先跑起来bashgit clone https://github.com/CatCatUncle/openworkbuddy.git cd openworkbuddy npm install npm run app # 桌面版 npm start # → http://localhost:3800Node.js 18零构建。没有 webpack、没有编译等待、没有复杂的 monorepo 结构。改完存盘就见效——这一点对二次开发的迭代速度影响巨大。读代码的路线textserver.js → 看服务怎么起、路由怎么挂 agent.js → 看 Agent 主循环怎么编排模型和工具想理解 Agent 主循环规划 → 工具调用 → 观察 → 决策 → 继续从这两个文件进去最快。它的架构分层大致是text入口层桌面端 / Web / CLI / IM飞书、企微、钉钉、Telegram ↓ 本地运行时会话 · 权限 · 项目 · API ↓ Agent 编排规划 · 工具调用 · 文件验收 ↓ 模型路由云 LLM / Ollama / Claude Code / Codex ↓ 能力层Markdown Skills · 专家 · MCP · Plugins ↓ 工作区文件 · 素材 · 项目上下文 · 记忆 ↓ 本地 Trace模型 · 工具 · 耗时 · Token · 输入输出这张图就是你的改造地图——想改哪一层直接找对应模块。三、扩展点一Skills技能—— 最低门槛优先做这个3.1 机制textskills/ └── 技能名/ └── skill.md存盘后下一条任务就生效。不改代码、不重启、不打包。3.2 为什么这是最值得优先投入的扩展点因为它把「给 Agent 加能力」这件事的门槛从「写代码」降到了「写文档」。这意味着你们公司的业务专家能自己往系统里加能力部门沉淀出什么财务报销单审核规范、发票异常判断标准销售客户跟进话术、报价计算规则法务合同风险点检查项、常见条款红线HR简历初筛标准、面试评估维度客服FAQ、投诉分级与应对研发代码规范检查、发布 checklist经验从人的脑子里变成系统里的文件。这一步的意义在于它把 AI 落地从技术项目变成了业务项目。技术团队只负责搭容器能力由懂业务的人沉淀。3.3 实操建议写skill.md的时候我建议包含四块markdown# 技能名 ## 什么时候用 触发条件写得越具体越好 ## 具体步骤 1. ... 2. ... ## 需要什么输入 文件、数据、参数 ## 输出什么 格式要求、必须包含的字段、验收标准「输出什么 验收标准」这一块最容易被漏但最重要。因为 OpenWorkBuddy 有文件验收机制——你把验收标准写清楚它交付时就会自己对照。3.4 安全提醒装别人的技能之前先过一遍静态体检。项目本身会做但你自己也要读一眼skill.md——技能里写的是指令指令能指挥 Agent 干什么这一点必须清楚。四、扩展点二MCP —— 接你们自己的内部系统4.1 机制走标准 MCP 协议Model Context Protocol把外部工具和数据源接进来。4.2 二次开发的典型用途这是企业二次开发最有价值的一块。你公司的数据在 ERP、CRM、工单系统、知识库里Agent 默认读不到。通过 MCPtext内部 ERP → 让 Agent 查订单、查库存 内部 CRM → 让 Agent 查客户历史、写跟进记录 工单系统 → 让 Agent 建单、流转、查状态 内部知识库 → 让 Agent 检索公司文档 内部审批流 → 让 Agent 发起审批、查审批状态4.3 安全设计要点接内部系统时有几个坑要提前想权限对齐Agent 的权限不能超过调用者本人的权限。别让一个普通员工通过 Agent 读到 HR 数据。写操作要审批查询可以放行写操作下单、改状态、发审批必须走人工确认。审计留痕每一次 MCP 调用记录「谁、什么时候、让 Agent 干了什么」。白名单只暴露必要的接口别把整个内网 API 都挂上去。项目自带的命令审批 审计日志 四档权限在这一层可以直接复用。4.4 顺带说一个配套工具作者还写了一个姊妹项目toolward——专门给 Agent 用的技能 / MCP 连接器做静态安检37 条规则分六族零运行时依赖。bashnpm i -g toolward装上之后OpenWorkBuddy 会自动把它当第二把尺子用。不装也完全不影响运行。自己写 MCP 连接器的时候可以先拿它扫一遍。这东西对做二次开发的团队很实用。五、扩展点三Plugins —— 深度改行为5.1 什么时候需要它Skills 是「教它做事」Plugins 是「改它这个人的性格」。典型的场景强制审批流某类操作必须走审批不能只靠 Prompt 约束强制留痕某些操作必须记审计日志组织级约束比如禁止 Agent 访问某个目录、禁止发出含特定关键词的内容注入上下文在每次任务开始时自动注入公司规范5.2 设计原则我的经验是能用 Skills 解决的别用 Plugins。原因很简单——Skills 业务方能维护Plugins 只有技术能维护。每引入一个 Plugin你就多了一份只有少数人能改的代码。Plugin 只用在「必须用代码强制约束」的地方安全边界、审计要求、组织级规则。六、扩展点四Engines —— 换执行引擎直接省 token 钱6.1 用法bashopenworkbuddy engines use claude-code本机装了Claude Code / Codex的一键拿它当发动机跑在你已经付过钱的订阅上不额外烧 API 额度。6.2 为什么这对企业很重要企业落地 AI 最头疼的一个问题就是成本不可控。云端按 token 计费用得越多花得越多做预算时完全没法估。而如果团队里已经买了 Claude Code 或 Codex 的订阅把这块能力接进 Office Agent等于零边际成本。这是一个很聪明的设计——不逼你再买一份而是把你已有的用起来。6.3 也可以完全离线配合 Ollama 跑本地模型textOllama本地模型→ 从模型到数据全不出内网对数据安全要求最高的场景这条路是通的。七、CLI二次开发和自动化集成的接口CLI 与桌面版共用同一份配置、技能、记忆、连接器和会话。bashnpm link # 装成全局命令 openworkbuddy 帮我写一份本周周报 # 单发 openworkbuddy # 交互 cat error.log | openworkbuddy 这是什么问题 # 管道 openworkbuddy -q 生成本周周报 周报.md # 静默输出 openworkbuddy doctor # 环境自检 openworkbuddy sessions / resume # 会话 openworkbuddy worktree # 工作树退出码text0 成功 1 任务失败 2 参数错 130 CtrlC单发和管道模式不会反问所以在 CI、cron、内部工具脚本里可以放心用。举个实际的集成例子bash# 每天 18:00 自动生成日报 0 18 * * * openworkbuddy -q 汇总今天的 git 提交并生成日报 ~/reports/$(date %F).mdbash# 日志分析流水线 cat /var/log/app/error.log | openworkbuddy 定位根因给出修复建议八、上线前的安全清单这个 Agent 手里有 shell能跑命令、读写文件、上网。二次开发之后风险只会变大不会变小。上线前逐条核[ ] 命令审批危险命令人工确认[ ] 文件黑名单密钥、财务、HR 目录[ ] URL 白名单[ ] 四档权限按部门最小化[ ] 审计日志可查、留够时长[ ] 第三方技能/MCP 先过静态体检[ ] 默认监听127.0.0.1[ ] 二次开发新增的 MCP 接口只在内部网络可达⚠️ 官方明确说明默认配置只为本机调试设计。放公网前先读docs/安全.md。九、授权边界动手之前先确认PolyForm Noncommercial 1.0.0text个人 / 学习 / 非营利 → 免费 公司内部使用 → 需要商业授权一个诚实的设计买授权不解锁功能代码只有这一份。未授权版和授权版功能完全一样差别只在「合不合规」。作者不靠功能阉割逼单靠合法性和服务——这对准备长期投入二次开发的团队是好消息不用担心以后会不会突然被卡脖子。另外需要注意的是项目里有《开源与商业版边界》专门文档讲清楚买授权到底买到什么。二次开发之前请务必读一遍把我能改什么、改完能不能商用这两个问题先确认清楚。对接方式项目作者背景常驻深圳前大厂 Agent 工程师有丰富的 Agent 落地实践经验服务过跨境电商、制造业、AI 初创、私募金融机构、消费品巨头、国央企等客户。业务范围企业 AI 内训 / 企业私有化部署 / 行业智能体 / AI 数字化全案 / AI 搜索优化 / Agent 项目落地 / FDE驻场工程。text商业授权 · 私有化部署 · 二次开发合作 · FDE → contactaijentra.com邮件里把这些写清楚对方能直接给方案text1. 行业与规模 2. 想解决的问题 3. 是否二次开发 / 想扩展哪个方向Skills / MCP / Plugins / Engines 4. 数据安全要求级别是否要完全离线 5. 期望的时间节奏十、总结四个扩展点按投入产出排序优先级扩展点门槛见效速度Skills会写文档立竿见影Engines一条命令立刻省钱MCP懂协议打通内部系统后价值最大4Plugins写代码只在必须强制约束时用企业本地部署 Agent 系统它是首选基于它做二次开发它同样是最省事的那个起点。理由收敛成三条基础件齐全——不用自己造轮子扩展点明确——四个入口按需切入技术栈友好——Node.js 零构建改完存盘见效本地部署的 Agent 软件 本地部署的模型是每一个注重数据安全的企业未来必然要选的方向。它不是一个 toy project。212 Stars、持续迭代、企业后台完整、有 CLI、有 MCP、有插件体系、有明确的授权路径。text项目地址https://github.com/CatCatUncle/openworkbuddy 授权与二次开发contactaijentra.com
返回列表