OpenAgent 近日发布 v2.93.0。这是一个自托管的 AI Agent 平台,由 Casbin 开源社区维护,Go + React 编写,Apache 2.0 协议开源,目前在 GitHub 上有 5.6k star、658 fork。
项目定位
-
OpenAgent 不是需要写代码编排的 Agent 框架,而是一套部署完就能直接使用的平台:配置好模型 API Key 之后,非技术人员也可以通过 Web 界面使用。功能上同时覆盖多模型接入、RAG 知识库、自主 Agent 循环、BPMN 可视化工作流、定时任务、多租户、SSO、审计日志与用量成本统计。
部署方式是单个可执行文件。前端构建产物通过 Go embed 打包进二进制,默认静态资源也一并内嵌,因此在无外网、无法访问 CDN 的内网与气隙环境中同样可以正常运行。交叉编译覆盖 Linux 的 amd64 / arm64 / riscv64,以及 macOS 与 Windows 的 x86_64 / arm64。Windows 下原生运行,不需要 WSL 或 Docker。
# macOS / Linux
curl -fsSL https://raw.githubusercontent.com/the-open-agent/openagent/master/scripts/install.sh | bash
# Windows PowerShell
irm https://raw.githubusercontent.com/the-open-agent/openagent/master/scripts/install.ps1 | iex
启动后访问 http://localhost:14000 即可,内置 SQLite 与示例数据,无需预先准备数据库。仓库中也提供 docker-compose.yml。
主要能力
模型接入:支持 30 余家模型提供商,包括 OpenAI、Azure OpenAI、Anthropic Claude、Google Gemini、DeepSeek、通义千问、豆包、Kimi、智谱 GLM、Mistral、Grok、Amazon Bedrock、OpenRouter、Ollama 等,可按会话切换。
Agent 工具链:浏览器操作(chromedp 或官方 Chrome 扩展两种模式)、Windows UI Automation、Shell 执行、Office 文档读写(含 PPTX 模板填充与图片替换)、Web 搜索与抓取,以及完整的 MCP 支持(SSE / Stdio / StreamableHTTP 三种传输)。每一次工具调用的参数与返回值在界面上均可逐步展开查看。
RAG 知识库:支持 PDF、Word、Excel 等文档上传,自动分块、向量化与索引;嵌入模型可选 OpenAI、Azure、Gemini、Qwen、Cohere、Jina、HuggingFace 及本地模型;知识库相互隔离,可按会话或按应用分配。
消息渠道:同一个 Agent 可同时接入 Discord、Slack、Telegram、WhatsApp、微信公众号、X 私信、Threads、Snapchat、Facebook Messenger 以及通用 HTTP Webhook。
对外接口:配置好的 Agent 可作为标准 OpenAI 兼容端点(/v1/chat/completions)对外提供服务,外部客户端无需改造即可调用,同时所有对话仍会记入日志。
管理后台:按应用、用户、模型维度的 Token 与成本统计,活动监控(成功率、错误率、操作类型分布),工具集中管理,完整请求 / 响应日志,以及 OIDC / OAuth2 / LDAP / SAML 单点登录与多租户隔离。
近期更新
Agent Hub:参照代码托管平台的形态,为 Agent 增加了 Star / Watch / Fork、Issue、富文本评论,以及 Insights 面板(活跃度、贡献者、访问流量、提问词云、成本五个维度)。用户可以 Fork 他人发布的 Agent 后继续修改,Agent 详情页内嵌对话框可直接试用。上架 Hub 需通过发布状态权限与资格检查。
工具权限引擎:新增独立的 guard 模块,不依赖平台自身代码,可被其他 Agent 项目复用。权限判定为 allow / ask / deny 三态,其中 ask 表示需要带外审批;规则按「调用方 / 工具名 / 能力类别 / 资源」四元组匹配,支持通配符、角色继承与优先级排序,底层由 Casbin 实现。配套的 shellcmd 模块可从完整命令行中解析出实际会被执行的程序名,管道、子 Shell、sudo/env/xargs 等包装、sh -c 内容、find -exec 均会展开;无法确定时返回不确定标记,供调用方按失败关闭(fail closed)处理。当前引擎与后台策略管理页已合入主干,尚未接入工具执行路径。
结构化审计日志:每次工具调用输出一行 JSON,按会话分文件存放于二进制同级目录(可通过 OPENAGENT_AUDIT_DIR 覆盖),外部工具只读跟踪即可获取全部工具活动,无需访问数据库。写入为后台异步,队列满时丢弃事件而不阻塞工具调用。
迁移工具:支持从 OpenClaw 等 Agent 整体迁移,可识别其配置目录、ZIP 包或单个配置文件,导入 Agent、技能(SKILL.md)、MCP Server、模型提供商、渠道配置以及历史会话记录。迁移采用先生成计划再执行的方式,重名冲突可选择跳过、覆盖或重命名。
人工纠错经验库:用户可直接修改 AI 的回答并保存为一条经验记录,包含原问题、原答案、修正后答案、修改理由与分类(事实 / 风格 / 格式 / 边界)。后续生成前按向量相似度召回,相似度超过 0.95 的直接作为已批准答案使用,超过 0.75 的作为示例进入上下文;也可将某条修正提升为全局规则。
模型清单与计费:近几个版本刷新了硅基流动(含 DeepSeek-V4)、智谱 GLM、Kimi、阿里百炼 Qwen、火山引擎豆包的可用型号,新增 APIMart 提供商,新建提供商时默认选中当前有效型号;计费修正为输入与输出 Token 分开计价。
其余更新包括用户通知收件箱、聊天输入框支持直接粘贴文件与图片、PDF 与 Office 在线预览修复等。
相关链接
-
项目地址:https://github.com/the-open-agent/openagent
-
官方文档:https://www.openagentai.org
-
在线演示:https://demo.openagentai.org (只读)
-
体验环境:https://try.openagentai.org (可写,数据每 5 分钟重置)