在需要的层次接入您的应用
MCP 连接在 Galaris 中配置,并按智能体、连接和功能设置细粒度权限。枢纽向 Hermes、DSH、Codex、Claude 和内置执行框架等已配置引擎提供授权目录。聊天与文档是这个生态系统中的内置解决方案。
业务应用可以保留自己的界面,同时使用 Galaris 中配置的模型。LLM 网关提供经过身份验证的资源访问与调用跟踪;智能体层进一步提供身份、指令和智能体能力。
| 需求 | 入口 |
|---|---|
| 向模型发送消息 | POST /api/llm/openai/chat/completions |
| 使用 Responses 协议 | POST /api/llm/openai/responses |
| 使用 Anthropic 格式的 Messages | POST /api/llm/anthropic/v1/messages |
| 调用指定智能体 | POST /api/agent/openai/chat/completions |
| 通过统一入口选择智能体 | POST /api/janus/openai/chat/completions |
此处兼容 OpenAI 的格式是 Chat Completions 和 Responses,而 Messages 使用 Anthropic 格式。支持的参数取决于已配置的协议、供应商和模型。跟踪记录保留推理、尝试、事件,以及可获取的用量和费用信息;持久推理章节介绍相应控制方式。
在兼容客户端中与多个智能体交谈时,只需配置一个 API 基址 /api/janus/openai、模型 janus 和个人令牌。使用 @code 选择有权访问的智能体,Janus 随即转交,并可从对话历史恢复选择。也可以使用实例上声明的别名。
Nextcloud Talk、Matrix、OneBot 和 Telegram 桥接提供另一种智能体入口,各自使用相应的连接与身份,无需经过 Galaris 聊天界面或 Janus。了解渠道与工具。
区分三种接口
| 接口 | 客户端调用对象 |
|---|---|
| 模型网关 | 通过 Chat Completions、Responses 或 Anthropic Messages 调用 AI 资源 |
| 智能体作为模型 | 带权限和 Task 执行的 Galaris 身份 |
| 每智能体 MCP 服务 | 该智能体范围内的原生及连接函数 |
Janus 列出可用智能体,接受 @code 或 #code 选择,也可从历史恢复选择。/reset 或 /restart 返回选择步骤。个人令牌与 MCP 令牌不同。
个人订阅权限遵循所属用户和工作来源,技术身份不能借用其他用户的订阅。
选择适合的入口
智能体 API 面向已配置智能体与任务;Janus 通过兼容对话接口呈现智能体;LLM 与 Claude 接口支持选定客户端协议;流程 API 用于启动、查看、更新和取消持久工作流运行。
Janus 连接客户端与智能体
Janus 提供兼容 OpenAI 的 /models 与 /chat/completions 路由,通过配置别名和智能体 @code 路由交流,并在支持时保留对话标识。协议兼容不代表实现了提供方的全部专有选项。
从最小 Janus 请求开始
在实例上请求 /api/janus/openai/models,添加 Authorization: Bearer YOUR_TOKEN 请求头。接入客户端前,按已部署仓库的 API 文档核对请求体与流式选项。共享示例中不要放入真实凭证。
可撤销的个人 API 令牌
“我的 API 令牌”可创建具名凭证,并启用、停用或删除。权限随所有者授权变化。使用 HTTPS,妥善保管令牌值;它们与其他集成路径使用的限定范围令牌不同。
流程与 n8n 双向交互
入口可以是一次对话:智能体准备输入并启动已分配的流程。如果 n8n 工作流中的某一步需要模型,可以调用 POST /api/llm/openai/chat/completions,使用 Galaris 中配置的模型。
调用需要经过认证的 LLM API 访问权限,例如使用拥有 LLM_API_ACCESS 权限的用户的个人令牌。传递 X-Galaris-Process-Run-Id 请求头,将推理关联到获授权的运行,并跟踪调用及可用费用。流程回调令牌不能替代模型访问权限。
客户端可以启动流程并跟踪运行。交由 n8n 执行时,Galaris 传递幂等键,并按需提供临时文件 URL 和由本次运行专用令牌保护的回调 URL。事件及远程标识将工作流与 Galaris 来源连接起来。
保存并控制推理请求
经过认证的 /api/llm/openai/inferences API 可创建文本或结构化请求,并读取状态、尝试、结果与费用。SSE 流可在断线后从游标重新读取。暂停、停止、恢复和重放命令带有标识,避免重复应用。
恢复会根据冻结请求创建新尝试;重放则创建与原请求关联的另一推理。历史结果会保留。恢复可能再次调用供应商并产生费用,不是逐令牌继续原计算。关闭自主推理的订阅不会取消执行;普通 HTTP 调用仍遵循各自的取消约定。
协议请求通过兼容网关进入。该层不执行工具副作用,也未将生命周期推广到全部媒体。Chat/Responses 响应提供 X-Galaris-Inference-Id,用于查找对应推理。
文档应用的 Dataset SDK
智能体使用现有文件工具创建 HTML 与 JSON 文档。页面代码通过 data-dataset、data-dataset-alias 和 data-dataset-access 声明绑定,再使用 galaris.datasets 读取、向根数组追加记录或替换 JSON。每个应用最多声明十个绑定。
此浏览器接口与智能体 MCP 不同。每次操作检查页面、Dataset、读者当前权限及针对该文档版本的个人授权。修改必须提供预期版本,并写入历史记录。冲突会被拒绝,不自动重试;授权在人工界面管理,不能通过 MCP 授予。
应用 JSON 限制为序列化后 2,000,000 字节、20,000 个节点、深度 32,数字必须有限。每个用户–Dataset 组合在 60 秒窗口内共享 30 次写入与 4,000,000 字节结果额度,跨应用和标签页累计。这是结构校验,不是业务字段模型。文档流程。


