Galaris

模型、配置与执行框架

按用途选择 AI 资源,并为每个智能体选择任务执行引擎。身份和持久业务对象继续由 Galaris 管理。

模型、配置与执行框架

供应商提供推理资源;模型承担具体用途;配置组织这些选择。执行框架只运行 Task,不接收对话轮次。聊天使用内部控制器和对话模型资源。

四个文本层级及专用资源

层级 用途
Ultra low 需要模型的 Dream 机制
Low Dispatcher 和对话
Standard 标准执行、Goal 跟进及保留的 Briefing
High 高复杂度执行、Planner 和 Lab

推理强度单独设置。视觉、文档、嵌入、图像、转写、音视频分析和媒体生成分别选择资源。语音在智能体或用户上配置。

明确选择的配置具有排他性:缺少资源时,不会暗中从其他配置借用。未指定配置的智能体或用户跟随当前配置。

按用途配置模型 — 配置文件将模型分配给文本层级、图像处理和转录。
按用途配置模型 — 配置文件将模型分配给文本层级、图像处理和转录。C36

连接并管理供应商

测试连接、发现模型并选择要使用的资源。目录可保留模态、上下文和已知价格;未知费用不会被视为零。Ollama 还支持其适配器提供的模型管理。

类别 已有集成
按资源提供文本与多模态 OpenAI、Anthropic、Gemini、OpenRouter、Mammouth AI、DeepSeek、Fireworks、Groq、Mistral
其他推理目录 Together、Cerebras、xAI、NVIDIA、Hugging Face、Cohere、Perplexity
语音与媒体 ElevenLabs、Google Cloud TTS、Azure Speech、SunoAPI.org、BytePlus LAS
本地模型与元数据 Ollama;models.dev 用于补充目录信息

实际账号、模型和模态取决于供应商。支持的个人设备码认证仍绑定其所属用户。

网关依据供应商及端点约定调整参数。生成前明确拒绝某个可选设置时,可以仅移除该设置并进行有限重试。超时或部分输出不会触发移除;消息、工具、预算与输出格式保持不变。

选择每个智能体的执行框架

框架 在 Galaris 中的用途
内部 Pydantic AI 原生执行、规划、按需工具与副作用检查点
Hermès 每智能体独立运行环境,共用记忆并投射技能
Claude Agent 每智能体 SDK,Anthropic 网关及 Galaris MCP
Codex 受管理运行环境,工具与遥测适配共同约定
DeepSeek Harness DSH 实例,适配执行及流式输出
兼容 Chat Completions 的远程服务 配置 URL、模型、认证和服务声明的能力
可用运行框架 — 受管运行框架的管理器与目录,包含状态和配置控件。
可用运行框架 — 受管运行框架的管理器与目录,包含状态和配置控件。C44

管理生命周期

根据适配器能力查看状态、错误、日志和文件,创建、启动、停止或更新运行环境。耗时操作有跟踪记录,未结束任务可能阻止环境变更。

选择容器化框架不会自动完成部署。当前外部适配器每实例同时接纳一个运行。内部框架的恢复保证不会自动扩展到所有适配器。

架构 · API 网关 · 比较使用方式

选择执行框架实际支持的模式

执行框架 可用模式
内部框架 standard 执行、high 执行、high 计划
托管 Hermès、Codex、Claude Agent、DeepSeek Harness standard 与 high 执行
通用兼容服务器 standard 执行

四种托管运行时目前使用 Galaris 模型网关。SDK 自带推理选项不等于可以启用 high 执行。当前策略中 Briefing 保持禁用,但仍可查阅历史记录并在 Lab 测试。Dispatcher 只在允许模式中选择;只有一个选项时无需调用模型路由。

管理员按供应商设置策略与限制。实际能力由实现、配置和目标验证共同决定。请求停止与确认远程已停止是不同状态。

个人 ChatGPT 连接需要记录所有者的明确同意。撤回同意后,即使认证仍连接,也会阻止调用。

内部引擎的原生多模态输入

在使用内部引擎的聊天与 Task 中,图片、音频、视频和 PDF 附件可以直接提供给模型。是否支持取决于模型声明的能力、MIME 类型以及传输层实际能够序列化的格式。

音视频输入通过兼容协议使用同一模型;视频需要已声明的提供方适配器。此能力不会自动扩展到外部执行框架。系统检查权限、大小与总预算,并向模型说明拒绝或格式不兼容的原因。媒体处理详情。

先衡量差异,再做选择

更换模型或执行框架时,应结合自己的工作场景进行评估。Lab 可在相同案例上比较模型与机制配置的结果、稳定性、耗时及可获取的费用。还需结合所选执行框架的工具与实际能力进行试用。

更换引擎,连接仍保留在枢纽中

Hermes Agent、DSH(DeepSeek Harness)、Codex、Claude 和内置执行框架可以使用智能体的已授权工具。在 Galaris 中配置 MCP 服务器与功能,引擎获得适合其权限和执行上下文的工具集合。各引擎的能力和恢复方式仍有所不同。

例如,Telegram 承载请求,Hermes 执行任务,而在 Galaris 中配置的 Notion MCP 提供页面操作。选择引擎不意味着必须使用特定聊天界面或文档空间。查看组合方式与前置条件。

探索与 Galaris 兼容的生态系统:推理供应商、消息渠道、执行框架与服务,以及各项目的网站链接。