三种交互方式
文本用于交流,Task 承担持续工作,实时通话用于语音。语音留言和听写是不同输入方式。各路径保持自己的状态,并关联同一智能体。
从消息转向工作
控制器可以直接回答、调用对话允许的工具,或接纳任务和流程。它生成包含限制、文件和引用的独立请求。智能体的任务框架仅在执行 Task 时使用。
保留来源渠道
原生聊天与外部桥接使用共同对话模型。来源渠道和接收连接始终可识别,文件与回复因此使用相应传输和权限。
两条语音路径
转写—智能体—语音合成路径使用 STT、对话模型和 TTS 资源。原生语音到语音使用兼容实时供应商。通话可使用上下文和工具,具体功能取决于引擎与传输。
整理日常对话
为对话命名、搜索、归档或静音。回复具体消息、听写文本、添加附件,并在聊天面板找回相关任务、文档和流程。未读状态保存在服务器;配置 Web Push 并取得浏览器许可后可以接收新消息通知。
从语音交流启动持续工作
通话可以启动任务,同时继续交流。记录保留渠道、时长、轮次、中断和错误;已有转写及首段文字或音频响应时间帮助检查体验。
原生聊天使用 WebRTC,Matrix 和 Nextcloud Talk 使用各自语音传输。需要配置 STT/TTS 或原生语音资源及网络穿透。撤销通话权限会停止音频。
修改眼前正在查看的文档
在聊天中,桌面端使用文档面板,移动端使用对话框。编辑器保留权限、版本和草稿。发送消息前会等待保存,并附带实际显示文档的引用;关闭文档后,后续消息不再携带该上下文。
document_show 仅允许智能体在当前内部文字聊天中请求打开文档,不能用于任务、语音或外部渠道。它不授予访问权限,也不是收件人已阅读的证明。
保留请求及其相关媒体
当对话转为任务时,Galaris 将原始请求及其附件与模型补充的上下文分开保存。新的独立请求会保留先前正在执行或等待的工作,不会默默替换它们。
使用内部引擎的聊天,也可以将图片、音频、视频和 PDF 附件直接传给兼容模型,具体取决于模型和传输能力。媒体始终关联原始消息。了解媒体输入条件。打开的文档可以是 HTML 文本、应用或 JSON Dataset,编辑器遵循相应类型的规则。
文档在聊天面板中仍可使用:与智能体交流的同时,填写表单、调整计算器或操作 3D 场景。内容及其内嵌资源须符合隔离约束。





