会话配置用于控制聊天会话的全局行为,包括标题与标签生成、全局默认系统提示词、上下文压缩、用户参数透传,以及平台内置 Skills/Prompts。
使用入口#
进入管理端后打开“会话配置”。页面按“会话配置”“上下文压缩”“参数透传”组织,并在下方提供内置提示词库管理。
这些设置影响所有用户的后续会话。已经生成的历史标题、标签和消息内容不会因为修改设置而自动重写。
参数透传如何与能力配置、危险字段拦截和官方工具协同,见 能力透传与官方工具。上下文压缩、RAG 和文件证据如何协同,见 文件与检索进阶。
任务执行模型#
任务执行模型用于生成会话标题和标签。可以选择跟随当前模型,也可以指定一个稳定、便宜、响应快的聊天模型。
如果用户常用高成本模型,不建议让标题和标签任务跟随当前模型。指定内部任务模型可以降低成本,并让标题风格更一致。
全局默认系统提示词#
全局默认系统提示词会作为所有聊天模型的全局行为指令;留空表示不注入。模型级系统提示词会在全局提示词之后追加。
它适合写平台级通用要求,例如回答准确、清晰、遵守组织安全要求、避免泄露敏感信息等。不要把某个项目、某个用户或某次任务的临时要求写入全局提示词。
标题和标签提示词#
标题提示词用于控制自动标题生成。标签提示词用于控制自动标签生成。两者都支持插入会话消息占位内容,并要求模型返回稳定 JSON 结构。
修改提示词时,应保持输出结构稳定,否则标题或标签可能无法正确解析。建议先小范围验证,再用于生产环境。
上下文压缩#
上下文压缩用于长对话和大资料场景。管理员可以全局允许压缩,用户仍可在自己的聊天设置中决定是否使用。
| 设置 | 用途 |
|---|---|
| Token 预算截断 | 根据当前模型上下文窗口裁剪可发送历史,避免超过模型限制。 |
| 压缩触发轮次 / Token 阈值 | 达到轮次或 Token 条件后触发压缩。 |
| 原文保留轮次 | 保留最近若干轮原文,其余较早内容写入摘要。 |
| 每角色摘要条数 / 片段字符上限 | 控制模板压缩的摘要密度和单条片段长度。 |
| 证据保留天数 | 控制 RAG 结果、历史证据和工具结果的保留时长。 |
| 后台执行压缩 | 回复完成后异步压缩,减少当前回复链路阻塞。 |
| LLM 压缩 / 压缩模型 | 调用模型生成语义摘要;建议选择稳定、成本可控的聊天模型。 |
| 熔断阈值 | LLM 压缩连续失败后自动降级为模板摘要。 |
| 全量摘要提示词 / 轻量摘要提示词 | 自定义压缩指令,要求保留事实、数字、约束和未完成任务。 |
关闭上下文压缩会降低后台成本,但长会话更容易丢失早期上下文或触达模型上下文上限。
参数透传策略#
参数透传控制用户在会话配置中写入的模型选项是否可以进入上游调用。它用于在灵活性和安全性之间取得平衡。
| 策略 | 行为 | 适合场景 |
|---|---|---|
| 白名单 | 只允许列出的路径通过,其余丢弃。 | 默认推荐,适合多数生产环境。 |
| 黑名单 | 默认允许,通过黑名单移除指定路径。 | 适合高度可信用户或内部调试。 |
| 禁止透传 | 用户自定义选项不进入上游。 | 适合强管控、成本敏感或合规场景。 |
系统危险字段会始终拦截,不能通过白名单放行。这样可以避免用户绕过平台模型、工具、安全或路由策略。
路径配置和预览#
白名单和黑名单按路径写法配置。顶层写字段名,嵌套字段用点号连接。可以配置 default 规则,也可以为不同协议追加规则。
参数透传区域提供实时预览,展示哪些字段会通过、哪些字段会被过滤,以及过滤原因。教程会说明路径写法、策略差异、协议主键和系统拦截字段。
保存前应通过预览确认结果,尤其是切换黑名单或关闭透传策略时,避免误放行或误过滤用户需要的参数。
内置 Skills 与 Prompts#
会话配置页下方的提示词库用于维护平台内置 Skills 和 Prompts。内置项会展示给用户使用,但用户只能查看和装载,不能编辑或删除。
| 类型 | 管理内容 | 用户侧效果 |
|---|---|---|
| Prompts | 名称、说明、内容、启用状态 | 用户在 / 选择后把内容插入输入框。 |
| Skills | 名称、说明、SKILL.md、启用状态 | 用户在 / 选择后作为本轮上下文装载,不会运行命令。 |
删除内置项不会影响用户自己的自定义 Skills/Prompts。停用适合临时下线,删除适合确认不再维护的模板。
使用建议#
生产环境优先使用白名单策略,只开放少量明确需要的参数。全局系统提示词保持简短稳定;业务专属要求放到项目提示词、模型级提示词或内置 Skill。修改会话配置后,使用普通用户视角发起一次测试对话。
配置项对照#
会话配置页对应 chat.* 平台级设置,会影响所有用户后续会话。
| 分组 | 配置键 |
|---|---|
| 任务模型与提示词 | chat.conversation_task_model、chat.conversation_title_prompt、chat.conversation_labels_prompt、chat.default_system_prompt |
| 上下文压缩开关 | chat.context_compact_enabled、chat.context_token_budget_enabled |
| 压缩触发与保留 | chat.context_max_turns、chat.context_compact_trigger_tokens、chat.context_compact_preserve_recent_turns、chat.context_compact_highlights_per_role、chat.context_compact_snippet_chars、chat.context_artifact_retention_days |
| 压缩执行 | chat.compact_async_enabled、chat.compact_llm_enabled、chat.compact_task_model、chat.compact_max_failures、chat.compact_system_prompt、chat.compact_light_prompt |
| 参数透传 | chat.model_option_policy_mode、chat.model_option_allowed_paths、chat.model_option_denied_paths |
参数透传协议主键以最新前端为准:default、openai_chat_completions、openai_responses、openrouter_responses、openai_image_generations、openai_image_edits、anthropic_messages、gemini_generate_content、google_image_generation、xai_responses、xai_image、xai_image_edits。