5.4 KiB
5.4 KiB
输入与上下文
本章讲输入栏的两个菜单、文件引用、上传,以及 Astrion 的上下文管理体系——包括压缩机制的正确用法。
1. + 快捷菜单(完整功能清单)
点击输入栏左侧 + 打开。完整功能一览:
| 功能 | 说明 |
|---|---|
| 新建对话 | 开始一个新对话(等价 new / clear) |
| 上传文件 | 选择本地文件上传到工作区 |
| 发送图片 / 发送视频 | 附加到消息;当前模型不支持多模态时禁用(取决于 multimodal 配置) |
| 压缩对话 | 手动触发一次上下文压缩 |
| 选择 AgentSkill | 插入一个 Skill 引用(等价输入 // 快捷直达) |
| 工作流 | 激活一个工作流,让智能体按既定流程推进 |
| 对话类型 | 空对话时切换「智能体 / 多智能体」(创建后不可变) |
| 切换工作模式 | plan / ask / execute |
| 切换主题 | 经典 / 明亮 / 夜间 |
| 对话回顾 | 打开当前对话回顾 |
| 用量统计 | 上下文与 token 用量面板 |
| 目标模式 | 切换目标模式(Beta,见《对话》章) |
| 个人设置 | 打开个人空间 |
| 实时终端 | 打开实时终端面板 |
| 切换模型 | 选择本对话使用的模型 |
| 思考模式 | 切换 fast / thinking |
| 权限模式 | 切换 readonly / approval / auto / unrestricted |
| 网络权限 | 受限 / 完全开放(plan 模式下也可调) |
| 执行环境 | sandbox / direct(仅 host 模式) |
| 切换工作区 / 项目 | 切换当前对话绑定的工作区 |
| 版本控制 | 开/关本对话的版本控制 |
| Git 状态栏 | 显示/隐藏输入栏上方的 Git 状态条 |
| 路径授权 | 查看和管理沙箱路径授权 |
| 审批面板 | 查看审批记录 |
2. / 斜杠菜单
在输入框输入 / 触发斜杠直达菜单,用关键字快速过滤并直达某一类选项,目前支持 12 类:AgentSkills(// 直达)、工作流、主题、权限模式、执行环境、模型、思考模式、网络权限、工作模式、工作区、对话类型等。
典型用法:/skill 选技能、/workflow 选工作流、/model 切模型——比在 + 菜单里翻要快。
3. @ 文件引用
输入 @ 唤起文件菜单,从工作区中选择文件/目录插入引用。被引用的文件会作为上下文提供给智能体,适合「就这个文件展开讨论」的场景。图片类文件引用会按多模态能力处理。
4. 上下文压缩:浅压缩与深压缩
长对话迟早会触及模型上下文上限,Astrion 提供两级自动压缩 + 手动压缩:
浅压缩(默认关闭)
- 机制:把较早的工具调用结果替换为占位符(保留最近 N 个工具结果不压),立刻腾出空间。
- 触发:默认累计 80k tokens 触发(可调),另有「每 N 次工具调用」「每轮最多替换 N 个」「保留最近 N 次用户输入后的工具不压」等细调参数。
- ⚠️ 重要代价:浅压缩会改动历史消息内容,从而破坏服务商侧的上下文缓存(prompt cache)——压缩后的几轮请求将无法命中缓存,表现为响应变慢、费用上升。这是它默认关闭的原因。
深压缩(默认开启,推荐)
- 机制:对整段历史做深度总结,旧上下文整体替换为浓缩摘要后轻装继续。
- 产物形式可选(
deep_compress_form):file——总结写入文件,需要时随时回读(默认);inject——直接把总结全文注入上下文。 - 触发:默认 150k tokens。
自定义阈值的 80% 规则(务必遵守)
如果你要自定义压缩触发阈值,至少设为所用模型实际可用上下文的 80%。
例如模型实际上下文是 128k,触发阈值不应低于约 102k。阈值设得太低会频繁触发压缩:既浪费 token,又频繁破坏上下文缓存,还会让 AI 过早丢失细节记忆。让对话尽量「用满窗口再压缩」才是性价比最高的用法。
模型的实际上下文窗口以
custom_models.json中该模型的context_window为准;注意区分「标称上下文」与「实际可用上下文」(部分 API 会预留输出空间)。
手动压缩
+ 菜单 →「压缩对话」随时可手动触发,适合你预判接下来要开新话题、主动腾空间的场景。
5. 上下文注入类功能
这些功能影响每轮对话自动携带的上下文,都在个人空间配置:
- 最近对话提示(默认关闭):开启后,新对话自动把最近 N 条历史对话的摘要注入上下文(N 可配,1–30,默认 10)。适合「我最近一直在折腾同一个项目」的连续工作流;与「对话连续性」个性化设置配合使用。
- AGENTS.md 自动注入(默认关闭):开启后自动把项目根目录的 AGENTS.md 注入上下文,让 AI 始终带着项目规范工作。
- 项目记忆索引注入:AI 的项目记忆索引默认最多注入 20 条(5 起,可设为无上限)。记忆内容由 AI 在工作过程中主动沉淀。
- Skill 提示(默认关闭):根据当前任务动态提示可能相关的 Skill。
6. 上传与多模态
- 上传文件:进入工作区,AI 后续可读取处理;
- 发送图片/视频:随消息直接进入多模态上下文;
- 图片压缩档位(个人空间):
原图 / 1080p / 720p / 540p,默认原图。长对话里多发大图建议降档,节省上下文。