agent-Specialization/website-content/04-input-context.md
JOJO 39a7a5fc6f chore(website): 归档官网文档内容与设计素材
- website-content/:官网 10 篇文档内容 + README
- website-design/:官网设计稿、动画实验、预览图与资源
- 根目录官网截图两张
- .gitignore 忽略 website-design/exp/static/dist 构建产物(7.1MB)
2026-09-02 14:38:51 +08:00

90 lines
5.4 KiB
Markdown
Raw Blame History

This file contains ambiguous Unicode characters

This file contains Unicode characters that might be confused with other characters. If you think that this is intentional, you can safely ignore this warning. Use the Escape button to reveal them.

# 输入与上下文
本章讲输入栏的两个菜单、文件引用、上传,以及 Astrion 的上下文管理体系——包括压缩机制的正确用法。
---
## 1. `+` 快捷菜单(完整功能清单)
点击输入栏左侧 `+` 打开。完整功能一览:
| 功能 | 说明 |
|------|------|
| 新建对话 | 开始一个新对话(等价 `new` / `clear` |
| 上传文件 | 选择本地文件上传到工作区 |
| 发送图片 / 发送视频 | 附加到消息;**当前模型不支持多模态时禁用**(取决于 `multimodal` 配置) |
| 压缩对话 | 手动触发一次上下文压缩 |
| 选择 AgentSkill | 插入一个 Skill 引用(等价输入 `//` 快捷直达) |
| 工作流 | 激活一个工作流,让智能体按既定流程推进 |
| 对话类型 | 空对话时切换「智能体 / 多智能体」(创建后不可变) |
| 切换工作模式 | plan / ask / execute |
| 切换主题 | 经典 / 明亮 / 夜间 |
| 对话回顾 | 打开当前对话回顾 |
| 用量统计 | 上下文与 token 用量面板 |
| 目标模式 | 切换目标模式Beta见《对话》章 |
| 个人设置 | 打开个人空间 |
| 实时终端 | 打开实时终端面板 |
| 切换模型 | 选择本对话使用的模型 |
| 思考模式 | 切换 fast / thinking |
| 权限模式 | 切换 readonly / approval / auto / unrestricted |
| 网络权限 | 受限 / 完全开放plan 模式下也可调) |
| 执行环境 | sandbox / direct仅 host 模式) |
| 切换工作区 / 项目 | 切换当前对话绑定的工作区 |
| 版本控制 | 开/关本对话的版本控制 |
| Git 状态栏 | 显示/隐藏输入栏上方的 Git 状态条 |
| 路径授权 | 查看和管理沙箱路径授权 |
| 审批面板 | 查看审批记录 |
## 2. `/` 斜杠菜单
在输入框输入 `/` 触发斜杠直达菜单,用关键字快速过滤并直达某一类选项,目前支持 12 类AgentSkills`//` 直达)、工作流、主题、权限模式、执行环境、模型、思考模式、网络权限、工作模式、工作区、对话类型等。
典型用法:`/skill` 选技能、`/workflow` 选工作流、`/model` 切模型——比在 `+` 菜单里翻要快。
## 3. `@` 文件引用
输入 `@` 唤起文件菜单,从工作区中选择文件/目录插入引用。被引用的文件会作为上下文提供给智能体,适合「就这个文件展开讨论」的场景。图片类文件引用会按多模态能力处理。
## 4. 上下文压缩:浅压缩与深压缩
长对话迟早会触及模型上下文上限Astrion 提供两级自动压缩 + 手动压缩:
### 浅压缩(默认关闭)
- 机制:把较早的**工具调用结果替换为占位符**(保留最近 N 个工具结果不压),立刻腾出空间。
- 触发:默认累计 80k tokens 触发(可调),另有「每 N 次工具调用」「每轮最多替换 N 个」「保留最近 N 次用户输入后的工具不压」等细调参数。
- ⚠️ **重要代价浅压缩会改动历史消息内容从而破坏服务商侧的上下文缓存prompt cache**——压缩后的几轮请求将无法命中缓存,表现为响应变慢、费用上升。这是它默认关闭的原因。
### 深压缩(默认开启,推荐)
- 机制:对整段历史做**深度总结**,旧上下文整体替换为浓缩摘要后轻装继续。
- 产物形式可选(`deep_compress_form``file`——总结写入文件,需要时随时回读(默认);`inject`——直接把总结全文注入上下文。
- 触发:默认 150k tokens。
### 自定义阈值的 80% 规则(务必遵守)
如果你要自定义压缩触发阈值,**至少设为所用模型实际可用上下文的 80%**。
例如模型实际上下文是 128k触发阈值不应低于约 102k。阈值设得太低会频繁触发压缩既浪费 token又频繁破坏上下文缓存还会让 AI 过早丢失细节记忆。让对话尽量「用满窗口再压缩」才是性价比最高的用法。
> 模型的实际上下文窗口以 `custom_models.json` 中该模型的 `context_window` 为准;注意区分「标称上下文」与「实际可用上下文」(部分 API 会预留输出空间)。
### 手动压缩
`+` 菜单 →「压缩对话」随时可手动触发,适合你预判接下来要开新话题、主动腾空间的场景。
## 5. 上下文注入类功能
这些功能影响每轮对话自动携带的上下文,都在个人空间配置:
- **最近对话提示**(默认关闭):开启后,新对话自动把最近 N 条历史对话的摘要注入上下文N 可配130默认 10。适合「我最近一直在折腾同一个项目」的连续工作流与「对话连续性」个性化设置配合使用。
- **AGENTS.md 自动注入**(默认关闭):开启后自动把项目根目录的 AGENTS.md 注入上下文,让 AI 始终带着项目规范工作。
- **项目记忆索引注入**AI 的项目记忆索引默认最多注入 20 条5 起,可设为无上限)。记忆内容由 AI 在工作过程中主动沉淀。
- **Skill 提示**(默认关闭):根据当前任务动态提示可能相关的 Skill。
## 6. 上传与多模态
- **上传文件**进入工作区AI 后续可读取处理;
- **发送图片/视频**:随消息直接进入多模态上下文;
- 图片压缩档位(个人空间):`原图 / 1080p / 720p / 540p`,默认原图。长对话里多发大图建议降档,节省上下文。