- website-content/:官网 10 篇文档内容 + README - website-design/:官网设计稿、动画实验、预览图与资源 - 根目录官网截图两张 - .gitignore 忽略 website-design/exp/static/dist 构建产物(7.1MB)
90 lines
5.4 KiB
Markdown
90 lines
5.4 KiB
Markdown
# 输入与上下文
|
||
|
||
本章讲输入栏的两个菜单、文件引用、上传,以及 Astrion 的上下文管理体系——包括压缩机制的正确用法。
|
||
|
||
---
|
||
|
||
## 1. `+` 快捷菜单(完整功能清单)
|
||
|
||
点击输入栏左侧 `+` 打开。完整功能一览:
|
||
|
||
| 功能 | 说明 |
|
||
|------|------|
|
||
| 新建对话 | 开始一个新对话(等价 `new` / `clear`) |
|
||
| 上传文件 | 选择本地文件上传到工作区 |
|
||
| 发送图片 / 发送视频 | 附加到消息;**当前模型不支持多模态时禁用**(取决于 `multimodal` 配置) |
|
||
| 压缩对话 | 手动触发一次上下文压缩 |
|
||
| 选择 AgentSkill | 插入一个 Skill 引用(等价输入 `//` 快捷直达) |
|
||
| 工作流 | 激活一个工作流,让智能体按既定流程推进 |
|
||
| 对话类型 | 空对话时切换「智能体 / 多智能体」(创建后不可变) |
|
||
| 切换工作模式 | plan / ask / execute |
|
||
| 切换主题 | 经典 / 明亮 / 夜间 |
|
||
| 对话回顾 | 打开当前对话回顾 |
|
||
| 用量统计 | 上下文与 token 用量面板 |
|
||
| 目标模式 | 切换目标模式(Beta,见《对话》章) |
|
||
| 个人设置 | 打开个人空间 |
|
||
| 实时终端 | 打开实时终端面板 |
|
||
| 切换模型 | 选择本对话使用的模型 |
|
||
| 思考模式 | 切换 fast / thinking |
|
||
| 权限模式 | 切换 readonly / approval / auto / unrestricted |
|
||
| 网络权限 | 受限 / 完全开放(plan 模式下也可调) |
|
||
| 执行环境 | sandbox / direct(仅 host 模式) |
|
||
| 切换工作区 / 项目 | 切换当前对话绑定的工作区 |
|
||
| 版本控制 | 开/关本对话的版本控制 |
|
||
| Git 状态栏 | 显示/隐藏输入栏上方的 Git 状态条 |
|
||
| 路径授权 | 查看和管理沙箱路径授权 |
|
||
| 审批面板 | 查看审批记录 |
|
||
|
||
## 2. `/` 斜杠菜单
|
||
|
||
在输入框输入 `/` 触发斜杠直达菜单,用关键字快速过滤并直达某一类选项,目前支持 12 类:AgentSkills(`//` 直达)、工作流、主题、权限模式、执行环境、模型、思考模式、网络权限、工作模式、工作区、对话类型等。
|
||
|
||
典型用法:`/skill` 选技能、`/workflow` 选工作流、`/model` 切模型——比在 `+` 菜单里翻要快。
|
||
|
||
## 3. `@` 文件引用
|
||
|
||
输入 `@` 唤起文件菜单,从工作区中选择文件/目录插入引用。被引用的文件会作为上下文提供给智能体,适合「就这个文件展开讨论」的场景。图片类文件引用会按多模态能力处理。
|
||
|
||
## 4. 上下文压缩:浅压缩与深压缩
|
||
|
||
长对话迟早会触及模型上下文上限,Astrion 提供两级自动压缩 + 手动压缩:
|
||
|
||
### 浅压缩(默认关闭)
|
||
|
||
- 机制:把较早的**工具调用结果替换为占位符**(保留最近 N 个工具结果不压),立刻腾出空间。
|
||
- 触发:默认累计 80k tokens 触发(可调),另有「每 N 次工具调用」「每轮最多替换 N 个」「保留最近 N 次用户输入后的工具不压」等细调参数。
|
||
- ⚠️ **重要代价:浅压缩会改动历史消息内容,从而破坏服务商侧的上下文缓存(prompt cache)**——压缩后的几轮请求将无法命中缓存,表现为响应变慢、费用上升。这是它默认关闭的原因。
|
||
|
||
### 深压缩(默认开启,推荐)
|
||
|
||
- 机制:对整段历史做**深度总结**,旧上下文整体替换为浓缩摘要后轻装继续。
|
||
- 产物形式可选(`deep_compress_form`):`file`——总结写入文件,需要时随时回读(默认);`inject`——直接把总结全文注入上下文。
|
||
- 触发:默认 150k tokens。
|
||
|
||
### 自定义阈值的 80% 规则(务必遵守)
|
||
|
||
如果你要自定义压缩触发阈值,**至少设为所用模型实际可用上下文的 80%**。
|
||
|
||
例如模型实际上下文是 128k,触发阈值不应低于约 102k。阈值设得太低会频繁触发压缩:既浪费 token,又频繁破坏上下文缓存,还会让 AI 过早丢失细节记忆。让对话尽量「用满窗口再压缩」才是性价比最高的用法。
|
||
|
||
> 模型的实际上下文窗口以 `custom_models.json` 中该模型的 `context_window` 为准;注意区分「标称上下文」与「实际可用上下文」(部分 API 会预留输出空间)。
|
||
|
||
### 手动压缩
|
||
|
||
`+` 菜单 →「压缩对话」随时可手动触发,适合你预判接下来要开新话题、主动腾空间的场景。
|
||
|
||
## 5. 上下文注入类功能
|
||
|
||
这些功能影响每轮对话自动携带的上下文,都在个人空间配置:
|
||
|
||
- **最近对话提示**(默认关闭):开启后,新对话自动把最近 N 条历史对话的摘要注入上下文(N 可配,1–30,默认 10)。适合「我最近一直在折腾同一个项目」的连续工作流;与「对话连续性」个性化设置配合使用。
|
||
- **AGENTS.md 自动注入**(默认关闭):开启后自动把项目根目录的 AGENTS.md 注入上下文,让 AI 始终带着项目规范工作。
|
||
- **项目记忆索引注入**:AI 的项目记忆索引默认最多注入 20 条(5 起,可设为无上限)。记忆内容由 AI 在工作过程中主动沉淀。
|
||
- **Skill 提示**(默认关闭):根据当前任务动态提示可能相关的 Skill。
|
||
|
||
## 6. 上传与多模态
|
||
|
||
- **上传文件**:进入工作区,AI 后续可读取处理;
|
||
- **发送图片/视频**:随消息直接进入多模态上下文;
|
||
- 图片压缩档位(个人空间):`原图 / 1080p / 720p / 540p`,默认原图。长对话里多发大图建议降档,节省上下文。
|