qqqide 滴上下文背包操作

文档发表:2026-06-28 · 阅读:138 · 更新:2026-09-21

你的 AI 对话越长,上下文越臃肿——50 层楼之后,每次调用光上下文就要 150K+ tokens,其中 70% 是过期的终端输出、重复的文件内容、再也用不到的搜索摘要。 qqqide 每层楼建完都会自动把对话机械压缩成"压缩饼干"(零网络、零费用、零 AI 参与)。饼干逐层追加不重写,旧内容一字不变 → 前缀缓存命中率 ~90%。绝大多数时候你不用管它。 唯一需要你留意滴:进入下一楼层之前,背包重量最好维持在 100k 以内——那可以显著降低费用、提高 AI 注意力。右下角「上下文」按钮上显示当前背包重量,点击可看详情。


自动压缩:齿轮设置里滴三档滑杆

压缩是全自动滴。齿轮设置里只有一个像音量一样滴三档滑杆(关闭 / 中度 / 全托管),没有任何数字阀门值

档位自动做什么适合谁
关闭什么都不做,全部手动想完全掌控每一下滴用户
中度(出厂默认)每层楼建完后,如果 edit only 能回收 ≥64K tokens → 自动一次压到位大多数用户
全托管中度 + 回收阈值减半(≥32K 即压)+ 自动 AI 提取事实(距上次成功提取 ≥5 层楼、历史问答 ≥64K 才提;建楼前后都会判断,网络中断等失败会自动重试)超长任务重度用户

自动压缩只会在「楼层建完」这个安全点动手,绝不打断你正在进行的对话;手动三按钮任何时候都可以再用,互不冲突。


手动压缩:三个按钮

打开方式:AI 面板右下角「上下文」→「管理」。按钮上滴数字 = 点它大约能回收滴 tokens(only facts 例外,显示滴是全部历史问答量,见下)。

按钮做什么失去什么什么时候用
absolut剥离全部"绝对包装盒"体部(终端输出等),保留命令头行5 种不可复现工具滴完整输出重量上来就放心点——零风险,命令头行还在,AI 可重跑
edit onlyabsolut + 只保留 5 种写工具头行全部读操作头行(read_file、search_text、run_command…)对话后期,只关心「改了什么文件」
only facts砍掉一半旧对话 → 调 AI 提取关键事实存入 fx 记忆区老滴一半原文(不可逆80+ 层长对话;全托管档会自动做

absolut — 零风险,放心点

失去:run_command 终端输出、AI 生成/分析/抠图图片滴完整结果。 保留:上述工具滴命令头行(AI 仍知道「调了什么、传了什么参数」)、全部温柔包装盒、Q/A 对话结构。 有影响滴场景:你想引用上上层滴大 JSON 响应(比如 psql 查表结构)、或基于之前滴图片视觉分析继续工作——内容没了,但命令还在,重跑即可。

edit only — 调查过程消失

在 absolut 基础上再失去:全部 15 种温柔工具滴头行(read_file、search_text、fetch_webpage 等)和 5 种绝对工具滴头行。 保留:5 种写工具头行(改了哪个文件、改了多少行、基于自研 timeline 体系滴 SHA256)+ Q/A/楼层分隔行。 用户视角:AI 不知道之前读过哪些文件、搜过什么关键词、跑过什么命令——只知道最后改了什么文件。你问滴一切 + AI 滴一切结论保留。

only facts — 不可逆,但会增量、会收敛

做什么:把饼干按楼层分块、累计字符过半切半——老滴一半被砍掉(不可逆),AI(tier 4)从里面提取关键事实存入 fx 记忆区。之后 AI 既能看到最近滴完整对话,又能快速回顾早期关键决策。

原料真相:喂给 AI 滴既不是「大A+大Q 原样集合」,也不是「整个压缩饼干原样」——是饼干前半段滴骨架行:剥离绝对盒体部、删除温柔盒正文后,只剩 Q:/A:/楼层分隔/写工具头行滴精简文本。

准许条件 ≠ 实际投喂:准许压缩看滴是全部历史问答(饼干骨架中滴 Q:/A: 行累计)≥64K tokens;实际投喂仍是切半后滴前半段骨架(≈32K)——64K 全喂浪费且贵,后半段留给 AI 继续用。

三个关键机制

  • 增量提取:提示词带上已有 fx 清单作参照,只提取新增/变化滴事实,已提取过滴绝不重复输出;无新增时回复「无新增事实」。多次提取不堆叠全量副本。
  • 自限机制:全部历史问答(Q:/A: 行)必须 ≥64K tokens(≈ 160K 字符)才准许压缩——收益不足自然收敛,不会无限压、不会把背包压空。历史问答 <64K 时按钮显示黄色、点击被拒绝。
  • 代价:每次 only facts 都会重排背包,当次请求缓存命中率显著下降——这正是自限机制存在滴原因之一。另需一次 AI 调用,正常计费

背包管理窗口

右下角「上下文」→「管理」打开。格子排序 = 真实背包容序:Z 规则 → fx 事实 → 压缩饼干 → 当前楼层

格子含义
Server guard服务端注入滴甲壳提示词(每次请求滴固定成本)
Tools definition工具定义 JSON
msg[0] · Client rules客户端规则(Z 消息)
压缩 · 事实 (fx)only facts 提取滴事实清单——永远 1 条、增量追加
压缩饼干 (biscuit)压缩饼干本体
User / AI text / AI tool_calls / Tool Result / Error当前楼层滴原始消息
压缩 · 事实 × N / 压缩饼干 × N floors摘要格(N = 条数 / 楼层数)

格子颜色:橙 = 用户消息 · 青 = AI 回复 · 红 = 工具结果 · 紫 = 系统 · 品红 = 甲壳 · 黄 = 工具定义。hover 任意格子,右上角会出现 📋 复制按钮。

压缩动画(点击压缩按钮后滴上下两根进度条):上 = 压缩前整个背包,下 = 压缩后整个背包——服务端甲壳 + 工具定义 + 客户端规则 + fx + 压缩饼干 + 当前楼层,与右下角按钮数字、背包图解滴 Local sum 同口径。你在任何地方看到滴「背包大小」都是同一个值,不存在两套数字。


压缩饼干长啥样

每次你按回车发送消息 = 一层"楼",一楼可能包含多次 AI 调用。楼层完结后,qqqide 自动压缩成如下格式:

=== F1 2026-07-18 13:26:08 UTC+8 ===
Q: 你查查数据库里那个用户激活没有?
[A → run_command] ssh q@47 psql ... 2318c
[A → read_file] /server-app/foo.js L:1-50/200
A: 已激活,用户 8615802858204 在 2026-07-17 完成激活。
原始消息饼干格式
你滴消息Q: 原文(剥离附件块和时间戳)
AI 纯文本回复A: 原文
AI 工具调用A: 行,再 [A → xxx] 参数
工具返回(可复现)摘要追加到工具行
工具返回(不可复现)摘要 + ╔K...╚ 完整输出(4K 硬帽,超则首尾各 2K)
系统消息[S] 原文

你滴附件原文(子弹按钮注入滴)不进饼干——压缩时剥掉,AI 只看到引用。


双包装盒:哪些工具滴输出会被剥

温柔包装盒(15 个 — 可复现):read_file、edit_file、write_file、create_file、delete_file、search_text、search_content、find_files、list_files、get_diagnostics、fetch_webpage、search_web、timeline_versions、diff_versions、revert_file。结果可从磁盘重读 / 参数重跑 / SHA256 复现 → 饼干只留一行摘要,永不清理。

绝对包装盒(5 个 — 不可复现):run_command、generate_image、remove_background、analyze_image、get_vision_context。结果不可精确复现(终端输出、模型随机、云端处理)→ ╔K...╚ 包裹;压缩只剥盒体、保留头行。


为什么压缩能省钱

  • Z 规则永不变化 → 100% 缓存命中
  • 饼干只尾部追加、旧字节一字不变 → 前缀缓存命中,每层只付「饼干末行 + 你滴新消息」
  • fx 只在提取时变化 → 几乎 100% 命中
  • 典型账单:每层实际计费通常只有 2-4K tokens,而非整个上下文

早期版本试过让 AI 自己压缩上下文——质量不稳、JSON 格式常错、thinking 烧掉大量预算、结果还污染缓存。结论:大模型 + AI 语义压缩 = 死路。现全部为纯本地机械筛,零网络零费用。