Tau上下文压缩与思考模式详解:长会话不爆窗口、成本降一半的完整技巧
Tau上下文压缩与思考模式详解长会话不爆窗口、成本降一半的完整技巧【免费下载链接】tauA Python port of Pi’s minimalist coding agent.项目地址: https://gitcode.com/gh_mirrors/tau16/tau使用Tau 上下文压缩和思考模式是解决 AI 编码 Agent 长会话两大痛点的关键上下文窗口爆满导致报错、以及每一轮都重复发送冗长历史带来的token 成本膨胀。Tau 是 Pi 极简编码 Agent 的 Python 移植版内置了自动压缩compaction机制和 7 档可调的思考模式thinking mode。本文带你完整掌握如何查看上下文用量、如何让长会话永不溢出、如何用思考模式在不同任务间平衡速度与成本。先看上下文用量used/limit 状态栏 /session 详情Tau 的 TUI 提示符下方会常驻显示已用/上限的活跃上下文例如45000/128000这就是你的油表。输入/session还能看到更详细的分项信息项含义Estimated context tokens当前活跃上下文的 token 估算Context window当前模型的窗口大小Context token breakdown系统提示 / 消息 / 工具定义三部分占比Thinking mode当前思考模式档位估算策略很讲究模型成功响应后Tau 直接用服务商上报的真实 usage作为基准只对之后新增的消息做估算在没有可用数据时则退化为确定性的字符数 ÷ 4粗估。这套逻辑在 src/tau_coding/context_window.py 中实现官方说明见 website/content/guides/context.md。自动压缩三触发时机长会话不爆窗口的核心机制Tau 默认开启Pi 风格自动压缩触发阈值 模型窗口 − 16384 保留 token未知模型按 128000 窗口兜底。它在三个时机自动检查新提示发出前—— 捕获带外新增的上下文一轮成功结束后—— 赶在下一轮之前压缩上下文溢出报错后—— 无视本地估算强制压缩然后自动重试一次。阈值公式见 src/tau_coding/context_window.py设计文档见 dev-notes/architecture/phase-22-compaction-foundation.md。压缩是怎么工作的总结旧历史、保留近几轮压缩时 Tau 会让模型按固定结构总结旧消息——目标、约束偏好、进度已完成/进行中/受阻、关键决策、下一步、关键上下文并原样保留文件路径、函数名和错误信息。近期约 2 万 token 的对话原样保留更早的换成一段摘要。关键保证原始会话文件永远不被编辑append-only被改变的只是下次发给模型的活跃上下文。所以压缩无损可追溯历史分支照样能/tree回溯。手动压缩/compact 命令 聚焦指令随时可以主动压缩并附上聚焦指令/compact—— 标准压缩/compact focus on the database migration work—— 让摘要重点保留数据库迁移相关内容如果旧上下文太短、压缩后留不下真实内容Tau 会如实提示太短无法压缩。运行中按Esc可取消。命令清单见 website/content/reference/slash-commands.md 的 website/content/reference/slash-commands.md摘要提示词模板见 src/tau_coding/context_window.py。思考模式完整技巧ShiftTab 切换 7 档速度与成本自由平衡不是所有任务都值得模型深思熟虑。Tau 提供 7 档思考模式按ShiftTab循环切换CtrlT可显隐推理过程默认隐藏档位说明适用场景off/minimal不思考/极简推理改错别字、跑命令、格式化low/medium默认轻/中度推理日常编码、多数任务high/xhigh/max深度推理复杂架构设计、疑难 bug 排查档位定义在 src/tau_coding/thinking.py实现细节见 dev-notes/architecture/phase-20-2-thinking-controls.md。模型自适应与命令行启动参数模型感知Tau 只在该模型服务商声明支持时才开放思考控制不支持的模型会隐藏控件并给出原因不会出现选了但发不出去的情况。启动即设定tau -t high可用 CLI 参数 一次性指定档位off…max覆盖记忆默认值但不持久化。参数自动映射OpenAI 系映射为reasoning_effortCodex 系走reasoning.effortClaude 系映射为显式 token 预算medium≈ 4096max 32768。快捷键总表见 website/content/reference/keybindings.md。省钱实操清单长会话 token 成本降一半日常档位降到low/minimal改配置、跑测试这类任务关掉深度思考输出 token 立省大半定期/compact别等窗口逼近才压缩——历史越长每轮重复发送的 input token 越多越早压缩越划算压缩时给聚焦指令/compact 保留测试失败信息与未完成任务让摘要更可继续工作减少后续重复探索用/session核对占比若 tools 占比异常高考虑精简启用的工具集溢出自动兜底极端情况下 Tau 会在报错后强制压缩并重试一次无需人工干预。上下文压缩 思考模式是 Tau 中最不影响使用体验、却最省钱的两个开关。配合 website/content/guides/sessions.md 的会话管理你的长编码会话可以一路开到底窗口永不爆、账单不失控。相关行为均有测试覆盖见 tests/test_context_window.py 与 tests/test_thinking.py。【免费下载链接】tauA Python port of Pi’s minimalist coding agent.项目地址: https://gitcode.com/gh_mirrors/tau16/tau创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
上一篇/下一篇内容由系统自动关联
返回资讯列表 →