先补齐必要概念
适合:需要定位长对话或工具循环失败。
- Token
- 模型编码和计量内容的单位,不等于固定数量的汉字或单词;实验直接给定计数,不实现分词。
- 上下文
- 本次请求中模型能使用的信息,包括指令、历史、工具定义和材料。
- 生成预算
- 允许生成内容的上限;某些接口还将推理用量计入其中,具体规则要查目标接口。
- 安全余量
- 应用主动留出的空间,用于计数误差或预计增量;不能替代真实计数。
原理怎样一步步成立?
- 组装请求
分别统计指令、历史、工具定义和证据。
- 检查约束
同时检查总容量与独立输出上限。
- 调用并检查状态
区分完成、预算耗尽、拒绝和传输中断。
- 准备下一轮
加入工具结果后重新计数,检查必要证据是否保留。
进阶 · 定位故障
沿状态定位超窗、截断与丢证据
本层目标:能够依据请求、响应和证据快照定位失效阶段。
先保留能够区分原因的事实
至少记录各类输入计数、生成配置、响应终态、工具结果大小和证据标识。调试日志需要遵守材料本身的权限,不能为了排查就保存所有用户正文。只有“请求失败”一行,无法区分容量拒绝、网络失败和生成不完整。
构造三个不同反例
第一例保留生成预算,增加工具结果直到输入规则失败;第二例保持输入可容纳,降低允许生成范围并观察不完整产物;第三例在传输层中断。第三例不是本课数字实验覆盖的行为,需要真实接口或可靠工具替身另行验证。不要把三种情况用同一种“加大 token”策略处理。
摘要后还要查丢了什么
摘要能缩短材料,但可能丢掉例外条款。给固定问题标出必须保留的证据,再比较压缩前后的证据覆盖和回答。请求从失败变为成功,仅证明容量问题得到缓解;如果错误变成悄悄漏条件,修复仍未完成。
运行实验,观察反例
给定 token 数的离线算术实验;不调用模型,不验证分词器、流式传输或厂商实际限制。
Python 3.10+ · 默认运行只使用标准库 · 在你的电脑运行
- 先手算,再运行脚本核对
- 改变工具结果增量并重新计算
- 故意超过独立输出上限,检查错误分支
python3 context_budget.py查看本入口脚本
"""Given token counts: no tokenizer, model request or provider-specific limit."""
import json
def remaining(context, output_limit, output, reserve, components):
values = [context, output_limit, output, reserve, *components.values()]
if any(type(v) is not int or v < 0 for v in values):
raise ValueError("counts must be non-negative integers")
if output > output_limit:
raise ValueError("output limit exceeded")
return context - sum(components.values()) - output - reserve
def demo():
components = dict(instructions=2000, history=10000, tools=3000, evidence=8000)
before = remaining(32000, 8000, 6000, 1000, components)
after = remaining(32000, 8000, 6000, 1000, {**components, "result": 4000})
assert before == 2000 and after == -2000
return dict(input_tokens=sum(components.values()), current_room=before,
next_turn_room=after, next_turn_fits=after >= 0)
if __name__ == "__main__":
print(json.dumps(demo(), sort_keys=True))
本地运行的预期输出
{"current_room": 2000, "input_tokens": 23000, "next_turn_fits": false, "next_turn_room": -2000}- 完整输入分项一致
- 下一轮容量重新计算
- 实验通过不等于回答质量通过
本层验收任务
写一份排查表,为容量拒绝、生成截断、流式中断分别列观测信号与处理办法。
完成后逐条核对
- 容量错误关联完整输入与生成预算
- 截断检查响应终态和产物完整性
- 压缩后复核必要证据而非只看请求是否成功
保存自己的过程、代码与结果。这里提供验收要求,暂不自动评分或保存课程掌握状态。
收起答案,检查理解
同一请求压缩后能运行了,能直接宣布问题修好吗?
展开参考推导
不能。还要检查任务约束和例外证据是否保留,以及最终结论是否仍被材料支持。
延伸原理与知识练习
遇到不熟悉的原理,先阅读实现、连续追问和迁移案例,再独立说明前提与边界。作答与笔记保存到原有账号记录。
本专题的全部关联解析与练习(3 道)
依据与验证范围
原理依据来自公开资料;数字、案例和任务是本站教学设计。离线实验验证本页注明的范围,学习效果仍需通过独立任务与反馈判断。