2026-08-01T08:38:53.767Z
优化OpenClaw代币使用,而不会削弱结果
在新的会议中测量OpenClaw代币储蓄,削减重复的背景,并只在相同的验证结果存活时促进变化.
最安全的方法 优化 OpenClaw 代币使用 一次更改一个文本来源,测量两个新的运行,并要求两者均获得相同的结果. 如果代理人忘记了决定,重复了外部行动,或者返回了可信的答案,而不是请求的文物,则较低的代币数量并不是胜利. 在2026年7月28日的控制运行中,我用924字节的证据摘要取代了 4,102个字节的重复试验历史. 两次新的OpenClaw会议都使用了相同的模型,系统提示哈希,任务,预期的SHA 256和输出预测. 输入使用量从24,605美元下降到23,614美元:991美元减少,即4.0%. 返回的JSON,72个输出代币,文物消化和通过判决是相同的. 这证明了有限的决策trim重复,同时保留终端错误和结果收据不是预测每个工作负载将节省4%. 系统提示比更改的记录大得多,每个变体只运行一次. Sidewisp 目前处于私密预览阶段。 测量您实际上可以改变的提示 OpenClaw文本不仅仅是最新用户消息. 它的官方文本指南列出了系统提示,对话历史,工具调用和结果以及附件作为贡献者. 工具方案虽然不被表现为普通文本,但它们仍然存在. 技能添加一个紧的元数据列表;它们的完整指令按要求进行加载. 开始从证据,而不是清理: /context detail 可以找到大型启动器文件,工具方案,技能输入和紧的转录信息. 通过 /usage tokens 显示每个响应代币和缓存字段. /status 显示了最新的文本快照和最后的响应使用. 这些表面回答了不同的问题. 区别很重要,因为OpenClaw将供应商使用账户与当前文本快照分开. 正如标志性使用参考解释的那样,提供商总数可能包括缓存输入,输出和多个工具循环调用,而文本显示器使用最新的快速快照. 不要把一个从另一个中减去,把剩下的称作"废物". 在更改之前至少记录下: 保持配额窗口,账户总额和每次运行的代币在单独的列中. 订阅使用页面可以回答"剩下多少容量?" 转录条目可以归因于模拟调用,而无需证明预期的交付物存在. 执行前后控制测试 实验使用了合成的发票出口事件,以便在不暴露私人提示或日志的情况下发布输入. 基线包含了两次截止时间尝试,重复进步线和一个成功的尝试. 最优化的变体保留了尝试数量,终端时间切断事实,最终退出状态,文物路径,精确的SHA 256,测试结果和最终状态;它删除了没有改变决定的重复行. 每个变体都在一个新的会议中运行, 智能障碍者. 验证器要求一个精确的JSON形状,除非该文物存在,其消化匹配,并且测试通过,否则拒绝通过. 一个可重复使用的命令看起来像这样: 运行优化文件在不同的新式会议键下. 保持代理,模型,思维水平,任务,输出合同和系统配置固定. 如果系统提示哈希不同,则比较是受污染的,应该重复运行. 观察到的结果是: 测量 基线 优化 改变 : : : 输入文件 4,102 字节 924 字节 −77.5% 输入代码 24,605 23,614 −991 (−4.0%) 输出代码 72 72 没有变化 正确结果 JSON 通过 通过 保存 艺术品SHA 256 匹配 匹配 保存 测试 通过 通过 保存 文件减少和总输入减少之间的很大的区别是有用的发现. 在两次运行中,OpenClaw报告了相同的33,883字符系统提示. 因此,从一个记录中删除3,178个字节不能删除整个提示的77.5%. 这就是为什么一个更小的日志的戏剧性截图不会显著降低账单的原因. 墙时间从28.7秒降至21.8秒,但每种变体的一个样本不足以将延迟归因于文本变化. 模型服务变化,排队和网络条件不受控制. 处理延迟为未经证明的,直到多次间接重复显示稳定的分布. 删除重复而不删除决定 使用最小的杆,针对最大的测量贡献者. 对于旧工具输出,OpenClaws 会议剪切文件描述了内存切割,在保持磁盘转录完整的情况下切割符合条件的工具结果. 它可以保存最近的转折,并且可以在硬清除较老的结果之前软剪大结果. 这比重写正常对话文本更适合大量的命令输出. 为了长时间的对话历史, /compact 创建了总结并保存了最近的消息. 其他国家 紧缩指南 总结在转录中保留,而整个历史仍然存储在磁盘上. 将总结指导到任务: 宽容有界限. 如果一个小小的提示丢失了无权密钥,批准状态或预期的消化, 在收缩后,请经纪人重新确认结果合同,然后与存储的收据进行比较. 复试需要自己的控制. OpenClaws 复试政策明确旨在重新尝试当前的请求,保留订单,避免重复非无权的操作. 不要通过重播整个多步骤流程来解决暂停时间. 首先,检查外部影响是否已经发生. 然后再试试一个未解决的无力步骤, 一个复制记录仍然应该回答: 哪个步骤失败了,最后的错误是什么? 时间停止之前是否有外部影响? 下一场行动是无效的吗? 还有多少次尝试? 什么证据证明恢复? 任何不能改变这些答案的东西都是剪裁的候选人. 任何需要回答的东西都会留下来. 证实结果的门储蓄 测试报告中,令牌的减少和结果质量都属于相同的测试报告. 使用任务允许的确定性收据:文件存在加上消化,测试结果,数据库行加上无能率键,HTTP状态加上响应哈希,或目标特定消息ID. 仅用于不能直接检查的属性使用LLM判断器. 适用本决定规则: 一次测试一个杆:大工具结果剪裁,引导紧缩,更短的启动文件,更小的图像尺寸,更短的技能描述或不同的模型. 改变它们都可能会减少费用, 同时将缓存经济与原始代币减少分开. 一个稳定的重复前可能比一个不断重写的short提示更便宜. 换句话说,在使用时间到期后重新存储的大型提示可能是昂贵的. 单独报告输入,输出,缓存读取,缓存写入和本地价格假设;当缺少模型定价时,永远不要发明成本. 控制结果支持实际默认:保留终端错误和收据,崩重复,并对相同的交付值进行判断. 它不支持攻击性删除,普遍储蓄百分比, Sidewisp的产品方向包括OpenClaw和其他代理运行时间的预定代币使用和估计成本情报,但该功能今天还没有出货. 现场体验是早期访问网站和产品展示. 如果连接使用与验证结果的健康视图可以帮助您的操作,您可以加入私人预览,而不需要改变运行时间或通过Sidewisp调用路由模型调用.