2026-08-01T07:44:06.414Z

Оптимизировать использование токенов OpenClaw без ослабления результатов

Измерить сбережения токенов OpenClaw в новых сессиях, уменьшить повторяющийся контекст и способствовать изменению только тогда, когда сохранится тот же проверенный результат.

Наиболее безопасный способ использовать токен optimize OpenClaw использование токен заключается в том, чтобы изменить один источник контекста одновременно, измерить два новых запуска и потребовать от обоих одного и того же результата получения. Более низкое количество токенов не является победой, если агент забывает решение, повторяет внешнее действие или возвращает правдоподобный ответ вместо запрошенного артефакта. 28 июля 2026 года я заменил 4 102 байта истории повторных попыток с 924 байтным резюме доказательств. Обе новые сессии OpenClaw использовали одну и ту же модель, хэш прометы системы, задачу, ожидаемый SHA 256 и прогноз выхода. Использование ввода упало с 24 605 до 23 614 токенов: 991 меньше токенов, или на 4,0%. Возвращенный JSON, 72 выпускных токенов, перепись артефакта и вердикт пропуска были идентичны. Это свидетельствует о узком принятии решенийпрерывом повторении при сохранении терминальных ошибок и полученных результатовне прогноз, что каждая рабочая нагрузка позволит сэкономить 4%. Система была гораздо больше, чем измененная запись, и каждый вариант работал только один раз. Sidewisp сейчас находится на этапе закрытого предварительного доступа. Измерить запрос, который вы можете изменить Контекст OpenClaw это больше, чем последнее сообщение пользователя. Его официальный Контекстный справочник перечисляет системный запрос, историю разговоров, звонки инструмента и результаты, а также приложения в качестве участников. Схемы инструментов имеют значение, даже если они не отображаются как обычный текст. Навыки добавляют компактный список метаданных; их полные инструкции загружаются по запросу. Начнем с доказательств, а не с очистки: /context detail обнаруживает большие файлы загрузки, схемы инструментов, записи навыков и компактные сообщения транскрипта. /usage tokens раскрывает полы токенов и кеша на ответ. /status показывает последний контекстный снимок и использование последних ответов. Эти поверхности отвечают на разные вопросы. Различие имеет значение, потому что OpenClaw держит учет использования провайдера отдельно от текущего контекстного снижения. Как объясняет ссылка на использование символов, общие показатели провайдера могут включать вкладные входные, выходные и несколько звонков инструментального цикла, в то время как контекстный дисплей использует последние кратчайшие снимки. Не отнимайте одного от другого и называйте остальное "отходом". Запишите, по крайней мере, это перед изменением: Охраняйте окна квот, суммы счетов и токены на каждый запуск в отдельных колонках. Страница использования подписки может ответить на вопрос "Сколько же емкости осталось?" без доказательства того, какой локальный ход ее потреблял. Запись в транскрипте может отнести модели вызова, не доказывая существования предполагаемого поставщика. Проведение контролируемого теста до и после В эксперименте использовался синтетический инцидент с экспортом счетов, чтобы ввод мог быть опубликован без раскрытия частных запросов или журналов. Основная линия содержала две попытки отсрочки, повторяющиеся линии прогресса и одну успешную попытку. Оптимизированный вариант сохранил количество попыток, как терминальные факты отсрочки, окончательный статус выхода, путь артефакта, точный SHA 256, результат тестирования и окончательное состояние; он удалил повторяющиеся строки, которые не изменили решение. Каждый вариант проходил в новом сеансе с инвалидами мышления. Проверщик требовал точной формы JSON и отказался проходить, если артефакт не существовал, его переваривание не соответствовало и испытания не прошли. Повторно используемая команда выглядит так: Запустите оптимизированный файл под другим свежим клавишем сессии. Сохраняйте агент, модель, уровень мышления, задачу, выходный контракт и конфигурацию системы фиксированными. В случае, если настройки системных хашей отличаются, сравнение загрязнено и должно быть повторено. Наблюдаемый результат был: Измерение Исходная линия Оптимизированные Изменение : : : Входный файл 4 102 байты 924 байтов −77.5% Вводные токены 24,605 23,614 −991 (−4.0%) Токены выхода 72 72 Никаких изменений Точный результат JSON пропуск пропуск сохраняется Артефакт SHA 256 совпадение совпадение сохраняется Испытания пропуск пропуск сохраняется Большая разница между сокращением файлов и сокращением общего ввода является полезным результатом. В обоих запусках OpenClaw сообщил о том же 33,883 значном системном запросе. Таким образом, удаление 3 178 байтов из одной записи не могло удалить 77,5% всего запроса. Вот почему драматический скриншот небольшого блока не позволяет резко сократить расходы. Время стены упало с 28,7 до 21,8 секунды, но одного образца на вариант недостаточно, чтобы приписать задержку изменению контекста. Неконтролируемые варианты модели обслуживания, очереди и условия сети. Обращайтесь с задержкой как с не доказавшимся до тех пор, пока не будет установлено стабильное распределение несколькими повторяющимися повторяниями. Удалить повторение без удаления решения Используйте самый маленький рычаг, который нацелен на крупнейшего измеряемого участника. Для выхода старых инструментов OpenClaws документация о подрезке сеанса описывает подрезку в памяти, которая подбирает результаты инструмента, оставляя транскрипт на диске нетронутым. Он сохраняет недавние повороты и может смягчить большие результаты, прежде чем трудно очистить старые. Это лучше подходит для громоздких команд, чем перепись обычного текста разговора. Для долгой истории разговоров /compact создает резюме и сохраняет последние сообщения. руководство по сжатию говорит, что резюме сохраняется в транскрипте, пока полная история остается на диске. Направьте резюме к задаче: У компактности есть границы. Маленький запрос, который потеряет ключ от безработицы, состояние одобрения или ожидаемое переваривание, может привести к дорогостоящей и небезопасной переработке. После сжатия попросите агента перезаписать исходный контракт и сравнить его с сохраненным квитанцией, прежде чем продолжить. Возвращение требует собственного контроля. OpenClaws Политика повторных попыток явно стремится перепробовать текущий запрос, сохранить заказы и избежать дублирования неидемопотентных операций. Не решайте перерыв, повторяя целый многоступенчатый поток. Сначала проверьте, произошел ли внешний эффект. Затем попробуйте только неразрешенный бессильный шаг, с ограничением попыток. Комплексная запись повторного испытания должна ответить: Какой шаг провалился и с какой конечной ошибкой? Было ли замечено внешнее воздействие до отсрочки? Следующее действие бессильно? Сколько попыток осталось? Какие доказательства докажут, что он выздоровел? Все, что не может изменить эти ответы, является кандидатом на резку. Все, что нужно, чтобы ответить на них, остается. Сбережения по воротам по проверенному результату Уменьшение токенов и качество результатов относятся к одному и тому же отчету о испытаниях. Используйте детерминистическую квитанцию, когда задача позволяет: существование файла плюс переваривание, результаты тестов, ряд базы данных плюс ключ idempotency, статус HTTP плюс хэш ответа или идентификатор сообщения, специфический для пункта назначения. Используйте судью LLM только для свойств, которые не могут быть проверены напрямую. Применить это решение: Проверьте один рычаг за раз: большие инструментальные резки, управляемое сжатие, более короткие файлы для загрузки, меньшие размеры изображения, более короткие описания навыков или другую модель. Изменение всех из них вместе может уменьшить расходы, но это мешает вам узнать, какая из них помогла и какая повредила надежности. Также отделять экономику кеша от сокращения сырых токенов. Стабильный повторяющийся префикс может быть дешевле, когда он читается в кеше, чем постоянно переписываемый запрос short. С другой стороны, крупный запрос, перезагруженный после истечения срока его действия, может быть дорогостоящим. Отчеты о вводе, выводе, чтении в кеше, записи в кеше и предположениях о местных ценах отдельно; никогда не придумывайте стоимость, когда отсутствует ценообразование модели. Контролируемый результат здесь поддерживает практический дефолт: сохранение терминальных ошибок и расписок, повторение коллапса и оценка изменения по сравнению с той же доставкой. Он не поддерживает агрессивное удаление, универсальный процент сбережений или заявление о успехе только из числа токенов. Направление продукта Sidewisp включает в себя планируемое использование токенов и расчетную информацию о затратах на OpenClaw и другие агенты, но эта возможность не поставляется сегодня. Живой опыт это сайт с ранним доступом и демонстрация продукта. Если просмотр состояния, который соединяет использование с проверенными результатами, поможет вашим операциям, вы можете присоединиться к частному просмотру без изменения времени запуска или маршрутизации звонков модели через Sidewisp.