Налог на контекст: куда утекают токены
📊 Налог на контекст: куда утекают токены
Разбор 40 сессий агентной разработки — 20 в Claude Code и 20 в Codex — показал, что почти все деньги уходят на повторную пересылку уже отправленного. По данным Habr, на каждый токен, впервые попавший в контекст, медианная сессия повторно пересылает 47 старых у Claude Code и 36 у Codex. Свежий ввод — 0.003% объёма у Claude и 5.7% у Codex; ответ модели — меньше 1%. Всё остальное — круговорот одного и того же текста.
Модель не хранит состояние между вызовами: каждый шаг отправляет всю историю заново. Провайдеры смягчают проблему кэшированием запросов — повторная пересылка тарифицируется в 10 раз дешевле, но запись в кэш дороже и живёт час. Пауза в работе — и кэш создаётся заново, добавляя 11% к счёту.
→ Удвоение числа шагов даёт ×2.4 по токенам у Claude Code (наклон 1.27 в логарифмических координатах).
→ Вывод инструментов создаёт 60–90% связанной повторной пересылки: чтение файлов и команды bash.
→ Ошибки инструментов не бесплатны: 90 неудачных вызовов Codex утащили 5.5 млн токенов повторной пересылки.
→ Стартовый контекст — 54% всех повторов у Claude Code, 28% у Codex; инструкции человека — лишь 1.5–5%.
Оптимизировать цену за токен или ужимать CLAUDE.md бессмысленно: ваш текст не виден на фоне каркаса. Зато расширение с обработчиком на 4 тыс токенов на старте — это сотни тысяч токенов пересылки за длинную сессию. Реальная экономия — не выбор дешёвой модели, а короткие сессии и фильтрация вывода инструментов.
#ClaudeCode #Codex #агенты #токены #инференс
Такие разборы выходят в канале каждый день — коротко и со ссылкой на первоисточник.