Коротко: Claude Code отправляет около 33 000 токенов системного промпта и схем инструментов до обработки первого запроса — против 7 000 у OpenCode. В реальной продакшн-конфигурации с файлом инструкций и MCP-серверами стартовая нагрузка вырастает до 75 000–85 000 токенов. Кэширование у Claude Code значительно менее эффективно. По состоянию на июль 2026.
Почему токенные накладные расходы агента важны для бизнеса
Каждый токен нагрузки — это деньги, задержка и сжимающийся контекст. При агентной работе системный промпт отправляется заново на каждом ходу. Это означает, что базовая стоимость инструмента напрямую влияет на операционные расходы любого продакшн-пайплайна.
Чтобы получить точные цифры, исследователи встроили прокси-сервер с логированием между инструментами и API-эндпоинтом модели — и перехватили реальные JSON-payload, а не только итоговую статистику.
Базовые расходы: 33 000 против 7 000 токенов
Тест на минимальной задаче («Ответь ровно: OK») показал следующее:
| Инструмент | Базовая нагрузка |
|---|---|
| Claude Code (Sonnet 4.5) | ~33 000 токенов |
| OpenCode | ~7 000 токенов |
| Claude Code (Fable 5) | ~23 000 токенов |
Разница — в архитектуре. Claude Code заранее передаёт модели подробные схемы всех инструментов и расширенный системный промпт. При переходе на более новую модель Fable 5 разрыв сокращается до 3,3x, но кратность зависит от версии модели.
Почему кэширование у Claude Code стоит дороже
Кэширование промптов должно снижать затраты — но это работает только при стабильном префиксе запроса.
OpenCode обеспечивает побайтово идентичный префикс в каждом запуске: один раз платит за запись в кэш, дальше считывает по низкой ставке.
Claude Code перезаписывает десятки тысяч токенов кэша в середине сессии — снова и снова. На одной задаче он записывал в кэш до 54 раз больше токенов, чем OpenCode. Запись тарифицируется по повышенной ставке, что и объясняет неожиданный рост счётчиков при внешне похожей работе.
Что происходит в реальной конфигурации
В тестовой среде конфиги были намеренно пустыми. В реальном продакшне картина тяжелее:
- Файл инструкций 72 КБ (CLAUDE.md / AGENTS.md) добавляет в среднем +20 000 токенов к каждому запросу
- 5 MCP-серверов добавляют ещё +5 000–7 000 токенов
- Итого до первого слова пользователя: 75 000–85 000 токенов
Это не разовая плата — это стоимость каждого запроса в течение всей сессии.
Субагенты: скрытый множитель затрат
Одна из самых неожиданных находок — нелинейный рост стоимости при делегировании:
- Прямое выполнение задачи: 121 000 токенов
- Те же задачи через двух субагентов: 513 000 токенов
Каждый субагент несёт полные накладные расходы на инициализацию. Родительский агент затем оплачивает полный транскрипт каждого субагента. Для параллельных независимых задач это может быть оправдано, но для последовательных сценариев — прямое выполнение в 4 раза дешевле.
Когда Claude Code экономичнее OpenCode
На многошаговой задаче суммарный расход Claude Code оказался ниже. Причина: он группирует вызовы инструментов в меньшее количество запросов, тогда как OpenCode заново платит базовую стоимость за каждый ход.
Вывод: для коротких задач и простых конфигураций OpenCode экономичнее. Для длинных многошаговых сессий с интенсивным использованием инструментов — преимущество может перейти к Claude Code. Считайте токены на уровне API, а не по итоговым дашбордам.
Часто задаваемые вопросы
Почему Claude Code тратит так много токенов до начала работы?
Это архитектурное решение: инструмент передаёт модели детальные схемы всех доступных инструментов и расширенный системный контекст при каждом запросе. Это обеспечивает гибкость, но увеличивает базовую стоимость.
Как файл CLAUDE.md влияет на стоимость сессии?
Файл инструкций размером 72 КБ добавляет около 20 000 токенов к каждому запросу в сессии — не только к первому. При 50 запросах в сессии это дополнительный миллион токенов только за инструкции.
Стоит ли использовать субагентов в продакшн-пайплайнах?
Зависит от задачи. Если задачи реально параллельны и независимы — субагенты оправданы. Для последовательных задач прямое выполнение в 4 раза дешевле из-за накладных расходов на инициализацию и передачу транскриптов.
Как точно измерить токены своего агента?
Встройте прокси с логированием между инструментом и API. Перехватывайте JSON-payload запросов и поле usage в ответах — это единственный способ получить точные цифры по входным токенам, записям и считываниям из кэша.
Разбираем ИИ-инструменты для бизнеса →
<a href='https://t.me/contentrunbot'>ИИ Инструменты</a> | <a href='https://contentrun.ai/'>Контент-завод</a> | <a href='https://platform.contentrun.ai/'>База знаний</a>