Claude Code vs OpenCode: реальные токенные затраты по замерам API

2026-07-30

Claude Code тратит 33 000 токенов до вашего промпта, OpenCode — 7 000. Сравниваем реальные затраты, кеширование и субагентов по данным API.

Коротко: Claude Code отправляет около 33 000 токенов системного промпта и схем инструментов до обработки первого запроса — против 7 000 у OpenCode. В реальной продакшн-конфигурации с файлом инструкций и MCP-серверами стартовая нагрузка вырастает до 75 000–85 000 токенов. Кэширование у Claude Code значительно менее эффективно. По состоянию на июль 2026.

Почему токенные накладные расходы агента важны для бизнеса

Каждый токен нагрузки — это деньги, задержка и сжимающийся контекст. При агентной работе системный промпт отправляется заново на каждом ходу. Это означает, что базовая стоимость инструмента напрямую влияет на операционные расходы любого продакшн-пайплайна.

Чтобы получить точные цифры, исследователи встроили прокси-сервер с логированием между инструментами и API-эндпоинтом модели — и перехватили реальные JSON-payload, а не только итоговую статистику.

Базовые расходы: 33 000 против 7 000 токенов

Тест на минимальной задаче («Ответь ровно: OK») показал следующее:

ИнструментБазовая нагрузка
Claude Code (Sonnet 4.5)~33 000 токенов
OpenCode~7 000 токенов
Claude Code (Fable 5)~23 000 токенов

Разница — в архитектуре. Claude Code заранее передаёт модели подробные схемы всех инструментов и расширенный системный промпт. При переходе на более новую модель Fable 5 разрыв сокращается до 3,3x, но кратность зависит от версии модели.

Почему кэширование у Claude Code стоит дороже

Кэширование промптов должно снижать затраты — но это работает только при стабильном префиксе запроса.

OpenCode обеспечивает побайтово идентичный префикс в каждом запуске: один раз платит за запись в кэш, дальше считывает по низкой ставке.

Claude Code перезаписывает десятки тысяч токенов кэша в середине сессии — снова и снова. На одной задаче он записывал в кэш до 54 раз больше токенов, чем OpenCode. Запись тарифицируется по повышенной ставке, что и объясняет неожиданный рост счётчиков при внешне похожей работе.

Что происходит в реальной конфигурации

В тестовой среде конфиги были намеренно пустыми. В реальном продакшне картина тяжелее:

Это не разовая плата — это стоимость каждого запроса в течение всей сессии.

Субагенты: скрытый множитель затрат

Одна из самых неожиданных находок — нелинейный рост стоимости при делегировании:

Каждый субагент несёт полные накладные расходы на инициализацию. Родительский агент затем оплачивает полный транскрипт каждого субагента. Для параллельных независимых задач это может быть оправдано, но для последовательных сценариев — прямое выполнение в 4 раза дешевле.

Когда Claude Code экономичнее OpenCode

На многошаговой задаче суммарный расход Claude Code оказался ниже. Причина: он группирует вызовы инструментов в меньшее количество запросов, тогда как OpenCode заново платит базовую стоимость за каждый ход.

Вывод: для коротких задач и простых конфигураций OpenCode экономичнее. Для длинных многошаговых сессий с интенсивным использованием инструментов — преимущество может перейти к Claude Code. Считайте токены на уровне API, а не по итоговым дашбордам.

Часто задаваемые вопросы

Почему Claude Code тратит так много токенов до начала работы?
Это архитектурное решение: инструмент передаёт модели детальные схемы всех доступных инструментов и расширенный системный контекст при каждом запросе. Это обеспечивает гибкость, но увеличивает базовую стоимость.

Как файл CLAUDE.md влияет на стоимость сессии?
Файл инструкций размером 72 КБ добавляет около 20 000 токенов к каждому запросу в сессии — не только к первому. При 50 запросах в сессии это дополнительный миллион токенов только за инструкции.

Стоит ли использовать субагентов в продакшн-пайплайнах?
Зависит от задачи. Если задачи реально параллельны и независимы — субагенты оправданы. Для последовательных задач прямое выполнение в 4 раза дешевле из-за накладных расходов на инициализацию и передачу транскриптов.

Как точно измерить токены своего агента?
Встройте прокси с логированием между инструментом и API. Перехватывайте JSON-payload запросов и поле usage в ответах — это единственный способ получить точные цифры по входным токенам, записям и считываниям из кэша.

Разбираем ИИ-инструменты для бизнеса →
<a href='https://t.me/contentrunbot'>ИИ Инструменты</a> | <a href='https://contentrun.ai/'>Контент-завод</a> | <a href='https://platform.contentrun.ai/'>База знаний</a>

Опубликовано на ContentRun, внедрение ИИ в маркетинг и продажи. Что мы делаем.