Агентный кодинг с OpenCode — это быстро, но непрозрачно: за каждый промпт списываются деньги, а повторные запросы к одинаковому контексту обходятся по полной. Cloudflare AI Gateway решает обе проблемы — кэширует ответы, считает расходы и добавляет rate limiting. С OpenCode v1.18.19 настройка сводится к правке одного JSON-файла.
Что такое Cloudflare AI Gateway
Cloudflare AI Gateway — бесплатный прокси-слой между вашим приложением и LLM-провайдером. Вы меняете одну строку в URL (вместо api.openai.com/v1 ставите gateway.ai.cloudflare.com/v1/.../openai) — и все запросы проходят через инфраструктуру Cloudflare. Провайдер не видит разницы: те же API-ключи, тот же формат ответов (документация Cloudflare AI Gateway).
Что даёт этот слой:
- Кэширование — идентичные промпты отдаются из кэша Cloudflare без обращения к провайдеру. Одинаковые системные инструкции и повторяющиеся контексты экономят до 30–50% токенов (документация по кэшированию).
- Rate limiting — жёсткий лимит запросов, чтобы не превысить квоты провайдера.
- Аналитика и логи — сколько токенов, какая стоимость, какие модели используются больше всего. Всё видно в дашборде Cloudflare.
- Retry и fallback — автоматический повтор при ошибках и переключение на запасную модель.
- Data Loss Prevention — сканирование промптов на наличие секретов и конфиденциальных данных.
Тариф: полностью бесплатно на всех планах, включая бесплатный. Платные только логи сверх лимита (100 000 для бесплатного плана) и Unified Billing (5% комиссия при предоплате credits) (документация по ценам).
Что изменилось в OpenCode v1.18.19
20 августа 2026 года вышел OpenCode v1.18.19 с двумя изменениями, релевантными теме:
-
Нативные passthrough’и для OpenAI и Anthropic через Cloudflare AI Gateway. Раньше приходилось настраивать Cloudflare как кастомный провайдер с npm-пакетом
@ai-sdk/openai-compatible. Теперь OpenCode распознаёт шлюзы Cloudflare для обоих провайдеров из коробки — достаточно прописатьbaseURL. -
Лимиты Codex подогнаны под тарифы ChatGPT Plus. До этого OpenCode использовал свои внутренние лимиты, которые не совпадали с подписочными квотами ChatGPT. Конtribьютор @GameOn223 выровнял их (PR #39082).
Стоимость для OpenCode-проекта: $0. Бесплатная версия Cloudflare + OpenCode из коробки. Для моделей OpenAI/Anthropic нужны API-ключи, но шлюз между ними — бесплатно.
Пошаговая настройка
Шаг 1. Создание шлюза в Cloudflare
- Зарегистрируйтесь на dash.cloudflare.com (бесплатный аккаунт).
- Перейдите в AI → AI Gateway.
- Нажмите Create Gateway, задайте имя (например,
my-opencode). - Скопируйте Account ID (виден в правом столбце на странице шлюза).
- В разделе Settings включите Cache Responses (если хотите кэширование).
Шаг 2. Настройка OpenCode
В файле opencode.json в корне проекта (или в ~/.config/opencode/opencode.json для глобальных настроек) добавьте провайдер с baseURL, указывающим на ваш шлюз:
{
"$schema": "https://opencode.ai/config.json",
"model": "openai/gpt-4.1-mini",
"provider": {
"openai": {
"options": {
"baseURL": "https://gateway.ai.cloudflare.com/v1/YOUR_ACCOUNT_ID/my-opencode/openai"
}
}
}
}
Для Anthropic — аналогично:
{
"provider": {
"anthropic": {
"options": {
"baseURL": "https://gateway.ai.cloudflare.com/v1/YOUR_ACCOUNT_ID/my-opencode/anthropic"
}
}
}
}
YOUR_ACCOUNT_ID — ваш идентификатор аккаунта Cloudflare. my-opencode — имя шлюза.
API-ключ провайдера OpenCode подхватит автоматически (через /connect или переменные окружения OPENAI_API_KEY/ANTHROPIC_API_KEY). Шлюз не заменяет ключ — он пропускает трафик через себя и добавляет свои заголовки.
Шаг 3. Проверка
- Запустите
opencodeи отправьте любую задачу. - Откройте дашборд Cloudflare → AI Gateway → Logs.
- Убедитесь, что запрос появился с указанием модели и количества токенов.
Кэширование: как экономит
Кэширование в Cloudflare AI Gateway работает по точному совпадению запроса — хэш SHA-256 от провайдера, эндпоинта, модели, заголовка авторизации и тела запроса (документация).
Для агентного кодинга это значит: системные инструкции (system prompt), контекст проекта и повторяющиеся задачи могут отдаваться из кэша. Типичные сценарии:
- Одинаковый system prompt — при каждом новом чате OpenCode отправляет инструкции модели. Если они не меняются, кэш возвращает ответ мгновенно.
- Повторные вопросы — «объясни структуру проекта» при смене ветки отправляется с тем же контекстом. При повторе — HIT.
- Реран задач — если вы откатили изменения и запустили ту же задачу повторно.
На практике коэффициент попадания в кэш зависит от того, насколько стабилен контекст. Для систематических шаблонов и повторяющихся рефакторингов — существенная экономия. Для уникальных задач — ноль экономии (каждый промпт уникален).
Для каждого запроса можно управлять кэшем через HTTP-заголовки:
cf-aig-skip-cache: true— пропустить кэш и пойти напрямую к провайдеру.cf-aig-cache-ttl: 3600— время жизни кэша в секундах (60–2 592 000).cf-aig-cache-key: mykey— собственный ключ кэша для группировки запросов.
Rate limiting: контроль расходов
В дашборде Cloudflare AI Gateway задайте лимит: количество запросов в минуту/час/день. Когда лимит исчерпан, шлюз вернёт ошибку 429 вместо обращения к провайдеру. OpenCode получит ошибку и остановится — вместо неожиданного списания.
Комбинация «rate limiting в шлюзе + подписочные лимиты ChatGPT Plus» (которые теперь совпадают с внутренними лимитами OpenCode после v1.18.19) даёт двухуровневую защиту от перерасхода.
Российские реалии
- Cloudflare работает в РФ без VPN. Шлюз (
gateway.ai.cloudflare.com) доступен напрямую — это CDN/инфраструктура, а не AI-сервис, и она не под санкциями. - OpenCode работает в РФ без VPN. Проверено на практике — см. реальный опыт использования.
- API-ключи OpenAI и Anthropic. Регистрация на openai.com и anthropic.com из РФ может потребовать VPN. Но сам API-ключ одноразово создаётся и дальше используется без VPN — Cloudflare проксирует запросы.
- Оплата. Visa/Mastercard российскими картами не работают ни для OpenAI, ни для Anthropic. Варианты: виртуальные карты (Tinkoff Julian, QPay), UnionPay, криптовалюта через посредников, или через OpenCode Zen (бесплатные модели) / OpenCode Go ($5 первый месяц).
- Провайдеры с российской оплатой. Если проблема с платёжкой — DeepSeek (принимает карты) и OpenRouter (через крипту) работают через Cloudflare AI Gateway так же, как OpenAI/Anthropic. Конфиг тот же, меняется только провайдер.
Ограничения
- Кэш — только для идентичных запросов. Нет семантического кэширования (пока): если в промпте изменилась хотя бы запятая — это промах кэша. Cloudflare планирует добавить семантический кэш, но на момент публикации его нет.
- Латентность. Дополнительный хоп через Cloudflare добавляет 10–30 мс. Для агентного кодинга это незаметно (ответы моделей в секундах), но для realtime-сценариев может быть актуально.
- Только текст и изображения. Кэширование не работает для аудио и других модальностей.
- Cloudflare — ещё один точечный отказ. Если Cloudflare лежит, вы не достучитесь до провайдера. Хотя uptime Cloudflare стабильно выше 99,9%.
Стоимость: сводка
| Компонент | Цена |
|---|---|
| Cloudflare AI Gateway | Бесплатно (все планы) |
| OpenCode | Бесплатно (open source) |
| Кэширование | Бесплатно |
| Rate limiting | Бесплатно |
| Аналитика/логи | Бесплатно (до 100K логов) |
| OpenAI / Anthropic API | По тарифу провайдера (шлюз не добавляет наценку) |
Комбинация OpenCode + Cloudflare AI Gateway — это добавление бесплатного слоя контроля поверх уже бесплатного инструмента. Экономия идёт за счёт кэширования повторяющихся запросов и предотвращения случайных превышений лимитов.
