Grok Build CLI от xAI на модели Grok 4.5: код с первого раза на шахматной задаче, бенчмарк Lean 9/9 за $1.31 против Claude за $3.60 и вопрос приватности — что уходит в облако и как это отключить.
Запрос «grok code» набирает 245 показов в месяц (Wordstat, август 2026), и под ним чаще всего ищут именно терминальный агент xAI — Grok Build (Grok CLI). Репозитория xai-org/grok-code не существует: официальный продукт называется Grok Build, код лежит в github.com/xai-org/grok-build. В статье про установку Grok Code — как поставить и войти; здесь другой угол: три кейса, на которых видно, за что Grok хвалят, за что ругают и когда его выбирать.
Что такое Grok Build CLI
Grok Build — кодинг-агент xAI в терминале: полноэкранный TUI, headless-режим grok -p "..." для скриптов и CI, протокол ACP для встраивания в IDE (документация, docs.x.ai/build/overview). Ядро — модель Grok 4.5 с контекстом 500K токенов (страница продукта). Код открыт под Apache 2.0 с 14–15 июля 2026, внешние пул-реквесты не принимаются.
На момент публикации актуальна версия 1.0.0 (вышла 7 августа 2026, changelog). Установка одной командой:
curl -fsSL https://x.ai/cli/install.sh | bash
cd /путь/к/проекту && grok

Тарифы на момент публикации (страница тарифов, прайс API): бесплатный тариф с «щедрыми лимитами», SuperGrok за $30/мес, SuperGrok Plus за $100/мес; API grok-4.5 — $2 за 1M входных и $6 за 1M выходных токенов (при промпте от 200K токенов — $4/$12), специализированная модель для агентов grok-build-0.1 — $1 и $2.
Кейс 1: код с первого раза — шахматная задача Джона Кука
20 июля 2026 математик Джон Кук опубликовал эксперимент, на который в рунете ссылаются реже, чем он того заслуживает (johndcook.com). Он взял вариацию задачи о ферзях, которую сформулировал Мартин Гарднер: разместить на доске 5×5 пять белых и три чёрных ферзя так, чтобы ни один ферзь не атаковал ферзя другого цвета. Раньше Кук гонял эту задачу через Claude и ChatGPT на Prolog и Lean — с переменным успехом. Grok 4.5 он не пробовал принципиально:
I didn’t think Grok would be up to the task, though I didn’t try it. I’ve heard good things about Grok 4.5, so I gave it a shot. It did great.
«Я не думал, что Grok справится, хотя и не пробовал. Я слышал хорошие отзывы о Grok 4.5, поэтому дал ему шанс. Он справился отлично.»
Промпт для Prolog — одна фраза, без подсказок:
Generate SWI Prolog code to solve the following chess puzzle. On a 5 by 5 chessboard, place 5 white queens and 3 black queens so that no queen is attacking a queen of the other color. Have the code enumerate all solutions.
«Сгенерируй код на SWI Prolog для решения головоломки. На доске 5×5 размести 5 белых и 3 чёрных ферзя так, чтобы ни один ферзь не атаковал ферзя другого цвета. Пусть код перечислит все решения.»
Результат:
The code ran correctly, giving all eight solutions.
«Код отработал корректно и выдал все восемь решений.»
С первого раза, без единой итерации. Затем Кук попросил то же на Lean 4 — и вот тут начинается честная часть:
The code did not run on the first or second attempts but ran correctly on the third iteration. That’s better than I’ve seen before. It’s not an apples-to-apples comparison, but it has usually taken many iterations with Claude before Lean code would run.
«Код не запустился с первой и второй попыток, но с третьей отработал корректно. Такого я раньше не видел. Сравнение не совсем честное, но обычно с Claude на Lean уходило много итераций, прежде чем код начинал работать.»

Что это значит на практике. Показательно не «всё с первого раза» — такое бывает у любой хорошей модели на несложной задаче. Показательно другое: на Lean 4, где у Кука с другими моделями уходили десятки итераций, Grok пришёл к рабочему коду за три. Для алгоритмических задач «набросал код — сразу проверил — поправил» это и есть метрика скорости: не первая попытка, а количество итераций до рабочего результата. У Grok 4.5 их было меньше, чем Кук привык видеть.
Кейс 2: цена против качества — бенчмарк Lean на 9 задачах
Второй кейс — системный, с цифрами. Автор пакета OpenATP (единый интерфейс для гонки кодинг-агентов через формальные задачи Lean) прогнал Claude Code, Codex, Grok, DeepSeek и других на датасетах FATE-H и FATE-X и выложил результаты на Hacker News (HN, конец июля 2026, репозиторий OpenATP). Вывод автора:
I was surprised to find that Grok has accuracy competitive with Claude Code and Codex at faster wall-clock times and a fraction of the cost.
«Я был удивлён, обнаружив, что по точности Grok конкурирует с Claude Code и Codex, при этом быстрее по времени и заметно дешевле.»
На сложном датасете FATE-X — 9 задач автоматического доказательства теорем:
| Прувер | Решено | Время | Стоимость |
|---|---|---|---|
| Grok | 9/9 | 10:42 | $1.31 |
| Codex | 9/9 | 14:27 | $3.70 |
| Claude Code | 8/9 | 15:43 | $3.60 |
| DeepSeek | 3/9 | 41:48 | $0.21 |
На более простом FATE-H Grok решил 10/10 за $0.94 и 8:46, Claude — 10/10 за $2.05 и 9:50. Дословная формулировка автора про разницу:
Grok is ~50% faster and ~3x cheaper than Claude Code and Codex.
«Grok примерно на 50% быстрее и примерно в 3 раза дешевле Claude Code и Codex.»

Оговорки автора, которые стоит держать в голове (они же в посте): время и стоимость зависят от выбранного уровня effort, сравнение через CLI разных провайдеров не идеально чистое, из FATE-X исключена задача 10 (у Claude и Grok упёрлись лимиты сессии), а стоимость Codex посчитана по прайс-таблице, а не по отчёту CLI. Для оценки «порядка цифр» этого достаточно: у Grok цена за ту же точность действительно в разы ниже, и это не рекламная цифра от xAI, а независимый замер.
Кейс 3: приватность — что уходит в облако и как защититься
Самый важный кейс, потому что он про то, что происходит под капотом, а не в интерфейсе. В июле 2026 исследователь Cereblab разобрал трафик Grok Build версии 0.2.93 на уровне пакетов — через mitmproxy, с «канареечными» секретами в тестовом репозитории, без реальных данных (gist, 12.07.2026, обновлён 04.08; воспроизведение — репозиторий grok-build-exfil-repro). Два канала передачи:
Канал A — файлы, которые прочитал агент. Содержимое прочитанных файлов, включая .env с секретами, уходило в POST /v1/responses (то есть попадало в промпт к модели) дословно и без редактирования, а также паковалось в архив сессии для POST /v1/storage:
It transmits the contents of files it reads — including a .env secrets file — to xAI, verbatim and unredacted.
«Он передаёт в xAI содержимое читаемых файлов — включая файл .env с секретами — дословно и без редактирования.»
Канал B — весь репозиторий, независимо от того, что читал агент. CLI паковал весь воркспейс и загружал через POST /v1/storage в Google Cloud Storage — бакет grok-code-session-traces назван прямо в бинарнике. Проверка была жёсткая: агенту сказали «ответь OK, не читай никаких файлов» — и всё равно улетел git-bundle всего репозитория; из него можно было восстановить файл-канарейку, который агенту запрещали открывать. На репозитории в 12 ГБ случайных файлов канал B унёс 5,10 GiB (73 чанка по ~75 МБ, все с HTTP 200), а канал A — всего 192 КБ: соотношение ~27 800×, которое однозначно говорит, что загружается репозиторий, а не «то, что прочитали»:
It uploads the whole repository — every tracked file’s content plus git history — independent of what the agent reads.
«Он загружает весь репозиторий — содержимое каждого отслеживаемого файла плюс git-историю — независимо от того, что агент читает.»

Что изменилось после публикации разбора (по самому gist и changelog):
- 13 июля 2026 xAI отключила серверную загрузку — флаг
disable_codebase_upload: trueна стороне сервера; по проверке сообщества на 13.07 серверныйin_remote_trace_upload_enabled: false, то есть загрузка приостановлена удалённо; - 14–15 июля 2026 компания открыла исходники Grok Build под Apache 2.0, Илон Маск публично пообещал удалить собранные ранее данные — по состоянию на gist завершение удаления не подтверждено;
- в CLI появилась команда
/privacy— но это настройка хранения данных (retention), а не блокировка отправки: как показал сам Cereblab,/privacyне выключает передачу.
Ключевое для пользователя: даже после серверного отключения клиент сохраняет возможность загружать данные, поэтому локальные переключатели надёжнее, чем надежда на серверную политику. Проверенные сообществом варианты (комментарии к gist, репозиторий wetlink с canary-проверкой):
# ~/.grok/config.toml — жёсткий запрет канала B (весь репозиторий)
[harness]
disable_codebase_upload = true
# дополнительно выключить канал A (файлы в промпте)
[features]
telemetry = false
[telemetry]
trace_upload = false
# переменные окружения — наивысший приоритет (env > config > сервер)
export GROK_TELEMETRY_ENABLED=0
export GROK_TELEMETRY_TRACE_UPLOAD=0
Приоритет, по замерам wetlink: env перекрывает config, config перекрывает серверный флаг; [harness] disable_codebase_upload = true держится даже если загрузку форсят через env — это жёсткий локальный выключатель канала B. Ограничения этих средств: переменные окружения работают только при запуске через shell-обёртку (прямой вызов ~/.grok/bin/grok их обходит), а автообновление может поменять поведение — в репозитории wetlink есть скрипт verify.sh, который перепроверяет после каждого обновления. Диагностика текущего состояния — /privacy в TUI и grok doctor.
Тема чувствительная, поэтому без паники: ничто из разбора не доказывает, что xAI обучалась на чужих кодах — это политический вопрос, который исследователь явно вынес за скобки. Доказаны передача, приём и хранение. Для кода с секретами вывод один: либо локальные отключения, либо не использовать Grok Build на таком репозитории вовсе.
Выводы: когда выбирать Grok
Три кейса складываются в непротиворечивую картину.
- Быстрые алгоритмические задачи. Одна фраза промпта, рабочий код за одну-три итерации (кейс 1). Если задача не про архитектуру из 40 файлов, а про «реши головоломку / напиши функцию / собери proof-of-concept» — Grok 4.5 конкурирует с дорогими флагманами.
- Цена за объём. На формальных задачах Grok в ~3 раза дешевле Claude Code и Codex при сопоставимой точности и быстрее по времени (кейс 2). Для ночной прогонки сотен мелких задач это заметная экономия.
- Не выбирать для кода с секретами. История с
.envи загрузкой всего репозитория (кейс 3) — достаточный повод не пускать Grok Build в коммерческий код с ключами и NDA-материалами без локальных отключений, а лучше — вообще без него на таких репозиториях.
Проверка, подходит ли Grok под вашу задачу, бесплатна: вход по X-аккаунту, лимиты на бесплатном тарифе «щедрые» (формулировка xAI), обновления — grok update.
Российские реалии
Кейсы про скорость и цену Grok Build в рунете практически не освещены — пошаговых русскоязычных разборов именно CLI на момент публикации нет, а с кейсом про приватность ситуация чуть лучше. Что известно из доступных русскоязычных источников:
- Доступность. xAI фильтрует российские IP-адреса на своей стороне: grok.com и x.ai открываются из РФ только у части провайдеров, стабильной работы без зарубежного IP не ждать; Роскомнадзор ресурс формально не блокировал — ограничение ставит сама компания (AIMarketCap, 01.08.2026). Установка CLI из-под VPN проблем не создаёт, но каждый запуск агента требует соединения с серверами xAI — офлайн-работы нет.
- Вход и оплата. Для входа нужен аккаунт X (российские номера при верификации проходят не всегда — проще аккаунт через VPN с «чистым» IP). Платежи обрабатывает Stripe, карты российских банков (Visa, Mastercard, Mir) для SuperGrok не подходят — рабочие варианты: карта банка Казахстана/Узбекистана/Киргизии или посредники (AIMarketCap, там же). Бесплатный тариф карты не требует — этого достаточно, чтобы повторить все три кейса из статьи.
- Инцидент с приватностью в рунете освещён: новость о том, что xAI открыла код Grok Build после обнаружения загрузки репозиториев и SSH-ключей, разобрана на Tproger (июль 2026).
- Агрегаторы — не замена CLI. Российские сервисы вроде Study24, FICHI.AI, Syntx AI перепродают API-доступ к Grok за рубли, но это чат с моделью, а не терминальный агент с файловым доступом (AIMarketCap, там же).
Коротко: из РФ Grok Build устанавливается штатно, бесплатный тариф не требует карты, но стабильно работать получится только через VPN, а платить — зарубежной картой или через посредника. Русскоязычных кейсов «как я гонял Grok Build в продакшене» на момент публикации нет — эту нишу пока занимают только англоязычные источники из этой статьи.
Честные ограничения
- Все замеры сделаны на конкретных версиях. Кейс 1 — Grok 4.5 в июле 2026, кейс 3 — бинарник 0.2.93; на момент публикации актуальна 1.0.0. Поведение могло измениться — проверяйте на своей версии.
- Приватность — это не «было/стало чисто». Серверную загрузку xAI отключила, но удалённое подтверждение удаления ранее собранных данных на момент публикации не подтверждено, а клиент сохраняет возможность загрузки. Локальные переключатели — единственное, что вы контролируете сами.
- Границы исследования Cereblab. Не тестировалось, попадает ли в канал B файл из
.gitignore; вывод «непрочитанный файл не уходит» верен только для канала A (промпта), для снапшота репозитория — наоборот, доказано, что уходит. - Бенчмарк Lean — не универсальная оценка. Датасет узкий (формальные теоремы), сравнение через разные CLI не идеально чистое, у Claude на FATE-X был сбой делегирования субагенту. Для реальных кодовых задач цифры могут отличаться.
- Облачная архитектура. Grok Build всегда ходит в облако xAI за моделью: «локальная установка» не делает агента локальным, и из РФ это значит VPN.
- Оплата из РФ. Бесплатный тариф доступен; платные лимиты и API — только зарубежной картой или через посредников.
Вывод
Grok Build CLI — редкий случай, когда терминальный агент дешевле конкурентов не за счёт качества: на шахматной задаче Кука код с первого раза, на бенчмарке OpenATP — 9/9 за $1.31 против $3.60 у Claude. Платить за это приходится вниманием к приватности: разбор Cereblab показал, что ранние версии грузили в облако и .env, и весь репозиторий, и хотя xAI загрузку отключила и открыла код, на коммерческих репозиториях без локальных переключателей и здравого смысла не обойтись. Вывод простой: пет-проекты и задачи «на скорость» — да; код с секретами — только с [harness] disable_codebase_upload = true или вообще не Grok.
Дальше по серии: установка и первый запуск — «Grok Code (Grok Build CLI): установка», сравнение агентов — «Лучший ИИ-агент для кодинга в 2026», аналоги — «Как установить Codex CLI», «Как установить Gemini CLI», общая вводная — «Что такое агентный кодинг», протокол внешних инструментов — «Что такое MCP».
