Перейти к содержимому

Grok Build CLI: скорость, цена и вопрос приватности — три кейса

Grok Build CLI от xAI на модели Grok 4.5: код с первого раза на шахматной задаче, бенчмарк Lean 9/9 за $1.31 против Claude за $3.60 и вопрос приватности — что уходит в облако и как это отключить.

Запрос «grok code» набирает 245 показов в месяц (Wordstat, август 2026), и под ним чаще всего ищут именно терминальный агент xAI — Grok Build (Grok CLI). Репозитория xai-org/grok-code не существует: официальный продукт называется Grok Build, код лежит в github.com/xai-org/grok-build. В статье про установку Grok Code — как поставить и войти; здесь другой угол: три кейса, на которых видно, за что Grok хвалят, за что ругают и когда его выбирать.

Что такое Grok Build CLI

Grok Build — кодинг-агент xAI в терминале: полноэкранный TUI, headless-режим grok -p "..." для скриптов и CI, протокол ACP для встраивания в IDE (документация, docs.x.ai/build/overview). Ядро — модель Grok 4.5 с контекстом 500K токенов (страница продукта). Код открыт под Apache 2.0 с 14–15 июля 2026, внешние пул-реквесты не принимаются.

На момент публикации актуальна версия 1.0.0 (вышла 7 августа 2026, changelog). Установка одной командой:

curl -fsSL https://x.ai/cli/install.sh | bash
cd /путь/к/проекту && grok
Официальный changelog Grok Build: v1.0.0 от 7 августа 2026
Заглавная запись changelog на момент публикации — v1.0.0 от 07.08.2026, там же команда установки. Источник: x.ai/build/changelog (скриншот на момент публикации).

Тарифы на момент публикации (страница тарифов, прайс API): бесплатный тариф с «щедрыми лимитами», SuperGrok за $30/мес, SuperGrok Plus за $100/мес; API grok-4.5 — $2 за 1M входных и $6 за 1M выходных токенов (при промпте от 200K токенов — $4/$12), специализированная модель для агентов grok-build-0.1 — $1 и $2.

Кейс 1: код с первого раза — шахматная задача Джона Кука

20 июля 2026 математик Джон Кук опубликовал эксперимент, на который в рунете ссылаются реже, чем он того заслуживает (johndcook.com). Он взял вариацию задачи о ферзях, которую сформулировал Мартин Гарднер: разместить на доске 5×5 пять белых и три чёрных ферзя так, чтобы ни один ферзь не атаковал ферзя другого цвета. Раньше Кук гонял эту задачу через Claude и ChatGPT на Prolog и Lean — с переменным успехом. Grok 4.5 он не пробовал принципиально:

I didn’t think Grok would be up to the task, though I didn’t try it. I’ve heard good things about Grok 4.5, so I gave it a shot. It did great.

«Я не думал, что Grok справится, хотя и не пробовал. Я слышал хорошие отзывы о Grok 4.5, поэтому дал ему шанс. Он справился отлично.»

Промпт для Prolog — одна фраза, без подсказок:

Generate SWI Prolog code to solve the following chess puzzle. On a 5 by 5 chessboard, place 5 white queens and 3 black queens so that no queen is attacking a queen of the other color. Have the code enumerate all solutions.

«Сгенерируй код на SWI Prolog для решения головоломки. На доске 5×5 размести 5 белых и 3 чёрных ферзя так, чтобы ни один ферзь не атаковал ферзя другого цвета. Пусть код перечислит все решения.»

Результат:

The code ran correctly, giving all eight solutions.

«Код отработал корректно и выдал все восемь решений.»

С первого раза, без единой итерации. Затем Кук попросил то же на Lean 4 — и вот тут начинается честная часть:

The code did not run on the first or second attempts but ran correctly on the third iteration. That’s better than I’ve seen before. It’s not an apples-to-apples comparison, but it has usually taken many iterations with Claude before Lean code would run.

«Код не запустился с первой и второй попыток, но с третьей отработал корректно. Такого я раньше не видел. Сравнение не совсем честное, но обычно с Claude на Lean уходило много итераций, прежде чем код начинал работать.»

Статья Джона Кука «Solving a chess puzzle with Grok 4.5»: промпт и вывод о восьми решениях
Первая часть поста от 20.07.2026: промпт на SWI Prolog, результат «код отработал корректно, все восемь решений» и признание про Lean 4 — с третьей итерации. Источник: johndcook.com/blog/2026/07/20/grok-chess (скриншот на момент публикации).

Что это значит на практике. Показательно не «всё с первого раза» — такое бывает у любой хорошей модели на несложной задаче. Показательно другое: на Lean 4, где у Кука с другими моделями уходили десятки итераций, Grok пришёл к рабочему коду за три. Для алгоритмических задач «набросал код — сразу проверил — поправил» это и есть метрика скорости: не первая попытка, а количество итераций до рабочего результата. У Grok 4.5 их было меньше, чем Кук привык видеть.

Кейс 2: цена против качества — бенчмарк Lean на 9 задачах

Второй кейс — системный, с цифрами. Автор пакета OpenATP (единый интерфейс для гонки кодинг-агентов через формальные задачи Lean) прогнал Claude Code, Codex, Grok, DeepSeek и других на датасетах FATE-H и FATE-X и выложил результаты на Hacker News (HN, конец июля 2026, репозиторий OpenATP). Вывод автора:

I was surprised to find that Grok has accuracy competitive with Claude Code and Codex at faster wall-clock times and a fraction of the cost.

«Я был удивлён, обнаружив, что по точности Grok конкурирует с Claude Code и Codex, при этом быстрее по времени и заметно дешевле.»

На сложном датасете FATE-X — 9 задач автоматического доказательства теорем:

Прувер Решено Время Стоимость
Grok 9/9 10:42 $1.31
Codex 9/9 14:27 $3.70
Claude Code 8/9 15:43 $3.60
DeepSeek 3/9 41:48 $0.21

На более простом FATE-H Grok решил 10/10 за $0.94 и 8:46, Claude — 10/10 за $2.05 и 9:50. Дословная формулировка автора про разницу:

Grok is ~50% faster and ~3x cheaper than Claude Code and Codex.

«Grok примерно на 50% быстрее и примерно в 3 раза дешевле Claude Code и Codex.»

Пост на Hacker News «Grok is a surprisingly good automated theorem prover» с таблицами бенчмарка FATE-H и FATE-X
Текст поста OpenATP: на FATE-X Grok решает 9/9 за 10:42 и $1.31 против 8/9 у Claude за $3.60; на FATE-H 10/10 за $0.94. Источник: news.ycombinator.com/item?id=49010310 (скриншот на момент публикации).

Оговорки автора, которые стоит держать в голове (они же в посте): время и стоимость зависят от выбранного уровня effort, сравнение через CLI разных провайдеров не идеально чистое, из FATE-X исключена задача 10 (у Claude и Grok упёрлись лимиты сессии), а стоимость Codex посчитана по прайс-таблице, а не по отчёту CLI. Для оценки «порядка цифр» этого достаточно: у Grok цена за ту же точность действительно в разы ниже, и это не рекламная цифра от xAI, а независимый замер.

Кейс 3: приватность — что уходит в облако и как защититься

Самый важный кейс, потому что он про то, что происходит под капотом, а не в интерфейсе. В июле 2026 исследователь Cereblab разобрал трафик Grok Build версии 0.2.93 на уровне пакетов — через mitmproxy, с «канареечными» секретами в тестовом репозитории, без реальных данных (gist, 12.07.2026, обновлён 04.08; воспроизведение — репозиторий grok-build-exfil-repro). Два канала передачи:

Канал A — файлы, которые прочитал агент. Содержимое прочитанных файлов, включая .env с секретами, уходило в POST /v1/responses (то есть попадало в промпт к модели) дословно и без редактирования, а также паковалось в архив сессии для POST /v1/storage:

It transmits the contents of files it reads — including a .env secrets file — to xAI, verbatim and unredacted.

«Он передаёт в xAI содержимое читаемых файлов — включая файл .env с секретами — дословно и без редактирования.»

Канал B — весь репозиторий, независимо от того, что читал агент. CLI паковал весь воркспейс и загружал через POST /v1/storage в Google Cloud Storage — бакет grok-code-session-traces назван прямо в бинарнике. Проверка была жёсткая: агенту сказали «ответь OK, не читай никаких файлов» — и всё равно улетел git-bundle всего репозитория; из него можно было восстановить файл-канарейку, который агенту запрещали открывать. На репозитории в 12 ГБ случайных файлов канал B унёс 5,10 GiB (73 чанка по ~75 МБ, все с HTTP 200), а канал A — всего 192 КБ: соотношение ~27 800×, которое однозначно говорит, что загружается репозиторий, а не «то, что прочитали»:

It uploads the whole repository — every tracked file’s content plus git history — independent of what the agent reads.

«Он загружает весь репозиторий — содержимое каждого отслеживаемого файла плюс git-историю — независимо от того, что агент читает.»

Схема: два канала передачи данных Grok Build 0.2.93 — канал A (прочитанные файлы в /v1/responses) и канал B (весь репозиторий в GCS-бакет grok-code-session-traces), внизу — локальные переключатели защиты
Собственная схема по данным wire-level анализа @cereblab (grok 0.2.93): канал B нёс 5,10 GiB с репозитория в 12 ГБ, пока канал A — 192 КБ. Нижняя панель — проверенные локальные отключения. Источник данных: gist cereblab, июль 2026.

Что изменилось после публикации разбора (по самому gist и changelog):

  • 13 июля 2026 xAI отключила серверную загрузку — флаг disable_codebase_upload: true на стороне сервера; по проверке сообщества на 13.07 серверный in_remote_trace_upload_enabled: false, то есть загрузка приостановлена удалённо;
  • 14–15 июля 2026 компания открыла исходники Grok Build под Apache 2.0, Илон Маск публично пообещал удалить собранные ранее данные — по состоянию на gist завершение удаления не подтверждено;
  • в CLI появилась команда /privacy — но это настройка хранения данных (retention), а не блокировка отправки: как показал сам Cereblab, /privacy не выключает передачу.

Ключевое для пользователя: даже после серверного отключения клиент сохраняет возможность загружать данные, поэтому локальные переключатели надёжнее, чем надежда на серверную политику. Проверенные сообществом варианты (комментарии к gist, репозиторий wetlink с canary-проверкой):

# ~/.grok/config.toml — жёсткий запрет канала B (весь репозиторий)
[harness]
disable_codebase_upload = true

# дополнительно выключить канал A (файлы в промпте)
[features]
telemetry = false

[telemetry]
trace_upload = false
# переменные окружения — наивысший приоритет (env > config > сервер)
export GROK_TELEMETRY_ENABLED=0
export GROK_TELEMETRY_TRACE_UPLOAD=0

Приоритет, по замерам wetlink: env перекрывает config, config перекрывает серверный флаг; [harness] disable_codebase_upload = true держится даже если загрузку форсят через env — это жёсткий локальный выключатель канала B. Ограничения этих средств: переменные окружения работают только при запуске через shell-обёртку (прямой вызов ~/.grok/bin/grok их обходит), а автообновление может поменять поведение — в репозитории wetlink есть скрипт verify.sh, который перепроверяет после каждого обновления. Диагностика текущего состояния — /privacy в TUI и grok doctor.

Тема чувствительная, поэтому без паники: ничто из разбора не доказывает, что xAI обучалась на чужих кодах — это политический вопрос, который исследователь явно вынес за скобки. Доказаны передача, приём и хранение. Для кода с секретами вывод один: либо локальные отключения, либо не использовать Grok Build на таком репозитории вовсе.

Выводы: когда выбирать Grok

Три кейса складываются в непротиворечивую картину.

  • Быстрые алгоритмические задачи. Одна фраза промпта, рабочий код за одну-три итерации (кейс 1). Если задача не про архитектуру из 40 файлов, а про «реши головоломку / напиши функцию / собери proof-of-concept» — Grok 4.5 конкурирует с дорогими флагманами.
  • Цена за объём. На формальных задачах Grok в ~3 раза дешевле Claude Code и Codex при сопоставимой точности и быстрее по времени (кейс 2). Для ночной прогонки сотен мелких задач это заметная экономия.
  • Не выбирать для кода с секретами. История с .env и загрузкой всего репозитория (кейс 3) — достаточный повод не пускать Grok Build в коммерческий код с ключами и NDA-материалами без локальных отключений, а лучше — вообще без него на таких репозиториях.

Проверка, подходит ли Grok под вашу задачу, бесплатна: вход по X-аккаунту, лимиты на бесплатном тарифе «щедрые» (формулировка xAI), обновления — grok update.

Российские реалии

Кейсы про скорость и цену Grok Build в рунете практически не освещены — пошаговых русскоязычных разборов именно CLI на момент публикации нет, а с кейсом про приватность ситуация чуть лучше. Что известно из доступных русскоязычных источников:

  • Доступность. xAI фильтрует российские IP-адреса на своей стороне: grok.com и x.ai открываются из РФ только у части провайдеров, стабильной работы без зарубежного IP не ждать; Роскомнадзор ресурс формально не блокировал — ограничение ставит сама компания (AIMarketCap, 01.08.2026). Установка CLI из-под VPN проблем не создаёт, но каждый запуск агента требует соединения с серверами xAI — офлайн-работы нет.
  • Вход и оплата. Для входа нужен аккаунт X (российские номера при верификации проходят не всегда — проще аккаунт через VPN с «чистым» IP). Платежи обрабатывает Stripe, карты российских банков (Visa, Mastercard, Mir) для SuperGrok не подходят — рабочие варианты: карта банка Казахстана/Узбекистана/Киргизии или посредники (AIMarketCap, там же). Бесплатный тариф карты не требует — этого достаточно, чтобы повторить все три кейса из статьи.
  • Инцидент с приватностью в рунете освещён: новость о том, что xAI открыла код Grok Build после обнаружения загрузки репозиториев и SSH-ключей, разобрана на Tproger (июль 2026).
  • Агрегаторы — не замена CLI. Российские сервисы вроде Study24, FICHI.AI, Syntx AI перепродают API-доступ к Grok за рубли, но это чат с моделью, а не терминальный агент с файловым доступом (AIMarketCap, там же).

Коротко: из РФ Grok Build устанавливается штатно, бесплатный тариф не требует карты, но стабильно работать получится только через VPN, а платить — зарубежной картой или через посредника. Русскоязычных кейсов «как я гонял Grok Build в продакшене» на момент публикации нет — эту нишу пока занимают только англоязычные источники из этой статьи.

Честные ограничения

  • Все замеры сделаны на конкретных версиях. Кейс 1 — Grok 4.5 в июле 2026, кейс 3 — бинарник 0.2.93; на момент публикации актуальна 1.0.0. Поведение могло измениться — проверяйте на своей версии.
  • Приватность — это не «было/стало чисто». Серверную загрузку xAI отключила, но удалённое подтверждение удаления ранее собранных данных на момент публикации не подтверждено, а клиент сохраняет возможность загрузки. Локальные переключатели — единственное, что вы контролируете сами.
  • Границы исследования Cereblab. Не тестировалось, попадает ли в канал B файл из .gitignore; вывод «непрочитанный файл не уходит» верен только для канала A (промпта), для снапшота репозитория — наоборот, доказано, что уходит.
  • Бенчмарк Lean — не универсальная оценка. Датасет узкий (формальные теоремы), сравнение через разные CLI не идеально чистое, у Claude на FATE-X был сбой делегирования субагенту. Для реальных кодовых задач цифры могут отличаться.
  • Облачная архитектура. Grok Build всегда ходит в облако xAI за моделью: «локальная установка» не делает агента локальным, и из РФ это значит VPN.
  • Оплата из РФ. Бесплатный тариф доступен; платные лимиты и API — только зарубежной картой или через посредников.

Вывод

Grok Build CLI — редкий случай, когда терминальный агент дешевле конкурентов не за счёт качества: на шахматной задаче Кука код с первого раза, на бенчмарке OpenATP — 9/9 за $1.31 против $3.60 у Claude. Платить за это приходится вниманием к приватности: разбор Cereblab показал, что ранние версии грузили в облако и .env, и весь репозиторий, и хотя xAI загрузку отключила и открыла код, на коммерческих репозиториях без локальных переключателей и здравого смысла не обойтись. Вывод простой: пет-проекты и задачи «на скорость» — да; код с секретами — только с [harness] disable_codebase_upload = true или вообще не Grok.

Дальше по серии: установка и первый запуск — «Grok Code (Grok Build CLI): установка», сравнение агентов — «Лучший ИИ-агент для кодинга в 2026», аналоги — «Как установить Codex CLI», «Как установить Gemini CLI», общая вводная — «Что такое агентный кодинг», протокол внешних инструментов — «Что такое MCP».

Насколько публикация полезна?

Нажмите на звезду, чтобы оценить!

Средняя оценка / 5. Количество оценок:

Оценок пока нет. Поставьте оценку первым.

Добавить комментарий

Adblock
detector