Grok 4 API: стоимость, ограничения и как начать работу

Создаете приложение или составляете бюджет для агента? Начните с той модели, которую вы действительно будете использовать. Уведомление о миграции от 15 мая 2026 года говорится, что исходный идентификатор Grok 4 теперь без особых усилий сопоставляется с Grok 4.3. Успешный вызов по старому идентификатору больше не доказывает, что его обслуживала исходная модель.

Использование API тарифицируется отдельно от потребительских подписок Grok. Стоимость подписки и доступа к Grok охватывает тарифные планы на чат; эти ежемесячные платежи не являются кредитами для прямой интеграции с xAI.

Хотите опробовать подсказку, прежде чем интегрировать её в приложение? Попробуйте Grok 4.6 на GlobalGPT для рабочего процесса на основе чата. Используйте ключ API xAI для собственной интеграции и прямого выставления счетов xAI. Эта статья опубликована компанией GlobalGPT; ссылки на продукты содержат код отслеживания рефералов.

Grok 4 Цены по API: текущие тарифы и утративший силу первоначальный вариант

В приведенной ниже таблице используются Цены xAI по прейскуранту, проверенные 8 сентября 2026 года. Каждая сумма указана в долларах США за один миллион токенов. Входные данные, кешированные входные данные и выходные данные относятся к отдельным категориям, за которые взимается плата, поэтому единая совокупная “цена за миллион” скрывает фактическую стоимость обработки данных.

USD за 1 млн токенов · стандартная обработка

grok-4.3

Оригинальный Grok, 4 цели перенаправления

Контекст: 1 000 000 токенов

Подсказка < 200K

Вход
$1.25
Кэшированный ввод
$0.20
Результат / обоснование
$2.50

Подсказка >= 200K

Вход
$2.50
Кэшированный ввод
$0.40
Результат / обоснование
$5.00

grok-4.6

Текущий флагман

Контекст: 500 000 токенов

Подсказка < 200K

Вход
$2.00
Кэшированный ввод
$0.50
Результат / обоснование
$6.00

Подсказка >= 200K

Вход
$4.00
Кэшированный ввод
$1.00
Результат / обоснование
$12.00

grok-4.5

Предыдущая версия текущего поколения

Контекст: 500 000 токенов

Подсказка < 200K

Вход
$2.00
Кэшированный ввод
$0.30
Результат / обоснование
$6.00

Подсказка >= 200K

Вход
$4.00
Кэшированный ввод
$0.60
Результат / обоснование
$12.00

Как только объем запроса достигает 200 тыс. токенов, тарифы на обработку длинных контекстов начинают применяться ко всем токенам в данном запросе, включая выходные данные.

Другие указанные идентификаторы семейства Grok 4 включают: grok-4.20-0309-reasoning, grok-4.20-0309-без-вывода и grok-4.20-multi-agent-0309. Каждый из них имеет контекстное окно размером 1 млн токенов и те же коэффициенты коротких/длинных токенов, что и в Grok 4.3. Соответствующая удельная цена не означает соответствия общего потребления токенов, особенно при работе с несколькими агентами.

Если вам нужен вариант, ориентированный на программирование, grok-build-0.1 имеет контекстное окно объёмом 256K, а скорости ввода/кэширования/вывода с коротким контекстом составляют $1.00/$0.20/$2.00, которые увеличиваются до $2,00/$0,40/$4,00 при пороговом значении подсказки 200K. Более подробную информацию о поведении системы и сценариях использования см. в нашем Обзор Grok 4.6.

Официальная документация xAI, в которой указаны Grok 4.6, идентификатор модели, контекст объемом 500K и настраиваемые возможности вывода.
Официальный каталог моделей xAI, зафиксировано 7 сентября и перепроверено 8 сентября 2026 года. Заголовок $2/$6 — это цена Grok для ввода-вывода с коротким контекстом (4,6); показатели для кэша и длинного контекста приведены выше.

А что стало с первоначальной ценой на модели $3 / $15?

Более старые источники, в том числе наши Руководство по интеграции Grok 4 API, котировка $3 за миллион входных токенов и $15 за миллион выходных токенов для исходного Grok 4. Рассматривайте это как историческую котировку, а не как сегодняшний счет по выведенному из обращения идентификатору. Старый официальный URL модели теперь ведёт в общий каталог моделей, поэтому это не является недавно подтверждённым архивным прайс-листом.

Сайт оригинальное объявление Grok 4 описывает контекстное окно размером 256 000 токенов. Эта историческая емкость, а также старые цены или пороговые значения модели Fast не должны копироваться в бюджет на замену. Точное правило для grok-4-0709 теперь составляет Grok 4.3 с низкой степенью сложности рассуждений; оплата производится по тарифам Grok 4.3.

Официальное уведомление о прекращении поддержки, в котором упоминается версия grok-4-0709 и её перенаправление на grok-4.3
Уведомление о прекращении работы xAI, зафиксировано 7 сентября 2026 г.; текст перепроверен 8 сентября. Указанное исходное перенаправление Grok 4 ID ведёт на Grok 4.3. В полном тексте уведомления отдельно указаны исключения, касающиеся кодирования и моделей изображений.

Grok 4 — это название поколения моделей, тогда как Grok — это также название потребительского продукта. Наш объяснение того, что такое Grok 4 содержит эту справочную информацию о продукте. При создании нового кода следует явно выбирать поддерживаемую модель, а не полагаться на перенаправление при снятии с производства или исходить из того, что псевдоним поставщика останется неизменным.

Как ввод данных, кэшированные данные и логические выводы влияют на законопроект

Один запрос, три символических списания

Некешированные входные данные

(I – C) × скорость подачи

I = все токены подсказки; C = токены подсказки из кэша.

Кэшированный ввод

C × частота кэша

Кэшированные токены являются частью входных данных, а не дополнительными входными данными.

Объем работ, подлежащих оплате

O × скорость выхода

O учитывает логику, когда конечная точка сообщает об этом в выводе.

Расчетная стоимость токена в долларах США = [(I – C) × ставка за ввод данных + C × ставка за кэшированный ввод + O × ставка за вывод данных] / 1 000 000. Затем добавьте соответствующие расходы на инструменты, хранение или прочие расходы. Перед выполнением вычислений выберите тарифы с учетом длительного контекста, используя запрос на общую сумму, включая токены из кэша.

Входные данные включают сообщения, инструкции и историю диалога, отправленные модели. При кэшировании для всех запросов повторно используется один и тот же начальный префикс; этот процесс происходит автоматически, и xAI рекомендует использовать идентификатор диалога для более эффективного повторного использования. Наличие внешне похожего запроса не гарантирует попадания в кэш. Документация по кэшированию подсказок объясняет, как происходит сопоставление.

В разделе «Автозаполнение в чате» прочитайте prompt_tokens_details.cached_tokens; в разделе «Ответы» читайте: input_tokens_details.cached_tokens. . Справочник по использованию кэша и ценам счета, учитывающие токены за логические выводы по полной ставке. Если в итоговой сумме вывода уже учтены логические выводы, добавление tokenы_рассуждений это снова привело бы к двойному учету.

Версия Grok 4.6 поддерживает уровни сложности вывода «низкий», «средний», «высокий» и «очень высокий»; по умолчанию задокументированным значением является «высокий», и вывод отключить невозможно. Версия Grok 4.3 поддерживает уровни «отсутствует», «низкий», «средний» и «высокий». Поэтому версия Grok 4.3 с уровнем «none» заслуживает внимания для задач строгого извлечения, в то время как версия Grok 4.6 может затрачивать больше токенов даже при коротком видимом ответе. См. параметры логики и запись о модели Grok 4.3, приведенную выше.

Вызовы инструментов, пакетная обработка и запросы с приоритетом

Согласно официальный прайс-лист на инструменты, «Веб-поиск», «X-поиск» и «Выполнение кода» стоят $5 за каждую 1 000 запросов, или $0,005 за один запрос, плюс расход токенов. Один запрос может вызывать инструменты более одного раза. Десять запросов на поиск добавляют $0.05 до токенов модели; включение инструмента не указывает, сколько раз он будет использован.

Поиск по вложениям файлов стоит $10 за 1 000 запросов; поиск по коллекциям — $2,50 за 1 000. За хранение и скачивание файлов и коллекций также взимается ежедневная плата. Для изображений и видео используются собственные единицы измерения стоимости, поэтому их следует исключать из расчёта токенов, относящегося только к тексту. Наш Руководство по рабочему процессу с изображениями и видео в Grok покрывает этот отдельный маршрут генерации.

Сайт Пакетный API предусматривает скидку в размере 20% токенов для версии Grok 4.3 и трёх указанных вариантов версии Grok 4.20. Скидка распространяется на токены ввода, кэшированного ввода, вывода и вывода заключений. На странице модели Grok 4.6 указано, что Batch API не поддерживается. Не применяйте общую скидку 50% и не предполагайте, что каждая перечисленная модель поддерживает пакетную обработку.

Приоритетная обработка стоит в 2 раза дороже стандартной стоимости токенов, включая токены кэширования и рассуждений, когда возвращаемый уровень_обслуживания подтверждает приоритет. При переходе на уровень по умолчанию применяются стандартные тарифы. Приоритет распространяется на завершение чатов и ответы, но не на пакетный API.

Три наглядных примера расчета стоимости API

Это ориентировочные цены по прейскуранту, а не фактические суммы счетов. Все приведенные ниже запросы обрабатываются по стандартной схеме: только текст, без использования инструментов, без хранения данных, без повторных попыток и без учета налогов. “Результат” включает в себя любую часть, подлежащую оплате. Первые две рабочие нагрузки предполагают длину запросов менее 200 тыс. токенов.

Стоимость одного запроса и 10 000 запросов

Grok 4,3 · без кэша

$0.005 / запрос

2 000 входов × $1.25 + 1 000 выходов × $2.50, деленное на 1 млн. 10 000 запросов = $50.

Grok 4,6 · без кэша

$0.010 / запрос

2 000 входов × $2 + 1 000 выходов × $6, деленное на 1 млн. 10 000 запросов = $100.

Grok 4,6 · 90% — данные ввода кэшированы

$0.0073 / запрос

200 без кэширования × $2 + 1 800 с кэшированием × $0,50 + 1 000 на выходе × $6, деленное на 1 млн. 10 000 запросов = $73.

Высокий коэффициент попадания в кэш наиболее эффективен в тех случаях, когда основную часть рабочей нагрузки составляет ввод данных. В примере Grok 4.6 кэширование экономит $0.0027 на каждый вызов, или 27% от общего объема, даже несмотря на то, что в кэше находится 90% входных токенов. Нагрузка на вывод остается на уровне $0.006. Оценивайте экономию по отношению ко всему запросу, а не только к кэшированной части.

Пороговое значение запроса в 200K может изменить весь запрос

Еще один входной токен превысил ценовой порог

199 999 токенов «prompt»

$0.459998

Grok 4.6: (199 999 × $2 + 10 000 выходных данных × $6) / 1M. Без кэша.

200 000 токенов «prompt»

$0.920000

Grok 4.6: (200 000 × $4 + 10 000 выходов × $12) / 1M. Без кэша.

Основной В таблице цен явно указано: “Длинный контекст >= 200 тыс. токенов” и указывает, что для всех токенов будет применяться более высокий тариф, как только показатель достигнет порогового значения. В описании модели указано, что показатель “превышает” 200 тыс. При составлении бюджета ровно на 200 000 используйте четко указанный порог из таблицы цен; не следует полагать, что по-прежнему действует более низкий тариф.

Для составления ежемесячного прогноза оцените объем запросов отдельно для каждой рабочей нагрузки, диапазона контекста, схемы попаданий в кэш и настройки логики. Добавьте ожидаемое количество повторных попыток и вызовов инструмента. Затем сравните эту оценку с вашими собственными данными о затратах, полученными по итогам небольшого пилотного проекта. Показатель «центы за вызов» имеет смысл только в том случае, если лежащие в его основе допущения соответствуют реальным условиям эксплуатации.

Контекст, выходные данные, ограничения скорости и лимиты расходов — это разные понятия

Четыре ограничения, которые необходимо проверить перед масштабированием

Окно контекста

По запросу

Grok 4.3: 1 млн токенов. Grok 4.6: 500 тыс. Это не ежемесячный лимит.

Бюджет на выплаты

За каждый ответ

Установите допустимую мощность выхода. Номинальная мощность не гарантирует столь значительного видимого выхода.

RPS / TPM

Пропускная способность

Количество запросов в секунду и токенов в минуту. Оба показателя должны укладываться в лимит, установленный для уровня команды.

Контроль расходов

Деньги

Лимиты по балансу предоплаты, автоматическому пополнению и выставлению счетов определяют различные режимы пополнения счета.

Общественность таблица ограничений скорости В таблице для модели Grok 4.3 указаны показатели уровня 0: 37 запросов в секунду и 10 миллионов токенов в минуту; для модели Grok 4.6 указаны показатели: 150 запросов в секунду и 50 миллионов токенов в минуту. Это устаревшие данные о уровнях, опубликованные ранее, а не гарантия того, что каждый ключ обладает одинаковой полезной пропускной способностью. Консоль вашей команды является авторитетным источником информации о доступе и ограничениях для текущей модели.

Уровни определяются на основе совокупных расходов на API с 1 января 2026 года: $0, $50, $250, $1 000 и $5 000 для уровней с 0 по 4. Ограничение количества запросов в секунду осуществляется путем деления минутного лимита запросов на 60, поэтому вы не можете использовать весь лимит за одну минуту за один раз. Токены ввода, вывода, вывода заключений и кэшированные токены учитываются при подсчете TPM, даже если стоимость некоторых из них ниже.

На проверенных страницах моделей Grok 4.3 и 4.6 приведены размеры контекста без указания отдельного максимального значения выходной мощности. Текущие Справочник по конечным точкам ответов определяет max_output_tokens в качестве совокупного бюджета на вывод и рассуждения: по умолчанию он равен 128 000, если не задан, и допускает более высокое значение для более длинных поколений. Это значение по умолчанию не гарантирует 128 000 видимых токенов ответа или неограниченный объем контекста. Задайте явный бюджет и проанализируйте неполные ответы.

Документация по выставлению счетов xAI разделяет предоплаченные средства и ежемесячное выставление счетов, которое по умолчанию отключено. Функция автоматического пополнения позволяет пополнять предоплаченные средства и имеет собственные пороговые значения и ежемесячный лимит. Лимит по выставлению счетов регулирует использование услуг по постоплате; это не то же самое, что единый общий лимит на покупки, пополнения и запросы в рамках предоплаты.

При первой интеграции начните с небольшой суммы на счете и внимательно проверьте все настройки автоматического пополнения. Для повседневного доступа к чату без написания кода интеграции можно использовать отдельный Руководство по использованию Grok охватывает весь рабочий процесс продукта. У подписки на чат и у команды API предусмотрены разные средства управления.

Две реальные задачи Grok 4.6: что показывают данные об использовании

Мы повторно использовали два завершенных теста от 7 сентября 2026 года через API агрегации Broly по адресу https://anywhere.broly.ai/v1, с помощью функции автодополнения в чате. Как запрошенные, так и возвращенные grok-4.6; идентичность модели выше по цепочке не была подтверждена независимо. Это результаты тестирования шлюза Grok 4.6, а не результаты исходных тестов Grok 4 или сравнение различных моделей.

Каждая задача выполнялась один раз с температура=0, max_tokens=2048 и stream=false. Никаких инструментов или явно заданных параметров для рассуждений не передавалось. Для обоих запросов использовалась одна и та же системная инструкция:

Инструкция по совместному использованию системы

Извлечение расходов

В рамках задачи пять синтетических счетов-фактур были преобразованы в структурированный JSON-формат с целыми центами, включая отрицательный возврат средств. В ответе были сохранены все запрошенные поля и указана правильная итоговая сумма нетто — $209,00.

Точный запрос: Извлечение данных о расходах

Полный вывод результатов: извлечение расходов

{
  "currency": "USD",
  "items": [
    {
 "label": "поезд",
 "amount_cents": 4680
    },
    {
 "label": "hotel",
 "amount_cents": 12800
    },
    {
      "label": "ужин",
 "amount_cents": 2745
    },
    {
 "label": "возврат",
 "amount_cents": -1250
    },
    {
 "label": "такси",
 "amount_cents": 1925
    }
  ],
  "net_total_cents": 20900
}

Отчет об использовании · Вывод данных о расходах

Ввод / кэшированные данные

364 / 192

Токены из кэша включаются в подсчёт входных данных.

Завершение / обоснование

991 / 857

Обоснование приводится в сведениях о завершении.

Время по настенным часам

22,753 секунды

Включает накладные расходы на сеть и шлюз; один прогон.

Планирование с ограничениями

В задаче предлагалось выбрать неделимые задания в рамках восьмичасового бюджета с учетом заданных условий. В ответе были выбраны варианты A, B, C и E, общая продолжительность которых составила восемь часов, а суммарная стоимость — 24. Мы самостоятельно перечислили все 64 подмножества: 17 из них оказались выполнимыми, и это было единственным оптимальным набором.

Точный текст задания: Планирование с ограничениями

Полный вывод результатов: планирование с ограничениями

{
  "selected": ["A", "B", "C", "E"],
  "order": ["A", "B", "C", "E"],
  "total_hours": 8,
  "total_value": 24
}

Отчет об использовании · Планирование с ограничениями

Ввод / кэшированные данные

428 / 192

Токены из кэша включаются в подсчёт входных данных.

Завершение / обоснование

4267 / 4217

Обоснование приводится в сведениях о завершении.

Время по настенным часам

61,980 секунд

Включает накладные расходы на сеть и шлюз; один прогон.

Ответ, касающийся планирования, короче, чем JSON-файл с данными о расходах, однако его общая длина, указанная в отчете, составляет 4 267 токенов, включая 4 217 токенов, связанных с вычислениями. В этом и заключается урок по составлению бюджета: видимая длина ответа — ненадёжный показатель ресурсопотребления модели вывода. Эти две задачи являются полезными примерами характера использования, а не тестом на задержку или общим рейтингом качества.

Выдержка из руководства по использованию шлюза: планирование с ограничениями

{
  "prompt_tokens": 428,
  "completion_tokens": 4267,
  "total_tokens": 4695,
  "prompt_tokens_details": {
    "cached_tokens": 192
  },
  "completion_tokens_details": {
    "reasoning_tokens": 4217
  }
}

Шлюз также вернул значение, равное нулю input_tokens и output_tokens поля, несмотря на ненулевые значения счетчиков «Завершение чата». Для этих записей мы использовали prompt_tokens и токены_завершения. Мы не рассматривали нулевые псевдонимы как бесплатные запросы и не выводили количество видимых токенов на основе других полей с нулевыми значениями.

Применение официальных тарифов без указания, что это счет-фактура

Если бы эти показатели пропускной способности шлюзов выставлялись в счете по текущим ценникам xAI для коротких контекстов в версии Grok 4.6, стоимость задачи извлечения составила бы [(364 – 192) × $2 + 192 × $0,50 + 991 × $6] / 1M = $0,006386. Расписание будет следующим: [(428 – 192) × $2 + 192 × $0,50 + 4 267 × $6] / 1M = $0,026170. Это гипотетические оценки скорости xAI, а не показатели, зафиксированные на «Броли».

В ответе службы планирования было указано 4 267 маркеров завершения, хотя в запросе было отправлено max_tokens=2048. Семантика ограничения шлюза не была проверена. Это несоответствие не позволяет установить, как работает собственное ограничение вывода xAI, и запрошенное ограничение не может рассматриваться как подтвержденный предел расходов для данного шлюза.

Прямые ответы xAI содержат более полезный сигнал для выставления счетов: стоимость_в_долларах_США_в_тиках. В официальной документации один USD определяется как 10 000 000 000 тиков; там же указано, что это поле включает в себя комиссию за токен данного запроса, скидки и стоимость вызовов серверных инструментов. В повторно используемых ответах шлюза это поле отсутствует. Для ведения диалога следует суммировать значения тиков по каждому запросу, а не предполагать, что каждый ответ содержит итоговое значение для сессии.

Что заметили пользователи независимых API

21 августа 2026 года пользователь Hacker News mediaman отметили, что показатель Grok 4.6 по количеству кэшированных входов ($0,50 на миллион) составляет 25% от показателя по некэшированным входам ($2). Их беспокойство было связано с повторяющимися кэшированными чтениями при выполнении агентных задач. Эти два показателя Grok соответствуют текущей официальной таблице; более широкие сравнения и предположения комментатора являются его личными оценками.

Пользователь mediaman на Hacker News обсуждает цены на API-кеш Grok
mediaman о ценах на процессоры Grok с 4,6-гигабайтным кэшем, 21 августа 2026 года. Личная оценка стоимости; сравнения и предположения принадлежат автору комментария. Записано 8 сентября 2026 года.

Ранее, 9 ноября 2025 года, XCSme В отчете описывается использование модели Grok 4 Fast через API для анализа и извлечения данных, при этом она называется «дешёвой и быстрой». Это исторический отчёт о модели Fast, которая в настоящее время снята с производства. Он не отражает современные цены, скорость или качество моделей Grok 4.3 или Grok 4.6.

XCSme на Hacker News обсуждает извлечение данных из API Grok
XCSme об использовании Grok 4 Fast для извлечения, 9 ноября 2025 года. Личный опыт работы с моделью, которая сейчас уже снята с производства. Записано 8 сентября 2026 года.

Эти два конкретных примера подсказывают полезные ориентировочные вопросы: какая доля ваших затрат приходится на кэшированный контекст, а какая — на логические выводы и повторные попытки? Они не отражают единого мнения разработчиков. Если вы также сравниваете объем полученной работы, то наш Сравнение работы, поиска и кодирования моделей Grok и ChatGPT рассматривает это отдельное решение.

Как начать работу с официальным API xAI

Сайт Официальное краткое руководство по xAI использует API «Responses» по адресу https://api.x.ai/v1/responses. Это другой конечный пункт и учетная запись по сравнению с платформой агрегации, использовавшейся в наших тестах 7 сентября.

  1. Создайте учетную запись в xAI Console или войдите в нее и выберите нужную команду.
  2. Пополните баланс API и проверьте настройки расходов. Убедитесь, что выбранная модель доступна для вашей команды.
  3. Создайте ключ API и передайте его процессу сервера в качестве переменной XAI_API_KEY. Не указывайте его в коде браузера, системе контроля версий, скриншотах и журналах.
  4. Отправьте небольшой запрос, указав конкретный текущий идентификатор модели, а затем запишите возвращенные данные: модель, тип использования, уровень обслуживания и идентификатор запроса.

В приведенном ниже примере используется Node.js версии 18 или более поздней и его встроенная функция fetch, поэтому установка SDK не требуется. Перед запуском процесса необходимо задать переменную XAI_API_KEY в среде выполнения. В примере используется текущий официальный формат запроса «Responses» и низкий уровень сложности рассуждений; код был проверен локально без отправки дополнительного платного запроса к API.

Первый официальный запрос · Node.js

Перед увеличением масштаба убедитесь, что статус задачи — «Завершено», и проверьте объект использования. В данном примере через официальное поле «Responses» выделяется 2 048 токенов на вывод результатов и обоснование. Таймаут — это крайний срок на стороне клиента, а не доказательство того, что работа на стороне сервера была отменена или не была выставлена в счёт. В данном примере повторные попытки не выполняются автоматически; ограничение на количество токенов не является исчерпывающим ограничением в долларах для приложения, которое также отправляет входные данные или вызывает инструменты.

Для SDK, совместимого с OpenAI, базовый URL-адрес: https://api.x.ai/v1 и учетные данные по-прежнему остаются вашими xAI Ключ API. API «Ответы» использует ввод и обоснование: { усилия: "низкие" }; Функция автозаполнения в чате использует сообщения и собственные имена параметров. Копирование запроса шлюза без изменений в другую конечную точку может завершиться сбоем, даже если обе поддерживают формат JSON.

Распространенные ошибки при интеграции и меры по контролю затрат

  • 401 Неавторизованный: проверьте заголовок «Bearer», ключ и условия выполнения. Код ошибки 403 может указывать на проблемы с правами доступа или ограничениями доступа. Повторная отправка того же неверного запроса не устранит проблему.
  • 404 Not Found: проверьте точный конечный пункт и идентификатор модели. Различайте недопустимый идентификатор от задокументированного идентификатора, снятого с использования, который по-прежнему разрешается посредством перенаправления.
  • 400 или 422: проверьте схему запроса и поддерживаемые настройки. Например, в текущей документации по выводу заключений не допускается использование штрафов за наличие/частоту, а также настроек остановки для моделей вывода заключений.
  • 429 «Слишком много запросов»: обрабатывайте запросы в очереди, сглаживайте всплески нагрузки и используйте ограниченный экспоненциальный откат с джиттером. Отслеживайте как RPS, так и TPM, и учитывайте повторные попытки в бюджете рабочей нагрузки.
  • Неожиданный результат или неполный статус: проверьте ответ, настройки логики и применимое ограничение объема вывода. Перед использованием данных проверьте их машиночитаемость; успешный HTTP-ответ не является гарантией качества выполнения задачи.

Для контроля затрат выбирайте самую недорогую модель и настройки рассуждений, которые проходят ваши собственные проверки задач; в начале сохраняйте стабильные инструкции для повторного использования кэша; удаляйте нерелевантную историю; следите за пределом в 200K промптов и ограничивайте количество циклов инструментов агента. Используйте пакетную обработку только в том случае, если модель это поддерживает и работа может подождать. Рассматривайте приоритет как отдельный критерий при выборе.

Сохраняйте приблизительные оценки токенов для планирования и данные о стоимости, возвращаемые в отчетах, для сверки. При агрегировании большого количества запросов сохраняйте целочисленные значения и сравнивайте итоговые показатели по запросам с данными об использовании в Консоли и счетами. Отсутствие поля “стоимость” означает «неизвестно», а не «ноль»; небольшой объем видимых ответов не гарантирует, что счет будет небольшим.

Что касается сегодняшних цен на API Grok 4, составляйте бюджет с учетом модели, которая фактически обрабатывает запрос, ценового диапазона промпта и общего объема оплачиваемого вывода. Начните с небольшого официального запроса, проанализируйте показатели использования и стоимости, а затем масштабируйте рабочую нагрузку, которая прошла ваши собственные проверки. Для изучения промптов в рабочей области чата, открыть позицию Grok 4,6 на GlobalGPT.

Grok 4 — Часто задаваемые вопросы о ценах API

Сколько сейчас стоит Grok 4 API?

По состоянию на 8 сентября 2026 года устаревший идентификатор grok-4-0709 перенаправляет на Grok 4.3. При количестве токенов подсказки менее 200 тыс. ставки в долларах США за миллион составляют: $1,25 для входных данных, $0,20 для данных из кэша и $2,50 для выходных данных. При длинном контексте ставки удваиваются.

Есть ли ещё в наличии оригинальная модель Grok 4 API?

Первоначальная модель grok-4-0709 была выведена из API xAI 15 мая 2026 года. Её идентификатор по-прежнему разрешается, однако запросы обрабатываются моделью Grok 4.3 с низкой интенсивностью рассуждений, а оплата производится по тарифам, установленным для заменяющей модели.

Сколько стоит Grok 4.6 API?

Grok 4.6 требует $2 входных данных, $0.50 кэшированных входных данных и $6 выходных данных на каждый миллион токенов при количестве токенов промпта менее 200K. При количестве токенов 200K и более показатели составляют $4, $1 и $12. Вызовы инструментов и другие применимые сборы оплачиваются отдельно.

Взимается ли плата за токены рассуждений?

Да. xAI начисляет токены за логическое обоснование по ставке за завершение. Если логическое обоснование уже включено в отчетный объем вывода или в итоговый объем завершения, не включайте его повторно в свою оценку.

Учитывается ли кэшированный ввод при подсчете порога в 200 тысяч?

Да. Подсчитывайте полный текст запроса, включая токены из кэша. Согласно официальной таблице тарифов, запрос объёмом 200 тыс. токенов и более относится к категории «длинного контекста», и к всем токенам в этом запросе применяются более высокие тарифы.

Предусмотрен ли бесплатный лимит API-вызовов для Grok при подписке на чат?

Не следует полагать, что подписка на чат включает кредиты API xAI. В официальном руководстве по быстрому запуску API используется отдельная учетная запись в Консоли и отдельные кредиты. Любая рекламная акция должна быть проверена именно для этой API-команды; бесплатный доступ для конечных пользователей — это отдельное предложение.

Каковы ограничения по скорости вызова API Grok?

Ограничения зависят от модели и уровня команды. В приведённой таблице для уровня 0 указаны следующие значения: Grok 4.3 — 37 RPS и 10 млн TPM, а также Grok 4.6 — 150 RPS и 50 млн TPM. Воспользуйтесь консолью вашей команды, чтобы уточнить ограничения, применимые к вашему ключу.

Можно ли использовать Grok 4.6 на GlobalGPT?

Да. В GlobalGPT имеется подтверждённая запись чата Grok 4.6. Это отдельный рабочий процесс платформы; он не заменяет ключ API xAI, прямой расчёт по API или средства управления в вашей консоли xAI.

Как узнать фактическую стоимость запроса xAI?

Считайте значение usage.cost_in_usd_ticks из официального ответа и разделите его на 10 000 000 000, чтобы получить сумму в долларах США. Это поле отражает стоимость данного запроса, включая скидки на токены и серверные инструменты. Суммируйте запросы, чтобы отслеживать цепочку взаимодействий.

Поделиться сообщением:

Похожие посты

Объяснение титров в видео с ИИ: бюджет на готовые ролики

Обзор услуг по созданию видео с использованием ИИ: актуальные тарифы, правила срока действия и примерный бюджет на готовые ролики. Сравните реальные затраты и выберите подходящий тарифный план перед оплатой.

Читать далее

AI Motion Design: объединение сгенерированного видео с редактируемым кодом

Создайте рабочий процесс по разработке анимационного дизайна с использованием искусственного интеллекта, включающий сгенерированные видеофрагменты, редактируемый текст, точную синхронизацию и фирменную графику. Получите практические рекомендации и контрольный список для производства.

Читать далее
Как GlobalGPT тестирует модели искусственного интеллекта: качество, скорость и стоимость

Как GlobalGPT тестирует модели искусственного интеллекта: качество, скорость и стоимость

Узнайте, как GlobalGPT тестирует модели искусственного интеллекта с помощью конкретных задач, оценки ИИ и сравнения затрат. Ознакомьтесь с имеющимися данными, прежде чем выбирать модель для своей работы.

Читать далее