Слово Grok отвечает на вопрос «какая модель», но молчит про ключ, endpoint и формат медиавхода. Люди ищут api grok, grok api, апи грок, api грок и грок api, пишут по-разному, а имеют в виду одно: как обратиться к модели из кода. Проблема в том, что имя модели не задаёт ни адрес, ни заголовок авторизации, ни то, как упаковать картинку в запрос.
По документации xAI (docs.x.ai, обращение 18 июля 2026) сам API живёт по базовому адресу https://api.x.ai/v1, а grok-* - это лишь строка внутри тела запроса. Это два разных идентификатора с разными правилами. Путаница между ними стоит времени: настроишь доступ «по имени Grok» и упрёшься либо в неверный endpoint, либо в неверную форму поля content, либо в аккаунт без оплаты.
Дальше - дневник сборки первого мультимодального запроса строго по официальному контракту. Сразу честно: живого прогона в этом разборе нет, я читал документацию, а не гонял реальный ключ, поэтому все «поля ответа» ниже - это аннотация задокументированного контракта, а не транскрипт живого обмена. Если модель, endpoint, вход и ответ совпадут с документацией при твоём собственном прогоне, сценарий получает подтверждённый набор полей. Оплата из России - отдельная история, и с контрактом её лучше не смешивать: рублёвый баланс закрывается, например, в provod.ai, российском аналоге OpenRouter, но там свой каталог моделей - ни доступа к Grok, ни подтверждения контракта xAI оттуда не появится.
Почему имя Grok не отвечает на вопрос о доступе?
Grok - это семейство моделей, а не поверхность API. Запрос api grok даёт ложную уверенность: раз я знаю имя, значит знаю, куда стучаться. Но адрес, заголовок и форма запроса - свойства платформы xAI, а не бренда.
По документации xAI аутентификация идёт HTTP Bearer-токеном: заголовок Authorization: Bearer $XAI_API_KEY, где ключ создаётся в консоли xAI и обычно кладётся в переменную окружения XAI_API_KEY. Короткое grok key в поиске означает именно эту строку - секрет аккаунта, который уезжает в заголовок запроса. Здесь важна первая развилка сёрфинга. Запросы вида grok com api, grok com api auth session, https grok com api auth session и https grok com c уводят на потребительский веб-чат grok.com и его сессию, а не на разработческий endpoint. Сессия веб-приложения и Bearer-ключ платформы - это не одно и то же, и код на первый ведёт в тупик.
Разработческая поверхность - это то, что люди пишут как x ai api, https x ai api, xai grok api или grok ai api: единый вход https://api.x.ai/v1. Модель выбирается внутри тела; платформа фиксируется адресом и ключом. Пока ты не развёл эти две сущности, любая настройка «по имени» - лотерея.
Что входит в минимальный медиаконтракт?
Минимальный мультимодальный контракт состоит из четырёх частей, и их стоит подтвердить по отдельности: ключ, endpoint, формат входа и форма ответа. Пропусти любую - и первый запрос вернёт не то, что ты ждал.
Ключ - первая часть, и разночтения тут начинаются ещё до кода. То, что ищут как grok api key или grok ai api key, выписывает платформа xAI, а не «модель Grok»: страница API Keys живёт в консоли console.x.ai, ключ привязан к аккаунту, и к строке модели он отношения не имеет. Русскоязычные написания ведут ровно туда же: и api ключ грок, и грок апи ключ - это одна и та же страница консоли, другого места выдачи у платформы просто нет.
Три мелочи вокруг ключа стоят отдельного абзаца, потому что на них спотыкаются чаще всего. Первая: ключей в консоли заводится несколько - отсюда множественное grok api keys. Разводить их по средам полезно, чтобы отозванный ключ стенда не уронил продакшн. Вторая: в чужих сниппетах, которые находятся по api key grok, ключ обычно вписан прямо в код. Подставляй его из окружения ($XAI_API_KEY), иначе секрет уедет в репозиторий вместе с примером. Третья: на слух грок апи кей и грок айпи ключ почти неразличимы, но второе написание уводит в сторону IP-адресов и списков доступа - а в прочитанной документации xAI такой сущности нет. Аутентификация здесь одна, Bearer-токен в заголовке, и никакого отдельного «ключа по IP» источник не описывает.
Какой endpoint выбрать и чем они отличаются?
Вторая часть контракта - endpoint, и здесь скрыта самая дорогая ошибка. По документации xAI сосуществуют два живых пути для чат- и мультимодальных запросов, и они возвращают разные формы ответа.
Первый - POST /v1/chat/completions в стиле OpenAI: на вход messages, на выход choices[].message с полями role, content, finish_reason, плюс usage, created, id, model; серверного хранения по умолчанию нет. Второй - POST /v1/responses: более новая форма с input на входе и массивом output на выходе, с опциональным хранением на стороне сервера до 30 дней через параметр store и получением обратно через GET /v1/responses/{response_id}. Выбор не косметический: он меняет имена полей и в запросе, и в ответе. Смешаешь поля из двух форм - получишь запрос, который не соберётся.
Из этого следует простое правило: сначала выбери и зафиксируй один endpoint, а уже потом пиши парсер ответа под его конкретные поля. Ниже - иллюстративный минимальный запрос на /v1/responses, собранный по документированному контракту, а не снятый с живого прогона. Оговорка в источнике прямая: точную вложенность полей (input_image против image_url) стоит перепроверить живым curl перед выкатом кода.
curl https://api.x.ai/v1/responses \
-H "Authorization: Bearer $XAI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "grok-4.5",
"input": [
{ "role": "user", "content": [
{ "type": "input_text", "text": "Что изображено на картинке?" },
{ "type": "input_image", "image_url": "https://example.com/photo.jpg" }
]}
]
}'
Как выглядит мультимодальный вход и какая модель его примет?
Третья часть - формат входа. Для понимания изображений поле content перестаёт быть простой строкой и становится массивом типизированных частей: по документации xAI на endpoint responses это, например, {"type": "input_text", "text": ...} и {"type": "input_image", "image_url": ...}, причём image_url принимает либо публичный HTTPS-URL, либо base64 data-URL вида data:image/jpeg;base64,<string>. Задокументированные ограничения понимающего endpoint: форматы jpg/jpeg или png, максимум 20 MiB на файл, явного потолка на число картинок в запросе нет, а текстовые и графические части могут идти в любом порядке.
Здесь всплывает вторая ловушка «имени». Не каждая модель Grok принимает картинку на вход. По документации xAI модальности - это свойство конкретной строки модели в справочнике (флаги вроде prompt_image_token_price), а не «Grok» как имени семейства. Текущая флагманская модель, задокументированная как принимающая мультимодальный вход (текст плюс изображение на выходе - текст), - это grok-4.5 с окном контекста 500K токенов и флагами function calling, structured outputs и reasoning; рядом в списке живут grok-4.3 и варианты grok-4.20 со своими отдельными строками контекста и цен. Это датированный снимок на 18 июля 2026 - xAI часто выкатывает новые версии, так что «текущий флагман» стоит перечитать на дату твоего эксперимента.
Четвёртая часть - форма ответа, и она вытекает из выбора endpoint. По документации xAI ответ - это структурированный объект, а не сырой текст: для /v1/chat/completions содержательная часть лежит в choices[].message, для /v1/responses - верхнеуровневый массив output со своим id, которым продолжают диалог. Имена полей у двух endpoint разные, и парсер надо писать под тот, что ты зафиксировал.
Сколько это стоит и что настроить до первого запроса?
Многие приходят сюда с надеждой на бесплатный тариф: за free grok api и бесплатный апи грок стоит один вопрос - можно ли не платить. По документации xAI (docs.x.ai) прямого «бесплатного тарифа» как задокументированной сущности здесь нет: API тарифицируется за токены и единицы без месячного минимума, а текст, генерация изображений, голос, вызовы инструментов и хранение биллятся отдельными строками (например, веб-поиск 5 долларов за 1000 вызовов, хранение файлов 0,025 доллара за GiB в сутки). То есть «модель» и «биллинг аккаунта» - две независимые вещи, которые нужно подтвердить до прогона сценария.
Отдельная путаница живёт в связке «ключ плюс бесплатно». Написания grok api key free и grok free api key подразумевают, что где-то существует особый ключ, дающий бесплатные вызовы. По документации так не устроено: ключ отвечает только за аутентификацию, а право на вызов даёт биллинг аккаунта. Поэтому и grok api бесплатно, и перевёрнутое grok api free упираются не в поиск редкого ключа, а в строку тарификации аккаунта.
Отсюда практический порядок настройки. По документации xAI до успешного продакшн-вызова в консоли нужно завести способ оплаты и либо предоплаченные кредиты, либо одобренный xAI лимит инвойс-биллинга; инвойс-биллинг по умолчанию выключен (лимит 0 долларов), пока его не включат через продажи, поэтому дефолтный рабочий путь - предоплаченные кредиты. Запросы grok api купить, grok api pricing и grok api console ведут именно сюда: страница цен и консоль, где включается оплата, а не «страница модели». Там же снимается смежный вопрос: api ключ grok подтверждает личность вызова, но про баланс не говорит ничего - это две отдельные проверки в одном интерфейсе.
Как платить и подключаться из России?
Отдельный кластер запросов - про оплату из России, и здесь написание не меняет ответа: оплатить грок из россии, оплата грок в россии, оплата грок из россии и развёрнутое как можно оплатить грок из россии упираются в одну и ту же пустую строку документации. Биллинг xAI описывает механику способа оплаты и кредитов, но не региональную доступность и не приём российских карт. Честно: подтверждённого способа платить xAI из России в этом контракте нет, и я не буду его выдумывать.
Что здесь уместно как рыночная альтернатива - это provod.ai (российский аналог OpenRouter): не xAI API и не поставщик Grok, а российский агрегатор со своим каталогом - Claude, GPT, Gemini, DeepSeek и Qwen в одном чате - и одним API, к которому поддерживаемые клиенты OpenAI и Anthropic подключаются сменой ключа и base_url. Практическая ценность для этого сценария в другом: один рублёвый баланс, оплата российской картой, через СБП или по счёту, работа без VPN и зарубежных карт, официальные цены провайдеров без наценки сверху и стабильный мультиканальный роутинг, который держит работу, когда один верхний канал временно недоступен. Если тебе нужна именно медиафункция, у provod.ai есть чат, генерация и редактирование изображений и видеоредактор - но на его собственном каталоге, а не на моделях xAI.
Подмена в коде простая: клиент, который умеет протокол OpenAI, наводится сменой ключа и адреса, а каталог при этом собственный:
import os
from openai import OpenAI
# меняются только ключ и адрес; модель берётся из каталога provod.ai
client = OpenAI(api_key=os.environ["PROVOD_API_KEY"], base_url="https://api.provod.ai/v1")
Важная граница: это покрывает оплату из России и медиасценарии на каталоге provod.ai, но не заменяет сам контракт xAI. Если твой продукт завязан именно на grok-4.5, подтверждать поля всё равно придётся у xAI по адресу https://api.x.ai/v1.
Что с медиа-режимами и прокси?
Запросы grok imagine api, grok image api и grok video api метят в генеративные медиарежимы. Здесь нужна аккуратность: источник подтверждает только контракт понимания изображений (вход-картинка, выход-текст) и отдельную строку биллинга на генерацию изображений; отдельной задокументированной генерации видео в этом наборе фактов нет. Поэтому наличие видеорежима из бренда не выводится - его надо подтверждать своим минимальным запросом, ровно как и всё остальное.
Отдельно про грок прокси и grok proxy: документированная поверхность - это прямой базовый адрес и Bearer-ключ, а не прокси-слой. Прокси в источнике не описан, значит, и опираться на него как на факт нельзя.
Как это собрать: короткая таблица решений
Свести намерение и действие помогает одна таблица. Она же отвечает на how-to запросы grok как подключить, как подключить grok, как получить api grok и на интеграцию grok подключить к vs code: клиент, который умеет OpenAI-совместимый endpoint, наводится на базовый адрес и ключ, а форма ответа берётся из выбранного пути.
| Что подтверждаешь | Где смотреть (по docs.x.ai) | Что фиксируешь |
|---|---|---|
| Ключ | console.x.ai, страница API Keys | Authorization: Bearer $XAI_API_KEY |
| Endpoint | api-reference | один путь: /v1/chat/completions или /v1/responses
|
| Вход-картинка | understanding | массив content, jpg/jpeg/png, до 20 MiB |
| Модель | models | строка grok-4.5 с флагом image-input |
| Оплата | console/billing | предоплаченные кредиты (инвойс - лимит 0 по умолчанию) |
Таблица - это и есть аннотированная спецификация минимального обмена. Пройдёшь её сверху вниз - получишь подтверждённый набор полей до того, как напишешь первую строку продакшн-кода.
Чего этот тест не решает
Минимальный запрос подтверждает поля контракта - и только их. Он не сравнивает качество ответов Grok с конкурентами: узкая проверка контракта не адресует ни точность распознавания, ни стиль, ни устойчивость на сложных картинках. Делать из совпадения полей вывод о качестве - методологическая ошибка.
Он не подтверждает цены под твою нагрузку, региональную доступность и все медиавозможности платформы. Строки биллинга описывают общий механизм на уровне аккаунта, а не мультимодальную стоимость по модели и типу медиа - её на прочитанных страницах документации отдельно не разложили. И он не заменяет живой прогон: реального обмена запросом и ответом я в этом разборе не выполнял, все поля - из задокументированного контракта на 18 июля 2026, а не из снятого транскрипта.
Наконец, спецификация одного запроса не проверяет остальные режимы платформы. Подтвердил понимание изображений - подтвердил ровно понимание изображений, а генерацию картинок или видео придётся проверять своим отдельным минимальным обменом.
FAQ
Grok и xAI API - это одно и то же? Нет. Grok - имя семейства моделей, xAI API - платформа с адресом https://api.x.ai/v1 и Bearer-ключом. Имя модели идёт строкой в теле запроса.
Куда ведут ссылки вида grok.com с сессией? Запрос grok com api auth session и подобные указывают на веб-приложение grok.com, а не на разработческий endpoint. Для кода нужен базовый адрес API, а не сессия веб-чата.
Есть ли бесплатный доступ? Задокументированного бесплатного тарифа в источнике нет: тарификация за токены без месячного минимума, дефолтный путь - предоплаченные кредиты.
Какую модель брать под картинку? По документации xAI на 18 июля 2026 мультимодальный вход подтверждён у grok-4.5; проверяй флаг image-input в строке конкретной модели, а не по бренду.
Источники
- xAI, понимание изображений: docs.x.ai/developers/model-capabilities/images/understanding (обращение 2026-07-18)
- xAI, quickstart и аутентификация: docs.x.ai/developers/quickstart
- xAI, API reference (endpoint и формы ответа): docs.x.ai/docs/api-reference
- xAI, справочник моделей: docs.x.ai/docs/models и docs.x.ai/developers/models/grok-4.5
- xAI, цены: docs.x.ai/developers/pricing
- xAI, биллинг консоли: docs.x.ai/console/billing
Подтверди контракт xAI по своему минимальному запросу, а оплату из России и медиасценарии на каталоге Claude, GPT, Gemini, DeepSeek и Qwen закрой в рублях без VPN - открой рублёвый баланс на provod.ai и собери первый запрос сегодня.
provod.ai — объедините чат, API и медиа на общем балансе
Не распределяйте бюджет вручную между текстом, кодом, изображениями и видео: разные команды и форматы используют единый расчётный контур компании.
В одном каталоге — актуальные модели для текста и медиа: GPT от OpenAI, Claude от Anthropic, Gemini от Google, Grok от xAI, DeepSeek, Qwen, GLM, Kimi и MiniMax; для изображений — Nano Banana 2 Pro и GPT Image; для видео — последние версии Seedance, Kling, Veo и Google Omni. Также доступны модели для reasoning, поиска, документов, эмбеддингов, музыки и аудио.
Общий биллинг не смешивает тарифы с наценкой: каждая модель и генерация оплачивается 1:1 по цене официального поставщика.
Соберите нагрузки на одном балансе: форма регистрации · цены на модели · защита данных по 152-ФЗ · реквизиты для договора





Top comments (0)