Grok 4.5 API
model: grok/4-5
Принимает переписку списком сообщений и изображения, возвращает текст. Контекст 500 000 токенов, знания до 1 февраля 2026 года. Модель xAI.
Цена: за миллион токенов, вход — 360 кр. ($1.8), выход — 1080 кр. ($5.4).
кр. — кредиты, покупаются за рубли.
Песочница
Модель grok/4-5
Потолок ответа. Стоит то же значение, что шлюз подставляет сам, если поле не прислать. Списывается всё равно фактический расход.
Войдите и получите 50 кредитов на тесты и любое использование сервиса. Без регистрации доступен один запрос в сутки.
Нажмите «Запустить» — ответ модели появится здесь
{ }
Цена Grok 4.5
Цена за миллион токенов, отдельно за вход и за выход. Списывается фактический расход из поля
usage ответа: сколько токенов ушло в запрос и сколько модель
вернула.
| Токены | Наша цена | Скидка | Официальная |
|---|---|---|---|
| Вход | 360 кр. · $1.8180 ₽ | −10% | $2 |
| Выход | 1080 кр. · $5.4540 ₽ | −10% | $6 |
На 10% ниже официальной цены поставщика. кр. — кредиты, покупаются за рубли.
Длинный запрос. Поставщик считает его по второй цене: как только на вход уходит от 200 000 токенов, дороже становится весь запрос целиком — и вход, и выход.
| Токены | Наша цена | Скидка | Официальная |
|---|---|---|---|
| Вход | 720 кр. · $3.6360 ₽ | −10% | $4 |
| Выход | 2160 кр. · $10.81080 ₽ | −10% | $12 |
Вызов через API
Адрес один, и ответ приходит на этот же запрос: задачу ставить и опрашивать не нужно — этим текст и
отличается от картинок. Ключ передаётся заголовком
Authorization: Bearer sk-… и выпускается
в кабинете. На один ключ шлюз пропускает
60 запросов в минуту.
Счёт идёт по токенам из поля usage ответа: вход и выход по своим
ставкам. Кредиты списываются после ответа, по факту — заранее ничего не удерживается, поэтому
короткий вопрос стоит ровно столько, сколько стоит, и не занимает баланс под будущий ответ.
Сколько списано, приходит в самом ответе полем credits_consumed.
Перед вызовом проверяется одно: на балансе есть деньги. Запрос, не дошедший до ответа, не
тарифицируется вовсе.
Поля запроса
Все три лежат в корне тела запроса — вложенного input у текста нет.
Остальные поля формата OpenAI — temperature,
top_p, stop,
seed, response_format,
reasoning_effort и прочие — шлюз передаёт поставщику, проверив
значение: temperature от 0 до 2 (у Claude до 1),
top_p от 0 до 1, штрафы от −2 до 2,
reasoning_effort — minimal, low, medium или high, стоп-слов не
больше четырёх. Негодное значение возвращается отказом 400 с именем поля и не стоит ничего:
поставщик на такое отвечает своей пятисоткой, из которой не видно, что дело в значении. Набор у каждого
семейства свой, потому что форматы вызова разные: что именно принимает выбранная модель, названо
на её странице.
stream работает: ответ приходит событиями, как это принято у Chat
Completions, и заканчивается строкой data: [DONE]. У поставщика ответ
при этом запрашивается целиком — иначе неоткуда взять объём токенов, по которому считается цена
вызова, — поэтому весь текст приходит одним событием, а не словом за словом. Расход и объём
стоят на последнем событии, рядом с признаком конца.
tools передаётся всем моделям каталога.
n и
best_of не передаются: несколько вариантов ответа умножают расход, а
перед вызовом проверено, что денег хватает на один.
| Поле | Тип | Обяз. | Допустимые значения |
|---|---|---|---|
| model | текст | обязательное | grok/4-5 либо другое имя из каталога текстовых моделей |
| messages | массив | обязательное |
Непустой список сообщений с ролями system,
user, assistant. Пустой список
или не массив — отказ 400
|
| max_tokens | целое | опц. |
От 1 до 128000; вне границ — отказ 400.
Синоним — max_completion_tokens
· без него шлюз подставит 1024
|
Вызов
Запрос показан целиком, с именем этой модели: подставить остаётся только свой ключ. Ответ приходит сразу — задачу ставить и опрашивать не нужно.
curl https://api.gen202.com/v1/chat/completions \
-H "Authorization: Bearer sk-ваш-ключ" \
-H "Content-Type: application/json" \
-d '{
"model": "grok/4-5",
"messages": [{"role": "user", "content": "Привет"}],
"max_tokens": 200
}'
from openai import OpenAI
client = OpenAI(api_key="sk-ваш-ключ", base_url="https://api.gen202.com/v1")
answer = client.chat.completions.create(
model="grok/4-5",
messages=[{"role": "user", "content": "Привет"}],
max_tokens=200,
)
print(answer.choices[0].message.content)
print(answer.usage) # по нему выставлен счёт
Ответ
Форма ответа — OpenAI Chat Completions. Многоточия стоят там, где значение зависит от самого запроса: текст ответа и три числа расхода. Выдумывать их вместо примера нельзя — счёт выставляется по этим самым числам.
{
"choices": [
{
"index": 0,
"message": { "role": "assistant", "content": "…" },
"finish_reason": "stop"
}
],
"usage": { "prompt_tokens": …, "completion_tokens": …, "total_tokens": … }
}
Текст лежит в choices[0].message.content, причина остановки — в
finish_reason (stop или
length). По usage выставляется счёт, так
что сверить списание можно прямо из ответа. Служебных полей ответа OpenAI
(id, created,
object) шлюз не добавляет.
Отказы
Тело отказа — объект error, как у OpenAI:
{"error":{"message":…,"type":…,"code":…,"param":null}}. Ни один из этих отказов не тарифицируется:
деньги списываются только после ответа модели, и возвращать после отказа нечего.
| Код | code | Когда |
|---|---|---|
| 400 | model_not_found | Имени из поля model нет среди текстовых моделей. В сообщении перечислено, что принимается. |
| 400 | invalid_messages | Поле messages не передано, пустое или не массив. |
| 400 | invalid_max_tokens | Поле max_tokens не целое число либо вне границ от 1 до 128000. |
| 400 | invalid_setting | Настройка запроса с негодным значением: temperature вне границ от 0 до 2 (у Claude до 1), top_p вне границ от 0 до 1, штраф вне границ от −2 до 2, reasoning_effort не из списка minimal, low, medium, high, пустое стоп-слово или больше четырёх стоп-слов. В сообщении назван сам параметр. |
| 400 | key_required | Названный заголовком учёта ключ не принадлежит аккаунту или отключён. При вызове по ключу Bearer такого отказа не бывает. |
| 400 | — | Тело запроса не разобралось как JSON. Проверьте, что отправляете правильно составленный объект. |
| 401 | invalid_api_key | Ключа нет в заголовке Authorization, либо он неверный или отключён. |
| 402 | insufficient_credits | На балансе не осталось свободных кредитов. Перед вызовом шлюз проверяет только это — сумма списывается после ответа, по факту. |
| 413 | — | Тело запроса больше предела в 512 КиБ. |
| 415 | — | Не тот тип содержимого. Заголовок Content-Type должен быть application/json. |
| 429 | — | Больше 60 запросов в минуту на один ключ. |
| 502 | upstream_error | Поставщик не ответил или ответил ошибкой. Запрос не тарифицируется: списывать нечего, ответа не было. |
| 503 | service_overloaded | Поставщик перегружен или отбил запрос по своему лимиту. Запрос не тарифицируется, повторить можно через несколько секунд — срок назван в заголовке Retry-After. |
| 503 | upstream_error | Модель временно недоступна у поставщика. Запрос не тарифицируется. |
Что xAI говорит про Grok 4.5
Grok 4.5 сделана под инженерную работу: код, проектирование, оформление и профессиональные процессы.
Обучали её в дата-центрах в Мемфисе на новых наборах данных по науке, инженерии и математике, а считали на десятках тысяч видеокарт NVIDIA GB300.
Задачи она берёт крупнее и труднее, чем прошлые модели того же разработчика, а управление остаётся за человеком.
Характеристики Grok 4.5: окно, ответ и ступень цены
Grok 4.5 — одна запись каталога, а не набор уровней под общим номером: имя для поля model у неё единственное, и выбирать внутри страницы нечего.
В таблице собрано то, что задаёт рамку запроса ещё до первой строки кода.
| Характеристика | Значение |
|---|---|
| Имя для поля model | grok/4-5 |
| Окно контекста | 500 000 токенов |
| Предел одного ответа | разработчик его не назвал |
| Что берёт на вход | текст и картинки |
| Чем отвечает | текстом |
| Порог второй ставки | 200 000 токенов во входе |
Обе ставки — обычная и повышенная — стоят в таблице цен выше по этой же странице.
Как вести в Grok 4.5 работу длиннее одного запроса
Задача на один ответ вопросов не вызывает. Трудности начинаются там, где работа идёт несколькими заходами подряд, и порядок ниже их снимает.
- Попросите сначала план. План складывают отдельно от самой работы. Оборвалась работа на середине — её продолжают с места обрыва, а не начинают заново.
- Собирайте частями. Целиком задачу не отдают: сперва основание, потом по одной части сверху. Каждую следующую часть заводят отдельным разговором.
- Считайте первый ответ черновиком. Готовым он бывает редко. Дальше его правят, а не переписывают задание с нуля.
- Правьте по одному месту за раз. Короткая просьба про одну беду проходит вернее, чем список замечаний сразу. Список модель разбирает не весь.
- Проверьте сказанное «готово». Сообщение об успехе само по себе ничего не подтверждает: результат смотрят своими глазами, а не по отчёту модели.
- Повторите то, что не вышло. На трудном месте две попытки подряд могут кончиться ничем, а третья выйти. Одной попытки для вывода мало.
Особых полей запроса ни один из шагов не требует: порядок этот про то, как разбита сама задача.
Для чего xAI предлагает Grok 4.5
Отдельно названа работа в офисных приложениях: расчёты в Excel с формулами по нескольким листам, схемы из родных фигур PowerPoint, текст в Word.
В своём сервисе Grok Build и в надстройках для Word, PowerPoint и Excel разработчик поставил её моделью по умолчанию.
В редакторе Cursor Grok 4.5 открыта на всех тарифах.
Сколько текста Grok 4.5 держит за раз
Контекст у неё 500 тысяч токенов.
Это меньше, чем у соседей по каталогу: у Gemini 3.6 Flash окно в миллион токенов, у уровней GPT-5.6 — 1 050 000.
Меньше это и чем у прошлых моделей самого xAI: у Grok 4.3 и у трёх вариантов Grok 4.20 окно было миллионным.
Предела длины ответа не назвали ни в справочнике, ни в карточке модели.
Когда запрос к Grok 4.5 дорожает
В окно уходит запрос целиком: указание, приложенный материал и вся прошлая переписка того же разговора.
У цены есть вторая ступень, и включается она рано — на 200 000 токенах во входе.
По повышенной ставке идёт с этого места и присланный текст, и написанный ответ.
Порог этот заметно ниже размера окна: материал успевает подорожать задолго до того, как перестанет помещаться.
Из этого следует и обратное: пока запрос до порога не дорос, длина на ставку не влияет вовсе.
Какие числа xAI публикует про Grok 4.5
Среди опубликованного есть редкое: насколько модель склонна выдумывать и поддакивать.
Доля выдуманных утверждений — 0,98 процента. Падение точности под нажимом собеседника — 0,01 процента. Доля нечестных ответов под тем же нажимом — 0,67 процента.
Доля предвзятых ответов — 20,4 процента, а доля выполненных запросов, которые следовало отклонить, — 0,73 процента.
Из рабочих чисел названы 64,7 процента решённых задач в многофайловых репозиториях и 29 процентов на сверхдлинных инженерных задачах. Средний ответ на одну такую задачу — 15 954 токена.
Проверки на выдумывание и на поддакивание внутренние, публичной методики у них нет. Замерено всё на высоком уровне рассуждения — самом подробном из трёх, какие у модели есть.
Где Grok 4.5 промахивается и что с этим делают
Разработчик называет то, на что модель рассчитана. Ниже другое — то, что заметно на второй и третьей задаче подряд.
- Новый код на распространённых наборах библиотек выходит без замечаний. Расхождение начинается на правке готового и на случаях, которые в задании не оговорены.
- Просьбу поправить по месту модель понимает шире, чем она сказана: вместо правки в десяток строк переписывает целые куски затронутых файлов.
- На долгой работе она теряет собственный учёт и ссылается на записи, которых не заводила. Со стороны при этом всё выглядит идущим своим чередом.
- Уверенный тон ответа не отличает верное от неверного: названное поломкой оказывается ею не всегда.
- Ответ выходит короче, чем у соседних моделей на том же задании: длину она сокращает сама, без просьбы.
- По ходу работы она переспрашивает и уточняет условие, а не идёт делать молча.
- К заданию она нередко добавляет то, о чём не просили: разбор в конце ответа выходит подробнее заказанного.
- Собранное ею выходит неподвижным: движение и оживление приходится просить отдельным указанием.
Отсюда и порядок работы выше: сначала план, потом сборка частями, а правки — короткими просьбами по одному месту за раз.
До какого времени Grok 4.5 знает мир
Мир Grok 4.5 знает по 1 февраля 2026 года.
Ни событий, ни данных, появившихся после этой даты, в ней нет.
Вопрос о том, что случилось весной 2026 года, модель не закроет.
Где xAI не советует применять Grok 4.5
Границу применения xAI очерчивает в карточке модели сам, и укладывается она в одну фразу.
На самостоятельные решения там, где ошибка дорого стоит, модель не рассчитана.
Перечень такой: медицина, юридические вопросы, финансы и системы, отказ которых опасен для людей.
Работать в них модель может, но за ней должен смотреть человек, а результат — проверять специалист.