Claude Fable 5 API
model: claude/fable-5
Принимает переписку списком сообщений и изображения, возвращает текст. Контекст 1 000 000 токенов, ответ до 128 000, знания до января 2026 года. Модель Anthropic, выпущена 9 июня 2026 года.
Цена: за миллион токенов, вход — 1800 кр. ($9), выход — 9000 кр. ($45).
кр. — кредиты, покупаются за рубли.
Песочница
Модель claude/fable-5
Потолок ответа. Стоит то же значение, что шлюз подставляет сам, если поле не прислать. Списывается всё равно фактический расход.
Войдите и получите 50 кредитов на тесты и любое использование сервиса. Без регистрации доступен один запрос в сутки.
Нажмите «Запустить» — ответ модели появится здесь
{ }
Цена Claude Fable 5
Цена за миллион токенов, отдельно за вход и за выход. Списывается фактический расход из поля
usage ответа: сколько токенов ушло в запрос и сколько модель
вернула.
| Токены | Наша цена | Скидка | Официальная |
|---|---|---|---|
| Вход | 1800 кр. · $9900 ₽ | −10% | $10 |
| Выход | 9000 кр. · $454500 ₽ | −10% | $50 |
На 10% ниже официальной цены поставщика. кр. — кредиты, покупаются за рубли.
Вызов через API
Адрес один, и ответ приходит на этот же запрос: задачу ставить и опрашивать не нужно — этим текст и
отличается от картинок. Ключ передаётся заголовком
Authorization: Bearer sk-… и выпускается
в кабинете. На один ключ шлюз пропускает
60 запросов в минуту.
Счёт идёт по токенам из поля usage ответа: вход и выход по своим
ставкам. Кредиты списываются после ответа, по факту — заранее ничего не удерживается, поэтому
короткий вопрос стоит ровно столько, сколько стоит, и не занимает баланс под будущий ответ.
Сколько списано, приходит в самом ответе полем credits_consumed.
Перед вызовом проверяется одно: на балансе есть деньги. Запрос, не дошедший до ответа, не
тарифицируется вовсе.
Поля запроса
Все три лежат в корне тела запроса — вложенного input у текста нет.
Остальные поля формата OpenAI — temperature,
top_p, stop,
seed, response_format,
reasoning_effort и прочие — шлюз передаёт поставщику, проверив
значение: temperature от 0 до 2 (у Claude до 1),
top_p от 0 до 1, штрафы от −2 до 2,
reasoning_effort — minimal, low, medium или high, стоп-слов не
больше четырёх. Негодное значение возвращается отказом 400 с именем поля и не стоит ничего:
поставщик на такое отвечает своей пятисоткой, из которой не видно, что дело в значении. Набор у каждого
семейства свой, потому что форматы вызова разные: что именно принимает выбранная модель, названо
на её странице.
stream работает: ответ приходит событиями, как это принято у Chat
Completions, и заканчивается строкой data: [DONE]. У поставщика ответ
при этом запрашивается целиком — иначе неоткуда взять объём токенов, по которому считается цена
вызова, — поэтому весь текст приходит одним событием, а не словом за словом. Расход и объём
стоят на последнем событии, рядом с признаком конца.
tools передаётся всем моделям каталога.
n и
best_of не передаются: несколько вариантов ответа умножают расход, а
перед вызовом проверено, что денег хватает на один.
| Поле | Тип | Обяз. | Допустимые значения |
|---|---|---|---|
| model | текст | обязательное | claude/fable-5 либо другое имя из каталога текстовых моделей |
| messages | массив | обязательное |
Непустой список сообщений с ролями system,
user, assistant. Пустой список
или не массив — отказ 400
|
| max_tokens | целое | опц. |
От 1 до 128000; вне границ — отказ 400.
Синоним — max_completion_tokens
· без него шлюз подставит 1024
|
Вызов
Запрос показан целиком, с именем этой модели: подставить остаётся только свой ключ. Ответ приходит сразу — задачу ставить и опрашивать не нужно.
curl https://api.gen202.com/v1/chat/completions \
-H "Authorization: Bearer sk-ваш-ключ" \
-H "Content-Type: application/json" \
-d '{
"model": "claude/fable-5",
"messages": [{"role": "user", "content": "Привет"}],
"max_tokens": 200
}'
from openai import OpenAI
client = OpenAI(api_key="sk-ваш-ключ", base_url="https://api.gen202.com/v1")
answer = client.chat.completions.create(
model="claude/fable-5",
messages=[{"role": "user", "content": "Привет"}],
max_tokens=200,
)
print(answer.choices[0].message.content)
print(answer.usage) # по нему выставлен счёт
Ответ
Форма ответа — OpenAI Chat Completions. Многоточия стоят там, где значение зависит от самого запроса: текст ответа и три числа расхода. Выдумывать их вместо примера нельзя — счёт выставляется по этим самым числам.
{
"choices": [
{
"index": 0,
"message": { "role": "assistant", "content": "…" },
"finish_reason": "stop"
}
],
"usage": { "prompt_tokens": …, "completion_tokens": …, "total_tokens": … }
}
Текст лежит в choices[0].message.content, причина остановки — в
finish_reason (stop или
length). По usage выставляется счёт, так
что сверить списание можно прямо из ответа. Служебных полей ответа OpenAI
(id, created,
object) шлюз не добавляет.
Отказы
Тело отказа — объект error, как у OpenAI:
{"error":{"message":…,"type":…,"code":…,"param":null}}. Ни один из этих отказов не тарифицируется:
деньги списываются только после ответа модели, и возвращать после отказа нечего.
| Код | code | Когда |
|---|---|---|
| 400 | model_not_found | Имени из поля model нет среди текстовых моделей. В сообщении перечислено, что принимается. |
| 400 | invalid_messages | Поле messages не передано, пустое или не массив. |
| 400 | invalid_max_tokens | Поле max_tokens не целое число либо вне границ от 1 до 128000. |
| 400 | invalid_setting | Настройка запроса с негодным значением: temperature вне границ от 0 до 2 (у Claude до 1), top_p вне границ от 0 до 1, штраф вне границ от −2 до 2, reasoning_effort не из списка minimal, low, medium, high, пустое стоп-слово или больше четырёх стоп-слов. В сообщении назван сам параметр. |
| 400 | key_required | Названный заголовком учёта ключ не принадлежит аккаунту или отключён. При вызове по ключу Bearer такого отказа не бывает. |
| 400 | — | Тело запроса не разобралось как JSON. Проверьте, что отправляете правильно составленный объект. |
| 401 | invalid_api_key | Ключа нет в заголовке Authorization, либо он неверный или отключён. |
| 402 | insufficient_credits | На балансе не осталось свободных кредитов. Перед вызовом шлюз проверяет только это — сумма списывается после ответа, по факту. |
| 413 | — | Тело запроса больше предела в 512 КиБ. |
| 415 | — | Не тот тип содержимого. Заголовок Content-Type должен быть application/json. |
| 429 | — | Больше 60 запросов в минуту на один ключ. |
| 502 | upstream_error | Поставщик не ответил или ответил ошибкой. Запрос не тарифицируется: списывать нечего, ответа не было. |
| 503 | service_overloaded | Поставщик перегружен или отбил запрос по своему лимиту. Запрос не тарифицируется, повторить можно через несколько секунд — срок назван в заголовке Retry-After. |
| 503 | upstream_error | Модель временно недоступна у поставщика. Запрос не тарифицируется. |
Что Anthropic говорит про Claude Fable 5
Claude Fable 5 разработчик отдаёт под задачи, где рассуждать приходится долго и много.
Выпущена она 9 июня 2026 года.
Обдумывание у неё включено всегда: выключить его запросом нельзя, и этим она отличается от соседей по семейству.
Самого хода размышления наружу не отдают: вместо него приходит либо короткий пересказ, либо пустое место.
Характеристики Claude Fable 5: имя, окно и предел ответа
Всё, что у Claude Fable 5 выражается числом, собрано в одну таблицу.
Верхняя строка нужна для вызова: это имя подставляется в поле model.
| Характеристика | Claude Fable 5 |
|---|---|
| Имя для поля model | claude/fable-5 |
| Окно контекста | 1 000 000 токенов |
| Предел одного ответа | 128 000 токенов |
| Что берёт на вход | текст и изображения |
| Чем отвечает | текстом |
| Обдумывание | всегда включено |
| Отсечка знаний | январь 2026 года |
Цена Claude Fable 5 за миллион токенов разобрана в таблице цен выше по этой же странице.
Как поставить задачу Claude Fable 5
Модель отдана под работу, где рассуждать приходится долго, и задание для неё пишется полнее, чем короткий вопрос.
- Отдавайте ей длинную работу. На коротком поручении обдумывание всё равно пройдёт целиком, и ответа придётся ждать столько же, сколько на крупном.
- Опишите условия до конца. Уточняющих вопросов модель не задаёт: подложенный дубль, строка в другой валюте и невозможная дата уйдут в расчёт как есть.
- Назовите вид готового ответа. Нужен файл с расчётом — так и пишите. Иначе вместо таблицы, которую можно открыть и пересчитать, приходит текст с числами.
- Начните с одного прогона на своём материале. Разница между моделями видна не на примере из справочника, а на вашей задаче. Запрос из песочницы выше уходит на эту же модель.
Имя модели для поля model и пример запроса целиком стоят в разделе «Вызов через API».
Сколько текста Claude Fable 5 держит за раз
В запрос помещается миллион токенов, в ответ — до 128 тысяч.
Ровно такое же окно у соседей по семейству — у Claude Opus 5 и у Claude Sonnet 5.
Кроме букв на вход идут изображения, а отвечает модель одним текстом.
Сравнение с GPT-5.6 возможно по устройству: у трёх его уровней окно 1 050 000 токенов, у Claude Fable 5 — миллион.
Числа замеров у двух разработчиков сняты в разной оснастке, и в одну таблицу они не складываются.
Сколько токенов уходит на обдумывание Claude Fable 5
Рассуждение состоит из тех же токенов, что и написанный ответ, и в счёт оно попадает наравне с ним.
Разбирать неудачный ответ приходится по самому ответу: пути, которым модель к нему пришла, наружу не отдают.
Предел длины ответа делится между рассуждением и ответом, поэтому поставленный впритык предел обрывает готовый текст на середине.
Мелкое поручение модель обдумывает так же, как крупное: отменить это запросом нельзя.
Обе ставки — за прочитанные и за написанные токены — стоят в таблице цен.
Что встречается в работе с Claude Fable 5
Ниже — наблюдения из чужих разборов, где автор работает с моделью при читателе и показывает, чем всё кончилось.
- Обдумывание идёт и там, где задание умещается в одну строку, поэтому ответа на мелкую просьбу приходится ждать заметно дольше привычного.
- Разбор медицинских снимков модель не берёт вовсе, и это совпадает с тем, что Anthropic пишет о своих моделях сам.
- Отказ приходит и на задание, которое со стороны выглядит совершенно безобидным.
- Долгую работу модель доводит до конца без напоминаний, но сомнительные места в исходных данных она по дороге не отмечает.
- Итог по одной и той же пачке документов у разных моделей выходит разным.
Отсюда рабочее правило: числа из ответа сверяют с исходными документами, а не принимают на веру.
До какого времени Claude Fable 5 знает мир
Знания Claude Fable 5 кончаются на январе 2026 года.
Тот же месяц стоит и в строке про обучающие данные: двух разных дат, как это бывает у других поставщиков, здесь нет.
Всего, что случилось после января, для этой модели не существует.
Что Anthropic сам называет особенностью Claude Fable 5
Главной переменой для тех, кто встраивает эту модель, разработчик называет проверку безопасности, способную отклонить запрос.
Отклонённый запрос возвращается успешным ответом с пометкой, а не ошибкой обращения.
Ещё одно условие: данные запросов к этой модели хранятся тридцать дней, и работы вовсе без хранения у неё не предусмотрено.