Проблемы

Лимиты DeepSeek: что ограничено в чате и где взять точные числа

09.09.2026

Чужие таблицы уверенно называют суточную норму сообщений в дипсике, а на страницах самого DeepSeek такого числа нет ни одного. Здесь собрано, что компания публикует на самом деле: чем упирается длина чата, что стоит за надписью о слишком частых сообщениях и какие пределы названы точными числами.

Попробуйте GPT-5.6 Luna — чат с нейросетью онлайн и без регистрации, ниже на странице.

Что DeepSeek ограничивает в чате

Числовых ограничений бесплатного чата DeepSeek не публикует нигде. Проверены главная страница, справочный центр из сорока двух статей, пользовательское соглашение, политика конфиденциальности и вся документация — ни числа сообщений в сутки, ни числа запросов в час, ни предельной длины ответа для чата там нет.

Пользовательское соглашение, обновлённое 27 марта 2026 года, вообще не содержит раздела о нормах использования: слов о частоте обращений, суточной норме или квоте в его тексте не встречается. Единственная оговорка про доступность стоит в пункте 1.5 и звучит так: «We make no warranty that the Services are available or will continue to be available in certain jurisdictions» — гарантии, что сервис доступен в той или иной юрисдикции, компания не даёт (пользовательское соглашение DeepSeek).

Ограничения при этом существуют, и человек упирается в три разных: длина одного чата, частота обращений и загрузка картинок. Первые два разобраны ниже по отдельности, третье описано в справочном центре без числа — среди причин отказа при загрузке снимка названы неподдерживаемый формат, отсутствие распознаваемого текста, нарушающее правила содержимое и «Exceeded maximum upload limit», превышение предела загрузки.

Числа у DeepSeek всё-таки есть, и много. Все они относятся к обращению к моделям по ключу из своей программы, и там компания публикует величины точнее, чем большинство разработчиков. Почему точные числа по тарифам за 2026 год перестали публиковать почти все, разобрано в статье лимиты нейросетей.

Достигнут предел длины чата: почему переписка кончается

Надпись о достигнутом пределе длины чата приходит не от нормы сообщений, а от объёма самой переписки. Механика описана в документации.

Контекстное окно у обеих моделей DeepSeek — миллион токенов, предельная длина одного ответа — 384 тысячи токенов; обе величины стоят в таблице моделей на странице цен. Токен здесь — наименьшая единица текста, которую различает модель: слово, часть слова, число или знак препинания.

Дальше важна вторая особенность, из-за которой окно расходуется быстрее, чем кажется. Обращение к модели устроено без памяти: «The DeepSeek /chat/completions API is a “stateless” API, meaning the server does not record the context of the user’s requests. Therefore, the user must concatenate all previous conversation history and pass it to the chat API with each request» (документация DeepSeek о многоходовом разговоре). Проще говоря, на каждом новом ходу модели заново отдают всю переписку целиком. Чем длиннее разговор, тем больше окна занимает уже сказанное, и в какой-то момент новое сообщение туда не помещается.

Про сам чат в справочном центре есть ровно одна строка на эту тему, в статье о том, что история переписки не загружается: «Check your network connection. The chat context is too long; try viewing it on the web version» — проверьте соединение, а если переписка стала слишком длинной, откройте её в браузере (справочный центр DeepSeek). Числа, после которого чат считается слишком длинным, там нет.

Как это выглядит на экране, показано в разборе канала Васил от 8 сентября 2026 года: надпись прочитана вслух, и сразу же снят главный испуг.

Достигнут предел длины. Пожалуйста, начните новый чат. Это значит, что разговор стал слишком длинным. У каждого чата есть свой предел, и вы его исчерпали. Тоже не про деньги.

Васил, 8 сентября 2026 года

Там же названо и то, что теряется при переходе: «Единственное, что в новом чате он вас не помнит. Если в старом чате была важная информация, то нужно её скопировать и вставить в новый чат». Цитаты приведены по автоматическим субтитрам, где имя сервиса распознаётся с ошибками; сами надписи с экрана автор проговаривает дословно.

Прикинуть расход заранее можно только для двух языков. DeepSeek публикует соотношение знаков и токенов так: «1 English character ≈ 0.3 token. 1 Chinese character ≈ 0.6 token» — примерно 0,3 токена на английский знак и 0,6 на китайский. Для русского языка коэффициента у компании нет; вместо него на той же странице выложен разборщик токенов, который считает точно по вашему тексту, и калькулятор токенов для картинки (страница о токенах).

  1. Начните новый чат, когда прежний перестал принимать сообщения. Прошлая переписка при этом остаётся в списке слева и открывается на чтение.
  2. Перенесите в новый чат только то, что нужно дальше: короткий пересказ задачи и последний рабочий вариант, а не весь разговор.
  3. Держите длинные разборы в браузере. Справочный центр прямо советует открыть слишком длинную переписку в веб-версии, если в приложении она не грузится.
  4. Сохраните переписку до того, как она понадобится: «Settings» → «Data» → «Export data». В выгрузку попадают сведения об аккаунте и вся история, ссылка на скачивание живёт семь суток.

Слишком частые сообщения: что стоит за этой надписью

Сообщение о слишком частых обращениях приходит от ограничения скорости, а не от исчерпанной суточной нормы. Разница видна по тому, что публикует сам DeepSeek.

В таблице кодов ошибок ограничению скорости отведена отдельная строка: «429 — Rate Limit Reached. Cause: You are sending requests too quickly. Solution: Please pace your requests reasonably». Причина названа прямо — запросы идут слишком быстро, — а решение сформулировано как просьба обращаться размереннее. В той же строке стоит фраза, которую редко встретишь в чужой документации: «We also advise users to temporarily switch to the APIs of alternative LLM service providers, like OpenAI» — компания советует на время перейти к другому поставщику (таблица кодов ошибок).

Рядом в той же таблице стоит второй отказ, который люди тоже принимают за лимит: «503 — Server Overloaded. Cause: The server is overloaded due to high traffic». Это перегрузка, а не ваша норма, и решение к ней предложено одно — подождать и повторить. Что за этим стоит и как проверить, идёт ли сбой прямо сейчас, разобрано в статье DeepSeek не работает.

Единственное место, где ограничение частоты названо для обычного пользователя, а не для программы, — статья о неполученном коде подтверждения: «If you’ve requested too many codes within a short period, wait a while before trying again». Слишком частые запросы кода придётся переждать; сколько именно, в справке не сказано.

В чате эта же надпись выглядит по-русски, и её разбирают в кадре. Автор канала Васил показывает её первой из трёх:

Слишком частые сообщения. Повторите попытку позже. И сразу отвечу на главный вопрос, который тут возникает. Это не значит, что у вас закончились бесплатные лимиты. Денег с вас не попросят.

Васил, 8 сентября 2026 года

Объяснение там же: несколько сообщений ушло слишком быстро, одно за другим, сервис попросил притормозить, и переждать нужно около полуминуты; перезагружать и переустанавливать при этом ничего не надо. Второй вариант той же надписи приводит автор канала SVIIATOSLAVICH 11 августа 2026 года: «слишком много запросов, попробуйте позже» — и объясняет это большой нагрузкой на серверы (SVIIATOSLAVICH, 11 августа 2026 года).

Что видно на экране Что за этим стоит
429, Rate Limit Reached обращения идут слишком часто, срок ожидания не назван
503, Server Overloaded перегрузка на стороне сервиса, а не ваш расход
402, Insufficient Balance на счёте доступа по ключу кончились деньги
Код подтверждения не приходит коды запрашивались слишком часто, нужно переждать

Режим эксперта: единственная подпись про ограниченные ресурсы

Одно место, где DeepSeek говорит про ограничение прямо человеку, а не программисту, всё-таки есть, и оно спрятано в подсказке. Всплывает она при наведении на кнопку выбора режима, и три автора прочли её независимо друг от друга.

Автор канала SVIIATOSLAVICH читает подсказку с экрана 11 августа 2026 года: «Экспертный режим, соответственно, если наведёмся, видим, для сложных задач ресурсы ограничены без поиска и загрузки файлов. То есть как минимум мы не можем загружать файлы». Автор канала «Ватлин и Чугунов» тремя месяцами раньше, 15 мая 2026 года, читает ту же подсказку чуть иначе: «А вот режим эксперта для сложных задач. Ограничены ресурсы без загрузки файлов. То есть всё вообще можно сделать, но без загрузки файлов» (разбор от 15 мая 2026 года).

Расхождение здесь ровно одно: у первого автора в подписи назван и поиск, у второго только загрузка файлов. Третий кадр это расхождение снимает. Автор канала Васил 8 сентября 2026 года описывает не подпись, а сам набор кнопок в каждом режиме: в быстром доступны глубокое мышление, умный поиск и скрепка для вложений; в режиме эксперта остаётся только глубокое мышление, а скрепки нет; в режиме распознавания снимка доступно всё. То есть в режиме эксперта отпадают и вложения, и поиск.

Что именно значит «ресурсы ограничены», подпись не поясняет, и другого объяснения у компании нет. Зато на официальной странице состояния служб быстрый режим и режим эксперта стоят отдельными строками с разной работоспособностью — за июнь — сентябрь 2026 года 99,79 % у быстрого и 99,74 % у режима эксперта.

Размер вложения называет только один автор: в разборе от 15 мая 2026 года сказано, что загрузить можно файл до 100 мегабайт. В документах DeepSeek такого числа нет, поэтому это наблюдение автора, а не опубликованная норма.

Числа, которые DeepSeek публикует: одновременные запросы вместо сообщений

Единицу измерения DeepSeek выбрал не такую, как остальные. Ни запросов в минуту, ни токенов в минуту, ни сообщений в сутки — считается число одновременных обращений. Одно обращение занимает место с момента отправки и до конца ответа модели: «A request counts as one concurrent connection from the time it is sent until the model response is complete» (страница об ограничении частоты).

Модель Одновременных обращений
deepseek-v4-pro 500
deepseek-v4-flash 2500
deepseek-v4-flash-vision-exp 2500

Считается это на аккаунт целиком, а не на ключ: «Concurrency limits are calculated at the account level, regardless of which API Key is used». Завести второй ключ, чтобы получить второй запас, не получится — оба ключа делят один счёт. При превышении приходит тот самый ответ 429.

Отдельно устроено разделение по людям на вашей стороне. Параметр user_id разводит пользователей вашего продукта по трём линиям сразу: проверка содержимого, кэш и очередь обработки. У обычного аккаунта все значения user_id складываются в общий счёт; у аккаунта с расширенным запасом предел действует ещё и на каждое значение отдельно. Формат задан жёстко — строка из латинских букв, цифр, дефиса и подчёркивания длиной до 512 знаков, — и компания прямо просит не класть в неё персональные данные.

Самое непохожее на соседей — то, что ступеней тарифа у DeepSeek нет вовсе. Справочный центр отвечает на вопрос о планах с более высоким пределом так: «There is a unified pricing standard and no tiered plans». Единая цена, ступеней нет. И тут же: «If you need higher rate limits, you can submit a Rate Limit Increase Request. We’ll match it to an appropriate level based on your actual needs — at no additional cost» — предел поднимают по заявке, без доплаты. Документация повторяет то же самое про одновременные обращения: «There is no additional cost for capacity expansion».

У соседей по рынку это устроено иначе. И у OpenAI, и у Google предел поднимается ступенями, а на каждую следующую ступень пускают по накопленной оплате и по сроку с первого платежа — как именно, разобрано в статьях лимиты ChatGPT и лимиты Gemini. У DeepSeek ступеней нет вовсе: цена одна для всех, а предел поднимают по заявке.

Точные пределы у картинок и файлов

Там, где DeepSeek числа всё-таки называет, он называет их подробно. Ниже — всё, что опубликовано про картинки и файлы при обращении по ключу.

Что ограничено Значение
Форматы картинок JPEG, PNG, GIF, WebP
Длина внешней ссылки на картинку 8192 знака
Размер тела одного запроса 48 MiB
Одна картинка ссылкой или прямо в запросе до 32 MiB
Одна картинка через хранилище файлов до 64 MiB
Картинок в одном запросе до 600
Суммарный объём картинок в запросе 64 MiB без хранилища, до 200 MiB с ним
Сторона картинки 8192 пикселя; при 15 и более картинках — 4096
Файл при загрузке в хранилище до 64 MiB, уложиться нужно в 10 минут
Длина имени файла 512 знаков
Хранилище на одного пользователя 25 GiB
Файлов на одного пользователя 10 000
Срок хранения файла от часа до 30 суток либо бессрочно

Числа сняты со страниц документации о работе с изображениями и о хранилище файлов (работа с изображениями, хранилище файлов).

Два правила оттуда же меняют расчёт. Первое: картинки принимает только модель deepseek-v4-flash-vision-exp, остальные отвечают ошибкой 400 с текстом «This model does not support image», а картинка в системном или ответном сообщении даёт ту же ошибку — снимки кладут только в сообщение пользователя. Второе: перед обработкой любая картинка приводится примерно к площади снимка 800 × 800, поэтому верхний предел — 384 токена на картинку, и снимок 2000 × 2000 обходится ровно во столько же, во сколько 5000 × 5000.

Цена вместо нормы: как считается расход по ключу

Обращение к моделям по ключу считает не сообщения, а токены. Тариф, который действует с четырёх часов дня 16 августа 2026 года по всемирному времени, разводит ввод на две колонки. Кэш-хит — ставка для той части запроса, которую сервис уже разбирал раньше и держит наготове; промах — обычная ставка, когда весь ввод разбирается заново. Величины ниже даны в долларах за миллион токенов.

Модель Период Вход, кэш-хит Вход, промах Выход
deepseek-v4-flash непиковый 0,007 0,22 0,66
deepseek-v4-flash пиковый 0,014 0,44 1,32
deepseek-v4-pro непиковый 0,022 0,66 1,98
deepseek-v4-pro пиковый 0,044 1,32 3,96
deepseek-v4-flash-vision-exp непиковый 0,007 0,22 0,66
deepseek-v4-flash-vision-exp пиковый 0,014 0,44 1,32

Сноска к таблице описывает окна дороже обычного: «Off-peak rates are half of the peak rates. Peak hours are 01:00 - 04:00 and 06:00 - 10:00 UTC, Monday through Friday (all other hours are off-peak)» (страница моделей и цен). То есть базовым является непиковый тариф, а вдвое дороже становится в двух окнах по будням; по московскому времени это 04:00–07:00 и 09:00–13:00. Выходные целиком идут по непиковой цене: сноска относит к пиковым только будние окна. Оговорка про будни в сноске стоит на 9 сентября 2026 года — в снимке той же страницы от 18 августа её ещё не было, так что описания без неё сделаны по прежней редакции.

Правило списания там же и короткое: «The expense = number of tokens × price», а списывается расход сначала с подаренного остатка и только потом с пополненного. Пополнить счёт можно через PayPal, банковской картой, через Alipay или WeChat Pay; остаток не сгорает по времени — «Top-up balances do not expire», — а неизрасходованные деньги возвращаются через раздел «Billing» → «Refunds». Одна оговорка в справке стоит отдельного внимания: при удалении аккаунта остаток пропадает — «Any unused balance in your developer account will be forfeited upon deletion».

Режимы размышления и что они меняют

Размышление у DeepSeek включено по умолчанию. Дословно: «Thinking mode is enabled by default, with the default effort being high» — режим включён, уровень усилия по умолчанию высокий (документация о режиме размышления).

Уровней три: low, high и max. Тут в документации спрятана подробность, из-за которой чужие описания расходятся с действительностью: отдельная таблица показывает, что просьбы medium и xhigh приводятся к high. Промежуточных ступеней на самом деле нет, есть три, и любые описания «пяти уровней размышления» описывают названия параметра, а не поведение модели. Отключается режим значением disabled в поле thinking, а в формате Anthropic — уровнем усилия none.

Ещё одно правило того же раздела объясняет, почему привычные настройки иногда не действуют: в режиме размышления не работают temperature, top_p, presence_penalty и frequency_penalty, причём ошибки не будет — «setting these parameters will not trigger an error but will also have no effect». Параметр принят и проигнорирован.

В самом чате те же режимы называются иначе, и увидеть их названия можно на официальной странице состояния служб: там отдельными строками стоят 快速模式 (Instant Mode) и 专家模式 (Expert Mode) — быстрый режим и режим эксперта. Работоспособность у них разная, и это разобрано выше.

Ограничения содержания: что записано в правилах

Отдельный поток запросов про DeepSeek — как снять ограничения промтом. Ответ на него лежит не в приёмах, а в документах компании, и разобрать их полезнее.

Что запрещено, перечислено в пункте 3.4 соглашения десятью категориями. Среди них ненависть, клевета, оскорбления и грубость; травля и намеренное провоцирование; преследование и запугивание; дискриминация по расе, полу, ориентации, религии, национальности, инвалидности или возрасту; порнография и откровенно сексуальное содержание, где отдельно названы «sexual chatbots»; насилие, терроризм и экстремизм; вред несовершеннолетним; персонажи, рассчитанные на лиц младше восемнадцати лет; подстрекательство к преступлению и инструкции к нему; выдача себя за известного человека без пометки «unofficial» или «parody».

Как это проверяется, сказано в пункте 3.3: компания оставляет за собой право применять технические средства для проверки поведения пользователей, включая механизмы фильтрации рисков и базы признаков запрещённого содержимого. Что бывает при нарушении, перечислено в пункте 8.2: предупреждение, срок на исправление, ограничение возможностей аккаунта, приостановка, закрытие аккаунта, запрет на повторную регистрацию и удаление содержимого.

Главное же для практического вопроса — где именно живут эти ограничения. В документе об устройстве модели, на который ссылается пункт 5.5 соглашения, написано: «To ensure model safety, during the optimization training phase, we construct specialized safety data to align the model with human values, enhancing its inherent safety capabilities» — правила поведения закладываются в саму модель на этапе обучения (объяснение принципов модели). Это не фильтр, надетый поверх готового ответа, и текстом запроса он не снимается.

Как выглядит сработавшее правило со стороны аккаунта, описано в справочном центре отдельной статьёй. Сообщение о временной приостановке означает, что аккаунт попал под защитные меры из-за возможного нарушения правил площадки. Обжалование идёт формой «Account Suspension Appeal», и срок рассмотрения назван: «Most reviews are completed within 3 business days» — обычно три рабочих дня, после одобрения доступ возвращается сразу.

Те же задачи через GEN202

Большинство задач, ради которых открывают дипсик, решаются любой сильной моделью — важен ответ по существу, а не конкретное окно. GEN202 — российский сервис доступа к моделям: один ключ открывает сразу весь набор, счёт пополняется рублями с карты российского банка, и расход виден деньгами за фактически израсходованные токены по каждому обращению. Ни суточной нормы сообщений, ни предела длины разговора, ни счётчика в процентах от неназванной величины здесь нет. Ограничение частоты обращений есть и тут, но задача у него другая: оно не даёт разогнать поток запросов и никакой суточной нормы вам не отмеряет. Сколько обращений в минуту допускается, перечислено в документации.

Цены за миллион токенов в рублях выглядят так. GPT-5.6 Luna: вход 18 ₽, выход 108 ₽. Старшая ступень GPT-5.6 Sol: 450 ₽ и 2700 ₽. Claude Sonnet 5: 180 ₽ и 900 ₽. Gemini 3.6 Flash: 135 ₽ и 675 ₽. Grok 4.5: 180 ₽ и 540 ₽. При первом входе на счёт кладут 50 кредитов (25 ₽), а минимальное пополнение — 500 ₽.

Ставки по всем моделям собраны на странице цены, весь набор — в списке моделей. Чем различаются модели самого DeepSeek и что компания пишет про данные, разобрано в статье какой DeepSeek лучше; сравнение с другими линейками — в разборах DeepSeek или ChatGPT, Claude или DeepSeek и DeepSeek или Qwen.

Частые вопросы

Какие ограничения есть у дипсика? Числом не названо ни одно из тех, что касаются чата. DeepSeek не публикует ни суточной нормы сообщений, ни предела длины разговора, ни числа картинок — это проверено по главной странице, справочному центру, соглашению и документации. Опубликованы другие величины: контекст в миллион токенов, ответ до 384 тысяч токенов, число одновременных обращений по ключу и подробные пределы для картинок и файлов.

Что делать, когда достигнут предел длины чата в дипсике? Начать новый разговор и перенести в него только нужное: короткий пересказ задачи и последний рабочий вариант. Прежняя переписка остаётся в списке и открывается на чтение. Если история не грузится в приложении, справочный центр советует открыть её в браузере — там же названа и причина: переписка стала слишком длинной.

Почему дипсик пишет «слишком частые сообщения»? Это ограничение скорости, а не исчерпанная дневная норма. В таблице кодов ошибок такому отказу отведён ответ 429 с причиной «You are sending requests too quickly» и просьбой обращаться размереннее. Срока ожидания компания не называет. Похожая по виду надпись про занятый сервер означает другое — перегрузку на стороне сервиса.

Есть ли у DeepSeek дневной лимит сообщений? Опубликованного числа нет: единственное официальное утверждение о бесплатности — надпись «Chat Now — Free access to DeepSeek» на главной странице. Обратное утверждение, что ограничений нет вовсе, тоже неверно — его опровергают кадры с двумя надписями об отказе, снятые в августе и сентябре 2026 года. Ограничение существует, числом оно не названо, и по описаниям авторов зависит от нагрузки на сервис, длины запросов и выбранного режима.

Как снять ограничения дипсика промтом? Ограничения задаются не фильтром поверх ответа, а обучением самой модели: в объяснении принципов работы сказано, что на этапе дообучения для этого готовятся отдельные наборы данных. Запросом такое не отменяется. Что именно запрещено, перечислено десятью категориями в пункте 3.4 соглашения, а последствия названы в пункте 8.2: от предупреждения до закрытия аккаунта и запрета на повторную регистрацию.

Какой лимит чата в дипсик? Выраженного числом лимита для чата DeepSeek не публикует. Числа опубликованы только для обращения по ключу: 500 одновременных обращений у модели v4-pro и 2500 у v4-flash и у принимающей картинки v4-flash-vision-exp. Считаются они на аккаунт целиком, а не на отдельный ключ. Ступеней тарифа у DeepSeek нет, а предел повышают по заявке без доплаты.

Чат с нейросетью онлайн

ChatGPT, Claude, Gemini, Nano Banana и другие нейросети — в одном окне, прямо в браузере, из России и без VPN. Выберите нужную в списке над полем ввода и напишите задание: первый ответ бесплатно и без регистрации. Счётчика сообщений здесь нет: расход считается деньгами за токены, и видно, сколько стоила каждая задача. Больше моделей и история разговоров — в чате с нейросетью.