Сравнения нейросетей

Две модели рядом на одной и той же задаче: чем отличаются ответы и сколько стоит вызов каждой. В этой же рубрике — разборы «какую модель выбрать».

Сравнения

Gemini или DeepSeek: что показали два теста

Gemini или DeepSeek: два независимых теста — планировка дома и процесс в n8n против трёх вопросов на рассуждение. Версии, цитаты авторов, выбор под задачу.

19.08.2026

Сравнения

Grok или ChatGPT: что выбрать

Непредвзятый разбор Grok и ChatGPT по двум независимым тестам: скорость, данные из X, следование инструкции, лимиты, цены подписок и API за рубли.

19.08.2026

Сравнения

Алиса AI или DeepSeek: что выбрать по тестам

Алиса или DeepSeek: два свежих теста на быте, коде и русском контексте, цензура с двух сторон, регистрация и данные — и выбор под конкретную задачу.

18.08.2026

Сравнения

Claude или ChatGPT: что выбрать

Непредвзятое сравнение Claude и ChatGPT по задачам: актуальные модели, независимые тесты, картинки и голос, цены подписок и API, доступ из России.

18.08.2026

Сравнения

DeepSeek или ChatGPT: что лучше по задачам

DeepSeek или ChatGPT: независимые тесты V4 Pro против GPT-5.5, официальные цены за токены, самозаявленные замеры и выбор под задачу.

18.08.2026

Сравнение нейросетей собрано в этой рубрике. Здесь разобраны пары «одна модель против другой», серия «лучшая нейросеть» с ответом по каждой отдельной задаче и сопоставления версий внутри одного семейства моделей. В каждом разборе названы источник теста с датой и цена вызова каждой модели в рублях.

Сравнение двух нейросетей: какие пары разобраны

Пары разобраны такие: Claude или ChatGPT, DeepSeek или ChatGPT, Gemini или ChatGPT, Gemini или DeepSeek, Claude или DeepSeek, DeepSeek или Qwen, Grok или ChatGPT, Алиса AI или DeepSeek и GPT-5.6 против Claude Fable 5. Модели, которые рисуют картинки и снимают ролики, разобраны отдельными парами: Midjourney против Nano Banana и Kling или Veo.

Парный разбор построен на живых тестах независимых авторов: названы версия каждой модели, дата теста и то, что автор увидел на своём экране. Рядом с тестом стоят официальная цена разработчика за миллион токенов и цена той же модели у GEN202 в рублях. Токен — кусочек текста, на которые модель дробит и запрос, и свой ответ; платят за их количество, поэтому ставка и названа сразу за миллион.

Сравнение моделей нейросетей по задачам

Серия «лучшая нейросеть» отвечает на вопрос «кто наверху по этой задаче». Сводная страница лучшая нейросеть сводит задачи в одну таблицу, а дальше каждая задача разобрана отдельно: код, тексты и статьи, картинки по описанию, ролики, правка готового снимка и работа на русском языке.

Версии внутри одного семейства сравниваются в рубрике отдельно от чужих моделей. Claude Opus 5, Sonnet 5 и Fable 5 разобраны на странице про выбор модели Claude, версии DeepSeek V4 Pro и Flash — на странице про модели DeepSeek.

На чём стоят выводы: слепые зачёты, а не чужие обзоры

Серия «лучшая нейросеть» построена на слепых зачётах со снимками конца августа 2026 года. Слепым зачёт называют потому, что голосующий не знает, какая модель написала ответ, который он выбирает. Источники такие: сводный индекс Artificial Analysis версии 4.1.1, площадка Arena, бывшая LMArena, с её отраслевыми зачётами, Terminal-Bench 4.0 и русские замеры MERA и llmarena.ru.

У каждого числа в этих статьях названы источник, дата снимка и объём выборки. Текстовый зачёт Arena снят 27 августа 2026 года и держится на 7 922 078 голосах при 395 участниках, таблицы Artificial Analysis сняты 30 августа 2026 года, таблица Terminal-Bench 4.0 обновлена 29 августа 2026 года, и каждую связку модели с рабочей обвязкой там прогоняют 330 раз.

Что в разборах есть кроме мест в зачёте

Кроме мест в зачёте в статьях стоят цены и оговорки источников. Для каждой модели указана официальная цена разработчика за миллион токенов, за картинку или за секунду ролика, а рядом — цена той же модели у GEN202 в рублях по одному ключу на весь каталог.

Оговорки разобраны там же, где стоят таблицы. Terminal-Bench меряет связку модели с рабочей обвязкой, а не модель отдельно; сводный индекс Artificial Analysis собран на англоязычных заданиях и к работе на русском отношения не имеет; у русского разреза Arena доверительные интервалы втрое шире, чем у общего зачёта, потому что голосов по русскому языку в десять раз меньше. Доверительный интервал — разброс, внутри которого держится настоящий счёт модели: чем он шире, тем меньше разницы между соседними строчками таблицы.