Niko AI

19 сентября 2026, обновлено 21 сентября 2026

Рейтинг нейросетей 2026: какая нейросеть лучше по независимому индексу

Лучшие нейросети 2026 года по индексу интеллекта Artificial Analysis: таблица из двадцати строк, оценка, цена задачи и разработчик. Где в этом рейтинге российские нейросети.

Рейтинг нейросетей ниже составлен не нами. Это индекс интеллекта компании Artificial Analysis, независимой лаборатории тестирования из Сан-Франциско. Она сама прогоняет все тесты через официальный платный доступ к каждой нейросети и никогда не берёт цифры у разработчиков. Таблица прочитана 21 сентября 2026 года. Мы её почистили, перевели на русский и добавили последний столбец: есть ли нейросеть в Niko AI.

Что измеряет индекс

Индекс это одна оценка, собранная из десяти тестов в четырёх группах. Чем больше, тем лучше. Лучший результат на сентябрь 2026 года равен 53.

ГруппаВесЧто проверяет
Агентские задачи30%работу по шагам с инструментами и файлами
Общие знания и понимание30%фактическую точность и чтение длинных документов
Программирование20%написание и исправление кода
Научные рассуждения20%сложные задачи уровня исследования

Все тесты компания запускает сама, на одинаковых настройках, через обычный платный доступ. Поэтому оценки сопоставимы между разработчиками. Заявленная погрешность итоговой оценки меньше одного балла.

Как мы почистили таблицу

В исходном рейтинге больше двухсот семидесяти строк, и одна нейросеть занимает несколько: по строке на каждый уровень усилий. Поэтому мы свели её к списку, по которому можно выбирать.

  • Одна строка на нейросеть, на её лучшем уровне усилий.
  • Старые версии убраны, если у того же разработчика есть новее в том же классе.
  • Дубликаты убраны: часть нейросетей стоит в рейтинге дважды, под именем открытых весов и под именем платного доступа.
  • Узкие нейросети убраны: отдельные строки для программирования и для распознавания изображений сравнивать с универсальными нечестно.

Двадцать самых сильных нейросетей на сентябрь 2026 года и две российские для сравнения

#НейросетьРазработчикСтранаИндексЦена задачи, долларовЕсть в Niko AI
1Claude Fable 5.1AnthropicСША537,63да
2GPT-6 AstraOpenAIСША533,26да
3Claude Opus 5AnthropicСША515,86да
4Muse Spark 1.3MetaСША481,60нет
5GPT-5.6 SolOpenAIСША471,99да
6Grok 4.7xAIСША46нет данныхда
7Qwen 3.8 MaxAlibabaКитай455,41да
8GLM 5.3Z.aiКитай452,01да
9Step 5 PreviewStepFunКитай440,72нет
10Kimi K3Moonshot AIКитай442,00да
11GPT-5.6 TerraOpenAIСША421,40да
12GLM 5.3 FlashZ.aiКитай420,25да
13Gemini 3.8 FlashGoogleСША411,24да
14Qwen 3.8 FlashAlibabaКитай400,37да
15DeepSeek V4.1 FlashDeepSeekКитай390,27да
16Claude Sonnet 5AnthropicСША385,09да
17GPT-5.6 LunaOpenAIСША370,18да
18DeepSeek V4 ProDeepSeekКитай360,67да
19Agnes 3.0 FlashSapiens AIСингапур36нет данныхнет
20Agnes 2.5 Pro BetaSapiens AIСингапур35нет данныхнет
≈21GigaChat 3.5, наша оценкаСберРоссияот 31 до 34около 4,6нет
≈55Alice AI LLM, наша оценкаЯндексРоссияот 13 до 16около 1,3нет

Две последние строки в рейтинге не стоят. Российских нейросетей в нём нет вовсе, и мы добавили их сами, по своей оценке. Место у них поэтому приблизительное, а как эта оценка получена, разобрано ниже в отдельном разделе. Цена у строки Сбера это оплата по факту, без пакетной скидки, и за ту версию, которую Сбер продаёт сегодня.

Цена задачи это столбец самого рейтинга. Он показывает, сколько в среднем стоило выполнить одну тестовую задачу по ценам разработчика. Это не цена подписки, а расход на саму работу, и он отличается между соседними строками в десятки раз.

У двух строк Agnes оценка предварительная, полный независимый прогон ещё идёт, поэтому цены для них нет. У Grok 4.7 оценка полная, а цены задачи пока нет: нейросеть вышла 21 сентября, в день этого замера, и рейтинг ещё не опубликовал её расход.

Компания Meta признана в России экстремистской организацией, её деятельность на территории России запрещена.

По странам измеренная двадцатка делится так: десять нейросетей американские, восемь китайские и две из Сингапура. Шестнадцать из двадцати строк доступны в Niko AI.

Какая нейросеть лучше

Короткий ответ: Claude Fable 5.1 и GPT-6 Astra, у обеих 53 балла. Дальше идёт Claude Opus 5 с 51 баллом.

Длинный ответ полезнее. Одна и та же задача на Astra стоит 3,26 доллара, а на Fable 7,63, при одинаковой оценке. Значит, даже на самом верху таблицы цена решает больше, чем место в списке.

Верхняя строка нужна редко. Она окупается там, где ошибка дорога: сложный договор, длинный отчёт, анализ на несколько источников, разбор кода. Для писем, правок, переводов и вопросов по таблице разница в качестве между 53 и 40 баллами почти не видна, а разница в деньгах видна сразу.

Лучшие нейросети 2026 года по соотношению силы и цены

НейросетьИндексЦена задачи, долларов
GPT-5.6 Luna370,18
GLM 5.3 Flash420,25
DeepSeek V4.1 Flash390,27
Qwen 3.8 Flash400,37

Эти четыре строки отстают от вершины на 11 до 16 баллов, а стоят в 20 до 40 раз дешевле. На повседневной работе это и есть разумный выбор, а сильную нейросеть стоит включать на те задачи, где она действительно нужна.

Где в рейтинге российские нейросети

Ни одного российского разработчика в двухстах семидесяти с лишним строках рейтинга нет. Причина не в качестве, а в правилах замера: Artificial Analysis тестирует только то, что может купить и вызвать из-за рубежа. Сбер и Яндекс продают доступ российским компаниям за рубли, а открытые веса GigaChat за пределами России никто не разместил. Российские нейросети не получили низкую оценку, они просто не измерены.

Две последние строки таблицы выше это наша собственная оценка. Она собрана из сравнений, которые опубликовали сами разработчики, и из независимых российских замеров. Это оценка, а не результат прогона тестов.

GigaChat 3.5 от Сбера

Открытые веса под лицензией MIT, июль 2026 года. 432 миллиарда параметров, из них одновременно работают 28 миллиардов, контекст 262 тысячи токенов.

Собственная карточка Сбера сравнивает эту нейросеть с DeepSeek V4 Flash Preview.

ТестGigaChat 3.5 ReasoningDeepSeek V4 Flash Preview
GPQA Diamond82,387,4
LiveCodeBench v685,487,9
SWE-bench Verified64,778,6
AIME 20258989

Сбер уступает на трёх тестах из четырёх, и сравнивает себя с предварительной версией DeepSeek прошлого поколения. Строка DeepSeek того поколения набирает в индексе 35 баллов, следующая, V4.1 Flash, набирает 39.

Отсюда наша оценка GigaChat 3.5: от 31 до 34 баллов, то есть место с 21 по 23 в очищенном списке. Это примерно год отставания от вершины рейтинга.

Alice AI LLM от Яндекса

По техническому отчёту Яндекса от декабря 2025 года нейросеть построена на открытых весах Qwen3 235B и дообучена сверху. Сама эта основа набирает в индексе 13 баллов. Яндекс заявляет несколько баллов сверх неё на собственных проверках фактов.

Независимые российские замеры с этим согласуются. В мартовском рейтинге MySummit для управленцев Alice AI LLM v3 заняла 43 место из 47, ниже DeepSeek V4 Flash на 28 месте. В июльской редакции того же рейтинга она осталась в нижней группе, а первое место занял Kimi K3.

Наша оценка: от 13 до 16 баллов, место с 52 по 66 в очищенном списке. Для сравнения, Claude Haiku 4.5 с 17 баллами и Gemini 3.5 Flash Lite с 22 баллами стоят выше, и обе доступны в Niko AI.

Сколько они стоят

Цену задачи для российских нейросетей рейтинг не считает. Мы прикинули её сами, по опубликованным тарифам и по расходу токенов, который рейтинг показывает на сопоставимых строках. У Сбера взята оплата по факту, без пакета: пакеты со скидкой продаются по договору и обычному покупателю недоступны.

Нейросеть и канал продажиТариф за миллион токенов, вход и выходОценка цены задачи, долларов
GigaChat 2 Max через API Сбера3 000 и 3 000 рублейот 3,2 до 6,0
Alice AI LLM через Yandex AI Studio500 и от 1 200 до 2 000 рублейот 0,7 до 2,2
Alice AI LLM Flash100 и 200 рублейот 0,13 до 0,27

Из этой таблицы следуют две вещи.

У Сбера одна задача обходится примерно в те же деньги, что на Claude Opus 5 с 51 баллом или на Qwen 3.8 Max с 45. При этом по своему API Сбер продаёт прошлое поколение, GigaChat 2 Max: версии 3.5, о которой шла речь выше, в тарифах для юридических лиц нет вовсе. Добавьте к этому, что вход и выход у Сбера стоят одинаково, а зарубежные поставщики берут за вход в несколько раз меньше, чем за выход. Поэтому разрыв заметнее всего на длинных документах, которые нужно прочитать целиком.

Alice AI LLM через Yandex AI Studio оказывается самой дорогой строкой среди сопоставимых по силе. Её ровесники по оценке стоят от 0,11 до 0,44 доллара за задачу.

Оговорки. Тарифы Сбера и Яндекса опубликованы с учётом налога. Российские источники расходятся в цене выхода Alice AI LLM, поэтому в таблице стоит вилка. И главное: ни одна российская нейросеть тесты индекса не проходила. Обе оценки держатся на сравнениях самих разработчиков и будут пересчитаны, как только появится независимый прогон.

В чём российские нейросети сильны

Русский язык в бытовых формулировках, местные реалии, интеграция с российскими сервисами и хранение данных внутри страны. Индекс интеллекта не измеряет ничего из этого. Выбор между российской и зарубежной нейросетью часто решается именно здесь, а не баллами.

Как пользоваться этими нейросетями из России

Шестнадцать строк таблицы открываются в Niko AI из России, без ВПН и без зарубежной карты, с оплатой в рублях по факту. Нейросеть выбирается прямо в чате и меняется посреди разговора, история сохраняется. Цена каждого сообщения видна под ним.

Таблица обновляется вместе с рейтингом. Эта редакция прочитана 21 сентября 2026 года.

Источники