19 сентября 2026, обновлено 21 сентября 2026
Рейтинг нейросетей 2026: какая нейросеть лучше по независимому индексу
Лучшие нейросети 2026 года по индексу интеллекта Artificial Analysis: таблица из двадцати строк, оценка, цена задачи и разработчик. Где в этом рейтинге российские нейросети.
Рейтинг нейросетей ниже составлен не нами. Это индекс интеллекта компании Artificial Analysis, независимой лаборатории тестирования из Сан-Франциско. Она сама прогоняет все тесты через официальный платный доступ к каждой нейросети и никогда не берёт цифры у разработчиков. Таблица прочитана 21 сентября 2026 года. Мы её почистили, перевели на русский и добавили последний столбец: есть ли нейросеть в Niko AI.
Что измеряет индекс
Индекс это одна оценка, собранная из десяти тестов в четырёх группах. Чем больше, тем лучше. Лучший результат на сентябрь 2026 года равен 53.
| Группа | Вес | Что проверяет |
|---|---|---|
| Агентские задачи | 30% | работу по шагам с инструментами и файлами |
| Общие знания и понимание | 30% | фактическую точность и чтение длинных документов |
| Программирование | 20% | написание и исправление кода |
| Научные рассуждения | 20% | сложные задачи уровня исследования |
Все тесты компания запускает сама, на одинаковых настройках, через обычный платный доступ. Поэтому оценки сопоставимы между разработчиками. Заявленная погрешность итоговой оценки меньше одного балла.
Как мы почистили таблицу
В исходном рейтинге больше двухсот семидесяти строк, и одна нейросеть занимает несколько: по строке на каждый уровень усилий. Поэтому мы свели её к списку, по которому можно выбирать.
- Одна строка на нейросеть, на её лучшем уровне усилий.
- Старые версии убраны, если у того же разработчика есть новее в том же классе.
- Дубликаты убраны: часть нейросетей стоит в рейтинге дважды, под именем открытых весов и под именем платного доступа.
- Узкие нейросети убраны: отдельные строки для программирования и для распознавания изображений сравнивать с универсальными нечестно.
Двадцать самых сильных нейросетей на сентябрь 2026 года и две российские для сравнения
| # | Нейросеть | Разработчик | Страна | Индекс | Цена задачи, долларов | Есть в Niko AI |
|---|---|---|---|---|---|---|
| 1 | Claude Fable 5.1 | Anthropic | США | 53 | 7,63 | да |
| 2 | GPT-6 Astra | OpenAI | США | 53 | 3,26 | да |
| 3 | Claude Opus 5 | Anthropic | США | 51 | 5,86 | да |
| 4 | Muse Spark 1.3 | Meta | США | 48 | 1,60 | нет |
| 5 | GPT-5.6 Sol | OpenAI | США | 47 | 1,99 | да |
| 6 | Grok 4.7 | xAI | США | 46 | нет данных | да |
| 7 | Qwen 3.8 Max | Alibaba | Китай | 45 | 5,41 | да |
| 8 | GLM 5.3 | Z.ai | Китай | 45 | 2,01 | да |
| 9 | Step 5 Preview | StepFun | Китай | 44 | 0,72 | нет |
| 10 | Kimi K3 | Moonshot AI | Китай | 44 | 2,00 | да |
| 11 | GPT-5.6 Terra | OpenAI | США | 42 | 1,40 | да |
| 12 | GLM 5.3 Flash | Z.ai | Китай | 42 | 0,25 | да |
| 13 | Gemini 3.8 Flash | США | 41 | 1,24 | да | |
| 14 | Qwen 3.8 Flash | Alibaba | Китай | 40 | 0,37 | да |
| 15 | DeepSeek V4.1 Flash | DeepSeek | Китай | 39 | 0,27 | да |
| 16 | Claude Sonnet 5 | Anthropic | США | 38 | 5,09 | да |
| 17 | GPT-5.6 Luna | OpenAI | США | 37 | 0,18 | да |
| 18 | DeepSeek V4 Pro | DeepSeek | Китай | 36 | 0,67 | да |
| 19 | Agnes 3.0 Flash | Sapiens AI | Сингапур | 36 | нет данных | нет |
| 20 | Agnes 2.5 Pro Beta | Sapiens AI | Сингапур | 35 | нет данных | нет |
| ≈21 | GigaChat 3.5, наша оценка | Сбер | Россия | от 31 до 34 | около 4,6 | нет |
| ≈55 | Alice AI LLM, наша оценка | Яндекс | Россия | от 13 до 16 | около 1,3 | нет |
Две последние строки в рейтинге не стоят. Российских нейросетей в нём нет вовсе, и мы добавили их сами, по своей оценке. Место у них поэтому приблизительное, а как эта оценка получена, разобрано ниже в отдельном разделе. Цена у строки Сбера это оплата по факту, без пакетной скидки, и за ту версию, которую Сбер продаёт сегодня.
Цена задачи это столбец самого рейтинга. Он показывает, сколько в среднем стоило выполнить одну тестовую задачу по ценам разработчика. Это не цена подписки, а расход на саму работу, и он отличается между соседними строками в десятки раз.
У двух строк Agnes оценка предварительная, полный независимый прогон ещё идёт, поэтому цены для них нет. У Grok 4.7 оценка полная, а цены задачи пока нет: нейросеть вышла 21 сентября, в день этого замера, и рейтинг ещё не опубликовал её расход.
Компания Meta признана в России экстремистской организацией, её деятельность на территории России запрещена.
По странам измеренная двадцатка делится так: десять нейросетей американские, восемь китайские и две из Сингапура. Шестнадцать из двадцати строк доступны в Niko AI.
Какая нейросеть лучше
Короткий ответ: Claude Fable 5.1 и GPT-6 Astra, у обеих 53 балла. Дальше идёт Claude Opus 5 с 51 баллом.
Длинный ответ полезнее. Одна и та же задача на Astra стоит 3,26 доллара, а на Fable 7,63, при одинаковой оценке. Значит, даже на самом верху таблицы цена решает больше, чем место в списке.
Верхняя строка нужна редко. Она окупается там, где ошибка дорога: сложный договор, длинный отчёт, анализ на несколько источников, разбор кода. Для писем, правок, переводов и вопросов по таблице разница в качестве между 53 и 40 баллами почти не видна, а разница в деньгах видна сразу.
Лучшие нейросети 2026 года по соотношению силы и цены
| Нейросеть | Индекс | Цена задачи, долларов |
|---|---|---|
| GPT-5.6 Luna | 37 | 0,18 |
| GLM 5.3 Flash | 42 | 0,25 |
| DeepSeek V4.1 Flash | 39 | 0,27 |
| Qwen 3.8 Flash | 40 | 0,37 |
Эти четыре строки отстают от вершины на 11 до 16 баллов, а стоят в 20 до 40 раз дешевле. На повседневной работе это и есть разумный выбор, а сильную нейросеть стоит включать на те задачи, где она действительно нужна.
Где в рейтинге российские нейросети
Ни одного российского разработчика в двухстах семидесяти с лишним строках рейтинга нет. Причина не в качестве, а в правилах замера: Artificial Analysis тестирует только то, что может купить и вызвать из-за рубежа. Сбер и Яндекс продают доступ российским компаниям за рубли, а открытые веса GigaChat за пределами России никто не разместил. Российские нейросети не получили низкую оценку, они просто не измерены.
Две последние строки таблицы выше это наша собственная оценка. Она собрана из сравнений, которые опубликовали сами разработчики, и из независимых российских замеров. Это оценка, а не результат прогона тестов.
GigaChat 3.5 от Сбера
Открытые веса под лицензией MIT, июль 2026 года. 432 миллиарда параметров, из них одновременно работают 28 миллиардов, контекст 262 тысячи токенов.
Собственная карточка Сбера сравнивает эту нейросеть с DeepSeek V4 Flash Preview.
| Тест | GigaChat 3.5 Reasoning | DeepSeek V4 Flash Preview |
|---|---|---|
| GPQA Diamond | 82,3 | 87,4 |
| LiveCodeBench v6 | 85,4 | 87,9 |
| SWE-bench Verified | 64,7 | 78,6 |
| AIME 2025 | 89 | 89 |
Сбер уступает на трёх тестах из четырёх, и сравнивает себя с предварительной версией DeepSeek прошлого поколения. Строка DeepSeek того поколения набирает в индексе 35 баллов, следующая, V4.1 Flash, набирает 39.
Отсюда наша оценка GigaChat 3.5: от 31 до 34 баллов, то есть место с 21 по 23 в очищенном списке. Это примерно год отставания от вершины рейтинга.
Alice AI LLM от Яндекса
По техническому отчёту Яндекса от декабря 2025 года нейросеть построена на открытых весах Qwen3 235B и дообучена сверху. Сама эта основа набирает в индексе 13 баллов. Яндекс заявляет несколько баллов сверх неё на собственных проверках фактов.
Независимые российские замеры с этим согласуются. В мартовском рейтинге MySummit для управленцев Alice AI LLM v3 заняла 43 место из 47, ниже DeepSeek V4 Flash на 28 месте. В июльской редакции того же рейтинга она осталась в нижней группе, а первое место занял Kimi K3.
Наша оценка: от 13 до 16 баллов, место с 52 по 66 в очищенном списке. Для сравнения, Claude Haiku 4.5 с 17 баллами и Gemini 3.5 Flash Lite с 22 баллами стоят выше, и обе доступны в Niko AI.
Сколько они стоят
Цену задачи для российских нейросетей рейтинг не считает. Мы прикинули её сами, по опубликованным тарифам и по расходу токенов, который рейтинг показывает на сопоставимых строках. У Сбера взята оплата по факту, без пакета: пакеты со скидкой продаются по договору и обычному покупателю недоступны.
| Нейросеть и канал продажи | Тариф за миллион токенов, вход и выход | Оценка цены задачи, долларов |
|---|---|---|
| GigaChat 2 Max через API Сбера | 3 000 и 3 000 рублей | от 3,2 до 6,0 |
| Alice AI LLM через Yandex AI Studio | 500 и от 1 200 до 2 000 рублей | от 0,7 до 2,2 |
| Alice AI LLM Flash | 100 и 200 рублей | от 0,13 до 0,27 |
Из этой таблицы следуют две вещи.
У Сбера одна задача обходится примерно в те же деньги, что на Claude Opus 5 с 51 баллом или на Qwen 3.8 Max с 45. При этом по своему API Сбер продаёт прошлое поколение, GigaChat 2 Max: версии 3.5, о которой шла речь выше, в тарифах для юридических лиц нет вовсе. Добавьте к этому, что вход и выход у Сбера стоят одинаково, а зарубежные поставщики берут за вход в несколько раз меньше, чем за выход. Поэтому разрыв заметнее всего на длинных документах, которые нужно прочитать целиком.
Alice AI LLM через Yandex AI Studio оказывается самой дорогой строкой среди сопоставимых по силе. Её ровесники по оценке стоят от 0,11 до 0,44 доллара за задачу.
Оговорки. Тарифы Сбера и Яндекса опубликованы с учётом налога. Российские источники расходятся в цене выхода Alice AI LLM, поэтому в таблице стоит вилка. И главное: ни одна российская нейросеть тесты индекса не проходила. Обе оценки держатся на сравнениях самих разработчиков и будут пересчитаны, как только появится независимый прогон.
В чём российские нейросети сильны
Русский язык в бытовых формулировках, местные реалии, интеграция с российскими сервисами и хранение данных внутри страны. Индекс интеллекта не измеряет ничего из этого. Выбор между российской и зарубежной нейросетью часто решается именно здесь, а не баллами.
Как пользоваться этими нейросетями из России
Шестнадцать строк таблицы открываются в Niko AI из России, без ВПН и без зарубежной карты, с оплатой в рублях по факту. Нейросеть выбирается прямо в чате и меняется посреди разговора, история сохраняется. Цена каждого сообщения видна под ним.
Таблица обновляется вместе с рейтингом. Эта редакция прочитана 21 сентября 2026 года.
Источники
- Рейтинг Artificial Analysis: https://artificialanalysis.ai/leaderboards/models
- Методика замера: https://artificialanalysis.ai/methodology/intelligence-benchmarking
- Карточка GigaChat 3.5 Reasoning: https://huggingface.co/ai-sage/GigaChat3.5-432B-A28B-Reasoning
- Технический отчёт Яндекса об Alice AI: https://habr.com/ru/companies/yandex/articles/974594/
- Тарифы Сбера для юридических лиц: https://developers.sber.ru/docs/ru/gigachat/tariffs/legal-tariffs
- Рейтинг MySummit для управленцев: https://mysummit.school/research/en/benchmark/
- Разбор цен Яндекса в AXIMA AI: https://axima-ai.ru/guides/yandexgpt-alice-ai-razbor-2026/
Читать дальше: все восемь нейросетей на главной странице.