
Четыре новые нейросети за восемь дней, гонка ИИ-лабораторий вышла на новый уровень
За восемь дней сразу четыре компании выпустили новые нейросети, и расстановка сил на рынке искусственного интеллекта изменилась быстрее, чем когда-либо раньше. Разбираемся, кто теперь входит в число лидеров, кто обошёл кого, и почему мощный ИИ внезапно подешевел в несколько раз.
Что произошло, четыре запуска нейросетей подряд
Рынок искусственного интеллекта на 17 июля 2026 года только что пережил один из самых плотных периодов запусков за всю историю. За восемь дней вышли сразу четыре модели, Grok 4.5 от SpaceXAI, GPT-5.6 от OpenAI, Muse Spark 1.1 от Meta и Kimi K3 от Moonshot AI. Для сравнения, ещё в начале июня только две компании, Anthropic и OpenAI, могли похвастаться моделью такого высокого уровня. Сейчас таких компаний уже шесть.
Речь идёт о независимом рейтинге под названием Artificial Analysis Intelligence Index. Это своего рода сводный экзамен для нейросетей, который объединяет сразу несколько разных тестов и переводит результат в единую шкалу. Чем выше число, тем умнее модель показывает себя в целом, а не в какой-то одной узкой задаче.
Grok 4.5 вышла 8 июля с результатом 54 балла. Буквально через два дня подтянулись сразу GPT-5.6 в трёх версиях, Sol с результатом 59, Terra с 55 и Luna с 51, а также Muse Spark 1.1 от Meta с результатом 51. А 16 июля вышла Kimi K3 от Moonshot AI и сразу набрала 57 баллов, заняв третье место в общем рейтинге, обойдя даже Claude Opus 4.8 с его 56 баллами.
Как топ рейтинга превратился из двух лидеров в шесть

Шесть лабораторий теперь держат модель с результатом выше 50 баллов на Artificial Analysis Intelligence Index, Anthropic (Claude Fable 5, 60), OpenAI (GPT-5.6 Sol, max, 59), Moonshot AI (Kimi K3, 57), SpaceXAI (Grok 4.5, high, 54), Z AI (GLM-5.2, max, 51) и Meta (Muse Spark 1.1, xhigh, 51). Стрелками отмечены шесть моделей, вышедших за последние восемь дней.
До июня 2026 года только модели Anthropic и OpenAI набирали 51 балл и выше в этом рейтинге. В середине июня к ним присоединилась компания Z AI со своей моделью GLM-5.2, набравшей ровно 51 балл. А буквально на прошлой неделе список пополнился сразу двумя новыми именами, SpaceXAI с Grok 4.5 и Meta с Muse Spark 1.1. Запуск Kimi K3 сделал Moonshot AI уже шестой компанией в этом клубе, причём сразу с результатом 57 баллов.
При этом важно, что топ-три модели рейтинга теперь принадлежат трём разным компаниям, и разница между ними составляет всего три балла. Четыре из десяти самых сильных моделей вышли только за последние восемь дней, а шесть из десяти, это модели, выпущенные с начала июня.
Единственное, что осталось неизменным, это первое место. Claude Fable 5 держит лидерство с 9 июня и набирает 60 баллов, но отрыв от ближайшего конкурента сократился с четырёх баллов до одного. По сути гонка за первое место стала настолько плотной, что любой следующий релиз способен её изменить.
Как выглядит эта гонка на длинной временной шкале

Долгосрочный взгляд показывает, насколько необычными были последние шесть недель. Большую часть периода с конца 2022 года лидерство в рейтинге интеллекта держали одна-две компании одновременно. С начала июня SpaceXAI, Moonshot AI, Meta и Z AI, все они сократили отставание от первого места до однозначных чисел.
Если посмотреть на всю историю рейтинга с конца 2022 года, станет заметно, насколько непривычна текущая ситуация. Обычно верхушку таблицы держали одна-две компании подряд на протяжении долгого времени. То, что сразу четыре разные лаборатории одновременно подобрались вплотную к лидеру, случилось впервые за всё время существования рейтинга.
Почему Kimi K3 сразу заняла третье место
Kimi K3 от Moonshot AI дебютировала сразу с сильным результатом, и это не случайность. На тесте GDPval-AA v2, который проверяет качество работы модели в реальных профессиональных задачах, Kimi K3 набирает 1668 очков по системе Эло, это похоже на рейтинг в шахматах, чем больше уверенных побед над сильными соперниками, тем выше итоговый счёт. Это третий результат, уступающий только Claude Fable 5 с 1760 очками и GPT-5.6 Sol с 1748 очками.
На другом тесте, AA-Briefcase, который проверяет способность модели вести долгие профессиональные задачи, Kimi K3 занимает уже второе место с результатом 1547, уступая только Claude Fable 5 с 1583 очками, но опережая GPT-5.6 Sol, у которой 1495 очков. Отдельно стоит отметить показатель качества аналитической работы, здесь у Kimi K3 1760 очков, что практически на равных с показателем Claude Fable 5 в 1764 очка.
А теперь про цену. Kimi K3 стоит 3 доллара за миллион входящих токенов и 15 долларов за миллион исходящих, и в пересчёте на одну задачу из рейтинга интеллекта это выходит всего 0,94 доллара. Для сравнения, похожий по силе результат Claude Opus 4.8 обходится в 1,80 доллара за задачу, то есть примерно вдвое дороже при сопоставимом уровне интеллекта.
Как изменились места в рейтинге по программированию

Новые запуски также изменили рейтинг Artificial Analysis Coding Agent Index. GPT-5.6 Sol в связке с Codex теперь лидирует с результатом 80, опережая GPT-5.6 Terra в Codex с результатом 77 и Claude Fable 5 в связке с Claude Code, тоже 77. Grok 4.5 в связке с Grok Build набирает 76, что примерно на уровне GPT-5.5 в Codex, а Muse Spark 1.1 в связке с Opencode дебютирует с результатом 69.
Эти же четыре запуска затронули и отдельный рейтинг по программированию. Новым лидером стала связка GPT-5.6 Sol с инструментом Codex, результат 80 баллов. Чуть позади идут GPT-5.6 Terra тоже в Codex с 77 баллами и Claude Fable 5 в связке с Claude Code, тоже с результатом 77. Grok 4.5 в связке с Grok Build набирает 76 баллов, это примерно на уровне предыдущей версии GPT-5.5 в Codex. А Muse Spark 1.1 в паре с Opencode дебютирует сразу с результатом 69.
Почему мощный интеллект подешевел в 2-3 раза всего за восемь дней

Всего за восемь дней изменилось соотношение между уровнем интеллекта модели и её стоимостью. GPT-5.6 Luna (0,21 доллара), Muse Spark 1.1 (0,26 доллара) и Grok 4.5 (0,31 доллара) теперь стоят столько же или дешевле, чем неделю назад стоила GLM-5.2 с ценой 0,32 доллара. При этом Kimi K3 (0,94 доллара) и GPT-5.6 Sol (1,04 доллара) показывают результат всего на три и один балл ниже, чем Claude Fable 5, но стоят примерно втрое дешевле за одну задачу.
Пожалуй, самое интересное изменение произошло именно в цене. GPT-5.6 Sol показывает результат всего на один балл ниже Claude Fable 5, но обходится в 1,04 доллара за задачу против 2,75 доллара у лидера. Grok 4.5 даёт результат в 54 балла всего за 0,31 доллара, это меньше трети от цены предыдущей модели GPT-5.5, которая стоила 0,99 доллара за похожую задачу.
На уровне в 51 балл ситуация похожая. GPT-5.6 Luna обходится в 0,21 доллара, а Muse Spark 1.1 в 0,26 доллара, и обе модели дешевле, чем GLM-5.2 с её 0,32 доллара, которая ещё неделю назад была самым доступным вариантом на этом уровне интеллекта. Получается, что почти такой же мощный ИИ, как топовые модели, всего за восемь дней подешевел в два-три раза.
Заключение
Всего за восемь дней расстановка сил в мире искусственного интеллекта поменялась сильнее, чем за предыдущие месяцы вместе взятые. Шесть разных компаний теперь держат модели высокого уровня, топ-три места занимают три разные лаборатории, а цена за примерно такой же уровень интеллекта упала в два-три раза. Лидер, Claude Fable 5, всё ещё держит первое место, но отрыв сократился до одного балла, и следующий релиз способен снова всё изменить.
Для обычного пользователя это значит одну простую вещь, теперь не существует одной «правильной» нейросети на все случаи жизни. Grok 4.5, GPT-5.6, Kimi K3, Muse Spark 1.1, у каждой модели своя сильная сторона и своя цена, и разбираться, какая подойдёт именно под твою задачу, приходится буквально каждую неделю заново.
Тестировать все шесть моделей по отдельности, оформляя доступ к каждой лаборатории напрямую, слишком долго и неудобно. Гораздо проще, когда все актуальные нейросети уже собраны в одном месте, и можно сразу сравнить результат на своей задаче, а не только на баллах из рейтинга.
Именно для этого работает unitool.ai. Оформи одну подписку и получи доступ ко всем самым новым моделям сразу, включая свежие релизы этой недели, без иностранных карт и отдельной регистрации на сайте каждой компании. Попробуй сам, какая нейросеть окажется сильнее именно на твоих задачах.