Новый рейтинг ИИ: OpenAI, Anthropic и Google делят лидерство
Последнее исследование Artificial Analysis показало, что три ведущих компании идут вровень в разработке искусственного интеллекта, с минимальным отрывом друг от друга.
Компания Artificial Analysis опубликовала обновленную версию 4.0 своего рейтинга Intelligence Index, в котором оценивает возможности современных моделей искусственного интеллекта.
В тройку лидеров вошли: GPT-5.2 от OpenAI (50 баллов), Claude Opus 4.5 от Anthropic (49 баллов) и Gemini 3 Pro от Google (48 баллов). Интересно, что в этот раз максимальные оценки оказались значительно ниже предыдущей версии рейтинга - 50 баллов против 73.
Оценка проводилась по четырем равнозначным категориям: работа с агентами, программирование, научное мышление и общие способности. В новой версии рейтинга были представлены три новых теста:
-
AA-Omniscience для проверки знаний по 40 темам и выявления ложной информации
-
GDPval-AA для оценки практических навыков в 44 профессиях
-
CritPt для решения задач в области физических исследований
Если говорить о стоимости использования этих моделей, самой дорогой оказалась GPT-5.2 в максимальной конфигурации - $2,322. За ней следуют Grok 4 ($1,574) и Claude 4.5 Opus ($1,510). Gemini 3 Pro оказалась заметно дешевле - $988.
Все тесты проводились независимо по стандартизированной методике, с полным соблюдением протокола тестирования.
Смотрите также
-
Ассистенты·Как отключить Gemini на Android: все способы
-
ИИ-агент·ИИ-браузеры в 2026 году: сравнение Comet, Dia, Aside и ego lite – и почему закрылся ChatGPT Atlas
-
ИИ-агент·Google расширяет доступ к Gemini Spark — агентному ИИ-ассистенту
-
Здоровье·ChatGPT даёт разные медицинские советы платным и бесплатным пользователям
-
Чат-боты·GPT-5.6: обзор нового семейства OpenAI – Sol, Terra и Luna, и какую модель выбрать
-
ИИ-агент·Brain: как ИИ решает, что Azure официально упал
-
ИИ-агент·Apple встроила MCP-сервер прямо в Safari — теперь ИИ-агенты могут управлять браузером
-
ИИ-агент·Microsoft переделывает Copilot: единое приложение, агенты AutoPilot и ставка на «реальную работу»
-
ИИ-агент·Claude Science: рабочая среда Anthropic для учёных