Cursor Composer 2.5 вошел в топ-3 ИИ для кодинга

2 мин
Cursor Composer 2.5 вошел в топ-3 ИИ для кодинга

Сервис независимых оценок ИИ-моделей Artificial Analysis опубликовал новый сводный рейтинг агентов для программирования — Coding Agent Index. В нем Cursor Composer 2.5 набрал 63 балла и занял третье место. Выше только Claude Code с Opus 4.7 на максимальном режиме (67 баллов) и Codex с GPT-5.5 на режиме экстра-рассуждений (65). Все остальные участники — позади.

Главная цифра — даже не место, а цена. Composer 2.5 Fast обходится в 44 цента за задачу, тогда как Claude Code с Opus 4.7 — $4.14, а Codex с GPT-5.5 — $4.33. Это приблизительно в десять раз дешевле при сопоставимом качестве. Базовый вариант Composer 2.5 стоит и вовсе 7 центов за задачу — в 60 раз дешевле лидеров. Coding Agent Index считается как средний итог на трех тестах: SWE-Bench-Pro-Hard-AA (правка реальных багов в открытых проектах), Terminal-Bench v2 (работа в терминале) и SWE-Atlas-QnA (вопросы по большим кодовым базам). Composer 2.5 оказался самым дешевым агентом из всех, кто перевалил отметку в 60 баллов.

Наиболее интересный результат — на SWE-Bench-Pro-Hard-AA, который считается самым сложным из трех. Здесь Composer 2.5 Fast выбил 49% и обошел Claude Opus 4.7 Max (45%) и GPT-5.5 XHigh (31%). У предыдущей версии Composer 2 на этом же тесте было всего 12%. То есть Cursor подняла собственный метрика в четыре раза за один выпуск. На Terminal-Bench v2 увеличение скромнее — с 64% до 67%, на SWE-Atlas-QnA — с 69% до 72%. Но в общем и целом индексе скачок все равно солидный: с 48 до 63 баллов.

Базовая схема та же, что и у Composer 2 — открытая Kimi K2.5 от китайской Moonshot AI. Но Cursor отдельно отчиталась, что около 85% новой модели — собственное дообучение и обучение с подкреплением, когда модель учат на наградах за удачные решения. У Composer 2.5 два варианта: стандартный по цене 50 центов и $2.50 за миллион входных и выходных токенов, и Fast — по $3 и $15. Это та же схема, но на более быстрой инфраструктуре: одна задача в среднем занимает 6.7 минуты против 9.3 у стандартного варианта.

P.S. Поддержать меня можно подпиской на канал "сбежавшая нейросеть", где я рассказываю про ИИ с творческой стороны.

Читают сейчас

Вышло апдейт диагностической утилиты CPU-Z 2.21

6 часов назад

Вышло апдейт диагностической утилиты CPU-Z 2.21

18 августа 2026 года вышла новая релиз диагностической утилиты CPU-Z 2.21 для ПК на Windows. Подход CPU-Z 2.0 команда проекта опубликовала в марте 2022 года. Выпуск CPU-Z 2.15 произошёл в марте 2025 г

Китайские учёные создали ИИ‑модель для прогнозирования депрессии

10 часов назад

Китайские учёные создали ИИ‑модель для прогнозирования депрессии

Исследователи из Шэньчжэньского университета разработали схема искусственного интеллекта, которая, по их словам, может прогнозировать риски развития депрессии в перспективе ближайших четырёх лет, пише

Китайский видеохостинг Bilibili стартовал функционировать за пределами страны

14 часов назад

Китайский видеохостинг Bilibili стартовал функционировать за пределами страны

Китайская система для публикации видео Bilibili запустила международное приложение с ИИ‑переводом, возможностью скачивания и офлайн‑просмотра видео. Пока доступна версия только для Android, приложение

14 часов назад

Возможно, у нас уже есть первые признаки квантовой гравитации, которые скрываются на самом видном месте

В соответствии с самым точным имеющимся данным, Вселенная расширяется, и это плагин ускоряется. Проблема для учёных заключается в том, чтобы объяснить, что является причиной этого ускорения — и соотве

«Известия»: из «Антифрода 3.0» убрали требование о трёхлетнем хранении данных о регистрациях

16 часов назад

«Известия»: из «Антифрода 3.0» убрали требование о трёхлетнем хранении данных о регистрациях

Владельцам сайтов, информационных систем и приложений не надо будет хранить информация о регистрации пользователей, её отмене и авторизациях в привязке к номеру телефона в течение трёх лет. Это следуе