24 марта 2026, 09:10
Cursor ускоряет regex-поиск по коду для ИИ-агентов

Компания Cursor рассказала о подходе к ускорению поиска по регулярным выражениям в больших кодовых базах. Речь идет о задаче, которая становится все важнее на фоне распространения ИИ-агентов для программирования. Такие системы постоянно ищут по проекту функции, сигнатуры, конфигурации и другие точные текстовые совпадения, а в крупных монорепозиториях это превращается в заметное узкое место.
По данным Cursor, в больших репозиториях обычный поиск через ripgrep в отдельных случаях может занимать более 15 секунд. Для разработчика это означает паузу в работе, а для ИИ-агента - дополнительную задержку при каждом обращении к коду. Поэтому организация решила ускорить не только сами модели, но и базовую инфраструктуру поиска.
В основе нового подхода лежит локальная индексация. Вместо того чтобы каждый раз заново просматривать всю кодовую базу, Cursor предлагает заранее строить индекс на компьютере пользователя и применять его для предварительного отбора файлов, где совпадение действительно вероятно. После этого система запускает уже обычную проверку регулярным выражением, но не по всему проекту, а по более узкому набору кандидатов.
Для такой фильтрации Cursor использует триграммы - последовательности из трех символов. Это популярный подход из систем поиска по тексту и коду, который позволяет быстро определить, в каких документах потенциально может встретиться необходимый шаблон. В компании отмечают, что одних триграмм для больших проектов нев достаточной степени, следовательно дополнительно применяются более сложные методы отбора, в том числе sparse n-grams - «разреженные n-граммы» и вероятностные маски. Их задача уменьшить число лишних совпадений и сократить объем файлов, которые все же придется читать полностью.
Cursor подчеркивает, что индексы будут храниться и использоваться локально. Такой вариант должен снизить задержки, уменьшить зависимость от сети и упростить работу с быстро меняющимся кодом, который агент только что отредактировал. Для больших репозиториев это особенно важно: индекс должен быть максимально свежим, иначе выигрыш в скорости быстро исчезает.
Итак, Cursor делает ставку не только на развитие ИИ-моделей, но и на ускорение самых частых операций под капотом. Организация практически демонстрирует, что в AI IDE эффективность зависит не только от качества генерации, но и от того, насколько быстро платформа находит необходимый контекст в проекте.
Короче говоря, Cursor рассматривает оперативный regex-поиск как один из ключевых элементов следующего поколения инструментов разработки. И в этом смысле речь идет о довольно прикладной инженерной задаче: сократить время между запросом агента и полезным ответом.
Источник: Cursor
Читают сейчас

52 минуты назад
Зона.рф лидирует по темпам идентификации администраторов через «Госуслуги»
Посмотрели, как проходит обязательная идентификация администраторов доменов через ЕСИА, и заметили, что наилучшую динамику показывает кириллическая зона .рф. Совокупно в нашей группе Рунити обслуживае

1 час назад
Meta* анонсировала начальный трансатлантический интернет‑кабель с пропускной способностью 1 Пбит/с
Meta* анонсировала подводный оптоволоконный кабель Petal, который станет первой трансатлантической линией связи с пропускной способностью 1 Пбит/с (1000 Тбит/с). Его введут в эксплуатацию в 2029 году.

2 часа назад
OpenAI выпустила GPT-6 Sol и GPT-6 Luna: модели дешевле GPT-5.6 в два раза
OpenAI расширила семейство GPT-6 двумя моделями — GPT-6 Sol и GPT-6 Luna. Они дополняют флагманскую GPT-6 Astra и рассчитаны на задачи, где важны не максимальные возможности модели, а стоимость, скоро

2 часа назад
Bambu Lab представила R1 — свой начальный настольный лазерный станок
Bambu Lab представила свой начальный станок для лазерной резки и гравировки с 55-ваттным CO₂‑лазером. Это равным образом первое устройство компании за пределами 3D‑печати. Читать далее
3 часа назад
Индийские специалисты разработали более прочный бетон, который заодно поглощает углекислый газ из воздуха
Исследователи из инженерного колледжа Mepco Schlenk в Индии разработали бетонную смесь, которая оказалась прочнее обычного бетона и поглощала больше углекислого газа в условиях ускоренной карбонизации