Выбрать ИИ-помощника для написания кода непросто: на рынке есть несколько сильных решений, и они устроены по-разному. Кто-то привык работать в привычной IDE, кому-то удобнее терминал, а кто-то хочет полностью делегировать задачу облачному агенту. Разберём три самых заметных варианта и сравним их по реальным сценариям.
Что представляют собой инструменты
Cursor — AI-нативная среда разработки, созданная на основе VS Code. Начиная с версии 3.0 это самостоятельное приложение, которое умеет работать в агентном режиме. Внутри есть облачные агенты на изолированных виртуальных машинах, встроенный Bugbot и система параллельных задач. В апрельском обновлении 3.1 появились durable canvases — холсты для многошагового планирования. Примечательно, что агент уже самостоятельно создаёт около 30% внутренних pull request’ов в самой компании.
Claude Code — CLI-агент от Anthropic, который запускается прямо в терминале. Он читает репозиторий, выполняет bash-команды и редактирует файлы. По умолчанию для сложных задач выбирается Claude Opus 4.7, а для рутины — Sonnet 4.6. Кроме терминала, есть расширение для VS Code, десктопное приложение и браузерная IDE на claude.ai/code.
OpenAI Codex — облачный автономный агент, встроенный в ChatGPT. Также доступен open-source CLI на Rust (более 82 000 звёзд на GitHub, лицензия Apache-2.0) и десктопные приложения для macOS и Windows. Codex работает в изолированном облачном sandbox и может выполнять задачи, которые занимают несколько дней, без участия разработчика.

Как они справляются с задачами: бенчмарки
Чтобы понять, кто лучше решает реальные задачи, сравним результаты на популярных тестах. По данным на май 2026 года, Cursor и Claude Code тестировались с моделью Opus 4.7, а OpenAI Codex — с GPT-5.5. На SWE-bench Verified лидирует Codex с отрывом в 1,1 процентного пункта. Однако на более сложном SWE-bench Pro первое место занимает Claude Code, опережая ближайшего конкурента на 5,7 пункта. На Terminal-Bench 2.0 снова впереди Codex. Есть и собственный тест CursorBench, где результат Cursor составил 70%.
Правда, к SWE-bench Verified у сообщества есть претензии: считается, что современные модели могли встречать очень похожие задачи в обучающих данных. Поэтому более надёжным считают SWE-bench Pro.

Эффективность и расходы токенов
Один из важных критериев — сколько токенов тратится на задачу. Независимый тест от Builder.io показал, что Claude Code справился с одной и той же задачей за 33 000 токенов и без единой ошибки. Cursor в агентном режиме потратил 188 000 токенов и допустил ошибки. Разница — в 5,5 раза. Это объясняется тем, что Claude Code использует prompt caching и лучше управляет контекстом. Правда, и оплата устроена иначе: Claude Code тарифицируется по токенам через API или подписку, а Cursor Pro за 20 долларов в месяц даёт 500 premium-запросов. При активной работе с большими кодовыми базами в Agent mode этот лимит может закончиться за пару дней.
Контекстное окно: сколько кода помещается в «голове»
Контекст — это объём информации, который агент может одновременно анализировать. Cursor заявляет окно в 200K токенов, но пользователи на форуме замечают, что после внутреннего сжатия реально используется лишь 70–120K. Claude Code стабильно работает с 200K, а в бета-версии Opus 4.6 поддерживает до 1M токенов, достигая 76% на тесте MRCR v2. Это особенно важно для больших репозиториев, где приходится удерживать в памяти много файлов сразу.
Сценарий «пишете фичу»: что выбрать
Если ваша задача — написать новую фичу, сидя за компьютером, лучшим выбором будет Cursor. У него быстрый Tab autocomplete на базе Supermaven: задержка меньше 100 миллисекунд. Плюс визуальные диффы, Composer для многофайловых правок и мгновенный фидбэк. Всё это делает процесс написания кода максимально комфортным и наглядным.
А если нужно запустить долгую автономную задачу, которая может выполняться несколько дней, присмотритесь к OpenAI Codex. Для тех, кто привык работать в терминале и ценит экономию токенов, хорош Claude Code.
В итоге всё упирается в ваш сценарий: Cursor — для интерактивной работы, Codex — для автономных задач, Claude Code — для тех, кто хочет контролировать каждый шаг и при этом не переплачивать.



