Современные инструменты для программирования с использованием ИИ достигли уровня, позволяющего создавать визуально проработанные приложения. Однако реальные различия проявляются в деталях: отступах, поведении компонентов, консистентности интерфейса и общей логике построения продукта. Чтобы оценить эти отличия, был проведен тест, в котором Claude Code, Codex и Cursor получили задание создать «Командный центр редактора» для фрилансера с единым набором требований.

Особенности тестирования и требования к приложению
Для обеспечения объективности эксперимента во всех случаях использовался идентичный подробный промпт без дополнительных подсказок и последующих корректировок. В основе работы лежали актуальные высокопроизводительные модели: Opus 5.5, GPT 6 Astra и Grok 4.7. Проект включал управление статьями, контроль дедлайнов, Kanban-доску, календарь, аналитику, поиск, адаптивный дизайн, темную тему и ряд вспомогательных UX-элементов.
Codex: лидер по скорости выполнения
Codex произвел впечатление своей производительностью, завершив работу почти в три раза быстрее Claude Code и примерно в два раза быстрее Cursor. Визуально приложение выглядело чисто и цельно, особенно в темном режиме с использованием зеленой цветовой схемы. Однако высокая скорость сказалась на проработке деталей.




Некоторые элементы интерфейса оказались менее отшлифованными: размер типографики местами был слишком мелким, а карточки задач на Kanban-доске выглядели неоправданно высокими, что нарушало компактность макета. Тем не менее, с учетом оперативности, результат можно оценить на 8 баллов из 10.

Cursor: акцент на эстетику и визуальный стиль
Cursor продемонстрировал превосходную визуальную составляющую. Приложение было выполнено в бежевых тонах, напоминающих газетную верстку, что идеально соответствовало концепции редакционного дашборда. Дизайн выглядел выверенным, отступы были согласованы, а типографика оказалась более удачной, чем у Codex.

Несмотря на общий успех, были выявлены и недочеты. Раздел «Последние действия» оказался менее структурированным, чем у конкурентов. Также недостаточно проработанным показался блок «Аналитика», который на фоне остального интерфейса выглядел поспешным. Общая оценка инструмента составила 8,5 балла из 10.

Claude Code: внимание к деталям и логика опытного разработчика
Claude Code стал самым медленным инструментом в тестировании, однако затраченное время позволило добиться лучшего результата в плане продуктовой логики. Инструмент внедрил множество мелких, но важных улучшений: например, использование специфических иконок для различных событий в панели активности (рукопожатие для принятых заявок, календарь для измененных дедлайнов).

Claude Code проявил самостоятельность, приняв ряд взвешенных UX-решений без прямых указаний. В частности, система управления статьями была организована через содержательные категории, такие как «Написание», «Назначено» и «Редактирование», а при создании новой статьи были предложены полезные шаблоны с подсчетом слов. Несмотря на спорную стандартную синюю тему, внимательность к деталям и принятие решений на уровне опытного разработчика позволили поставить оценку 9,5 балла из 10.

Итоги сравнения ИИ-помощников
Все три участника доказали способность создавать рабочие приложения по одному детальному промпту. Codex показал выдающуюся скорость, Cursor — уникальный дизайн, но именно Claude Code продемонстрировал наиболее зрелый подход, самостоятельно дорабатывая неочевидные аспекты интерфейса и выстраивая логику приложения так, как это сделал бы опытный специалист.

Методология оценки: почему важны детали
Инструменты для кодинга на базе ИИ достигли того этапа, когда любой из них способен собрать проект, выглядящий эффектно при первом знакомстве. Однако настоящий разрыв в качестве становится очевиден, если сфокусироваться на нюансах: поведении компонентов, консистентности интерфейса и ощущении того, насколько «продуманным» получилось приложение. Чтобы наглядно увидеть, насколько существенна эта разница, автор эксперимента поставил перед Claude Code, Codex и Cursor задачу с идентичными требованиями. Главной целью было проверить, какой из ИИ-помощников проявит внимание к деталям, свойственное не просто инструменту для написания кода, а опытному разработчику, который «чувствует» конечный продукт.

Codex: быстрый результат с компромиссами
Codex одержал уверенную победу в гонке скоростей. Его работа была не только быстрой, но и визуально приятной, особенно в темном режиме, где зеленая тема выглядела по-настоящему стильно. Интерфейс в целом ощущался как целостный продукт. Однако эта впечатляющая скорость, позволившая закончить приложение почти в три раза быстрее, чем Claude Code, имела свои недостатки. Помимо мелкой типографики, которая уже стала типичной «болезнью» GPT-моделей, вопросы вызвал макет Kanban-доски. Необоснованно высокие карточки задач делали интерфейс излишне громоздким для инструмента, ориентированного на продуктивность. Кроме того, вкладка «Статьи» (Articles) явно требовала дополнительной доработки UI, чтобы выглядеть законченной. Несмотря на это, учитывая колоссальный выигрыш во времени, результат в 8/10 выглядит заслуженным.

Cursor: эстетика газетной полосы и некоторые недочеты
Cursor сразу подкупил своим визуальным направлением. Выбор цветовой палитры — приглушенного бежевого тона — вызывал прямые ассоциации с печатной прессой, что казалось удивительно уместным для редакционной панели. С точки зрения типографики и отступов Cursor превзошел Codex, обеспечив гораздо более комфортное восприятие текста. Однако в архитектуре интерфейса обнаружились просчеты. Например, раздел Recent Activity на дашборде выглядел слишком просто и «плоско» по сравнению с timeline-структурами у конкурентов, которые были гораздо информативнее. В то же время раздел «Публикации» показал, что Cursor обладает глубоким пониманием специфики именно этого типа приложений. Тем не менее, поспешность в реализации блока «Аналитика» не позволила инструменту получить высший балл — итоговая оценка остановилась на 8,5 из 10.

Claude Code: победа за счет глубины проработки
Claude Code был самым медленным участником теста. На этапе генерации кода возникали сомнения, оправдает ли длительное время обработки результат. Однако при детальном изучении готового приложения все вопросы отпали. Ключевое отличие заключалось в том, что интерфейс ощущался «живым». Например, панель Recent activity вместо стандартных маркеров использовала осмысленные иконки: принятый питч отмечался значком рукопожатия, а изменение дедлайна — календарем. Это именно те мелочи, из которых складывается ощущение завершенного продукта. Аналогичный подход наблюдался при создании новых материалов, где модель предложила шаблоны с расчетом количества слов, и в разделе статей, который был разбит на логические категории — от «Написания» до «Редактирования». Даже с учетом скучноватой стандартной синей темы, Claude Code продемонстрировал способность самостоятельно принимать UX-решения, которые не были прописаны в промпте, что вывело его на уровень 9,5 из 10.

Вердикт: судейство против чек-листа
Главный вывод теста заключается в том, что разница между современными ИИ-помощниками лежит не в способности закрыть пункты технического задания, а в уровне «продуктового суждения». В то время как Codex ставит рекорды скорости, а Cursor создает уникальный визуальный ряд, Claude Code делает ставку на качество взаимодействия пользователя с приложением. Это именно та разница, которую ожидаешь от senior-разработчика: способность предвидеть проблемы, организовать структуру данных с пониманием контекста и самостоятельно отшлифовать те шероховатости, которые часто остаются незамеченными при автоматической генерации кода.







