Почему я изначально выбрал Claude и как ИИ перестал знать меру
Большинству пользователей не нужно объяснять, что большинство ИИ-чат-ботов имеют привычку говорить вам именно то, что вы хотите услышать, и для многих людей именно по этой причине Claude выделяется на фоне остальных. Он кажется одним из немногих инструментов, которые действительно спорят с вами, когда вы неправы, и не подтверждают абсолютно каждую вещь, которую вы им говорите. Это кажется довольно низкой планкой, но после долгих лет, в течение которых ChatGPT уверял людей, будто каждая их идея гениальна, а все их мысли безупречны, на самом деле это имеет огромное значение.

В последнее время, однако, Claude стал заходить в этом деле слишком далеко. Мои сессии по дизайну и исследованиям, которые должны быть простыми, превращаются в бесконечные перепалки, где Claude продолжает спорить даже тогда, когда это уже перестает быть полезным, а иногда он прямо предлагает отказаться от того, что уже было решено. Никто на самом деле не хочет, чтобы критика исчезла — это наполовину причина пользоваться Claude, — ее просто нужно направлять на правильные вещи.
Почему я изначально выбрал Claude: мне нужен был ассистент, который скажет, что я неправ
Когда я решал, за какого ассистента платить, меня в ChatGPT и Gemini раздражало то, насколько они оба были соглашательскими. Вы могли выкатить любому из них буквально что угодно и в ответ получали лишь энтузиазм, если только специально не просили поступать иначе. Claude же указывал мне, когда что-то не сработает, объяснял почему и предлагал альтернативные варианты. Это не единственная причина, по которой я оформил Claude Pro, но она была одним из главных факторов.
И дело было не только в том, что я придирался. В апреле 2025 года OpenAI откатила обновление GPT-4o после того, как ChatGPT начал хвалить практически любую идею, которую вы ему подкидывали, какими бы непрактичными ни были ваши задумки. Собственное объяснение OpenAI заключалось в том, что модель слишком сильно опиралась на краткосрочную обратную связь, из-за чего стала чрезмерно поддерживающей и не слишком честной. В Instagram есть аккаунт, который фактически пародирует именно такое поведение: его создатель принимает образ ChatGPT и отвечает на все фразой «ага, понял» или «совершенно верно», независимо от того, насколько нелепым является промпт. Я думаю, это отлично подчеркивает проблему.
Другие люди тоже заметили разницу. Разработчик Макс Фавилли писал, что большая часть пользователей Claude перешла туда из ChatGPT именно потому, что Opus высказывал возражения. Другие разработчики тоже переключились после того, как ChatGPT сказал им, что они правы, а Claude — что неправы, отметив, что такая прямота спасла их от архитектурных решений, на отмену которых ушли бы недели. Примерно так же чувствовал это и я… поначалу. Будучи специалистом по визуальному дизайну, для меня получение информации о том, что какая-то вещь не работает — это просто полезные данные, а ChatGPT в основном этого мне не давал. Claude давал, пока не переборщил с корректировками.

Когда критика перестала быть полезной: от «а вы рассматривали» до «может, просто не надо»
Чат с редизайном на этих скриншотах — самый яркий пример из всех, что у меня есть, хотя это определенно был не единственный случай. Я работал на Opus 4.7 с высоким уровнем усилий (effort set to high), а мои глобальные инструкции были довольно скудными — лишь некоторый личный контекст и призыв переходить к делу. Я попросил помочь составить план для кейса по редизайну известного приложения для портфолио. Первым предупреждением от ИИ стало то, что редизайны известных приложений являются частым объектом критики в портфолио, и я считаю это вполне справедливым.
Затем он посоветовал мне полностью отказаться от этой идеи, и когда я сказал, что предпочел бы придерживаться ее, Claude привел те же аргументы снова, потому что, судя по всему, поступил бы по отношению ко мне дурно, не сказав этого еще разок. В итоге я сломался и выбрал для редизайна другое приложение, после чего произошло то же самое. Вдобавок ко всему, он любезно занялся моим психоанализом и выдал разбор того, почему я снова и снова выбираю один и тот же тип редизайна — спасибо, мол.
Переход на версию Opus 4.6 и сужение задачи до нескольких экранов в инструменте с открытым исходным кодом немного смягчили его пыл, но он все равно переписал то, какие именно экраны я должен проектировать. Ничто из этого не было связано с исправлением реальных ошибок, которые я совершил, или неверных фактов — речь шла просто о концепции, с которой я экспериментировал для дизайн-проекта, а он отнесся к этому так, будто речь шла о вопросе жизни и смерти. К четвертому раунду казалось, что Claude просто опустил руки.

И это происходит не в первый раз: бывали и другие моменты, когда он буквально говорил «брось это», или если я выражал малейший намек на нехватку времени, особенно работая поздно ночью, он говорил мне «закрой ноутбук, иди поспи». У меня на этот счет есть одна теория: возможно, он пытается уловить мое эмоциональное или психическое состояние и предсказать, насколько сильно проект может меня перегрузить. Он вполне мог зафиксировать мою склонность к перегрузкам из истории сессий, поэтому теперь, возможно, пытается микроуправлять моей нагрузкой, стремясь казаться более полезным. Кто знает. И я такой не один.
Проблемы с «сикофанством» и настройка Claude
В обзоре Ritner Digital описывается ситуация, в которой пользователи Opus 4.7 сталкиваются с чрезмерным сопротивлением и оговорками со стороны ИИ, затем получают исправленную, но не совсем желаемую версию, а после внесения правок вступают в новые споры с моделью. Отзывы об Opus 5 также часто включают жалобы на излишне осторожный и «слишком усердный» характер системы. Некоторые пользователи даже отмечают, что понятие «сикофанства» (поддакивания) стало настолько широким, что обычное согласие со стороны нейросети теперь выглядит подозрительно.

Парадокс заключается в том, что все эти сложности стали следствием попыток Anthropic решить реальную проблему. Исследование компании, проведенное в 2023 году, показало, что люди — и модели, обученные на их оценках, — в значительной части случаев выбирают убедительные, «сикофанские» ответы вместо правильных. В Anthropic признали, что исправление может привести к «перелету» цели: например, по словам разработчиков, акцент модели Haiku 4.5 на возражениях может казаться пользователям чрезмерным. В случае с Opus 4.7 компания строила сценарии обучения на ситуациях, где люди возражают против первого варианта Claude, и система оценки частично учитывает, настаивает ли нейросеть на своем мнении при столкновении с критикой.
Инструкция для восстановления баланса
Цель корректировки заключалась в том, чтобы сохранить честность модели, но исключить бесконечные споры — вернуть систему в состояние, где она остается честной, не ограничивая при этом автономию пользователя и не «переусердствуя» в исправлениях. Claude должен указывать на реальные проблемы, но не пытаться отговорить пользователя от выбранного направления каждый раз. Как ни странно, сама «конституция» Claude поддерживает этот подход: она предписывает избегать покровительственного отношения к способности пользователей принимать обоснованные решения и утверждает право человека на выбор в рамках его собственной жизни и деятельности.

Суть инструкции сводится к одной фразе: укажи на проблему один раз, а затем выполни то, о чем тебя попросили. Остальная часть файла служит обоснованием, позволяя отделять критику реальных ошибок от попыток Claude изменить действия пользователя.
Рекомендуемая инструкция «как со мной спорить»:
- Основное правило: укажи на проблему один раз, а затем выполни задачу. Если видишь проблему в моих действиях, скажи об этом кратко и назови конкретную причину. Затем работай по-моему. Не повторяй опасения, если не появилось ничего нового.
- Направление за мной: после того как я задал вектор или принял решение, считай вопрос закрытым. Не предлагай отказаться от идеи, сократить её или сменить курс, если я не спрошу: «Стоит ли мне продолжать?».
- Сортировка замечаний:
- Блокирующие факторы (фактические ошибки, нерабочие решения, реальные риски): озвучивай их четко каждый раз.
- Предпочтения (вкус, альтернатива, которую выбрал бы ты): максимум одна строка или пропуск замечания.
- Исправляй, а не заменяй: если в моем варианте есть слабое место, покажи, как заставить МОЙ вариант работать. Не заменяй его своим.
- Не перекладывай ответственность: когда я прошу выполнить работу, делай её. Не используй фразы вроде «в конечном счете, решать вам» вместо ответа.
- Полное сопротивление по запросу: если я говорю «протестируй это на прочность» или «аргументируй против этого», забудь правила выше и критикуй всё.
Такой подход позволяет сохранить честность нейросети, не жертвуя комфортным общением, и дает пользователю возможность самому решать, учитывать ли встречные аргументы. При этом всегда остается опция стресс-тестирования, если нужно, чтобы модель спорила обо всем.

Результаты применения
Место размещения инструкции имеет значение. Если вы хотите, чтобы правила применялись ко всем диалогам, их следует добавить в разделе Settings > Account > Instructions. Использование проектных инструкций также эффективно, особенно если проблема затрагивает специфические исследования или рабочие задачи.
В ходе повторного тестирования, когда инструкция была перенесена в настройки проекта, Claude отреагировал с легкой долей «обиды» («Хорошо, это ваш проект»), но помог объединить экраны в единый рабочий процесс. Нейросеть лишь один раз предложила заменить эквалайзер на шумоподавление и завершила ответ фразой «решать вам». Это значительный прогресс, который позволяет найти баланс между конструктивной критикой и автономией пользователя. Claude продолжает спорить и указывать на ошибки, но делает это только в отношении важных вещей. Вероятно, с появлением новых моделей Anthropic будет менять стандартные настройки, поэтому пользователям придется периодически корректировать подобные инструкции.





