Напевно, мені не потрібно розповідати вам, що більшість чат-ботів зі штучним інтелектом мають звичку говорити вам те, що ви хочете почути, і саме цим Клод виділяється багатьом користувачам. Здається, це один із небагатьох людей, які насправді не погоджуються з вами, коли ви не праві, і не схвалюють усе, що ви говорите. Це здається досить низькою планкою, але після того, як ChatGPT багато років розповідає людям, наскільки чудовою є кожна їх ідея та все, що вони вважають правильним, це справді велика справа.
Але останнім часом Клод зайшов занадто далеко. Мої сесії з проектування та дослідження, які мають бути простими, перетворюються на те, що Клод сперечається, де це корисно, а іноді прямо пропонує щось, про що вже вирішено. Ніхто насправді не хоче, щоб тиск зник, це половина причини бути в Клоді, потрібно просто зосередитися на правильних речах.
Хочете бути в курсі останніх новинок ШІ? Інформаційний бюлетень XDA AI Insider публікується щотижня з глибокими зануреннями, рекомендаціями щодо інструментів і практичними матеріалами, яких ви більше ніде не знайдете на сайті. Підпишіться, змінивши налаштування розсилки!
Чому я взагалі вибрав Клода
Мені потрібен був помічник, який би сказав мені, що я не правий
Коли я вирішував, за якого помічника заплатити, у ChatGPT і Gemini мене вразило те, наскільки вони сумісні. Ви можете сказати одне з них, ну, по суті, нічого, і отримати лише ентузіазм, якщо вам спеціально не наказано цього не робити. Клод казав мені, що коли щось не працювало, він пояснював, чому, і пропонував колеса. Це не єдина причина, чому я отримав Claude Pro, але це була одна з головних причин.
І це була не лише я вибаглива. У квітні 2025 року OpenAI випустив оновлення GPT-4o після того, як ChatGPT повернувся до вихвалення будь-якої вашої ідеї, якою б непрактичною вона не була. Власне пояснення OpenAI полягало в тому, що він надто сильно покладався на короткочасний зворотний зв’язок, тому модель була надто підтримана та не дуже чесна щодо цього. Існує обліковий запис Instagram, який фактично пародіює саме таку поведінку – творець приймає персонажа ChatGPT і відповідає на все “ага, зрозумів!” або «цілком слушним», — відповідає він, незважаючи на те, чи запит смішний. Я думаю, що це чудово висвітлює проблему.
Інші люди також помітили різницю. Розробник Макс Фавіллі написав, що значна частина користувачів Клода прийшли з ChatGPT саме тому, що Opus повернувся. Інші розробники наслідували їхній приклад після того, як ChatGPT сказав їм, що вони були праві, а Клод сказав їм, що вони неправі, стверджуючи, що він безпосередньо врятував їх від архітектурних рішень, на скасування яких знадобилися тижні.
Приблизно так я відчував про це… спочатку. Якщо говорити про візуальний дизайн, то кажучи мені, що щось не працює, це просто корисна інформація, і ChatGPT, по суті, не зробив це за мене. Клод був таким, поки він не виправив це.
Коли опора перестала бути прибутковою
Це змінилося від «ти думав» до «можливо, ти ні».
Чат скидання на цих скріншотах — мій яскравий приклад, хоча це, звичайно, не єдиний випадок. Я був на Opus 4.7, коли зусилля були зроблені, і мої глобальні вказівки були дуже простими, лише особистий контекст і підтримка для досягнення мети.
Я попросив допомоги з редизайном популярного додатка для портфоліо. Перший прапор полягав у тому, що дизайн популярних додатків є звичайною критикою портфоліо, що, на мою думку, є досить справедливим. Потім воно наказало мені взагалі відмовитися від цієї ідеї, і коли я сказав, що краще триматися цього, Клод повторив той самий випадок, тому що, очевидно, було б мені погано не повторювати це знову.
Тож я спробував і вибрав іншу програму для редизайну, і сталося те саме. Крім того, був люб’язний провести мене психоаналіз і пояснити мені, чому я опинився в такому ж дизайні – дякую, я думаю?
Перехід на Opus 4.6 і звуження його до кількох екранів у інструменті з відкритим вихідним кодом трохи пом’якшили його, але все одно переписали екрани, які я мав розробити. Нічого з цього не стосувалося пошуку моїх справжніх помилок чи доказів того, що я був неправий, це була просто концепція, з якою я грався для дизайн-проекту, і це розглядалося як ситуація життя чи смерті. У четвертому раунді було відчуття, що Клод розвів руками.
І це не вперше – були випадки, коли буквально говорилося «кинь це», або якщо я висловлював певні часові обмеження, особливо під час роботи вночі, мені казали «закрити ноутбук, поспати». У мене тут є теорія, і вона, можливо, намагається відчути мій емоційний або психічний стан і передбачити, наскільки проект мене засмутить. Він міг легко підхопити мою схильність копатися в історії сеансів, тож, можливо, зараз він намагається зменшити моє робоче навантаження, щоб здаватися більш корисним. Хто знає.
Це не тільки я. Підсумок від Ritner Digital описує, як користувачі Opus 4.7 отримують знімки та попередження, потім модифіковану версію того, що вони запитували, і додаткові обговорення після виправлення. Рецензенти Opus 5 все ще називають обережність і надмірну активність як одну з найпоширеніших скарг, а деякі навіть стверджують, що вся ідея догляду настільки надумана, що звичайна угода виглядає сумнівною.
Найсмішніше те, що все це відбувається завдяки тому, що Anthropic вирішує реальну проблему. Його дослідження 2023 року показало, що люди та моделі, навчені їхнім рейтингам, за короткий проміжок часу вибирали правдоподібні відповіді замість правильних. Anthropic визнав, що виправлення може бути надмірним, сказавши, що акцент Haiku 4.5 на відштовхуванні може здатися приголомшливим для користувачів. Для Opus 4.7 він створив навчальні сценарії з моментів, коли люди повертаються до першого захоплення Клода, а його грейдер частково оцінює, чи Клод утримує свою позицію під час експонування.
Керівництво, яке це виправило
Зберігайте чесність, втрачайте агресію
Те, що я хотів, так це повернути його до того, яким він був раніше – чесним, але не настільки, щоб це знищило автономію користувача або забагато виправлень. У Клода все одно має бути справжня проблема, вона не повинна щоразу вибивати мене з колії. За іронією долі, власна конституція Клода тут на моєму боці, і в ній перераховується образа здатності користувачів приймати власні обґрунтовані рішення як щось, чого слід запобігати, і сказано, що користувачі мають право приймати рішення щодо речей у межах свого життя та юрисдикції.
Цей посібник зводиться до одного рядка: позначте це один раз і виконайте те, що я просив. Решта файлу є для підтвердження того, що Клод відокремлює справжню проблему від спроби Клода змінити мою роботу. Ось мій посібник «як зі мною не погоджуватися»:
## Core rule: flag it once, then build what I asked for
If you see a problem with my direction, say so once, briefly, with the specific reason. Then do the work my way. Don't repeat the concern unless something new comes up.
## Direction is mine
Once I've stated a direction or decision, treat it as settled. Don't suggest dropping, scaling back, or pivoting unless I ask "should I keep going with this?"
## Sort concerns before raising them
- Blockers (factual errors, something that won't work, real risk): say these clearly, every time.
- Preferences (taste, an alternative you'd pick): one line at most, or skip it.
## Fix, don't forfeit
If my version has a weak spot, show me how to make MY version work. Don't replace it with yours.
## Don't hand it back
When I ask for work, do the work. No "ultimately it's up to you" in place of an answer.
## Full pushback on request
If I say "stress-test this" or "argue against this," drop the above and challenge everything.
Справжні помилки та речі, які не працюють, усе ще з’являються, тому я не буду жертвувати чесністю заради кращої розмови. Це просто дозволяє мені вирішити на власних умовах, чи хочу я розглядати докази протилежного. І є можливість провести стрес-тест, якщо я дійсно хочу, щоб він пройшов через усе.
Місце, де ви розмістите цей посібник, також може змінити ситуацію. Якщо ви хочете, щоб це застосовувалося до кожної розмови, перейдіть у «Налаштування» > «Обліковий запис» > «Правила» та встановіть це там. Я вибрав інструкції для конкретних проектів, оскільки ця проблема в основному стосується моїх дослідницьких і дизайнерських проектів, і вони працюють разом із тим, що я вже маю в глобальних інструкціях.
У тій самій запланованій розмові, тепер перейшовши до проекту з файлом у його інструкціях, я сказав Клоду, що дотримуюся своєї початкової ідеї. Він відкрився трохи дивним «Добре. Це твій проект», але насправді допоміг мені об’єднати три екрани в один робочий процес. Він все ще пропонував одну настройку еквалайзера, щоб зменшити гучність і підписувався словами «це ваш дзвінок». Я б сказав, що це набагато краще та забезпечує баланс між конструктивною критикою та дозволом мені вибирати на власних умовах.
Клод досі сперечається зі мною про правильні речі
Клод все ще дуже зі мною не згоден і звинувачує мене в своїх нісенітницях, які я не хочу змінювати. Цей посібник просто повертає його туди, звідки почався надмірний виправлення. Я думаю, що з кожною новою моделлю Anthropic залишатиметься там, де встановлено за замовчуванням, тому я, ймовірно, повернуся до цього файлу, щоб виправити речі.