
Тепер ми всюди бачимо всі ці висновки ШІ. Вони з’являються, коли ви шукаєте щось в Інтернеті, у записах про зустріч, медичних картах, поліцейських звітах і в програмах, якими ми користуємося щодня. Подобається це чи ні, але вони всюди.
Зрозуміло, чому вони привабливі: ви економите час, розуміючи, що вийшло, і їх дуже легко зробити. Але нові дослідження показують, що воно того варте. Вони можуть змінити те, що сталося з нами в першу чергу.
Не вір своїм очам. Довіртеся ШІ
Експеримент розпочався з 25-секундного відео. А точніше, дві версії відео.
Учасники переглянули анімаційну сцену червоного автомобіля, який наближався до перехрестя, коли на дорогу вийшов пішохід. Машина перекотилася і збила пішохода. Пішохід впав, розвернувся і нарешті зустрів водія.
Учасникам показали одну з двох майже ідентичних версій цього кліпу. На одному з перехресть стояв знак «стоп». В іншому на ньому був знак врожаю. Ця різниця в знаках руху була ключовою відмінністю.
Обстановка добре відома. Він походить від відомої лінії психологічних досліджень, яка охоплює понад 50 років. Експерименти з використанням такого типу установки неодноразово показували, що пам’ять не працює так, як відеофайл, що зберігається в мозку. По суті, ми реконструюємо подію такою, як ми її пам’ятаємо, і інформація, з якою ми стикаємося пізніше, може бути використана для цієї реконструкції.
Психологи називають це ефектом дезінформації. Але що станеться, коли в суміш з’явиться штучний інтелект?
Короткий зміст “розуму”
Після перегляду відео аварії учасники залишили експеримент. Вони повернулися через 24-48 годин.
Цього разу вони прочитали резюме з 21 речення, створене ШІ. Для деяких учасників висновок правильно описав дорожній знак, який вони бачили. Для інших дослідники змінили його.
Людина, яка спостерігала, як транспортний засіб наближається до знаку «стоп», тепер може прочитати, що він наближається до в’їзного знаку.
Потім дослідники дали учасникам просту інструкцію: відповідайте, спираючись на те, що ви пам’ятаєте з оригінального відео, а не на короткий зміст.
Різниця була величезна. Серед людей, які прочитали точне резюме, 83,6% правильно запам’ятали дорожній знак. Серед тих, хто прочитав неправильний висновок, зробили це лише 44,8%.
І це не був випадок, коли люди просто забули, що сталося на відео.
Учасники отримали в середньому 91,4% правильних відповідей на інші 11 запитань щодо пам’яті. Наприклад, більше 96% правильно запам’ятали, що ДТП сталася вдень – короткі подробиці не згадувалися. Правда, запам’ятати день/ніч легше, ніж дорожній знак, але загалом пам’ять учасників була досить хорошою.
За винятком того, що AI сказав їм інше.
Знання про те, що він надійшов від ШІ, не захистило людей
Ви можете очікувати, що рішення буде простим, просто скажіть людям, що висновок походить від ШІ. Напевно, вони будуть налаштовані скептично і не дуже в це віритимуть, чи не так? Люди, безперечно, оскаржуватимуть помилки ШІ.
Що ж, дослідники спробували це теж, але не вийшло.
Перш ніж прочитати резюме, деяким учасникам сказали, що воно було написано штучним інтелектом. Іншим сказали, що це надійшло від професійного переписувача. Насправді оригінальний текст в обох випадках був створений ШІ.
Це навіть не мало значення.
Дослідники також запитали учасників, наскільки вони довіряють штучному інтелекту та як часто використовують чат-боти зі штучним інтелектом. Знову ж таки, вони не знайшли вагомих доказів, щоб захистити людей від оманливого висновку.
Здається, недостатньо просто знати, що ШІ робить помилки.
«Це новий метод доставки неправдивої інформації, і він має потенціал для створення помилкових спогадів у людей, які читають цю інформацію», — сказав Маттеа Сім, один з авторів дослідження, у прес-релізі Джорджтаунського університету.
«Я вважаю, що нам потрібно дуже глибоко й критично подумати про те, чи слід використовувати штучний інтелект для агрегування інформації, особливо в умовах високого упередження», — сказав Сім.
Поганий висновок може бути небезпечним, якщо нічого не вигадати
Дослідники також перевірили, наскільки добре системи AI можуть узагальнювати відео. Вони попросили ChatGPT-5.5 і Gemini 2.5 Flash-Lite описати ті самі два 25-секундні кліпи збоїв, запустивши кожну модель п’ять разів на відео, загалом 20 висновків.
Кожен висновок мав помилки. Дехто помилився в деталях або додав речі, яких ніколи не було. Але найпоширенішим провалом був провал: в середньому моделі пропустили 51,6% центральних деталей події.
Найцікавіша проблема була й найочевиднішою. У 19 з 20 висновків взагалі не було сказано, що автомобіль збив пішохода.
Галюцинації, як правило, вважаються основною проблемою збою ШІ. Але це дослідження вказує на менш драматичну, але потенційно широко поширену проблему. Навіть якщо це не галюцинації, узагальнення ШІ можуть ввести в оману. І знову ці висновки вже всюди.
Звичайно, можна стверджувати, що ці помилки могли з’явитися завжди, навіть до ШІ. Але це не зовсім так.
Деталі, яких бракує у висновку, можуть бути менш доступними, коли особа пізніше реконструює подію. Деталі, що повторюються, легше знайти. Неправильні деталі можуть конкурувати з оригінальною річчю.
Це те, що відрізняє резюмування ШІ від звичайної помилки транскрипції. Стенограма може містити помилки на сторінці. Висновок може стати історією у вашій голові.
Оскільки ми здебільшого використовуємо резюме саме тоді, коли вихідний матеріал надто довгий, нудний або його важко переглянути. Ми зіткнулися з класичним компромісом: пожертвувати деталями заради швидкості (чи ні).
Зрештою, ШІ вже здатний надавати швидкі та надійні висновки. Нове дослідження нагадує нам, що, принаймні на даний момент, це має свою ціну.
Дослідження в arXiv і ще не розглянуто.
