Наука пояснює світ і формує майбутнє
Новини науки Розповідаємо про науку з 2011 року
Штучний інтелект

Люди часто не можуть відрізнити моральне судження ШІ від людського — але менше довіряють йому, якщо думають, що це машина

Люди часто не можуть відрізнити моральне судження ШІ від людського — але менше довіряють йому, якщо думають, що це машина

Чи можна впізнати моральне судження, написане штучним інтелектом? Серія експериментів, опублікована в PLOS One і представлена Google DeepMind, показала: люди справді вгадують джерело трохи краще за випадковість, але точність залишається нижчою за 75%. Ще цікавіше те, що сама віра в «машинне» походження відповіді впливає на згоду з нею.

Учасникам показували обґрунтування моральних і неморальних рішень, створені людьми або великими мовними моделями. Після цього вони мали визначити джерело та оцінити, наскільки погоджуються з аргументом.

Анти-ШІ упередження працювало незалежно від справжнього автора

Коли люди вважали, що текст написаний ШІ, вони систематично менше погоджувалися з ним — навіть якщо насправді його створила людина.

Водночас загальної переваги людських відповідей за змістом не було. У складних моральних сценаріях машинні обґрунтування інколи навіть отримували вищі оцінки, якщо учасник не знав або неправильно вгадував їхнє походження.

На сприйняття впливали й мовні ознаки: довжина відповіді, друкарські помилки, займенник «я» та лексика, пов’язана з підрахунком користі й шкоди.

Чому це важливо для реальних систем

Мовні моделі дедалі частіше використовують як помічників у медицині, транспорті, праві та інших сферах, де рішення можуть мати моральний компонент.

Якщо одна й та сама аргументація оцінюється по-різному залежно від ярлика «людина» або «ШІ», це означає, що довіра формується не лише якістю самої відповіді.

Результат не доводить, що ШІ має моральне розуміння або здатний самостійно приймати етичні рішення. Модель може відтворювати переконливі аргументи без людського досвіду, відповідальності чи цінностей.

Але експеримент показує іншу важливу річ: у майбутньому дизайн інтерфейсів має враховувати, як інформація про джерело змінює людське судження. Прозорість щодо використання ШІ потрібна, але сам ярлик може викликати сильну психологічну реакцію, яку варто розуміти й вимірювати.

Подібний ефект має значення і для політики використання ШІ. Якщо люди систематично знижують оцінку лише через машинне походження тексту, це може призвести як до необґрунтованої недовіри, так і до хибної довіри до «людського» ярлика. Тому якість аргументу та перевірка фактичних підстав мають залишатися важливішими за припущення про автора.