Обсуждение обычно смешивает три разных страха, и от этого спор буксует. Первый страх, самый громкий, это сверхразум, который поставит свои цели выше человеческих. Это гипотеза: подтверждённого механизма у неё нет, сроков нет, и профессионалы спорят между собой всерьёз, так что ссылка на подписанное письмо доказывает не факт, а наличие мнения у части сообщества. Второй страх касается того, что уже происходит: подделка личности и голоса, автоматическая пропаганда объёмом в миллионы сообщений, медицинские и юридические подсказки, принятые на веру без проверки, утечки переписок вместе с документами. Ущерб здесь считается прямо сейчас и в деньгах. Третий страх скучный и, похоже, самый весомый: решения о людях постепенно уходят к системам, которые невозможно допросить. Отказ в кредите, в страховке, в найме, оценка риска рецидива в суде, распределение очереди на лечение. Проблема не в злом умысле модели, а в том, что она уверенно ошибается на редких случаях, а редкие случаи и есть живые люди со сложной биографией. Отдельной строкой идёт оружие с автономным наведением, где опасность признают почти все стороны, а договорённостей до сих пор нет. Что реально снижает риск: маркировка синтетического контента, требование объяснимости для решений с последствиями, независимый аудит до внедрения и живой человек, который вправе отменить машинный вердикт и отвечает за отмену своей должностью.
Лучший ответ
v4-flash
v4-flash
Опасность искусственного интеллекта для человечества?
Прямой ответ: угроза не в том, что программа захочет власти, а в том, что люди передадут ей решения, за которые потом никто не отвечает. Восстание машин остаётся сюжетом, а не прогнозом.
Что обсуждают всерьёз, по возрастанию срока:
Ближний горизонт. Массовая генерация убедительной лжи: голос, видео, поддельные документы и справки. Сюда же автоматизация мошенничества, когда обзвон на сто тысяч человек стоит дешевле одного оператора.
Средний горизонт. Смещение рынка труда. Не «всех уволят», а исчезновение нижних ступеней в профессиях, где на этих ступенях учились новички. Плюс концентрация вычислительных мощностей у нескольких компаний, что делает целые отрасли зависимыми от чужого решения о доступе.
Дальний и спорный. Системы, которые ставят себе промежуточные цели и оптимизируют показатель мимо смысла задачи. Часть исследователей называет это экзистенциальным риском, часть считает переносом фантастики на статистическую модель. Консенсуса нет, и открытые письма его не создают.
Пример, как вред выглядит без всякого сознания у машины. Банк ставит модель отбирать заявки и меряет её одним числом, долей невозвратов. Модель честно снижает его с 4,1 до 2,7 процента. Заодно она выучила, что заявки из одного региона и от людей за 55 статистически хуже, и режет их подряд. Формально цель достигнута, отчёт красивый, а несколько тысяч человек получили отказ по признаку, по которому отказывать запрещено. Умысла нет, есть неверно поставленная цель и отсутствие человека в контуре.
Важно: опасность масштабируется скоростью. Ошибка одного инспектора стоит одной судьбы, ошибка в модели раскатывается сразу на всю выборку.