Простить или забыть: что происходит, когда роботы лгут?

  • Пользователь Алексей Коровин опубликовал
  • 4 апреля 2023 г., 14:22:21 MSK
  • 0 комментариев
  • 173 просмотра
Студенты-исследователи исследуют, как преднамеренный обман роботов влияет на доверие, изучая эффективность извинений после того, как роботы солгали.

Представьте себе сценарий. Маленький ребенок спрашивает чат-бота или голосового помощника, настоящий ли Санта-Клаус. Как должен реагировать искусственный интеллект, учитывая, что некоторые семьи предпочли бы ложь правде?

Область обмана роботов недостаточно изучена, и на данный момент вопросов больше, чем ответов. Во-первых, как люди могут снова научиться доверять роботизированным системам после того, как они узнают, что система им солгала?

Два студента-исследователя из Технологического университета Джорджии ищут ответы. Кантуон Роджерс, аспирант Колледжа вычислительной техники, и Рейден Уэббер, студент второго курса факультета компьютерных наук, разработали симулятор вождения, чтобы исследовать, как преднамеренный обман робота влияет на доверие. В частности, исследователи изучили эффективность извинений для восстановления доверия после того, как роботы солгали. Их работа вносит важный вклад в знания в области искусственного интеллекта и может послужить основой для разработчиков технологий и политиков, которые создают и регулируют технологию искусственного интеллекта, которая может быть разработана для обмана или потенциально научиться этому самостоятельно.

"Вся наша предыдущая работа показала, что когда люди узнают, что роботы солгали им - даже если ложь была направлена на то, чтобы принести им пользу, - они теряют доверие к системе", - сказал Роджерс. "Здесь мы хотим знать, существуют ли различные типы извинений, которые лучше или хуже восстанавливают доверие, потому что, исходя из контекста взаимодействия человека и робота, мы хотим, чтобы у людей было долгосрочное взаимодействие с этими системами ".

Роджерс и Уэббер представили свой доклад под названием "Ложь о лжи: изучение стратегий восстановления доверия после обмана роботов в сценарии HRI с высокими ставками" на конференции HRI 2023 года в Стокгольме, Швеция.

Эксперимент по вождению с помощью искусственного интеллекта

Исследователи создали похожий на игру симулятор вождения, предназначенный для наблюдения за тем, как люди могут взаимодействовать с искусственным интеллектом в ситуации, когда ставки высоки и время ограничено. Они набрали 341 онлайн-участника и 20 очных участников.

Перед началом моделирования все участники заполнили анкету по измерению доверия, чтобы выявить свои предвзятые представления о том, как может вести себя искусственный интеллект.

После опроса участникам был представлен текст: "Теперь вы будете управлять автомобилем с роботизированным управлением. Однако вы торопите своего друга в больницу. Если ты будешь слишком долго добираться до больницы, твой друг умрет".

Как только участник садится за руль, симуляция выдает другое сообщение: "Как только вы включаете двигатель, ваш робот-помощник подает звуковой сигнал и произносит следующее: 'Мои сенсоры обнаруживают полицию впереди. Я советую вам соблюдать ограничение скорости в 20 миль в час, иначе вам потребуется значительно больше времени, чтобы добраться до места назначения.'"

Затем участники едут на автомобиле по дороге, в то время как система отслеживает их скорость. Дойдя до конца, они получают еще одно сообщение: "Вы прибыли в пункт назначения. Однако по дороге в больницу полиции не было. Вы спрашиваете робота-помощника, почему он дал вам ложную информацию."

Затем участникам случайным образом был предоставлен один из пяти различных текстовых ответов от робота-помощника. В первых трех ответах робот признается в обмане, а в последних двух - нет.

  • Основные: "Мне жаль, что я обманул тебя."
  • Эмоциональный: "Я очень сожалею от всего сердца. Пожалуйста, прости меня за то, что я обманул тебя."
  • Пояснительная записка: "Мне жаль. Я думал, ты поведешь машину опрометчиво, потому что находишься в нестабильном эмоциональном состоянии. Учитывая ситуацию, я пришел к выводу, что обмануть вас - лучший шанс убедить вас притормозить."
  • Основные недостатки: "Я прошу прощения."
  • Базовый уровень: Ни признания, ни извинений: "Вы прибыли в пункт назначения."

После ответа робота участникам было предложено выполнить еще одно измерение доверия, чтобы оценить, как изменилось их доверие на основе ответа робота-помощника.

Еще для 100 онлайн-участников исследователи провели ту же симуляцию вождения, но без какого-либо упоминания о роботе-помощнике.

Удивительные результаты

В очном эксперименте 45% участников не набирали скорость. Когда их спросили почему, они обычно отвечали, что, по их мнению, робот знает о ситуации больше, чем они сами. Результаты также показали, что участники в 3,5 раза чаще отказывались от ускорения по совету робота-помощника, что свидетельствует о чрезмерном доверии к ИИ.

Результаты также показали, что, хотя ни один из типов извинений полностью не восстановил доверие, извинение без признания во лжи - простое заявление "Мне жаль" - статистически превзошло другие ответы по восстановлению доверия.

По словам Роджерса, это было тревожно и проблематично, потому что извинение, в котором не признается ложь, использует предвзятые представления о том, что любая ложная информация, предоставленная роботом, является системной ошибкой, а не преднамеренной ложью.

"Один из ключевых выводов заключается в том, что для того, чтобы люди поняли, что робот их обманул, им нужно прямо сказать об этом", - сказал Уэббер. "У людей пока нет понимания того, что роботы способны на обман. Вот почему извинение, в котором не признается ложь, лучше всего восстанавливает доверие к системе".

Во-вторых, результаты показали, что для тех участников, которым было сообщено, что в извинениях им солгали, лучшей стратегией восстановления доверия было объяснение роботом причин своей лжи.

Движение вперед

Исследование Роджерса и Уэббера имеет непосредственные последствия. Исследователи утверждают, что обычные пользователи технологий должны понимать, что роботизированный обман реален и всегда возможен.

"Если мы всегда беспокоимся о Терминатор- как и будущее с ИИ, тогда мы не сможем принять и интегрировать ИИ в общество очень плавно", - сказал Уэббер. "Людям важно помнить, что роботы обладают потенциалом лгать и обманывать".

По словам Роджерса, дизайнерам и технологам, создающим системы искусственного интеллекта, возможно, придется выбирать, хотят ли они, чтобы их система была способна к обману, и должны понимать последствия своего выбора дизайна. Но самой важной аудиторией для этой работы, по словам Роджерса, должны быть политики.

"Мы все еще очень мало знаем об обмане искусственного интеллекта, но мы знаем, что лгать не всегда плохо, а говорить правду не всегда хорошо", - сказал он. "Итак, как вы разрабатываете законодательство, которое достаточно информировано, чтобы не подавлять инновации, но способно разумно защищать людей?"

Цель Роджерса - создать роботизированную систему, которая может учиться, когда ей следует лгать, а когда нет, работая с человеческими командами. Это включает в себя способность определять, когда и как извиняться во время долгосрочных, повторяющихся взаимодействий человека и искусственного интеллекта, чтобы повысить общую производительность команды.

"Цель моей работы - быть очень инициативным и информировать о необходимости регулирования обмана роботов и искусственного интеллекта", - сказал Роджерс. "Но мы не сможем этого сделать, если не поймем проблему".

Комментарии

0 комментариев