Как мы понимаем, что собеседник нас понимает? В речи мы опираемся на нюансы — на изменение тона, на уместную паузу, эмоциональный ответ.
Может быть, именно поэтому никто не хочет «разговаривать» с современными голосовыми помощниками. Пару вопросов-ответов — ОК, а вести долгий диалог — утомительно.
Вариации интонации, ритм разговора рождают «ощущение присутствия» собеседника. Именно его пытаются достичь ученые в стартапе Sesame. Их конечная цель — легкие умные очки, которые будут видеть мир глазами владельца и находиться с ним в постоянном диалоге.
Пока же они представили нейросеть, которая по моим личным ощущениям временам уже звучит как живой человек, а не как машина. Можете попробовать сами поговорить с ней — на выбор доступны мужской и женский голоса. Язык пока что только английский, хотя она чуть-чуть понимает русский.
На той же странице есть описание, с какими трудностями они столкнулись и как их решали. Обещают в ближайшее время выпустить модель в опен-сорс.
Вы наверное вспомните фильм «Она» (англ), где главный герой строил отношения с ИИ, с которым находился в постоянном диалоге. Это была и моя первая реакция, когда я прочитал на эту новость вчера.
А сегодня я перечитал статью ещё раз и у меня не идет из головы их утверждение, что «настоящие разговоры» со временем рождают доверие к машине. Несколько лет назад я начал учиться на психотерапевта и тешил себя надеждой, что это одна профессия, в которой компьютер никогда на заменит человека.
Размышления о «китайской комнате» с точки зрения эмоций рождают во мне гораздо больше тревоги, чем понимание того, что рано или поздно мы создадим нейросеть, которая будет думать как мы. Что нам делать, если она будет ещё и чувствовать как мы?
Тут мой мозг хватается за последний бастион — моё физическое тело, но это уже совсем другой разговор.
P. S. Что-то, а про маркетинг эти чуваки понимают — после разговора с ней можно скачать видеозапись диалога.