Возможна ли полная замена живых актеров цифровыми? Рассказывает кандидат экономических наук, доцент кафедры математики и анализа данных Финансового университета при Правительстве РФ Фомичева Татьяна Леонидовна. Этот вопрос возник с появлением фотореалистичной компьютерной графики, но активно стал обсуждаться несколько лет назад. Специально обученные нейросети стали массово выдавать сгенерированные ими картинки и видео, появилась технология «дипфейков», когда реально существующие люди говорят слова и совершают поступки, никогда не существовавшие в реальности, стали создаваться антропоморфные роботы, максимально похожие на людей, пытающиеся воспроизводить мимику. Режиссеры стали мечтать о фильмах и театральных постановках с полностью цифровым кастингом, где цифровые актеры и андроиды смогли бы полностью воплощать все их требования и пожелания. Что же из этого стало реальным?
Было создано уже немало как успешных, так и полностью провальных фильмов, и спектаклей. Причем, успеха добились произведения, где образ, созданный искусственно, подавался в «мультяшной» форме или изначально позиционировался, как искусственный, имеющий лишь определенное сходство с человеком. Провал же потерпели те создания, где авторы пытались придать искусственному существу максимальное сходство с человеком, в пределах сегодняшних технологий, и позиционировать его, как человека.
Еще в 1970 году японский инженер-исследователь в области робототехники М.Мори в своем эссе «Феномен «зловещей долины» описал нелинейную зависимость между человекоподобием роботов и эмоциональной реакцией людей на них. Сначала умеренно человекоподобные роботы по мере усиления их схожести с человеком смотрятся привлекательнее и вызывают положительные эмоции симпатии и эмпатии. Однако, при достижении ими определённого предела «почти полного человекоподобия» следует сильнейший эмоциональный провал привлекательности (и названный им «зловещей долиной»). Такие роботы вызывают дискомфорт, чувства тревожности, отвращения и другие отрицательные эмоции из-за микронесоответствий реальности. В дальнейшем выражение породило непреднамеренную ассоциацию с психоаналитической традицией исследования «жуткого».
Чтобы объяснить когнитивный механизм эффекта предлагались различные теории, сгруппированные по различным параметрам.
Эволюционные гипотезы. Гипотеза избегания патогенов предполагает, что при максимальной схожести с человеком экстремально значимыми становятся атипичные детали: искаженная симметрия лица, нарушения моторики и микродвижений, неестественность кожи, «мертвые глаза» и т.д. Подсознательно это может интерпретироваться как признаки болезни и угрозы заражения, что вызывает реакцию избегания. В гипотезе напоминания о смертности человекоподобный робот предстает как «ожившая оболочка» или доппельгангер, нарушающий границу между живым и неживым и тем самым провоцирующий подсознательный страх собственной смертности.
Перцептивные и когнитивные гипотезы. Согласно гипотезе нарушения человеческих норм и предиктивного кодирования по мере того, как объект приближается к человеческому образу, мы включаем «другого человека», с нормативные ожидания о микродвижениях, пластике, синхронности речи и мимики и пр. Даже незначительные отклонения становятся чрезвычайно заметными, поскольку воспринимаются аномалией у человека, а не у машины. Гипотеза конфликта перцептивных сигналов, когда негативный эффект возникает из-за одновременной активации конфликтующих когнитивных впечатлений. Например, фотореалистичное лицо, но роботизированная кинематика движений или синтетический голос несоответствующий человеческой мимике конфликт, субъективно оцениваемый как дискомфорт и «жуткость».
Эмпирические данные исследований в значительной мере согласуются с этой гипотезой. Так, время, необходимое для идентификации лица как «человеческим» или «роботизированным», достигает максимума именно в наиболее «жутком» диапазоне стимулов.
Социально-психологические гипотезы. Гипотеза угрозы человеческой идентичности - чем более объект схож с реальным человеком, тем более размывается граница между человеком и не-человеком, что воспринимается как человеческой уникальности.
Гипотеза «зловещей долины разума» основана на атрибуции ментальных состояний. Когда почти человекообразные объекты демонстрируют признаки эмоций и субъективного переживания мы можем пережить сильный диссонанс, т.к. сознаем, что фактически это неживая машина.
Скорее всего нельзя выделить какую-то одну гипотезу, как единственно правильную. Вероятнее всего «зловещая долина» это комплексный эффект, а предпочтительная гипотеза зависит от конкретной индивидуальной личности опрашиваемого.
Так возможно ли преодоление «проклятья зловещей долины»? На теперешнем уровне в инженерной практике и дизайне виртуальных персонажей на первый план выходит не столько достижение максимального реализма как такового, сколько обеспечение согласованности реализма между различными элементами образа и поведения. Так, одной из самых частых причин эффекта становится рассогласованность внешности и поведения. Т.е. степень реализма внешности должна соответствовать реалистичности движений, мимики, речи и сценариев взаимодействия. Иногда стратегически оправдано ограничить уровень антропоморфизма или подчеркнуть искусственную природу агента, чтобы зритель не судил его поведение по «человеческим» меркам. Необходимо согласовывать анатомию персонажа с возможностью текстур: так фотореалистичные текстуры кожи требуют человеческих пропорций лица, и, наоборот, стилизованные пропорции безопаснее сочетаются со стилизованной поверхностью и упрощённой детализацией.
М.Мори еще в своей первоначальной гипотезе предполагал, что по мере развития технологий, смогут быть устранены существующие микроразличия, такие как неестественность кожи, микромимика, мертвенность взгляда и прочие, и при еще более полном совпадении внешности и поведения людей и андроидов, последние будут вновь вызывать положительные эмоции.
А в конечном итоге, все зависит от создателя произведения и образа - сможет ли он пройти по тонкой грани ограничений «зловещей долины» и превратить ее недостатки в достоинства.