ИИ впервые прошел видеотест Тьюринга
Участники эксперимента совершили короткий видеозвонок и не догадались, что на том конце провода — искусственный интеллект.

Модель искусственного интеллекта Griffin впервые прошла тест Тьюринга в формате видеочата в реальном времени, сообщил ее разработчик, калифорнийский стартап Tavus.
В эксперименте принимали участие 54 человека. В течение минуты они обсуждали по видеосвязи свои ожидания от текущего года с собеседником, о котором не знали — живой это человек или ИИ. По завершении разговора 26 испытуемых так и не поняли, что вели его с Griffin.
Большинство современных ИИ-видеоагентов работают поэтапно — одна система распознает речь, языковая модель пишет ответ, другие компоненты превращают этот ответ в голос и лицо. Каждый шаг добавляет задержку и повышает риск ошибки — поэтому такой аватар делает паузы и может продолжать улыбаться, когда его визави уже перешел к невеселой теме.
Tavus называет Griffin моделью человеческого взаимодействия. Единая система принимает ваше видео и аудио и генерирует собственные, слушая и говоря одновременно. Несколько раз в секунду она переоценивает разговор и решает, промолчать, кивнуть, сказать «угу», перебить или уступить. Ее можно прервать на полуслове, и она не потеряет нить, а также реагирует на то, что видит в камере, а не только на то, что слышит. В одном из демонстрационных роликов Tavus она помогает человеку собрать кубик Рубика, следя за его руками, а когда тот замолкает, чтобы подумать, — ждет.
Еще одна составляющая успеха — быстрый и сравнительно качественный рендеринг. Griffin генерирует весь кадр в разрешении 720p в реальном времени из одной опорной фотографии, включая руки, тени и фон, и может, по утверждению Tavus, клонировать голос примерно по 10 секундам аудио.
Исследование было проведено с нарушением условий. В классическом тесте Тьюринга испытуемые сравнивают диалоги с машиной и человеком. Участникам эксперимента Tavus сказали, что они будут говорить с другими тестируемыми, а правду сообщали по окончании видеозвонка. Кроме того, выборка невелика, беседы были короткими, а результаты не проходили рецензирования. Тем не менее, прорыв более чем ощутимый — предыдущая модель Tavus в похожем опыте убедила всего одного человека из 41.
Более объективными можно считать результаты Video Full-Duplex Benchmark от NVIDIA, который оценивает, насколько естественно модель выстраивает разговорное поведение и насколько хорошо она считывает собеседника. По этому тесту Griffin-Lite стала первой среди всех аналогичных ИИ, набрав 3,83 из 5 баллов по генерации (живые люди — 3,92) и 3,73 по восприятию (человеческий эталон — 4,20). Этот разрыв важнее — он значит, что Griffin близок к человеку в том, чтобы вести свою сторону разговора, и заметно в считывании собеседника.
Новая модель пока доступна ограниченному кругу бета-тестеров. Впечатляющие результаты эксперимента вынудили Tavus задержать релиз до тех пор, пока компания не найдет надежный способ предотвратить использование своего продукта в криминальных целях.
Психологи научили людей идеально отличать настоящие лица от нарисованных ИИ
Ученые впервые изучили общение людей с «цифровыми призраками»
ИИ впервые превзошел человека в классическом тесте Тьюринга
Подписывайтесь и читайте «Науку» в MAX













