Tavus представила Griffin: в её тесте 48% приняли ИИ-аватар за человека

Калифорнийский стартап Tavus представил Griffin, модель, которую компания называет первой «Human Interaction Model» (HIM, модель человеческого взаимодействия). Это класс моделей, рассчитанных на то, чтобы понимать лицевой разговор и вести его в реальном времени. Griffin обрабатывает речь, мимику, тон голоса, жесты и паузы, одновременно принимая и генерируя видео.
Главная цифра: в исследовании Tavus 48% участников после минутного видеозвонка решили, что Griffin, настоящий человек. Прежние системы, как сказано в материале, не поднимались выше двух процентов.
Второе измерение, тест, который Tavus описывает как независимый тест Nvidia: он оценивает, насколько «человечным» ИИ ощущается в прямом аудио-видеоразговоре. Griffin набрал 3,83 балла, реальные люди, 3,92, а лучшая из прежних ИИ-моделей, 2,80.
Предварительная версия Griffin-Lite доступна «избранным тестировщикам в качестве исследовательского превью»; более мощная версия появится, когда будут решены «вопросы безопасности». Среди возможных сценариев Tavus называет репетиторство, отработку трудных разговоров и техподдержку через камеру.
Tavus основана в 2020 году в Сан-Франциско и привлекла около $64 млн. Начинала со стартапа персонализированных ИИ-видео для продаж и маркетинга, затем перешла к живым видеоразговорам с цифровыми персонами. Подробности о Griffin компания изложила в своём исследовательском отчёте.
Ключевые факты
- Tavus представила Griffin, по её словам, первую «Human Interaction Model» для живого видеоразговора: модель обрабатывает речь, мимику, тон голоса, жесты и паузы и сама генерирует видео.
- В исследовании Tavus 48% участников после минутного видеозвонка сочли Griffin настоящим человеком; прежние системы, по тексту, давали максимум 2%.
- В тесте, который Tavus называет независимым тестом Nvidia, Griffin получил 3,83 балла против 3,92 у людей и 2,80 у лучшей прежней ИИ-модели.
- Доступна только предварительная версия Griffin-Lite для избранных тестировщиков; более мощную версию обещают после решения вопросов безопасности.
- Tavus основана в 2020 году, привлекла около $64 млн; заявленные сценарии, репетиторство, отработка трудных разговоров, техподдержка через камеру.
Почему это важно
Если результаты Tavus верны, ИИ-собеседник на видео вплотную приблизился к тому, чтобы его не отличали от человека: 48% против максимум 2% у прежних систем в том же типе проверки. В тесте, который Tavus приписывает Nvidia, разрыв с людьми невелик: 3,83 против 3,92 балла, тогда как лучшая прежняя ИИ-модель набрала 2,80.
Кому это важно
Разработчикам и компаниям, которые строят цифровых персон и видеоагентов; командам, интересующимся обучением, тренировкой сложных разговоров и поддержкой по видео, именно эти сценарии называет сама Tavus. Также тем, кого заботят вопросы распознавания ИИ в видеозвонках.
Как это применить
Пока практически никак: доступна лишь Griffin-Lite в формате исследовательского превью для избранных тестировщиков. Цены и общая доступность в материале не названы, срок выхода более мощной версии не указан.
Можно ли доверять
Обе ключевые цифры исходят от самой Tavus. Тест Nvidia назван «независимым» только по описанию компании; материал не подтверждает роль Nvidia отдельно. Число участников исследования, их состав, методика и шкала теста Nvidia не раскрыты, а прежние системы, с которыми сравнивали Griffin, не названы.
Риски и подводные камни
Сама Tavus связывает выпуск более мощной версии с решением «вопросов безопасности», но в чём они состоят, в материале не сказано. Результат касается минутного звонка и не говорит о более длинных разговорах. Данные пока не проверены независимо.
«для избранных тестировщиков в качестве исследовательского превью»
— Tavus о доступности Griffin-Lite (в пересказе The Decoder)