Модель Griffin от Tavus заставила 48% участников видеозвонка ошибочно считать, что они общаются с реальным человеком
AI стартап Tavus 1 октября выпустил новую модель Griffin, назвав её первой "моделью человеческого взаимодействия", которая может понимать и генерировать лицом к лицу диалоги, обращая внимание не только на слова, но и на выражения лиц и паузы. Tavus заявляет, что в тестировании 54 участника после одной минуты видеозвонка с Griffin-Lite 26 человек (48%) считали собеседника настоящим человеком; в предыдущей версии системы только 1 из 41 участника поверил в это.Участникам было сказано, что они будут вести минутный видеозвонок с другим человеком, обсуждая ожидаемые события этого года, и только в конце звонка их спрашивали, сомневаются ли они, что собеседник не является настоящим человеком. Tavus утверждает, что те, кто начал сомневаться, обычно замечали это в течение 20 секунд. Эти результаты были получены из собственных исследований Tavus, участники были набраны через их канал, называемый независимой исследовательской платформой. Комментарии сообщества на X указывают на то, что эти результаты не были независимо проверены и не соответствуют стандартным протоколам.В бенчмаркинге VideoFDB от NVIDIA Tavus утверждает, что Griffin-Lite занял первое место, его оценка по генеративному измерению составила 3.83, у второго по качеству системы — 2.8, а у человеческого эталона — 3.92; оценка по восприятию составила 3.73, у самого сильного базового уровня — 3.44, у человеческого эталона — 4.2, Tavus утверждает, что NVIDIA независимо провела эту оценку. Griffin поддерживает полный дуплекс, может одновременно слушать, смотреть и говорить, при этом задержка аудио и видео на чипе NVIDIA H100 в среднем составляет 0.43 секунды. Tavus завершил раунд финансирования B на сумму 40 миллионов долларов, возглавляемый CRV, в ноябре 2025 года.