- Tavus создала ИИ, который видит, слышит и говорит одновременно.
- Griffin прошла тест Тьюринга и обогнала 15 моделей в тесте NVIDIA.
- 48% людей не распознали ИИ во время видеозвонка.
Компания Tavus представила Griffin — модель нового класса Human Interaction Model (HIM), которая в режиме реального времени может одновременно видеть, слышать, говорить и реагировать на невербальные сигналы собеседника. Разработчики называют ее первой моделью, которая прошла видеотест Тьюринга.
Introducing Griffin, the first model to pass the video Turing test.
— Tavus (@tavus) October 1, 2026
48% of people who talked to it live thought it was a real human. Previous systems have had a pass rate <3%. It is #1 on NVIDIA's benchmark for full-duplex AI video.
It’s the first Human Interaction Model (HIM). pic.twitter.com/eb11XbC8Xr
Во время тестирования 48% участников одноминутного видеоразговора считали, что общаются с реальным человеком, тогда как предыдущая система Tavus имела показатель 2,4%.
Модель пока доступна только ограниченной группе тестировщиков в формате исследовательского превью. Tavus отмечает, что перед публичным релизом необходимо решить ряд вопросов безопасности, поскольку способность Griffin выдавать себя за человека создает дополнительные риски.
Griffin одновременно видит, слышит и реагирует
Griffin построена как полнодуплексная система video-to-video. В отличие от каскадных систем, которые сначала распознают речь, затем генерируют ответ и только после этого озвучивают его, Griffin принимает решения на регулярных субсекундных интервалах.
- реагировать на паузы, взгляд, мимику и жесты собеседника;
- прерывать или поддерживать разговор, не теряя контекст;
- одновременно слушать и говорить;
- видеть предметы или окружающую среду и учитывать их в ответе;
- менять тон голоса, мимику и жесты в соответствии с ситуацией;
- понимать длительность паузы и самостоятельно определять момент для ответа.
Tavus продемонстрировала это на практике. Griffin могла играть в Simon Says, одновременно следя за словами и движениями собеседников. В другой демонстрации модель интегрировала показанного в камеру павлина в сюжет разговора. Также она помогала собирать кубик Рубика, ориентируясь на движения рук, и сопровождала работу с паяльником, отслеживая время.
Система состоит из двух основных компонентов: Continuous Conversational Modeling, который анализирует аудио и видео и определяет, когда и как отвечать, и Audio-Visual Generation, который преобразует эти сигналы в речь и видео.
По данным Tavus, Griffin-Lite генерирует видео 720p фрагментами по 320 мс в режиме реального времени. На графических процессорах H100 средняя задержка составила 0,43 секунды — примерно вдвое меньше, чем у следующего по скорости метода в тесте.
Griffin опередила другие модели в тестах NVIDIA
В независимом тестировании NVIDIA VideoFDB, предназначенном для оценки полнодуплексного аудиовизуального взаимодействия, Griffin-Lite заняла первое место среди 15 оцененных моделей.
В треке генерации модель получила 3,83 балла против 3,92 у человеческого эталона, а в треке восприятия — 3,73 балла. Также Griffin показала самый высокий показатель соответствия моменту, когда модель начинает говорить: 62,8% в генерации и 73,8% в восприятии.
Наиболее показательным стал тест с 54 участниками. После минутного видеозвонка 26 человек, или 48%, заявили, что их собеседником был реальный человек. Для предыдущей системы Phoenix-4.5 в сочетании со Sparrow-2 и Raven-1 этот показатель составлял 2,4% — лишь один из 41 участника.
В то же время более половины участников Griffin-Lite вообще не задумывались во время разговора, что могут общаться с ИИ. Те, кто заподозрил искусственное происхождение собеседника, обычно делали это в течение первых 20 секунд.
Именно способность Griffin убедительно имитировать человека стала причиной ограниченного доступа к модели. В Tavus заявили, что компания работает над функциями безопасного раскрытия ИИ и дополнительными процедурами оценки рисков.
«Те же свойства, которые делают Human Interaction Models мощными интерфейсами для естественной коммуникации между человеком и машиной, позволяют им обманом заставить человека поверить, что перед ним не ИИ», — отметили разработчики.
Tavus планирует более широкий релиз более мощной версии Griffin после решения вопросов безопасности.
- Anthropic представила более дешевую и более быструю ИИ-модель Claude Opus 5.5;
- OpenAI представила GPT-6 Sol и Luna с более низкой стоимостью использования;
- Google выпустила Gemini 4 Argon с миллионом токенов и киберзащитой без ограничений.
Сообщение ИИ прошел видеотест Тьюринга: Tavus представила модель Griffin появились сначала на INCRYPTED.