• Tavus создала ИИ, который видит, слышит и говорит одновременно.
  • Griffin прошла тест Тьюринга и обогнала 15 моделей в тесте NVIDIA.
  • 48% людей не распознали ИИ во время видеозвонка.

Компания Tavus представила Griffin — модель нового класса Human Interaction Model (HIM), которая в режиме реального времени может одновременно видеть, слышать, говорить и реагировать на невербальные сигналы собеседника. Разработчики называют ее первой моделью, которая прошла видеотест Тьюринга.

Introducing Griffin, the first model to pass the video Turing test.

48% of people who talked to it live thought it was a real human. Previous systems have had a pass rate <3%. It is #1 on NVIDIA's benchmark for full-duplex AI video.

It’s the first Human Interaction Model (HIM). pic.twitter.com/eb11XbC8Xr

— Tavus (@tavus) October 1, 2026

Во время тестирования 48% участников одноминутного видеоразговора считали, что общаются с реальным человеком, тогда как предыдущая система Tavus имела показатель 2,4%. 

Модель пока доступна только ограниченной группе тестировщиков в формате исследовательского превью. Tavus отмечает, что перед публичным релизом необходимо решить ряд вопросов безопасности, поскольку способность Griffin выдавать себя за человека создает дополнительные риски.

Griffin одновременно видит, слышит и реагирует

Griffin построена как полнодуплексная система video-to-video. В отличие от каскадных систем, которые сначала распознают речь, затем генерируют ответ и только после этого озвучивают его, Griffin принимает решения на регулярных субсекундных интервалах.

  • реагировать на паузы, взгляд, мимику и жесты собеседника;
  • прерывать или поддерживать разговор, не теряя контекст;
  • одновременно слушать и говорить;
  • видеть предметы или окружающую среду и учитывать их в ответе;
  • менять тон голоса, мимику и жесты в соответствии с ситуацией;
  • понимать длительность паузы и самостоятельно определять момент для ответа.

Tavus продемонстрировала это на практике. Griffin могла играть в Simon Says, одновременно следя за словами и движениями собеседников. В другой демонстрации модель интегрировала показанного в камеру павлина в сюжет разговора. Также она помогала собирать кубик Рубика, ориентируясь на движения рук, и сопровождала работу с паяльником, отслеживая время.

Система состоит из двух основных компонентов: Continuous Conversational Modeling, который анализирует аудио и видео и определяет, когда и как отвечать, и Audio-Visual Generation, который преобразует эти сигналы в речь и видео.

По данным Tavus, Griffin-Lite генерирует видео 720p фрагментами по 320 мс в режиме реального времени. На графических процессорах H100 средняя задержка составила 0,43 секунды — примерно вдвое меньше, чем у следующего по скорости метода в тесте.

Griffin опередила другие модели в тестах NVIDIA

В независимом тестировании NVIDIA VideoFDB, предназначенном для оценки полнодуплексного аудиовизуального взаимодействия, Griffin-Lite заняла первое место среди 15 оцененных моделей.

В треке генерации модель получила 3,83 балла против 3,92 у человеческого эталона, а в треке восприятия — 3,73 балла. Также Griffin показала самый высокий показатель соответствия моменту, когда модель начинает говорить: 62,8% в генерации и 73,8% в восприятии.

Показатели Griffin-Lite в рейтинге NVIDIA VideoFDB. Источник: Tavus.

Наиболее показательным стал тест с 54 участниками. После минутного видеозвонка 26 человек, или 48%, заявили, что их собеседником был реальный человек. Для предыдущей системы Phoenix-4.5 в сочетании со Sparrow-2 и Raven-1 этот показатель составлял 2,4% — лишь один из 41 участника.

В то же время более половины участников Griffin-Lite вообще не задумывались во время разговора, что могут общаться с ИИ. Те, кто заподозрил искусственное происхождение собеседника, обычно делали это в течение первых 20 секунд.

Именно способность Griffin убедительно имитировать человека стала причиной ограниченного доступа к модели. В Tavus заявили, что компания работает над функциями безопасного раскрытия ИИ и дополнительными процедурами оценки рисков.

«Те же свойства, которые делают Human Interaction Models мощными интерфейсами для естественной коммуникации между человеком и машиной, позволяют им обманом заставить человека поверить, что перед ним не ИИ», — отметили разработчики.

Tavus планирует более широкий релиз более мощной версии Griffin после решения вопросов безопасности.

  • Anthropic представила более дешевую и более быструю ИИ-модель Claude Opus 5.5;
  • OpenAI представила GPT-6 Sol и Luna с более низкой стоимостью использования;
  • Google выпустила Gemini 4 Argon с миллионом токенов и киберзащитой без ограничений.

Сообщение ИИ прошел видеотест Тьюринга: Tavus представила модель Griffin появились сначала на INCRYPTED.