Майже половина учасників тестування сплутали відеоаватара Tavus зі справжньою людиною під час одноминутного дзвінка
Tavus представила Griffin — те, що компанія називає першою «моделлю взаємодії з людиною» (HIM), класом моделей, розроблених для розуміння та ведення розмов віч-на-віч у реальному часі. Griffin обробляє мовлення, вирази обличчя, тон голосу, жести й паузи, одночасно отримуючи та генеруючи відео.
У дослідженні Tavus 48 відсотків учасників повірили, що Griffin — справжня людина, після одноминутного відеодзвінка. Попередні системи досягали максимуму лише у два відсотки. У тесті Nvidia, який Tavus описує як незалежне вимірювання того, наскільки людяним сприймається ШІ під час безпосередньої аудіовідеорозмови, Griffin набрав 3,83 бала. Справжні люди отримали 3,92 бала, а попередня найкраща модель ШІ — 2,80.
Попередня версія під назвою Griffin-Lite доступна «вибраним тестувальникам як дослідницький попередній перегляд», а потужніша версія з’явиться після того, як «буде розв’язано питання безпеки». Tavus називає потенційними варіантами використання репетиторство, практику складних розмов і технічну підтримку за допомогою камери.
Сан-франциський ШІ-стартап був заснований у 2020 році та залучив близько 64 мільйонів доларів. Спочатку компанія створювала персоналізовані відео на основі ШІ для продажів і маркетингу, а потім розширила діяльність, додавши відеорозмови наживо з цифровими персонажами. Докладніше про Griffin можна дізнатися у дослідницькому звіті Tavus.
Новини про ШІ без галасу — відібрані людьми
Підпишіться на THE DECODER, щоб читати матеріали без реклами, отримувати щотижневу розсилку про ШІ, наш ексклюзивний звіт про передові розробки «AI Radar» шість разів на рік, повний доступ до архіву та доступ до розділу коментарів.
Перекладено автоматично з англійської. Оригінал статті — за посиланням нижче.