Sakhanda Wire
NVDA $230.86 +1.09% MSFT $512.80 -0.02% GOOGL $338.24 -1.70% META $725.93 +0.10% AMZN $248.23 -0.37%
← Към новините

Създадох свой интерактивен дигитален аватар — и можете да разговаряте с него

Когато Александру Войка, ръководител на корпоративните въпроси в стартъпа за генериране на видео Synthesia, ми изпрати това лято линк към най-новото попълнение в PR екипа им, бях изненадана. Това беше интерактивен виртуален аватар на самия него, обучен да отговаря на често задавани журналистически въпроси за Synthesia — например с какво се занимава компанията и как работи. Ден по-рано участвах в панел, на който PR специалисти ме питаха дали имам нещо против предложения, написани с помощта на генериран от AI текст. Но аватарът на Александру беше нещо повече — за мен това изглеждаше като финалния бос на използването на AI в PR. 

През септември Synthesia ме покани в новото си офис пространство в Ню Йорк. Първоначално базирана във Великобритания, Synthesia е един от горещите стартъпи за дигитални аватари наред с компании като D-ID, HeyGen и Colossyan. По-рано тази година компанията достигна оценка от 4 милиарда долара, а миналата година заяви, че е преминала границата от 100 милиона долара годишни периодични приходи.

Synthesia позволява на предприятията да създават интерактивни обучителни видеа с AI аватари, а наскоро пусна продукт, наречен Roleplay Sessions, който позволява на служителите да упражняват например търговски презентации с интерактивен AI аватар, който отговаря на репликите им и оценява отговорите им.

Когато отидох на откриването на новия офис и ме попитаха дали бих искала собствен AI аватар, дори не се поколебах да кажа „да“. Разбира се, че бих искала собствен дигитален близнак. Този ден тоалетът ми беше симпатичен, а косата ми беше в ред.

Преди да се срещна с дигиталния си близнак, бях безразлична към аватарите, но смятах, че те неизбежно ще станат част от ежедневния онлайн живот. Чувала съм за хора в Instagram, които създават свои подобия, за да им помагат да създават съдържание за социалните мрежи. Всичко това ми се струва много интересно и може би затова сега нямам нищо против да ви представя своя дигитален близнак. Това е първият път, когато Synethsia създава дигитален аватар за журналист (или изобщо за някого извън Войка). Той е обучен върху моя материал за това защо стартъпите, подкрепени от рисков капитал, извършват повече измами от стартъпите без финансиране от рисков капитал и ще отговаря единствено на въпроси за този материал. 

По-долу просто натиснете „стартиране в нов прозорец“, за да започнете.

Можете да му задавате въпроси като:

  • Защо реших да напиша този материал?
  • За какво се отнася научното изследване?
  • Какво установиха изследователите?

За да бъде създаден, влязох в мини филмово студио, разположено в офиса на Synthesia, където ми направиха множество снимки и записаха двуминутен аудиозапис на гласа ми. Трябваше да дам съгласието си за създаването на тези аватари и така, дигиталният Дом се роди. Създадоха ми личен аватар (който просто прочита всеки сценарий, който му дам) — със и без очила — и два интерактивни аватара (които могат да ми отговарят и да ме слушат), също със и без очила. 

Избрахме статия, върху която да бъде обучен интерактивният аватар, а след това един от екипите изгради моя интерактивен аватар, който се захранва от комбинация от модели за преобразуване на реч в текст, видео, език и текст в реч. Технологичният стек на моя аватар включва собствените видео и гласови модели на Synthesia, макар че компанията позволява на клиентите да избират и алтернативи от други лаборатории като Cartesia, ElevenLabs, Google или OpenAI. Предприятията могат също да изберат да хостват аватарите си в предпочитания от тях облак или да плащат на Synthesia за хостинг.

Моделът за преобразуване на реч в текст превръща казаното от хората в текст, агентният езиков модел осмисля текста и може да предприема действия въз основа на него, моделът за преобразуване на текст в реч превръща отговора в аудио, а накрая видео модел (изграден от Synthesia) анимира аватара, докато говори. 

Като цяло Synthesia създава три вида продукти — платформа за създаване и разпространение на видео с класически аватари, в която някой въвежда сценарий, а аватарът го повтаря; агентна платформа, наречена Sessions, в която хората могат да взаимодействат с аватарите в проучвания или при ролеви игри; и API платформа, чрез която хората могат да комбинират видео и гласовите модели на Synthesia с други технологични услуги, за да създават интерактивни аватари или други видове продукти.

На екипа на Synthesia му отне няколко дни, за да създаде аватарите ми. Първо си поиграх с личните и въведох сравнително общ сценарий, за да чуя как звучи гласът ми, генериран от AI. Накарах го да говори за това как есента е настъпила в Ню Йорк — любимото ми време от годината. Гласът беше доста точен и се зарадвах, че не е уловил пресипналостта, която имах, когато записвах аудиопробата си. 

Показах го на няколко приятели, които не се занимават с технологии, и те го намериха едновременно за интересно и зловещо.

След това им показах интерактивния си аватар, който е детерминистичен — тоест ще казва само това, за което е обучен да отговаря. В този случай това беше историята ми за измамите в стартъпите. Задавах му въпроси като къде съм работила преди TechCrunch и в коя част на Ню Йорк живея, но всеки път той ме насочваше обратно към историята.

Приятелите ми не смятаха, че гласът му звучи много като моя, и мислеха, че приликата не е толкова добра, колкото при личния аватар, но въпреки това беше достатъчно близка, за да е донякъде зловеща. Майка ми го нарече „невероятен“, което е доста висока оценка от нейна страна. Тя и баща ми продължиха да се опитват да му задават въпроси „които само те биха знаели“ за мен — но моделът не отговаряше и всеки път ги насочваше към историята за измамите в стартъпите.

„Не си спомням да съм родила две от вас“, пошегува се тя, след като изпробва модела.

Това преживяване ме накара да се замисля какво би могло да бъде бъдещето на журналистиката. Дали хората биха се чувствали добре, ако включат новините и те бъдат представяни от аватар? Един инвеститор ми отговори незабавно, че не. Определено днес има много съпротива срещу нискокачественото AI съдържание, което е проникнало в социалните мрежи и други платформи за споделяне на новини. Но останалите хора, които попитах, не бяха толкова сигурни. Могат ли аватарите да допълнят — или дори да заменят — журналистите? Дали изпълнителните директори биха предпочели да разговарят с AI аватар на журналист, вместо с човек? 

Това, което харесвам в кариерата си, е да се свързвам с хора, да пиша истории и да проучвам нови теми. Но най-важната част от журналистиката е доверието. Не ми се струва, че то някога би могло да бъде възложено на AI.

Извън журналистиката съм убедена, че идеята да се клонираш може да бъде привлекателна. Вече няма да се налага да наваксваш с работата след празник или почивка, защото винаги може да има твоя версия, която да отговаря на въпроси.

Ще трябва да видим как ще се развие използването на аватари в американския корпоративен свят. Но сега, когато имам свой собствен, изпитвам смесени чувства. След като първоначалната новост отмина, се вгледах внимателно в аватара си, след като той спря да говори, и зачаках — не знам точно какво. Може би чаках да мигне. Или да каже нещо ново, да се усмихне или просто да ми покаже, че знае. 

Тъй като дигиталните ми близнаци са детерминистични, те никога няма да направят това. Но виждам колко лесно човек би могъл да изпадне в лека форма на AI психоза с такъв, който е недетерминистичен — тоест захранван от чатбот, свободен да философства.

Казах на един инвеститор, че независимо какво е бъдещето на дигиталните близнаци, предполагам, че моето поколение, поколение Z, вероятно няма да свикне с тях. Те изглеждат като научна фантастика: всичко, което някога сме виждали във филм, сега е тук. Но ще кажа, че намирам дигиталните аватари за по-малко стряскащи от хуманоидите. Поне с аватар, ако нещата станат странни, винаги мога да изляза от профила си. 

Дотогава обаче ето го личния ми аватар, който ви представя обзор на всички водещи истории в сайта ни тази седмица!

Преведено автоматично от английски. Оригиналната статия е на връзката по-долу.

Първоначално публикувано от TechCrunch на

Прочетете оригинала в TechCrunch ↗

Текстът и изображенията са собственост на TechCrunch и са възпроизведени тук с посочване на авторството и връзка към оригиналната публикация.

← Към новините

Още новини

Всички последни новини