У Synthesia створили інтерактивний цифровий аватар журналіста
Synthesia створила інтерактивний аватар журналіста, навчений відповідати на запитання про одну статтю.
Стартап Synthesia створив інтерактивний цифровий аватар автора матеріалу, який відповідає лише на запитання про його статтю щодо шахрайства у стартапах, що залучили венчурне фінансування. Для цього в нью-йоркському офісі компанії записали двохвилинний зразок голосу та зробили низку фотографій журналіста.
Як повідомляє TechCrunch, компанія виготовила кілька версій аватара: персональні, які відтворюють заданий текст, та інтерактивні, здатні слухати запитання й відповідати на них. Для кожного варіанта створили версії в окулярах і без них.
Як працює інтерактивна версія
Інтерактивний аватар працює на поєднанні моделей перетворення мовлення на текст, мовної моделі, синтезу голосу та відеомоделі Synthesia, яка анімує зображення під час відповіді. Компанія також дозволяє клієнтам обирати окремі моделі інших розробників, зокрема Cartesia, ElevenLabs, Google або OpenAI.
Аватар журналіста має детерміновані відповіді: він не виходить за межі матеріалу, на якому його навчали. Під час тестування на запитання про особисте життя автора система щоразу повертала розмову до теми венчурного шахрайства.
Продукти компанії
Synthesia, що спершу базувалася у Великій Британії, розробляє цифрові аватари для корпоративного використання. Компанія повідомляла, що торік її річний регулярний дохід перевищив 100 млн доларів, а раніше цього року її оцінили у 4 млрд доларів.
Серед продуктів Synthesia — платформа для створення відео з аватарами, сервіс Roleplay Sessions для тренування працівників у сценаріях на кшталт презентацій продажів, а також API для інтеграції її відео- й голосових моделей з іншими сервісами. Автор матеріалу зазначив, що експеримент змусив його замислитися про межі використання цифрових двійників у журналістиці, де ключовим чинником він назвав довіру.