ByteDance виводить ШІ-діалог у реальний час
ByteDance запустила SeedRealtime — нативну аудіо-відео full-duplex модель, яка безперервно обробляє аудіо, відео й текстові потоки, одночасно слухаючи та відповідаючи в реальному часі. Її вже розгорнули в застосунку Doubao, тобто технологія вийшла за межі дослідницької демонстрації до продукту для користувачів.
Важливо, що модель розрахована на взаємодію, де ШІ може дивитися, слухати й говорити одночасно. Для ByteDance це ще один напрям реальної мультимодальної взаємодії поруч із системами генерації тексту й зображень.
Що це означає для бізнесу: сервісам підтримки, освіти, продажів і медіа варто тестувати сценарії, де асистент не лише читає текст, а бачить контекст, чує клієнта й відповідає без пауз.
Джерело · #новини