Product Launch
Google выпустила Gemini 3.5 Transcribe для голосового AI в реальном времени
Google представила Gemini 3.5 Transcribe — модель для автоматической транскрипции речи с поддержкой более 85 языков и режимами потоковой и офлайн обработки.
AS1 News
Модель обеспечивает задержку менее секунды в режиме потоковой транскрипции и достигает ошибок менее 4% при streaming и 2,6% при обработке записанного аудио. Gemini 3.5 Transcribe поддерживает функции, такие как определение языка, разделение говорящих и автоматическое удаление слов-паразитов, что делает её подходящей для call-центров и голосовых ассистентов.
Расширение возможностей голосовых AI с высокой точностью и низкой задержкой, что способствует развитию голосовых ассистентов и автоматизации коммуникаций.