← Назад

Product Launch

Google выпустила Gemini 3.5 Transcribe для голосового AI в реальном времени

Google представила Gemini 3.5 Transcribe — модель для автоматической транскрипции речи с поддержкой более 85 языков и режимами потоковой и офлайн обработки.

AS1 News

voice-aitranscriptionmultilingualreal-time
REAL$0.0751+2.65%GOOGL$338.50-1.16%

Модель обеспечивает задержку менее секунды в режиме потоковой транскрипции и достигает ошибок менее 4% при streaming и 2,6% при обработке записанного аудио. Gemini 3.5 Transcribe поддерживает функции, такие как определение языка, разделение говорящих и автоматическое удаление слов-паразитов, что делает её подходящей для call-центров и голосовых ассистентов.

позитивно

Расширение возможностей голосовых AI с высокой точностью и низкой задержкой, что способствует развитию голосовых ассистентов и автоматизации коммуникаций.