Gemini 3.5 Transcribe
Our most precise speech-to-text model yet Link
Сюжет одним текстом
По данным 3DNews, Google представила модель Gemini 3.5 Transcribe, способную преобразовывать живую речь в текст без слов-паразитов. Новинка обладает возможностью расшифровки устной речи, поддерживает специальные термины и более 85 языков. Эта модель была представлена после задержки выпуска флагманской Gemini 3.5 Pro.
BBC уточняет, что Gemini 3.5 Transcribe описывается как самая точная модель преобразования речи в текст. Она рекомендуется для получения чистого, гиперточного и структурированного текста из аудиофайлов.
Издание dev.to отмечает, что Gemini 3.5 Transcribe может использоваться для анализа видео, подведения итогов подкастов, ответа на вопросы, заданные на записанных встречах. Авторы статьи рекомендуют использовать эту модель, как чрезвычайно полезную при необходимости получения точных транскрипций из аудиофайлов.
источников в основе: 3
Как получается порядок
- 3
- 3
- 2 д
- 0,03
- ×1,34
- 2 ч
Об этом написали
Рядом в ленте
- В Норвегии заявили об ухудшении здоровья 89-летнего короля Харальда Vkommersant.ru
- Пятница — новые «иноагенты»: — комик Александр Незлобин, — М.Ю.t.me
- «Газпром Арена» отказалась проводить концерт Канье Уэста. Организаторы заявили, что узнали об этом из СМИnovayagazeta.eu
- Актера Юрия Цурило похоронят в Санкт-Петербургеkommersant.ru
- Nvidia выпустила драйвер с поддержкой Star Wars Zero Company, Resonance: A Plague Tale Legacy и Hell Let Loose: Vietnam3dnews.ru
- Hugging Face получила предложение о покупке за $13 млрдhabr.com