Google представила аудиомодели Gemini 3.8 для синтеза речи

Популярные

The Gemini Audio logo featuring a dotted microphone icon and colorful star symbol

Быстрое чтение

  • Google представила новые аудиомодели Gemini 3.8 Flash TTS и Flash-Lite TTS.
  • Версия Flash-Lite специально оптимизирована для экономичного синтеза речи в больших масштабах.
  • Модели призваны сбалансировать высокое качество звучания с потребностями разработчиков в эффективности.

Компания Google официально расширила свою экосистему искусственного интеллекта, представив две новые аудиомодели в рамках архитектуры Gemini 3.8. Анонс, опубликованный на этой неделе, включает модели Gemini 3.8 Flash TTS и Gemini 3.8 Flash-Lite TTS, которые предназначены для удовлетворения растущего спроса на масштабируемый и качественный синтез речи в различных цифровых средах.

Эти модели разработаны с учетом различных сценариев использования. Модель Flash TTS оптимизирована для задач высококачественного творческого производства, в то время как версия Flash-Lite сосредоточена на экономической эффективности. Последняя позволяет разработчикам и предприятиям внедрять системы синтеза речи в больших масштабах, значительно снижая вычислительные затраты, которые обычно сопровождают работу со сложными генеративными аудиосистемами.

Данный запуск отражает стратегический сдвиг Google в сторону сегментации своих возможностей генеративного аудио. Предоставляя облегченную версию модели, компания делает технологию синтеза голоса доступной для более широкого круга разработчиков, работающих с ограниченными инфраструктурными ресурсами. Это решение позволяет автоматизировать создание контента в таких сферах, как обслуживание клиентов, образовательные платформы и интерактивные приложения, делая процесс более доступным и быстрым.

|
Редакционный вклад:Редакция Azat TV
|
Издатель:Azat TV

Самые последние