Перейти к содержимому
-
  • Facebook
  • X
  • Telegram
  • Instagram
  • YouTube
AI Feed AI Feed AI Feed

Новости ИИ, нейросетей, ChatGPT и AI-технологий

Подписаться
AI Feed AI Feed AI Feed

Новости ИИ, нейросетей, ChatGPT и AI-технологий

  • Новости ИИ
  • Промты
  • Блог
  • Радар
  • API-цены
  • Локальный AI
  • Профессии

Рубрики

  • Anthropic и Claude
  • Google AI, Gemini и DeepMind
  • NVIDIA и искусственный интеллект
  • OpenAI и ChatGPT
  • Блог
  • Главные
  • Новости ИИ
  • Промты
  • Профессии
  • Сравнения нейросетей

Последние новости

  • Google показала применение Gemini в кейтеринге Edy’s Grocer
  • VK внедрила канареечную доставку снапшотов для подбора рекламы
  • Google показала четыре проекта разработчиков на Gemini 3.8 Flash
  • Google объединила закупку вертикального видео в Display & Video 360
  • Сколько стоит AI API в 2026 году: расчёт для чата, RAG и агентов
  • Новости ИИ
  • Промты
  • Блог
  • Радар
  • API-цены
  • Локальный AI
  • Профессии
Подписаться
Закрыть

Поиск

Главная/Google AI, Gemini и DeepMind/Google представила Gemini 3.8 Flash TTS и Flash-Lite TTS
Иллюстрация к новости: Google представила Gemini 3.8 Flash TTS и Flash-Lite TTS
Google AI, Gemini и DeepMindНовости ИИ

Google представила Gemini 3.8 Flash TTS и Flash-Lite TTS

Alex
От Alex
23.09.2026 2 Минут чтения
◉3уникальных читателей

Google 23 сентября представила модели генерации речи Gemini 3.8 Flash TTS и Gemini 3.8 Flash-Lite TTS для создателей контента, разработчиков и компаний. Flash предназначена для проектирования персонажей и детальной постановки сцен, а Flash-Lite оптимизирована для экономичной массовой озвучки, создания аудиоконтента и голосовых агентов.

Gemini 3.8 Flash TTS позволяет создавать голос с помощью текстового описания роли, акцента и других характеристик. По данным Google, модель охватывает более 100 языков и диалектов. Компания также предлагает свыше 2000 подготовленных голосов, в том числе варианты мексиканского испанского, квебекского французского и шотландского английского.

Обе модели позволяют управлять подачей отдельных реплик с помощью сценарных указаний. Для Flash TTS Google отдельно заявляет детальную настройку актерских подсказок, темпа, смены диалекта и разговорных реакций; для Flash-Lite — управление тоном, темпом и выразительными нюансами. Модели также поддерживают постановку диалога двух собеседников из одного сценария с разделением голосов и естественным чередованием реплик.

Google утверждает, что при многочасовой генерации сохраняются качество голоса, естественный темп и тембр персонажа с минимальным отклонением голоса, что рассчитано на подкасты и аудиокниги. В сценарии можно добавлять невербальные реакции и короткие реплики активного слушания — например, смех, вздохи или междометия.

Flash TTS может воссоздать голосовой профиль по 30-секундному образцу голоса пользователя или человека, права на использование голоса которого у него есть. Перед созданием профиля требуется устная запись согласия владельца, совпадающая с голосом в образце. Google сообщает, что аудио моделей Gemini Audio маркируется незаметным водяным знаком SynthID; для репликации также предусмотрены учетные данные C2PA.

Развертывание обеих моделей началось в Gemini API и Google AI Studio. Flash TTS также появляется в Gemini Notebook, а Flash-Lite TTS — в Google Vids. Доступ через API Gemini Enterprise обещан позднее. Отдельно Google анонсировала будущую функцию ремикса готовых голосов с настройкой тембра, высоты, темпа и акцента.

Практический контекст: Разделение линейки дает разработчикам выбор между более глубокой режиссурой голосов и масштабной обработкой типовых материалов. При выборе модели важно учитывать, что детальная смена диалекта прямо заявлена для Flash TTS, но не для Flash-Lite. Репликация голосов также требует подтвержденного согласия и имеет территориальные ограничения в AI Studio.

Google сообщает, что Flash TTS получила 71,4 балла в Voice Design Benchmark компании Hume AI и 60,8 балла за моделирование акцентов. По заявлению компании, Flash и Flash-Lite заняли соответственно первое и второе места в Overall Quality Index. Это опубликованные поставщиком результаты; в исходном сообщении нет подробного описания методики для их независимой оценки.

Назначение и развертывание моделей Gemini 3.8 TTS
Модель Основное назначение Заявленное развертывание
Gemini 3.8 Flash TTS Создание голосов, персонажей и детально поставленных сцен Gemini API, Google AI Studio и Gemini Notebook; позднее — API Gemini Enterprise
Gemini 3.8 Flash-Lite TTS Массовая озвучка, аудиоконтент и выразительные голосовые агенты Gemini API, Google AI Studio и Google Vids; позднее — API Gemini Enterprise
Географические ограничения репликации голоса

Репликация голоса через Google AI Studio недоступна в Иллинойсе, Техасе, Европейской экономической зоне, Великобритании, Швейцарии и Индии. Для создания профиля требуется устная запись согласия владельца, совпадающая с референсным голосом.

Источники

  1. Google Blog

Дата события: 2026-09-23. Дата первоисточника: 2026-09-23.

Подписывайтесь на AI Feed в Telegram

Новые материалы об ИИ, практические разборы и сравнения инструментов — в одной удобной ленте.

Перейти в Telegram→

По теме

Продолжить чтение

Материалы по теме и практические инструменты AI Feed.
  1. 29.09.2026Google показала четыре проекта разработчиков на Gemini 3.8 Flash↗
  2. 15.09.2026Google выпустила Gemini 3.8 Live для голосовых ИИ-приложений↗
  3. 29.09.2026Google объединила закупку вертикального видео в Display & Video 360↗
  4. 24.09.2026Google добавила Live Avatar в Gemini 3.8 Live для предприятий↗
Как ИИ меняет IT-профессии→Радар AI-моделей→
Alex
Автор

Alex

Редактор AI Feed. Специализируется на практическом контексте технологических новостей, продуктов и инструментов.

Подпишись на меня
Другие статьи
Иллюстрация к новости: AWS открыла GPT-6 Sol и GPT-6 Luna в Amazon Bedrock
Назад

AWS открыла GPT-6 Sol и GPT-6 Luna в Amazon Bedrock

Иллюстрация к новости: Google открыла бесплатную генерацию видео Gemini Omni 1.1 в Vids
Далее

Google открыла бесплатную генерацию видео Gemini Omni 1.1 в Vids

Свежие записи

  • Google показала применение Gemini в кейтеринге Edy’s Grocer
  • VK внедрила канареечную доставку снапшотов для подбора рекламы
  • Google показала четыре проекта разработчиков на Gemini 3.8 Flash
  • Google объединила закупку вертикального видео в Display & Video 360
  • Сколько стоит AI API в 2026 году: расчёт для чата, RAG и агентов

Свежие комментарии

Нет комментариев для просмотра.

Архивы

  • Сентябрь 2026
  • Май 2026

Рубрики

  • Anthropic и Claude
  • Google AI, Gemini и DeepMind
  • NVIDIA и искусственный интеллект
  • OpenAI и ChatGPT
  • Блог
  • Главные
  • Новости ИИ
  • Промты
  • Профессии
  • Сравнения нейросетей

    © 2026 AI Feed. Все права защищены.
    RUEN
    О проектеРедакционная политикаИсточники и методологияИсправленияКонтактыКонфиденциальностьНастройки аналитики
    Аналитика AI Feed

    Помогает понять, какие материалы полезны. Рекламное отслеживание отключено.