Google Tacotron (синтезатор речи)

Продукт
Разработчики: Google
Дата последнего релиза: декабрь 2017 г
Отрасли: Интернет-сервисы
Технологии: Речевые технологии

2017: Разработка алгоритма Tacotron 2

В конце декабря 2017 года компания Google анонсировала систему синтеза речи, которая способна преобразовывать текст в речь, максимально приближенную к человеческой. Алгоритм получил название Tacotron 2.

Система способна читать любые предложения, игнорировать грамматические ошибки и менять тональность речи. Алгоритм говорит пока только на английском

Отмечается, что Tacotron 2 использует контекст, чтобы произносить абсолютно одинаковые слова. Он также реагирует на пунктуационные правила в тексте, а также может подчеркивать конкретные слова. Технология способна различить разные формы глагола или определить, выполняет ли слово роль глагола или существительного.

Google разработала систему синтеза речи, не отличимой от человеческой

Google давно занимается технологиями синтеза речи при помощи искусственного интеллекта. В 2016 году компания представила синтезатор, звучащий близко к человеческой речи. Он использует ИИ-систему WaveNet, которая обучается соответствию текста определенным формам колебаний волны и затем на основании этой базы знаний формирует из текстовых отрывков отдельные звуковые волны.

Tacotron 2 подключили к нейросети WaveNet, которая создает необходимые звуки на основе данных из другой системы глубинного обучения, которая преобразовывает текст в спектрограмму (изображает аудиочастоты в зависимости от времени).Международный конгресс по anti-age и эстетической медицине — ENTERESTET 2026

В Google отмечают, что в целом Tacotron 2 работает отлично, но все-таки испытывает сложности с произношением некоторых сложных слов, а также иногда случайным образом выдает странные шумы. Кроме того, система не способна работать в реальном времени, и авторам пока не удается взять движок под контроль, то есть задать ему нужную интонацию, например, счастливый или грустный голос. 

Как полагают разработчики Tacotron 2, алгоритм может быть использован для улучшения работы голосовых помощников, которые получают все более широкое распространение.[1]

Примечания



СМ. ТАКЖЕ (2)


Подрядчики-лидеры по количеству проектов

За всю историю
2023 год
2024 год
2025 год
Текущий год

  Группа компаний ЦРТ (Центр речевых технологий) (48)
  МТС Exolve (Межрегиональный ТранзитТелеком, МТТ) (40)
  Banks Soft Systems, BSS (Бэнкс Софт Системс, БСС) (29)
  SteadyControl (19)
  Naumen (Наумен консалтинг) (16)
  Другие (258)

  МТС Exolve (Межрегиональный ТранзитТелеком, МТТ) (9)
  Группа компаний ЦРТ (Центр речевых технологий) (8)
  SteadyControl (6)
  Unlimited Production (Анлимитед Продакшен, eXpress) (4)
  Banks Soft Systems, BSS (Бэнкс Софт Системс, БСС) (4)
  Другие (28)

  Banks Soft Systems, BSS (Бэнкс Софт Системс, БСС) (6)
  SteadyControl (5)
  Unlimited Production (Анлимитед Продакшен, eXpress) (5)
  МТС Exolve (Межрегиональный ТранзитТелеком, МТТ) (4)
  Проф ИТ (Prof IT) Ростов-на-Дону (3)
  Другие (39)

  МТС Exolve (Межрегиональный ТранзитТелеком, МТТ) (8)
  Сбербанк (6)
  Voice Systems Robotics (VSR, VS Robotics) (3)
  Banks Soft Systems, BSS (Бэнкс Софт Системс, БСС) (3)
  ОБИТ (3)
  Другие (30)

  Группа компаний ЦРТ (Центр речевых технологий) (1)
  Сбер Бизнес Софт (1)
  Сбербанк (1)
  ТелеМедХаб (1)
  Другие (0)

Распределение вендоров по количеству проектов внедрений (систем, проектов) с учётом партнёров

За всю историю
2023 год
2024 год
2025 год
Текущий год

  Группа компаний ЦРТ (Центр речевых технологий) (18, 50)
  МТС Exolve (Межрегиональный ТранзитТелеком, МТТ) (6, 41)
  Banks Soft Systems, BSS (Бэнкс Софт Системс, БСС) (13, 32)
  Сбербанк (24, 24)
  SteadyControl HoReCa (1, 24)
  Другие (503, 298)

  МТС Exolve (Межрегиональный ТранзитТелеком, МТТ) (1, 9)
  Группа компаний ЦРТ (Центр речевых технологий) (4, 7)
  SteadyControl HoReCa (1, 7)
  SteadyControl (1, 7)
  Banks Soft Systems, BSS (Бэнкс Софт Системс, БСС) (2, 6)
  Другие (18, 29)

  Banks Soft Systems, BSS (Бэнкс Софт Системс, БСС) (2, 7)
  Сбербанк (3, 5)
  SteadyControl (1, 5)
  SteadyControl HoReCa (1, 5)
  Unlimited Production (Анлимитед Продакшен, eXpress) (1, 5)
  Другие (29, 47)

  МТС Exolve (Межрегиональный ТранзитТелеком, МТТ) (3, 8)
  Сбербанк (2, 8)
  СалютДевайсы (ранее SberDevices) (2, 8)
  Яндекс (Yandex) (2, 5)
  Banks Soft Systems, BSS (Бэнкс Софт Системс, БСС) (4, 4)
  Другие (25, 31)

  СалютДевайсы (ранее SberDevices) (2, 2)
  Сбербанк (2, 2)
  ТелеМедХаб (1, 1)
  Группа компаний ЦРТ (Центр речевых технологий) (1, 1)
  Другие (0, 0)

Распределение базовых систем по количеству проектов, включая партнерские решения (проекты, партнерские проекты)

За всю историю
2023 год
2024 год
2025 год
Текущий год

  МТС Exolve Голосовой робот - 30 (6, 24)
  SteadyControl Система контроля и управления персоналом - 24 (24, 0)
  BSS Digital2Speech - 21 (21, 0)
  Сбер: GigaChat (ГигаЧат) - 20 (17, 3)
  EXpress Защищенный корпоративный мессенджер - 16 (16, 0)
  Другие 214

  МТС Exolve Голосовой робот - 9 (0, 9)
  SteadyControl Система контроля и управления персоналом - 7 (7, 0)
  EXpress Защищенный корпоративный мессенджер - 6 (6, 0)
  BSS Digital2Speech - 5 (5, 0)
  SmartLogger II - 4 (4, 0)
  Другие 11

  SteadyControl Система контроля и управления персоналом - 5 (5, 0)
  EXpress Защищенный корпоративный мессенджер - 5 (5, 0)
  BSS Digital2Speech - 4 (4, 0)
  Сбер: GigaChat (ГигаЧат) - 3 (3, 0)
  Prof IT: Vocamate AI - 3 (3, 0)
  Другие 36

  Сбер: GigaChat (ГигаЧат) - 8 (7, 1)
  МТС Exolve Виртуальная АТС - 6 (6, 0)
  YandexGPT - 4 (4, 0)
  EXpress Защищенный корпоративный мессенджер - 3 (3, 0)
  Naumen Erudite - 3 (3, 0)
  Другие 24

  Сбер: GigaChat (ГигаЧат) - 2 (1, 1)
  Другие -1