ИИ ИИшка Про
Новости
H

Hume выпустила Octave — озвучку, которая играет эмоции

AI-редакция

Компания Hume AI выпустила Octave — синтез речи, который делает ставку не на «чистоту» голоса, а на выразительность. Это «речевая языковая модель»: она не просто читает текст вслух, а понимает смысл фразы и подбирает под него интонацию, эмоцию и ударения.

Понимает смысл, а не только буквы

Главная идея Octave — осмысленная подача. Обычный синтезатор одинаково ровно прочитает и радостную, и тревожную реплику. Octave же учитывает контекст: там, где по смыслу нужна тревога, ирония или нежность, модель меняет интонацию сама. Это заметно на диалогах и художественном тексте.

Голос задаётся словами

Вторая сильная сторона — режиссура подачи прямо в запросе. Голос можно описать словами: «усталый детектив», «бодрый ведущий утреннего шоу», и попросить прочитать конкретную реплику с нужной эмоцией. Это удобно для персонажей, аудиокниг и рекламы, где важен характер голоса, а не только его разборчивость.

Доступность и языки

Octave работает через веб-сервис и API; есть бесплатный тариф с лимитом. Русский поддерживается, но лучшая выразительность — на английском. Прямого доступа из России без ограничений нет — нужен VPN.

Что учесть

Как и любой мощный синтез речи, Octave умеет клонировать голос — а значит, поднимает те же этические вопросы, что и конкуренты: озвучивать чужим голосом без разрешения нельзя. И сгенерированную речь стоит помечать там, где её могут принять за запись реального человека.

Подробности — на странице модели. Чем Octave отличается от лидера рынка — в сравнении Hume Octave и ElevenLabs. Как озвучить текст на практике — в гайде как озвучить текст нейросетью.