Обновлено: 24.07.2026
Голос агента в Corpis — это два независимых направления. Распознавание (голос → текст): в чате есть кнопка микрофона, вы наговариваете сообщение, и оно превращается в текст. Озвучка (текст → голос): агент проговаривает свои ответы вслух голосом, который вы настроили под его характер. Оба направления работают на сервере локально, без облачных ключей.
Создайте агента. Откройте создание агента и заполните имя, характер и приветствие — или опишите нужное словами, ИИ-ассистент заполнит форму сам.
Откройте вкладку «Голос». В настройках агента перейдите на вкладку «Голос» — здесь живёт профиль его голоса.
Выберите пресет. Возьмите готовый характер: Нейтральный, Грозный, Милый, Детский, Радостный, Деловой, Дружелюбный, Спокойный или Робот. Или опишите голос словами ассистенту вкладки.
Докрутите оси и эффект. При желании подправьте тон, темп, живость, энергию и придыхание; включите эффект «робот» или «рация», если он нужен образу.
Послушайте и сохраните. Нажмите «Послушать», чтобы проверить голос до сохранения. Устраивает — сохраните профиль.
Включите озвучку в чате. Откройте чат с агентом и включите тумблер-динамик в композере — с этого момента агент проговаривает новые ответы вслух.
Попробуйте голосовой ввод. Нажмите кнопку микрофона рядом с полем ввода, наговорите сообщение и остановите запись — речь распознается и станет текстом.
В композере чата рядом с полем ввода есть кнопка микрофона. Нажали — говорите, нажали ещё раз — запись останавливается, речь распознаётся и попадает в поле как обычный текст, который вы можете дочитать глазами и отправить.
Аудио готовится прямо в браузере и уходит на сервер уже в нужном виде — отдельных программ или кодеков ставить не нужно. Распознавание идёт нейросетью на сервере, без облака и без ключей.
В композере воркшопа агента есть тумблер-динамик. По умолчанию он выключен. Когда вы его включаете, каждый новый ответ агента дополнительно проговаривается вслух, а тело Pip синхронно шевелит губами по громкости звука.
Фолбэка на системный робо-голос браузера здесь намеренно нет: если серверная озвучка почему-то недоступна, реплика просто остаётся текстом в переписке — образ персонажа не ломается чужим голосом.
Характер голоса задаётся отдельно для каждого агента на вкладке «Голос» в его настройках. Начните с готового пресета: Нейтральный, Грозный, Милый, Детский, Радостный, Деловой, Дружелюбный, Спокойный или Робот.
Дальше пресет можно докрутить осями характера: тон (выше — моложе и звонче, ниже — крупнее и грознее), темп, живость интонации, энергия и придыхание. Отдельно включается пост-эффект — «робот» или «рация». Кнопка «Послушать» проигрывает выбранный голос сразу, до сохранения.
Распознавание микрофоном и озвучка работают в чате на платформе. Озвучка в веб-виджете и в Telegram пока не подключена — это следующий шаг, а не текущая возможность.
«Детский» голос на обоих движках — это приближение через тон, а не отдельный детский голос: нативных детских голосов у движков нет. Голос «по описанию или по образцу конкретного человека» — это класс GPU-моделей, отдельный будущий тир.
Нет. И распознавание речи, и озвучка работают нейросетью прямо на сервере, без облака и без ключей. Ключ нужен только если вы отдельно подключаете облачный движок Yandex ради более выраженных эмоций.
Пока нет. Распознавание микрофоном и озвучка ответов работают в чате на платформе; поддержка виджета и Telegram — следующий шаг, а не текущая возможность.
Да, для этого есть готовые пресеты «Детский» и «Грозный» и тонкая настройка осей. Честно: «детский» — это приближение через тон, отдельного детского голоса у движков нет, а по-настоящему выраженные эмоции даёт облачный движок Yandex.