> ## Documentation Index
> Fetch the complete documentation index at: https://docs.ukrgsm.com/llms.txt
> Use this file to discover all available pages before exploring further.

# Попередньо записане аудіо

> Створюйте гібридних голосових агентів, що поєднують попередньо записане аудіо з динамічною генерацією тексту — для нижчої затримки, меншої вартості TTS і природнішого звучання.

Власні записи дозволяють будувати **гібридних голосових агентів**, які використовують ваше власне попередньо записане аудіо для ключових частин розмови, а для динамічних відповідей переходять на мовлення, згенероване LLM (через клонований голос). Це поєднує емоційну глибину живого людського мовлення з гнучкістю ШІ-діалогу.

## Навіщо використовувати власні записи

* **Менша вартість TTS** — попередньо записане аудіо відтворюється напряму, тож синтез TTS для цих сегментів не оплачується.
* **Емоційна варіативність** — реальні записи мають природну інтонацію та емоції, які TTS не завжди може повністю відтворити.
* **Менша затримка** — відтворити готовий кліп швидше, ніж синтезувати текст у реальному часі.

## Передумови

* Провайдер TTS, що підтримує **клонування голосу** (наприклад, Cartesia, ElevenLabs або Deepgram).
* API-ключ обраного провайдера TTS, налаштований у розділі голосових налаштувань агента.

## Крок 1: Клонуйте голос

Клонуйте голос у вашого провайдера TTS, щоб динамічно згенероване мовлення звучало схоже на ваші записи. Наприклад, у Cartesia:

1. Перейдіть у Cartesia, у розділ **Instant Clone**.
2. Запишіть короткий аудіокліп (до 10 секунд) вашого голосу.
3. Дайте клону назву й оберіть мову.
4. Скопіюйте **Voice ID** — він знадобиться на наступному кроці.

<Note>
  Можна використовувати будь-якого провайдера TTS, що підтримує клонування голосу. Кроки відрізнятимуться залежно від провайдера, але результат завжди — **Voice ID**, прив'язаний до вашого клонованого голосу.
</Note>

## Крок 2: Налаштуйте клонований голос

1. Перейдіть до налаштувань моделі вашого агента в кабінеті.
2. У голосових налаштуваннях оберіть **Add Voice ID manually**.
3. Вставте Voice ID вашого клонованого голосу.
4. Переконайтесь, що **провайдер** відповідає тому, де ви клонували голос (наприклад, Cartesia).
5. Введіть API-ключ провайдера, якщо ще не зробили цього.
6. Збережіть налаштування.

## Крок 3: Завантажте записи

Перейдіть на сторінку записів у кабінеті. Записи спільні для всіх агентів вашої організації. Ви можете завантажити готові аудіофайли або записати звук прямо в браузері.

Для кожного запису:

1. Натисніть **Upload Recording**.
2. Оберіть аудіофайл або натисніть **Record**, щоб записати в браузері.
3. Перевірте правильність транскрипції — за потреби відредагуйте.
4. Натисніть **Upload**.

Ідентифікатор запису можна перейменувати будь-коли, натиснувши іконку редагування біля нього в списку записів.

## Крок 4: Побудуйте сценарій

Відкрийте сценарій вашого агента й опишіть розмову звичайною мовою. Щоб вставити запис, введіть **`@`** у редакторі промпту — з'явиться список усіх доступних записів вашої організації.

Для будь-якого запитання абонента, що виходить за межі ваших записів, агент автоматично генерує динамічну відповідь через LLM, яка потім синтезується вашим клонованим голосом через TTS.

## Поради для кращого результату

* **Записуйте в тихому середовищі** для якіснішого звуку й відповідності клонованому голосу.
* **Використовуйте професійне клонування** (де доступно) і надавайте більше зразків аудіо для якіснішого клону.
* **Тримайте записи короткими** — короткі, сфокусовані кліпи найкраще працюють для конкретних моментів розмови.
* **Переглядайте записи дзвінків** після тестування, щоб побачити, де перехід між записаним і динамічним аудіо можна покращити.
