Функцыі

Кланаванне голасу: уласны голас для джынглаў, аб'яў і падкастаў

31 жніўня 2026Аўтар Каманда Tunio7 хв чытання

Кланаванне голасу: джынглы, аб'явы і падкасты вашым уласным голасам

У каталогу Tunio даўно ёсць дзясяткі AI-галасоў на розных мовах — імі азвучваюцца джынглы, аб'явы, прагноз надвор'я і анонс часу. Але ў станцыі, кавярні ці фітнес-клуба ёсць голас, які слухачы пазнаюць лепш за любога дыктара: голас уладальніка, вядучага або адміністратара. Цяпер яго можна дадаць у Tunio. Кланаванне голасу працуе так: вы загружаеце кароткі ўзор маўлення, падцвярджаеце, што голас сапраўды ваш, — і праз пару хвілін ён з'яўляецца ў спісе галасоў побач з каталожнымі.

Навошта радыё і бізнесу свой голас

  • Пазнавальнасць. Джынгл з голасам вядучага або прывітанне голасам уладальніка закладу працуюць мацней за любую «нейтральную» азвучку — слухач разумее, што з ім гаворыць канкрэтны чалавек.
  • Без студыі і мікрафона на кожны ролік. Адзін раз запісалі ўзор — далей аб'явы пра акцыі, рэжым працы і падзеі азвучваюцца з тэксту за секунды.
  • Адзін голас на ўсю сетку. Для сеткі крам або салонаў свой голас становіцца часткай аўдыябрэнда: усюды гучыць адзін і той жа знаёмы тэмбр.
  • Любая мова. Клон гаворыць на той мове, на якой напісаны тэкст, — можна азвучыць аб'яву па-беларуску, па-руску або па-англійску адным і тым жа голасам.

Як загрузіць свой голас

Адкрыйце «Профіль» → укладка «Мае галасы» і націсніце «Загрузіць голас». Укладка з'яўляецца ў профілі, калі функцыя ўваходзіць у ваш тарыф. Майстар загрузкі складаецца з трох крокаў.

Крок 1. Умовы выкарыстання

Перш чым што-небудзь загрузіць, вы падцвярджаеце тры пункты: што гэта ваш голас (або ў вас ёсць выразная згода яго ўладальніка на кланаванне), што вы не будзеце выкарыстоўваць створаны кантэнт для падману або выдавання сябе за іншых людзей, і што вы згодныя на апрацоўку і захоўванне ўзору для сінтэзу маўлення. Без усіх трох галачак кнопка «Працягнуць» неактыўная — гэта свядомае рашэнне, а не фармальнасць.

Крок 2. Загрузка ўзору

Тут тры палі:

  • Назва голасу — як ён будзе падпісаны ў спісах выбару, напрыклад «Голас Марыны» або «Вядучы ранішняга шоу».
  • Аўдыяфайл — 5–90 секунд чыстага маўлення без музыкі і шуму. Падыдзе запіс на тэлефон, галасавое паведамленне або фрагмент з дыктафона ў любым распаўсюджаным фармаце: MP3, M4A, WAV, WebM. Найлепш клон атрымліваецца з 10–30 секунд спакойнага, разборлівага маўлення.
  • Тэкст фразы з узору — даслоўна тое, што вымаўляецца ў файле. Ён патрэбны не для праверкі, а самой мадэлі: яна супастаўляе гучанне з тэкстам і так «разумее», як менавіта вы вымаўляеце гукі.

Некалькі парад для добрага клона: запісвайцеся ў ціхім памяшканні, трымайце мікрафон на адной адлегласці, гаварыце ў тым тэмпе і з той інтанацыяй, з якімі хочаце чуць сябе ў эфіры. Абразаць паўзы і «э-э» не абавязкова, але маўленне, запісанае ў машыне або на вуліцы, заўважна пагоршыць рэзультат.

Крок 3. Падцвярджэнне голасу

Самы важны крок. На экране з'яўляецца выпадковая кароткая фраза — два-тры простыя сказы пра штосьці будзённае, 14–20 слоў — і запускаецца таймер прыкладна на 45 секунд. Трэба націснуць «Запісаць», прачытаць фразу ўголас у мікрафон, націснуць «Стоп», пры жаданні праслухаць запіс і адправіць яго кнопкай «Адправіць на праверку». Не спадабалася фраза або не паспелі — «Іншая фраза» выдасць новую.

Калі закрыць акно пасля другога кроку, голас нікуды не знікне — ён застанецца ў спісе са статусам «Чакае падцвярджэння». Вярнуцца да запісу можна ў любы момент праз меню дзеянняў → «Падцвердзіць голас».

Як праходзіць праверка

Пасля адпраўкі голас атрымлівае статус «На праверцы», затым «Правяраецца» — і звычайна праз пару хвілін становіцца «Гатовы». Старонка абнаўляецца сама, нічога перазагружаць не трэба.

Унутры праверка складаецца з дзвюх незалежных частак:

1. Супадзенне тэксту. Запіс распазнаецца сістэмай распазнавання маўлення, і атрыманы тэкст параўноўваецца з выдадзенай фразай. Так мы ўпэўніваемся, што запісаны жывы чалавек, які прачытаў менавіта гэтую фразу менавіта цяпер.

2. Супадзенне голасу. З запісу і з загружанага ўзору вылучаюцца галасавыя «адбіткі» — лікавыя прадстаўленні тэмбру — і параўноўваюцца між сабой. Так мы ўпэўніваемся, што фразу чытае той самы чалавек, чый голас ва ўзоры.

Калі хаця б адна частка не пройдзена, голас атрымлівае статус «Адхілены», а пры навядзенні на статус відаць прычына: «Прачытаны тэкст не супаў з фразай» або «Голас у запісе не супаў з голасам ва ўзоры». Адхіленне — не прысуд: праз «Падцвердзіць голас» можна атрымаць новую фразу і запісаць яе яшчэ раз, колькі заўгодна.

Навошта такая строгасць? Без праверкі голасу любы мог бы загрузіць запіс вядомага чалавека і прачытаць фразу сам. А без аднаразовай выпадковай фразы з таймерам можна было б загадзя сінтэзаваць яе чужым клонам і проста ўключыць запіс. Дзве праверкі разам закрываюць абодва сцэнарыі — так мы абараняем і ўладальнікаў галасоў, і слухачоў.

Як гэта працуе ўнутры

Мы не «навучаем» асобную мадэль пад кожнага карыстальніка — гэта доўга, дорага і патрабуе гадзін запісаў. Замест гэтага выкарыстоўваецца zero-shot кланаванне: пры кожнай генерацыі мадэль сінтэзу маўлення атрымлівае ваш узор разам з яго тэкстам як эталон і вымаўляе новы тэкст, капіруючы тэмбр, манеру і тэмп з эталона. Таму ўзор з 10–30 секунд — не абмежаванне, а дастатковая ўмова: мадэлі патрэбны не аб'ём, а чысціня.

Адсюль і некалькі наступстваў, якія заўважыць карыстальнік:

  • Клон гатовы адразу пасля праверкі — ніякага «навучанне зойме суткі».
  • Голас універсальны па мове. У каталожных галасоў у спісе стаіць сцяг краіны, у вашага — значок глобуса 🌐: ён азвучыць тэкст на любой з дзясяткаў моў, якія падтрымліваюцца.
  • Кнопка праслухоўвання ў спісе галасоў прайгравае ваш арыгінальны ўзор — тое, што вы загрузілі, а не сінтэзаванае маўленне.
  • Апрацоўка ідзе на ўласных GPU-серверах Tunio. Узор не перадаецца староннім сэрвісам сінтэзу голасу.

Дзе выкарыстоўваць свой голас

Падцверджаны голас з'яўляецца ў спісе выбару голасу з пазнакай «Мой» — першым, перад каталожнымі. Цяпер ён даступны:

  • У генератары джынглаў — раздзел «Джынглы» → укладка «Генератар джынглаў». Напішыце тэкст, выберыце свой голас і музычную падкладку — і джынгл з вашым голасам гатовы.
  • У аб'явах — раздзел «Аб'явы» → «Новая аб'ява». Тэкст, голас і расклад задаюцца ў адным месцы; далей аб'ява выходзіць у эфір між трэкамі па раскладзе, азвучаная вашым голасам.
  • У падкастах — азвучце выпуск або рубрыку сваім голасам і паставьце яго ў эфір праз «Расклад стрыму»: аўтарскі падкаст без студыі і мікрафона.
  • Праз API — для інтэграцый і ўласных сцэнарыяў азвучкі: падцверджаны голас вяртаецца ў спісе галасоў разам з каталожнымі.

На адным акаўнце можна трымаць да трох галасоў. Голас належыць не толькі вам: калегі, якія працуюць з той жа бібліятэкай кантэнту, таксама бачаць яго ў спісах і могуць ім азвучваць — гэтак жа, як агульнымі джынгламі і аб'явамі.

Генерацыя сваім голасам тарыфікуецца гэтак жа, як любым голасам з каталога, — дадатковай платы за сам клон няма.

Прыватнасць і кантроль

Узор голасу — біяметрычныя даныя, і мы абыходзімся з імі адпаведна:

  • Узор захоўваецца роўна да таго часу, пакуль існуе голас. Ён і ёсць ваш клон: без узору сінтэз немагчымы, таму выдаліць яго «пасля навучання» нельга — навучання не было.
  • Выдаленне ў адзін клік. Меню дзеянняў → «Выдаліць» сцірае сам голас, запіс падцвярджэння і прэв'ю. Улічыце: аб'явы і расклады, якія выкарыстоўвалі гэты голас, перастануць ім азвучвацца.
  • Згода фіксуецца. Мы захоўваем, якую версію ўмоў вы прынялі і калі — для кожнага голасу асобна.
  • Голас бачны толькі вашай бібліятэцы кантэнту. Іншыя акаўнты Tunio не ўбачаць яго ні ў каталогу, ні ў API.

Частыя пытанні

Ці можна загрузіць голас іншага чалавека — напрыклад, вядучага або акцёра?

Так, калі ў вас ёсць яго выразная згода на кланаванне — вы падцвярджаеце гэта на першым кроку. Але прайсці падцвярджэнне мусіць менавіта ён: фразу трэба прачытаць тым жа голасам, што і ва ўзоры.

На якіх мовах гаворыць клон?

На любой з дзясяткаў моў, якія падтрымліваюцца, — мадэль азвучвае тэкст на той мове, на якой ён напісаны. Узор пры гэтым можа быць на любой мове.

Што рабіць, калі голас адхілены?

Паглядзіце прычыну пры навядзенні на статус. Калі не супаў тэкст — чытайце фразу цалкам, выразна і без пропускаў. Калі не супаў голас — запісвайцеся ў тых жа ўмовах, што і ўзор, і тым жа голасам. Затым «Падцвердзіць голас» → новая фраза → новы запіс.

Колькі чакаць праверкі?

Звычайна пару хвілін. Спіс галасоў абнаўляецца аўтаматычна.

На якім тарыфе даступнае кланаванне голасу?

На тарыфах, дзе ўключаны карыстальніцкія галасы, — укладка «Мае галасы» з'яўляецца ў профілі аўтаматычна. Калі яе няма, паглядзіце ўмовы свайго тарыфу ў раздзеле аплаты.

Паспрабуйце ў сваім эфіры

Запішыце 20 секунд маўлення, падцвердзіце голас — і наступны джынгл або аб'ява пра зніжкі выйдзе ў эфір вашым голасам.