Przejrzysty przewodnik po studiu: dubbing, głosy i tworzenie własnego głosu, konwersja głosu, transkrypcja, eksport, plany i API. Wybierz temat po lewej. Do integracji jest osobna dokumentacja API.
HancVoice zamienia tekst w naturalną mowę za pomocą sieci neuronowej. Możesz tworzyć dubbing do scenariuszy, artykułów, książek i reklam z użyciem systemowych lub własnych głosów, a także transkrybować audio i wideo na tekst.
Pierwsze kroki
Zarejestruj się — przy rejestracji otrzymasz 10.000 znaków za darmo, bez karty.
Główny ekran studia. Tutaj wpisujesz tekst, wybierasz głos i otrzymujesz audio.
Wprowadzanie tekstu
Wpisz lub wklej — po prostu wpisz w polu; licznik pokazuje objętość i limit na jedno zapytanie.
Dyktuj — powiedz to na głos (do 30 sekund), rozpoznamy to i wstawimy tekst.
Plik — prześlij .txt lub .md.
Głos, język, intonacja
Wybierz głos i język na dole. „Smart intonation” automatycznie przypisuje emocje do każdego zdania; możesz ustawić ogólny nastrój i prędkość mowy.
Posłuchaj i pobierz
Przycisk „Voice” odtwarza wynik w przeglądarce (bezpłatny okres próbny). Przycisk „Export” tworzy gotowy plik i jednorazowo nalicza znaki za cały tekst — więcej w sekcji „Jak liczone są znaki”.
Nie musisz wpisywać ani wklejać tekstu: przycisk „File” wczytuje .txt i .md (kodowanie jest wykrywane automatycznie), a także książki .fb2 i .epub — tekst rozdziałów pojawia się w edytorze. Do lektury całych książek wygodniejsza jest osobna sekcja „Audiobook”.
Każde wygenerowanie jest trochę inne — to normalne dla sieci neuronowej. Możesz przypiąć wersję, która Ci się podoba, a wtedy dźwięk przestanie się zmieniać.
Nacisk — ustawia akcentowaną sylabę w słowie, jeśli silnik odczytał je źle.
Wzrost ↑ i Spadek ↓ — dwa osobne przyciski: podnoszą lub obniżają melodię na końcu frazy (pytanie, lista, zdanie zamykające).
Intonacja — przycisk w wierszu „Text & AI”: AI oznacza akcenty, spadki i przerwy w całym tekście. Dostępne w płatnych planach. Nie myl z „Smart mood”, który dotyczy emocji, a nie melodii.
Przerwy wstawione ikoną w tekście są uwzględniane zarówno w podglądzie edytora, jak i w pobranym pliku. „Leading pause” w bloku „Sound” dodaje dodatkową ciszę na samym początku pliku.
Ponad 326 gotowych głosów w 24 językach — męskie i żeńskie, o różnych charakterach. 10 języków objętych jest gwarancją jakości, a dodatkowo 14 więcej w wersji beta przez tryb automatyczny (wszystkie języki).
Jak wybrać
Otwórz listę głosów w edytorze lub sekcję „Głosy” w studiu.
Każdy głos ma język, płeć i styl; posłuchaj podglądu przed wyborem.
Głos z biblioteki mówi w swoim rodzimym języku.
Moje głosy
Głosy, które tworzysz, pojawiają się na tej samej liście i w rozwijanym menu edytora. Zarządzaj nimi przez menu „⋯” przy głosie.
Przenosi wykonanie — interpretację i intonację aktora — na wybrany przez Ciebie głos. Funkcja w planie płatnym (od Starter); sekcja jest oznaczona jako „beta”.
Jak to działa
Prześlij próbkę mowy z potrzebnym sposobem wykonania.
Wybierz głos, którym chcesz „przestawić” to wykonanie.
Otrzymujesz ten sam tekst i intonację, ale w innym brzmieniu.
Gotowy wynik można dopracować w edytorze — equalizer, „Zrób czyściej”, tła (zobacz Dźwięk i efekty).
Marketplace autorskich głosów: autor publikuje swój głos, kupujący zyskuje dostęp do opublikowanych głosów. Sekcja jest przygotowywana do startu — otwieramy wczesny dostęp dla autorów.
Co to jest
To kolejna warstwa po głosach systemowych i prywatnych: autor wypełnia kartę głosu (opis, tagi, demo), potwierdza prawa, przechodzi moderację — i głos staje się dostępny dla innych użytkowników.
Jak opublikować swój głos (dla autorów)
Utwórz głos i zapisz wariant brzmienia, który Ci się podoba.
Wypełnij kartę: nazwa, opis, demo, zasady użycia.
Potwierdź prawa do głosu i wyślij kartę do moderacji.
Po akceptacji głos pojawia się w showcase; kupujący uzyskuje dostęp po płatności.
Zarobki i wypłaty
Sprzedaż i udział autora są śledzone na koncie. Przy uruchomieniu wypłaty odbywają się na ręczny wniosek po sprawdzeniu Twoich danych oraz, zależnie od statusu podatkowego, wymaganych dokumentów. Dokładne warunki i progi są w dokumencie „Zasady wypłat”. Automatyczne wypłaty są opracowywane jako osobny etap.
Głos to dane osobowe. Możesz publikować tylko własny głos lub głos z udokumentowaną zgodą i prawami — zobacz „Prawa do głosu i prywatność”.
Udźwiękowij cały książkę rozdział po rozdziale: prześlij plik i otrzymaj audiobook głosem, który wybierzesz. Udźwiękowianie działa w tle — możesz zamknąć stronę.
Jak to działa
Kliknij „Nowy audiobook” i prześlij plik .fb2, .epub lub .txt (do 25 MB). Książka jest dzielona automatycznie na rozdziały.
Wybierz głos (swój lub z katalogu) i odtwórz próbkę — pierwsze linie książki w tym głosie.
Kliknij „Udźwiękowij książkę” — rozdziały są udźwiękowiane jeden po drugim z widocznym postępem i nazwą bieżącego rozdziału. Możesz też udźwiękowić rozdziały osobno za pomocą „Udźwiękowij rozdział”.
Gotowe rozdziały są osobnymi plikami MP3: słuchaj w przeglądarce lub pobierz.
Możesz zmienić głos gotowej książki: „Zmień głos” ponownie udźwiękawia całą książkę, aby rozdziały nie brzmiały inaczej.
Ile to kosztuje
Znaki są naliczane tylko za to, co rzeczywiście zostało udźwiękowione: cała książka przy pierwszym uruchomieniu, a potem tylko rozdziały nieudźwiękowione lub edytowane. Jeśli udźwiękowianie zostanie przerwane, znaki za niedokończone rozdziały są automatycznie zwracane. Audiobooki są dostępne w płatnych planach.
Edytowanie tekstu rozdziału
Każdy rozdział ma przycisk ołówka: otwórz tekst, popraw literówki, wstaw pauzy (‖) lub uruchom „Smart prep”; błędnie wymawiane słowa są poprawiane przez słownik wymowy (prowadzony przez pomoc). Po zapisaniu rozdział jest oznaczony jako „edytowany” i można go ponownie udźwiękowić osobno — koszt jest pokazany od razu w wierszu.
Śledź podczas słuchania
Podczas odtwarzania rozdziału fragment wypowiadany jest podświetlany w tekście — czytasz razem i od razu widzisz, gdzie coś brzmi źle. Kliknij dowolne miejsce w tekście, aby przejść tam od razu w odtwarzaczu.
Ponownie udźwiękowij jeden fragment
Jeśli przeszkadza tylko jedno zdanie, nie ma potrzeby ponownie udźwiękawiać całego rozdziału: każdy fragment ma przycisk „Ponownie udźwiękowij fragment”. Nowy dźwięk jest dokładnie wstawiany do istniejącego pliku, reszta rozdziału pozostaje bez zmian — i naliczane są tylko znaki tego fragmentu.
Pobierz całą książkę
Oprócz poszczególnych rozdziałów możesz pobrać całą książkę jako jeden plik: MP3 (jeden ciągły plik) lub M4B — format audiobooka ze znacznikami rozdziałów, które odtwarzacze pokazują jako spis treści i używają do zapamiętania twojej pozycji. Plik jest tworzony przy pierwszym pobraniu; rozdziały dodane później wymagają ponownego utworzenia.
Sprawdzenie robota
Po nagraniu robot odsłuchuje każdy rozdział i porównuje go z tekstem. Jeśli coś brzmi podejrzanie, w wierszu rozdziału pojawia się „⚠ podejrzane miejsca” — kliknięcie miejsca przenosi odtwarzacz dokładnie tam.
Rozdziały można zmieniać nazwę, usuwać, przestawiać i dodawać ręcznie — przyciski są w panelu edycji rozdziału.
Audio i wideo na tekst — z kodami czasowymi. Transkrypcja jest dostępna od planu Pro wzwyż (nie jest wliczona w Free ani Starter); etykiety mówców i podsumowania są w planie Business.
Jak transkrybować
Prześlij audio lub wideo — otrzymaj tekst z kodami czasowymi. W Pro transkrypcja jest ciągłym tekstem, bez oznaczeń mówców.
Oznaczenia mówców, „Wykryj imiona z AI” i podsumowanie — od planu Business. „Wykryj imiona z AI” uzupełnia imiona mówców na podstawie dialogu; jeśli nie jest pewna, zostawia „Speaker N”.
„Ulepsz z AI” — dwa tryby: „Delikatnie” (poprawia tylko oczywiste błędy rozpoznawania) i „Wygładź tekst” (śmielej: usuwa powtórzenia, poprawia gramatykę).
Ilość transkrypcji miesięcznie zależy od planu (minuty są wliczone w Pro i wyżej); diarizacja mówców i podsumowanie — od planu Business. Nieudaną transkrypcję można uruchomić ponownie przyciskiem „Ponów”.
Bardzo długi tekst (książka, duży scenariusz) jest eksportowany w tle: możesz zamknąć kartę, a e-mail przyjdzie, gdy będzie gotowy. Postęp jest widoczny w edytorze.
Równa narracja — artykuł/dokument
Od 5 000 znaków: tekst jest dzielony na fragmenty, barwa głosu pozostaje stabilna w całym dokumencie, a głośność jest wyrównywana na końcu — tak samo, jak są czytane nasze artykuły na blogu. Oznaczenia, emocje i intonacja nie są w tym trybie stosowane; eksport działa w tle i jest dostępny w płatnych planach.
Pobranie ponownie tego samego gotowego pliku jest bezpłatne. Znaki są naliczane raz, gdy plik jest tworzony.
Szczegóły dotyczące gotowych eksportów: gdzie je znaleźć, jak długo są przechowywane i w jakiej jakości.
Gdzie pobrać ponownie
Gotowy plik pobiera się zaraz po eksporcie. Ponowne pobranie tego samego pliku jest bezpłatne; znaki zostały już rozliczone i nie są naliczane ponownie.
Jak długo pliki są przechowywane
Gotowe eksporty są dostępne do ponownego pobrania przez około 5 dni (okresy są orientacyjne i będą doprecyzowywane wraz z rozwojem usługi). Jeśli chcesz zachować plik na dłużej, pobierz go zaraz po przygotowaniu. Nie możesz znaleźć pliku — napisz do supportu.
Format i jakość
WAV — bez kompresji, maksymalna jakość, do edycji i dalszego przetwarzania.
MP3 — kompaktowy, około 192 kbit/s, wygodny do publikowania i udostępniania.
Przesłany do transkrypcji plik audio/wideo jest przechowywany krótko i automatycznie usuwany — sam tekst transkrypcji pozostaje w projekcie.
Płacisz za rezultat — za utworzony plik, nie za podgląd.
Saldo i plan to różne rzeczy
Saldo — ile znaków możesz wykorzystać (portfel).
Plan — Twoje limity i funkcje: znaki na żądanie, efekty, dostęp do API.
Podgląd w edytorze jest bezpłatny, ale dziennie ograniczony (ochrona przed nadużyciami): po osiągnięciu dziennego limitu pojawia się komunikat — podgląd znów będzie dostępny następnego dnia, a eksporty nie są objęte limitem.
Za co naliczane są znaki
Podgląd w edytorze — bezpłatny, do 3.000 znaków naraz (próba jakości).
Eksport (pobranie pliku) — nalicza znaki za cały tekst jednorazowo.
Ponowne pobranie gotowego pliku — bezpłatne.
Transkrypcja: ≈1 000 znaków na minutę audio (naliczane po fakcie, według długości nagrania).
Konwersja głosu i zapisane warianty dźwięku: według długości przetworzonego tekstu lub audio.
Jeśli generowanie się nie powiedzie, znaki są automatycznie zwracane. Płacisz tylko za plik, który rzeczywiście został utworzony.
Jak przełączyć się na inny plan i jak działa odnowienie.
Zmień plan na wyższy
Otwórz sekcję „Plan i limity” w studio i opłać wybrany plan — nowe limity i funkcje włączą się zaraz po płatności.
Zmień plan na niższy
Jeśli potrzebujesz niższego planu, wybierz go w tej samej sekcji przy następnej płatności. W sprawie zmiany w trakcie okresu i przeliczenia — napisz do supportu, pomożemy wybrać opcję.
Co zawiera każdy plan
Plan określa: ile znaków obejmuje miesięcznie, maksymalną liczbę znaków na jedno żądanie, dostęp do efektów premium i inteligentnego przygotowania tekstu, minuty transkrypcji oraz dostęp do API. Free — do testów; API i zaawansowane funkcje są dostępne od planu Starter wzwyż. Pełne porównanie znajdziesz na stronie „Plany”. Głosy niestandardowe są nielimitowane we wszystkich płatnych planach — utworzenie głosu kosztuje 10.000 znaków z salda; przechowywanie i używanie są bezpłatne.
Automatyczne odnowienie
Zakup planu to subskrypcja: płatność odnawia się automatycznie (miesięcznie lub rocznie) aż do anulowania. Możesz anulować w dowolnym momencie — w swoim koncie w sekcji „Plan i limity” — link „Anuluj subskrypcję” lub przez link w potwierdzeniu płatności; dostęp pozostaje do końca opłaconego okresu. Pakiety jednorazowych znaków nie odnawiają się.
Saldo znaków i plan to dwie różne rzeczy: zmiana planu nie resetuje znaków już zakupionych na saldzie.
Co możesz opłacić i co zrobić w przypadku organizacji.
Metody płatności
Płatność odbywa się przez bezpieczną stronę dostawcy: karty bankowe Visa/Mastercard. Po płatności na Twój e-mail przyjdzie potwierdzenie.
Przelew bankowy i umowa dla firm
Płatność online działa kartą. Jeśli organizacja potrzebuje umowy lub płatności na fakturę, napisz do support — omówimy szczegóły. Dane firmy są opublikowane na stronie „Dane firmy”.
Konto jest przeznaczone dla jednego użytkownika — osobne miejsca dla zespołu i konta współdzielone nie są jeszcze dostępne.
Weryfikacja e-mail, hasło, zmiana danych i usuwanie konta.
Weryfikacja e-mail
Aby generować mowę, musisz potwierdzić e-mail. W sekcji „Konto” poproś o kod — przyjdzie na Twój e-mail i będzie ważny 15 minut. Nie dotarł — sprawdź folder „Spam” i adres, a następnie poproś o kod ponownie.
Reset hasła
Na stronie logowania kliknij „Nie pamiętasz hasła?” i wpisz swój e-mail — przyjdzie kod do zmiany hasła (ważny 15 minut). Nie dotarł — sprawdź „Spam” lub napisz do support.
Zmiana hasła
W swoim koncie, w sekcji „Konto”, możesz zmienić hasło — do potwierdzenia wymagane jest obecne hasło.
Zmiana e-mail
Nie możesz samodzielnie zmienić adresu e-mail. Jeśli musisz zmienić powiązany e-mail — napisz do pomocy technicznej z obecnego adresu.
Usuwanie konta
W swoim koncie, w sekcji „Konto”, jest usuwanie konta — trzeba będzie wprowadzić hasło, aby potwierdzić. Konto, głosy, projekty i historia zostaną usunięte, a sesja zakończy się. Działanie jest nieodwracalne.
Konto jest przeznaczone dla jednego użytkownika — miejsca dla zespołu i konta współdzielone nie są jeszcze dostępne.
Efekty premium i inteligentne przygotowanie tekstu są dostępne w płatnym planie; w darmowym są ignorowane. Sprawdź swój plan lub użyj podstawowych funkcji.
Podgląd się nie odtwarza
Sprawdź dźwięk i uprawnienie do odtwarzania w przeglądarce, a następnie odśwież stronę. Jeśli to nie pomoże — napisz do pomocy technicznej i podaj przeglądarkę oraz urządzenie.
Głos zniknął z listy
Głos mógł zostać usunięty. Jeśli go nie usuwałeś — napisz do pomocy technicznej, pomożemy go przywrócić.
„Nieskończone przetwarzanie” długiego eksportu
Długie teksty są przetwarzane w tle. Jeśli zadanie utknęło na długo — uruchom eksport ponownie (znaki za nieudane podejście zostaną zwrócone). Jeśli sytuacja się powtórzy — napisz do pomocy technicznej.
„Usługa zajęta” / błąd 503
Silnik się uruchamia lub obsługuje kolejkę. Spróbuj ponownie za kilka sekund.
Musisz zweryfikować e-mail, aby zamieniać tekst na głos: kod weryfikacyjny jest w sekcji „Konto”.
Najczęściej transkrypcja próbki nie zgadza się z nagraniem słowo w słowo. Nagraj próbkę ponownie i wpisz dokładnie to, co jest mówione. Pomaga krótka, precyzyjna próbka czystej mowy.
Płeć głosu się zmieniła
Utwórz głos ponownie z czystej, równej próbki 30–90 sekund. Jeśli to się powtarza — napisz do pomocy technicznej.
„Limit głosów planu został osiągnięty”
Plan Free zawiera 1 głos testowy; w płatnych planach liczba własnych głosów jest nieograniczona (utworzenie jednego kosztuje 10.000 znaków z salda; przechowywanie i używanie jest bezpłatne). Jeśli widzisz ten komunikat w Free — usuń głos testowy albo przejdź na płatny plan.
Możesz przesłać tylko swój własny głos lub głos, do którego masz prawa (zobacz „Prawa do głosu i prywatność”).
Potwierdzenie płatności czasem przychodzi z opóźnieniem — poczekaj kilka minut i odśwież stronę. Jeśli znaki nadal nie dotarły — napisz do pomocy technicznej i podaj e-mail, datę, godzinę oraz kwotę płatności; sprawdzimy i doliczymy je.
Podwójne obciążenie
Napisz do pomocy technicznej z danymi płatności — sprawdzimy i zwrócimy nadwyżkę.
Płatność nie powiodła się / odrzucono 3DS
Spróbuj innej karty, sprawdź limity karty i potwierdzenie z banku. Przy nieudanej płatności pieniądze nie są pobierane.
Zwrot
Zwrot jest realizowany tą samą metodą, którą dokonano płatności, i zwykle trwa do 5 dni roboczych (terminy są orientacyjne i są doprecyzowywane wraz z rozwojem usługi). W sprawie zwrotu — napisz do pomocy.
Automatyczne odnowienie
Subskrypcja planu odnawia się automatycznie. Możesz ją anulować w dowolnym momencie na koncie w sekcji „Plan i limity” — link „Anuluj subskrypcję” — dostęp pozostaje do końca bieżącego okresu rozliczeniowego i nie jest pobierana dalsza opłata.
Darmowe: po rejestracji otrzymasz 10.000 znaków, bez karty. Potem — plan albo pakiet znaków.
Dlaczego za każdym razem dźwięk jest trochę inny?
To sieć neuronowa, czyta z życiem. Możesz przypiąć wersję, która Ci się podoba, i przestanie się zmieniać.
W jakich językach działa lektor?
10 głównych języków z gwarancją jakości: niemiecki, angielski, francuski, hiszpański, włoski, portugalski, rosyjski, chiński, japoński i koreański — plus 14 kolejnych języków w beta przez tryb automatyczny (wszystkie języki). Każdy głos ma swój język ojczysty.
Czy mogę udźwiękowić całą książkę?
Tak. Długi tekst jest eksportowany w tle, a gdy będzie gotowy, przychodzi e-mail.
Czy tworzenie własnego głosu jest bezpieczne?
Tak: głos jest prywatny, nie jest publikowany bez moderacji i można go usunąć. Możesz przesłać tylko swój własny głos albo taki, na który masz zgodę.