Komponent Google Text to Speech — sgcAI | eSeGeCe

Text to Speech (Google)

TsgcTextToSpeechGoogle syntezuje mowę przez Google Cloud Text-to-Speech. Podpisuje JWT konta usługi, żąda dźwięku, dekoduje go do pliku i odtwarza przez przypisany przez ciebie odtwarzacz audio, więc szeroki katalog głosów i języków dzieli od ciebie jedna właściwość.

TsgcTextToSpeechGoogle

Zaplecze mowy w Google Cloud. Wklej JSON konta usługi do opcji, wybierz język, płeć i głos, a następnie wywołaj jedną metodę.

Klasa komponentu

TsgcTextToSpeechGoogle

Przeznaczenie

Synteza mowy Google Cloud

Platformy

Win32 i Win64

sgcAI jest samowystarczalny. Ten komponent jest dostarczany w sgcAI razem ze środowiskiem uruchomieniowym sgcWebSockets Core, na którym jest zbudowany, więc nie ma licencji bazowej do kupienia.

Mów głosem z Google Cloud

Podaj poświadczenia konta usługi, wybierz głos, podłącz odtwarzacz audio.

uses
  sgcAI, sgcAI_TextToSpeech_Google, sgcAI_AudioPlayer_MCI;

var
  oTTS: TsgcTextToSpeechGoogle;
begin
  oTTS := TsgcTextToSpeechGoogle.Create(nil);
  oTTS.AudioPlayer := sgcAudioPlayerMCI1;

  // The service account JSON, pasted as-is.
  oTTS.GoogleOptions.Settings.LoadFromFile('service-account.json');
  oTTS.GoogleOptions.Language      := 'en-US';
  oTTS.GoogleOptions.VoiceId       := 'en-US-Neural2-C';
  oTTS.GoogleOptions.AudioEncoding := 'MP3';
  oTTS.GoogleOptions.FileName      := 'speech.mp3';

  oTTS.TextToSpeech('The order has been shipped.');
end;
// includes: sgcAI.hpp, sgcAI_TextToSpeech_Google.hpp

TsgcTextToSpeechGoogle *oTTS = new TsgcTextToSpeechGoogle(NULL);
oTTS->AudioPlayer = sgcAudioPlayerMCI1;

oTTS->GoogleOptions->Settings->LoadFromFile("service-account.json");
oTTS->GoogleOptions->Language = "en-US";
oTTS->GoogleOptions->VoiceId  = "en-US-Neural2-C";

oTTS->TextToSpeech("The order has been shipped.");

Kluczowe właściwości i metody

Składowe, po które sięgasz najczęściej.

GoogleOptions

Settings przechowuje JSON konta usługi, Language i VoiceId wybierają głos, Gender wskazuje głos domyślny, gdy nie podano identyfikatora, a AudioEncoding oraz FileName sterują zsyntezowanym dźwiękiem.

AudioPlayer

AudioPlayer odtwarza zsyntezowany plik. Przypisz TsgcAudioPlayerMCI, a odtwarzanie ruszy, gdy tylko nadejdzie odpowiedź.

Uwierzytelnianie

Komponent buduje i podpisuje JWT kluczem prywatnym z konta usługi, a następnie buforuje token dostępu do jego wygaśnięcia, więc długo działająca aplikacja nie uwierzytelnia się ponownie przy każdej frazie.

TextToSpeech

TextToSpeech(aText) wykonuje cały cykl: żądanie, dekodowanie, zapis, odtworzenie i usunięcie pliku tymczasowego.

Cykl życia

OnStart i OnStop obejmują operację, i właśnie dzięki temu komponenty chatbota i tłumacza wznawiają nagrywanie po wypowiedzeniu odpowiedzi.

Wymienność

Ten sam interfejs co w komponentach mowy systemowej i Amazon, więc chatbot, tłumacz i asystent przyjmują dowolny z nich bez zmian w kodzie.

Specyfikacje i materiały źródłowe

Miarodajne źródła dla usług i protokołów, z których korzysta ten komponent.

Poznawaj dalej

Pomoc onlinePełna dokumentacja API i przewodnik użytkowania komponentów sgcAI.
Wszystkie komponenty sgcAIPrzejrzyj pełną matrycę funkcji wszystkich 15 komponentów.
Pobierz bezpłatną wersję próbnąSyntezuj mowę we własnym projekcie Google Cloud.
CennikLicencje Single, Team i Site, pełny kod źródłowy, bez wymaganego produktu bazowego.
Najkorzystniejsza oferta: All-AccessWszystkie produkty eSeGeCe, ze wsparciem Premium w cenie, już od €1,059 rocznie.
Zobacz cennik All-Access

Gotowy, aby zacząć?

Pobierz bezpłatną wersję próbną i nadaj swojej aplikacji głos z Google Cloud.