Komponent Amazon Polly Text to Speech — sgcAI | eSeGeCe

Text to Speech (Amazon)

TsgcTextToSpeechAmazon syntezuje mowę przez Amazon Polly. Żądania AWS są podpisywane za ciebie, silnik, głos i format wyjściowy są właściwościami, a powstały dźwięk odtwarza się przez przypisany przez ciebie odtwarzacz audio.

TsgcTextToSpeechAmazon

Zaplecze Amazon Polly. Uzupełnij poświadczenia AWS i region, wybierz silnik oraz głos, a następnie wywołaj jedną metodę.

Klasa komponentu

TsgcTextToSpeechAmazon

Przeznaczenie

Synteza mowy Amazon Polly

Platformy

Win32 i Win64

sgcAI jest samowystarczalny. Ten komponent jest dostarczany w sgcAI razem ze środowiskiem uruchomieniowym sgcWebSockets Core, na którym jest zbudowany, więc nie ma licencji bazowej do kupienia.

Mów głosem Amazon Polly

Ustaw poświadczenia AWS i region, wybierz silnik oraz głos, podłącz odtwarzacz audio.

uses
  sgcAI, sgcAI_TextToSpeech_Amazon, sgcAI_AudioPlayer_MCI;

var
  oTTS: TsgcTextToSpeechAmazon;
begin
  oTTS := TsgcTextToSpeechAmazon.Create(nil);
  oTTS.AudioPlayer := sgcAudioPlayerMCI1;

  oTTS.AmazonOptions.AWSOptions.AccessKey := 'AKIA...';
  oTTS.AmazonOptions.AWSOptions.SecretKey := '...';
  oTTS.AmazonOptions.AWSOptions.Region    := 'eu-west-1';

  oTTS.AmazonOptions.Engine       := 'neural';
  oTTS.AmazonOptions.VoiceId      := 'Joanna';
  oTTS.AmazonOptions.OutputFormat := 'mp3';
  oTTS.AmazonOptions.FileName     := 'speech.mp3';

  oTTS.TextToSpeech('The order has been shipped.');
end;
// includes: sgcAI.hpp, sgcAI_TextToSpeech_Amazon.hpp

TsgcTextToSpeechAmazon *oTTS = new TsgcTextToSpeechAmazon(NULL);
oTTS->AudioPlayer = sgcAudioPlayerMCI1;

oTTS->AmazonOptions->AWSOptions->AccessKey = "AKIA...";
oTTS->AmazonOptions->AWSOptions->SecretKey = "...";
oTTS->AmazonOptions->AWSOptions->Region    = "eu-west-1";

oTTS->AmazonOptions->VoiceId = "Joanna";
oTTS->TextToSpeech("The order has been shipped.");

Kluczowe właściwości i metody

Składowe, po które sięgasz najczęściej.

AmazonOptions

AWSOptions niesie klucz dostępu, klucz tajny i region. Engine, VoiceId, OutputFormat, TextType i FileName kształtują żądanie syntezy.

Podpisywanie żądań

Żądania są podpisywane przez AWS Signature Version 4 przez ten sam stos klienta AWS, którego używają pozostałe komponenty Amazon, więc żaden osobny SDK ani CLI nie jest potrzebny.

SSML

TextType przełącza między zwykłym tekstem a SSML, i tak właśnie sterujesz pauzami, akcentowaniem i wymową w wypowiadanym tekście.

AudioPlayer

AudioPlayer odtwarza plik zwrócony przez Polly. Przypisz TsgcAudioPlayerMCI, a odtwarzanie ruszy, gdy tylko odpowiedź zostanie zapisana.

Obsługa błędów

Gdy Polly zwróci dokument błędu zamiast dźwięku, plik tymczasowy zostaje usunięty i zgłaszany jest wyjątek niosący tekst błędu usługi, więc błędny identyfikator głosu albo region ujawnia się natychmiast.

Wymienność

Ten sam interfejs co w komponentach mowy systemowej i Google, więc dowolny z nich można przypisać do chatbota, tłumacza lub asystenta.

Specyfikacje i materiały źródłowe

Miarodajne źródła dla usług i protokołów, z których korzysta ten komponent.

Poznawaj dalej

Pomoc onlinePełna dokumentacja API i przewodnik użytkowania komponentów sgcAI.
Wszystkie komponenty sgcAIPrzejrzyj pełną matrycę funkcji wszystkich 15 komponentów.
Pobierz bezpłatną wersję próbnąSyntezuj mowę na własnym koncie AWS.
CennikLicencje Single, Team i Site, pełny kod źródłowy, bez wymaganego produktu bazowego.
Najkorzystniejsza oferta: All-AccessWszystkie produkty eSeGeCe, ze wsparciem Premium w cenie, już od €1,059 rocznie.
Zobacz cennik All-Access

Gotowy, aby zacząć?

Pobierz bezpłatną wersję próbną i nadaj swojej aplikacji głos Amazon Polly.