Text to Speech (Amazon)
TsgcTextToSpeechAmazon syntezuje mowę przez Amazon Polly. Żądania AWS są podpisywane za ciebie, silnik, głos i format wyjściowy są właściwościami, a powstały dźwięk odtwarza się przez przypisany przez ciebie odtwarzacz audio.
TsgcTextToSpeechAmazon syntezuje mowę przez Amazon Polly. Żądania AWS są podpisywane za ciebie, silnik, głos i format wyjściowy są właściwościami, a powstały dźwięk odtwarza się przez przypisany przez ciebie odtwarzacz audio.
Zaplecze Amazon Polly. Uzupełnij poświadczenia AWS i region, wybierz silnik oraz głos, a następnie wywołaj jedną metodę.
TsgcTextToSpeechAmazon
Synteza mowy Amazon Polly
Win32 i Win64
sgcAI jest samowystarczalny. Ten komponent jest dostarczany w sgcAI razem ze środowiskiem uruchomieniowym sgcWebSockets Core, na którym jest zbudowany, więc nie ma licencji bazowej do kupienia.
Ustaw poświadczenia AWS i region, wybierz silnik oraz głos, podłącz odtwarzacz audio.
uses
sgcAI, sgcAI_TextToSpeech_Amazon, sgcAI_AudioPlayer_MCI;
var
oTTS: TsgcTextToSpeechAmazon;
begin
oTTS := TsgcTextToSpeechAmazon.Create(nil);
oTTS.AudioPlayer := sgcAudioPlayerMCI1;
oTTS.AmazonOptions.AWSOptions.AccessKey := 'AKIA...';
oTTS.AmazonOptions.AWSOptions.SecretKey := '...';
oTTS.AmazonOptions.AWSOptions.Region := 'eu-west-1';
oTTS.AmazonOptions.Engine := 'neural';
oTTS.AmazonOptions.VoiceId := 'Joanna';
oTTS.AmazonOptions.OutputFormat := 'mp3';
oTTS.AmazonOptions.FileName := 'speech.mp3';
oTTS.TextToSpeech('The order has been shipped.');
end;
// includes: sgcAI.hpp, sgcAI_TextToSpeech_Amazon.hpp
TsgcTextToSpeechAmazon *oTTS = new TsgcTextToSpeechAmazon(NULL);
oTTS->AudioPlayer = sgcAudioPlayerMCI1;
oTTS->AmazonOptions->AWSOptions->AccessKey = "AKIA...";
oTTS->AmazonOptions->AWSOptions->SecretKey = "...";
oTTS->AmazonOptions->AWSOptions->Region = "eu-west-1";
oTTS->AmazonOptions->VoiceId = "Joanna";
oTTS->TextToSpeech("The order has been shipped.");
Składowe, po które sięgasz najczęściej.
AWSOptions niesie klucz dostępu, klucz tajny i region. Engine, VoiceId, OutputFormat, TextType i FileName kształtują żądanie syntezy.
Żądania są podpisywane przez AWS Signature Version 4 przez ten sam stos klienta AWS, którego używają pozostałe komponenty Amazon, więc żaden osobny SDK ani CLI nie jest potrzebny.
TextType przełącza między zwykłym tekstem a SSML, i tak właśnie sterujesz pauzami, akcentowaniem i wymową w wypowiadanym tekście.
AudioPlayer odtwarza plik zwrócony przez Polly. Przypisz TsgcAudioPlayerMCI, a odtwarzanie ruszy, gdy tylko odpowiedź zostanie zapisana.
Gdy Polly zwróci dokument błędu zamiast dźwięku, plik tymczasowy zostaje usunięty i zgłaszany jest wyjątek niosący tekst błędu usługi, więc błędny identyfikator głosu albo region ujawnia się natychmiast.
Ten sam interfejs co w komponentach mowy systemowej i Google, więc dowolny z nich można przypisać do chatbota, tłumacza lub asystenta.
Miarodajne źródła dla usług i protokołów, z których korzysta ten komponent.
| Pomoc onlinePełna dokumentacja API i przewodnik użytkowania komponentów sgcAI. | Otwórz | |
| Wszystkie komponenty sgcAIPrzejrzyj pełną matrycę funkcji wszystkich 15 komponentów. | Otwórz | |
| Pobierz bezpłatną wersję próbnąSyntezuj mowę na własnym koncie AWS. | Otwórz | |
| CennikLicencje Single, Team i Site, pełny kod źródłowy, bez wymaganego produktu bazowego. | Otwórz |