Componente Text to Speech Amazon Polly — sgcAI | eSeGeCe

Text to Speech (Amazon)

TsgcTextToSpeechAmazon sintetizza il parlato con Amazon Polly. Le richieste AWS vengono firmate per te, il motore, la voce e il formato di uscita sono proprietà, e l'audio risultante viene riprodotto tramite il player audio che gli assegni.

TsgcTextToSpeechAmazon

Un backend su Amazon Polly. Inserisci le credenziali AWS e la regione, scegli un motore e una voce, e chiama un solo metodo.

Classe del componente

TsgcTextToSpeechAmazon

Scopo

Sintesi vocale con Amazon Polly

Famiglia

Sintesi vocale

Piattaforme

Win32 e Win64

sgcAI è autonomo. Questo componente è distribuito dentro sgcAI insieme al runtime sgcWebSockets Core su cui è costruito, quindi non c'è nessuna licenza base da acquistare.

Parla con una voce di Amazon Polly

Imposta le credenziali AWS e la regione, scegli un motore e una voce, collega un player audio.

uses
  sgcAI, sgcAI_TextToSpeech_Amazon, sgcAI_AudioPlayer_MCI;

var
  oTTS: TsgcTextToSpeechAmazon;
begin
  oTTS := TsgcTextToSpeechAmazon.Create(nil);
  oTTS.AudioPlayer := sgcAudioPlayerMCI1;

  oTTS.AmazonOptions.AWSOptions.AccessKey := 'AKIA...';
  oTTS.AmazonOptions.AWSOptions.SecretKey := '...';
  oTTS.AmazonOptions.AWSOptions.Region    := 'eu-west-1';

  oTTS.AmazonOptions.Engine       := 'neural';
  oTTS.AmazonOptions.VoiceId      := 'Joanna';
  oTTS.AmazonOptions.OutputFormat := 'mp3';
  oTTS.AmazonOptions.FileName     := 'speech.mp3';

  oTTS.TextToSpeech('The order has been shipped.');
end;
// includes: sgcAI.hpp, sgcAI_TextToSpeech_Amazon.hpp

TsgcTextToSpeechAmazon *oTTS = new TsgcTextToSpeechAmazon(NULL);
oTTS->AudioPlayer = sgcAudioPlayerMCI1;

oTTS->AmazonOptions->AWSOptions->AccessKey = "AKIA...";
oTTS->AmazonOptions->AWSOptions->SecretKey = "...";
oTTS->AmazonOptions->AWSOptions->Region    = "eu-west-1";

oTTS->AmazonOptions->VoiceId = "Joanna";
oTTS->TextToSpeech("The order has been shipped.");

Proprietà e metodi principali

I membri che userai più spesso.

AmazonOptions

AWSOptions contiene la access key, la secret key e la regione. Engine, VoiceId, OutputFormat, TextType e FileName definiscono la richiesta di sintesi.

Firma delle richieste

Le richieste vengono firmate con AWS Signature Version 4 dallo stesso stack di client AWS che usano gli altri componenti Amazon, quindi non è coinvolto nessun SDK o CLI separato.

SSML

TextType commuta tra testo semplice e SSML, ed è così che controlli pause, enfasi e pronuncia all'interno del parlato prodotto.

AudioPlayer

AudioPlayer riproduce il file restituito da Polly. Assegna un TsgcAudioPlayerMCI e la riproduzione parte non appena la risposta viene scritta.

Gestione degli errori

Quando Polly restituisce un documento di errore invece dell'audio, il file temporaneo viene rimosso e viene sollevata un'eccezione che porta con sé il testo dell'errore del servizio, così un id di voce o una regione sbagliati falliscono in modo evidente.

Intercambiabile

La stessa interfaccia dei componenti vocali di sistema e Google, quindi ognuno di essi può essere assegnato al chatbot, al traduttore o all'assistente.

Specifiche e riferimenti

Fonti autorevoli per i servizi e i protocolli usati da questo componente.

Continua a esplorare

Guida onlineRiferimento API completo e guida all'utilizzo dei componenti sgcAI.
Tutti i componenti sgcAIEsplora la matrice completa delle funzionalità di tutti e 15 i componenti.
Scarica la versione di prova gratuitaSintetizza il parlato con il tuo account AWS.
PrezziLicenze Single, Team e Site, codice sorgente completo, nessun prodotto base richiesto.
La scelta più conveniente: All-AccessTutti i prodotti eSeGeCe, con Supporto Premium incluso, a partire da €1,059/anno.
Vedi i prezzi All-Access

Pronto per iniziare?

Scarica la versione di prova gratuita e dai alla tua applicazione una voce di Amazon Polly.