Composant de synthèse vocale Amazon Polly — sgcAI | eSeGeCe

Synthèse vocale (Amazon)

TsgcTextToSpeechAmazon synthétise la parole avec Amazon Polly. Les requêtes AWS sont signées pour toi, le moteur, la voix et le format de sortie sont des propriétés, et l'audio produit est lu par le lecteur audio que tu assignes.

TsgcTextToSpeechAmazon

Un backend Amazon Polly. Renseigne les identifiants AWS et la région, choisis un moteur et une voix, et appelle une seule méthode.

Classe du composant

TsgcTextToSpeechAmazon

Rôle

Synthèse vocale Amazon Polly

Plateformes

Win32 et Win64

sgcAI est autonome. Ce composant est livré dans sgcAI avec le runtime sgcWebSockets Core sur lequel il repose, il n'y a donc aucune licence de base à acheter.

Parler avec une voix Amazon Polly

Renseigne les identifiants AWS et la région, choisis un moteur et une voix, relie un lecteur audio.

uses
  sgcAI, sgcAI_TextToSpeech_Amazon, sgcAI_AudioPlayer_MCI;

var
  oTTS: TsgcTextToSpeechAmazon;
begin
  oTTS := TsgcTextToSpeechAmazon.Create(nil);
  oTTS.AudioPlayer := sgcAudioPlayerMCI1;

  oTTS.AmazonOptions.AWSOptions.AccessKey := 'AKIA...';
  oTTS.AmazonOptions.AWSOptions.SecretKey := '...';
  oTTS.AmazonOptions.AWSOptions.Region    := 'eu-west-1';

  oTTS.AmazonOptions.Engine       := 'neural';
  oTTS.AmazonOptions.VoiceId      := 'Joanna';
  oTTS.AmazonOptions.OutputFormat := 'mp3';
  oTTS.AmazonOptions.FileName     := 'speech.mp3';

  oTTS.TextToSpeech('The order has been shipped.');
end;
// includes: sgcAI.hpp, sgcAI_TextToSpeech_Amazon.hpp

TsgcTextToSpeechAmazon *oTTS = new TsgcTextToSpeechAmazon(NULL);
oTTS->AudioPlayer = sgcAudioPlayerMCI1;

oTTS->AmazonOptions->AWSOptions->AccessKey = "AKIA...";
oTTS->AmazonOptions->AWSOptions->SecretKey = "...";
oTTS->AmazonOptions->AWSOptions->Region    = "eu-west-1";

oTTS->AmazonOptions->VoiceId = "Joanna";
oTTS->TextToSpeech("The order has been shipped.");

Propriétés et méthodes clés

Les membres que tu utilises le plus souvent.

AmazonOptions

AWSOptions porte la clé d'accès, la clé secrète et la région. Engine, VoiceId, OutputFormat, TextType et FileName façonnent la requête de synthèse.

Signature des requêtes

Les requêtes sont signées avec AWS Signature Version 4 par la même pile cliente AWS que celle des autres composants Amazon, aucun SDK ni CLI séparé n'intervient.

SSML

TextType bascule entre texte brut et SSML, c'est ainsi que tu contrôles les pauses, l'accentuation et la prononciation dans la sortie vocale.

AudioPlayer

AudioPlayer lit le fichier renvoyé par Polly. Assigne un TsgcAudioPlayerMCI et la lecture démarre dès que la réponse est écrite.

Gestion des erreurs

Quand Polly renvoie un document d'erreur au lieu de l'audio, le fichier temporaire est supprimé et une exception portant le texte d'erreur du service est levée, une voix ou une région erronée échoue donc bruyamment.

Interchangeable

La même interface que les composants de synthèse vocale système et Google, n'importe lequel peut donc être assigné au chatbot, au traducteur ou à l'assistant.

Spécifications et références

Les sources faisant autorité pour les services et protocoles utilisés par ce composant.

Pour aller plus loin

Aide en ligneRéférence complète de l'API et guide d'utilisation des composants sgcAI.
Tous les composants sgcAIParcours la matrice complète des fonctionnalités des 15 composants.
Télécharger l'essai gratuitSynthétise la parole avec ton propre compte AWS.
TarifsLicences Single, Team et Site, code source complet, aucun produit de base requis.
Meilleur rapport qualité-prix : All-AccessTous les produits eSeGeCe, Support Premium inclus, à partir de €1,059/an.
Voir les tarifs All-Access

Prêt à te lancer ?

Télécharge l'essai gratuit et donne à ton application une voix Amazon Polly.