Composant de synthèse vocale Google — sgcAI | eSeGeCe

Synthèse vocale (Google)

TsgcTextToSpeechGoogle synthétise la parole avec Google Cloud Text-to-Speech. Il signe un JWT de compte de service, demande l'audio, le décode dans un fichier et le lit via le lecteur audio que tu assignes, un vaste catalogue de voix et de langues est donc à une propriété de distance.

TsgcTextToSpeechGoogle

Un backend vocal Google Cloud. Colle le JSON du compte de service dans les options, choisis la langue, le genre et la voix, et appelle une seule méthode.

Classe du composant

TsgcTextToSpeechGoogle

Rôle

Synthèse vocale Google Cloud

Plateformes

Win32 et Win64

sgcAI est autonome. Ce composant est livré dans sgcAI avec le runtime sgcWebSockets Core sur lequel il repose, il n'y a donc aucune licence de base à acheter.

Parler avec une voix Google Cloud

Fournis les identifiants du compte de service, choisis une voix, relie un lecteur audio.

uses
  sgcAI, sgcAI_TextToSpeech_Google, sgcAI_AudioPlayer_MCI;

var
  oTTS: TsgcTextToSpeechGoogle;
begin
  oTTS := TsgcTextToSpeechGoogle.Create(nil);
  oTTS.AudioPlayer := sgcAudioPlayerMCI1;

  // The service account JSON, pasted as-is.
  oTTS.GoogleOptions.Settings.LoadFromFile('service-account.json');
  oTTS.GoogleOptions.Language      := 'en-US';
  oTTS.GoogleOptions.VoiceId       := 'en-US-Neural2-C';
  oTTS.GoogleOptions.AudioEncoding := 'MP3';
  oTTS.GoogleOptions.FileName      := 'speech.mp3';

  oTTS.TextToSpeech('The order has been shipped.');
end;
// includes: sgcAI.hpp, sgcAI_TextToSpeech_Google.hpp

TsgcTextToSpeechGoogle *oTTS = new TsgcTextToSpeechGoogle(NULL);
oTTS->AudioPlayer = sgcAudioPlayerMCI1;

oTTS->GoogleOptions->Settings->LoadFromFile("service-account.json");
oTTS->GoogleOptions->Language = "en-US";
oTTS->GoogleOptions->VoiceId  = "en-US-Neural2-C";

oTTS->TextToSpeech("The order has been shipped.");

Propriétés et méthodes clés

Les membres que tu utilises le plus souvent.

GoogleOptions

Settings contient le JSON du compte de service, Language et VoiceId sélectionnent la voix, Gender choisit une voix par défaut quand aucun identifiant n'est fourni, et AudioEncoding et FileName contrôlent l'audio synthétisé.

AudioPlayer

AudioPlayer lit le fichier synthétisé. Assigne un TsgcAudioPlayerMCI et la lecture démarre dès l'arrivée de la réponse.

Authentification

Le composant construit et signe un JWT à partir de la clé privée du compte de service, puis met le jeton d'accès en cache jusqu'à son expiration, une application de longue durée ne se réauthentifie donc pas à chaque phrase.

TextToSpeech

TextToSpeech(aText) réalise tout le cycle : requête, décodage, écriture, lecture et nettoyage du fichier temporaire.

Cycle de vie

OnStart et OnStop encadrent l'opération, et c'est ce qui permet aux composants chatbot et traducteur de reprendre l'enregistrement une fois la réponse prononcée.

Interchangeable

La même interface que les composants de synthèse vocale système et Amazon, le chatbot, le traducteur et l'assistant acceptent donc n'importe lequel sans changement de code.

Spécifications et références

Les sources faisant autorité pour les services et protocoles utilisés par ce composant.

Pour aller plus loin

Aide en ligneRéférence complète de l'API et guide d'utilisation des composants sgcAI.
Tous les composants sgcAIParcours la matrice complète des fonctionnalités des 15 composants.
Télécharger l'essai gratuitSynthétise la parole avec ton propre projet Google Cloud.
TarifsLicences Single, Team et Site, code source complet, aucun produit de base requis.
Meilleur rapport qualité-prix : All-AccessTous les produits eSeGeCe, Support Premium inclus, à partir de €1,059/an.
Voir les tarifs All-Access

Prêt à te lancer ?

Télécharge l'essai gratuit et donne à ton application une voix Google Cloud.