Componente Text to Speech Google — sgcAI | eSeGeCe

Text to Speech (Google)

TsgcTextToSpeechGoogle sintetizza il parlato con Google Cloud Text-to-Speech. Firma un JWT dell'account di servizio, richiede l'audio, lo decodifica in un file e lo riproduce tramite il player audio che gli assegni, così un ampio catalogo di voci e lingue dista una sola proprietà.

TsgcTextToSpeechGoogle

Un backend vocale su Google Cloud. Incolla il JSON dell'account di servizio nelle opzioni, scegli la lingua, il genere e la voce, e chiama un solo metodo.

Classe del componente

TsgcTextToSpeechGoogle

Scopo

Sintesi vocale su Google Cloud

Famiglia

Sintesi vocale

Piattaforme

Win32 e Win64

sgcAI è autonomo. Questo componente è distribuito dentro sgcAI insieme al runtime sgcWebSockets Core su cui è costruito.

Parla con una voce di Google Cloud

Fornisci le credenziali dell'account di servizio, scegli una voce, collega un player audio.

uses
  sgcAI, sgcAI_TextToSpeech_Google, sgcAI_AudioPlayer_MCI;

var
  oTTS: TsgcTextToSpeechGoogle;
begin
  oTTS := TsgcTextToSpeechGoogle.Create(nil);
  oTTS.AudioPlayer := sgcAudioPlayerMCI1;

  // The service account JSON, pasted as-is.
  oTTS.GoogleOptions.Settings.LoadFromFile('service-account.json');
  oTTS.GoogleOptions.Language      := 'en-US';
  oTTS.GoogleOptions.VoiceId       := 'en-US-Neural2-C';
  oTTS.GoogleOptions.AudioEncoding := 'MP3';
  oTTS.GoogleOptions.FileName      := 'speech.mp3';

  oTTS.TextToSpeech('The order has been shipped.');
end;
// includes: sgcAI.hpp, sgcAI_TextToSpeech_Google.hpp

TsgcTextToSpeechGoogle *oTTS = new TsgcTextToSpeechGoogle(NULL);
oTTS->AudioPlayer = sgcAudioPlayerMCI1;

oTTS->GoogleOptions->Settings->LoadFromFile("service-account.json");
oTTS->GoogleOptions->Language = "en-US";
oTTS->GoogleOptions->VoiceId  = "en-US-Neural2-C";

oTTS->TextToSpeech("The order has been shipped.");

Proprietà e metodi principali

I membri che userai più spesso.

GoogleOptions

Settings contiene il JSON dell'account di servizio, Language e VoiceId selezionano la voce, Gender sceglie una voce predefinita quando non viene indicato nessun id, e AudioEncoding e FileName controllano l'audio sintetizzato.

AudioPlayer

AudioPlayer riproduce il file sintetizzato. Assegna un TsgcAudioPlayerMCI e la riproduzione parte non appena arriva la risposta.

Autenticazione

Il componente costruisce e firma un JWT a partire dalla chiave privata contenuta nell'account di servizio, poi mantiene in cache il token di accesso finché non scade, così un'applicazione a lunga esecuzione non si autentica di nuovo a ogni frase.

TextToSpeech

TextToSpeech(aText) esegue l'intero ciclo: richiesta, decodifica, scrittura, riproduzione e pulizia del file temporaneo.

Ciclo di vita

OnStart e OnStop delimitano l'operazione, ed è questo che permette ai componenti chatbot e traduttore di riprendere la registrazione una volta pronunciata la risposta.

Intercambiabile

La stessa interfaccia dei componenti vocali di sistema e Amazon, quindi il chatbot, il traduttore e l'assistente li accettano tutti senza modifiche al codice.

Specifiche e riferimenti

Fonti autorevoli per i servizi e i protocolli usati da questo componente.

Continua a esplorare

Guida onlineRiferimento API completo e guida all'utilizzo dei componenti sgcAI.
Tutti i componenti sgcAIEsplora la matrice completa delle funzionalità di tutti e 15 i componenti.
Scarica la versione di prova gratuitaSintetizza il parlato con il tuo progetto Google Cloud.
PrezziLicenze Single, Team e Site, codice sorgente completo.
La scelta più conveniente: All-AccessTutti i prodotti eSeGeCe, con Supporto Premium incluso, a partire da €1,059/anno.
Vedi i prezzi All-Access

Pronto per iniziare?

Scarica la versione di prova gratuita e dai alla tua applicazione una voce di Google Cloud.