Componente Text to Speech Google — sgcAI | eSeGeCe

Text to Speech (Google)

TsgcTextToSpeechGoogle sintetizza il parlato con Google Cloud Text-to-Speech. Firma un JWT dell'account di servizio, richiede l'audio, lo decodifica in un file e lo riproduce tramite il player audio che gli assegni, così un ampio catalogo di voci e lingue dista una sola proprietà.

TsgcTextToSpeechGoogle

Un backend vocale su Google Cloud. Incolla il JSON dell'account di servizio nelle opzioni, scegli la lingua, il genere e la voce, e chiama un solo metodo.

Classe del componente

TsgcTextToSpeechGoogle

Scopo

Sintesi vocale su Google Cloud

Famiglia

Sintesi vocale

Piattaforme

Win32 e Win64

sgcAI è autonomo. Questo componente è distribuito dentro sgcAI insieme al runtime sgcWebSockets Core su cui è costruito, quindi non c'è nessuna licenza base da acquistare.

Parla con una voce di Google Cloud

Fornisci le credenziali dell'account di servizio, scegli una voce, collega un player audio.

uses
  sgcAI, sgcAI_TextToSpeech_Google, sgcAI_AudioPlayer_MCI;

var
  oTTS: TsgcTextToSpeechGoogle;
begin
  oTTS := TsgcTextToSpeechGoogle.Create(nil);
  oTTS.AudioPlayer := sgcAudioPlayerMCI1;

  // The service account JSON, pasted as-is.
  oTTS.GoogleOptions.Settings.LoadFromFile('service-account.json');
  oTTS.GoogleOptions.Language      := 'en-US';
  oTTS.GoogleOptions.VoiceId       := 'en-US-Neural2-C';
  oTTS.GoogleOptions.AudioEncoding := 'MP3';
  oTTS.GoogleOptions.FileName      := 'speech.mp3';

  oTTS.TextToSpeech('The order has been shipped.');
end;
// includes: sgcAI.hpp, sgcAI_TextToSpeech_Google.hpp

TsgcTextToSpeechGoogle *oTTS = new TsgcTextToSpeechGoogle(NULL);
oTTS->AudioPlayer = sgcAudioPlayerMCI1;

oTTS->GoogleOptions->Settings->LoadFromFile("service-account.json");
oTTS->GoogleOptions->Language = "en-US";
oTTS->GoogleOptions->VoiceId  = "en-US-Neural2-C";

oTTS->TextToSpeech("The order has been shipped.");

Proprietà e metodi principali

I membri che userai più spesso.

GoogleOptions

Settings contiene il JSON dell'account di servizio, Language e VoiceId selezionano la voce, Gender sceglie una voce predefinita quando non viene indicato nessun id, e AudioEncoding e FileName controllano l'audio sintetizzato.

AudioPlayer

AudioPlayer riproduce il file sintetizzato. Assegna un TsgcAudioPlayerMCI e la riproduzione parte non appena arriva la risposta.

Autenticazione

Il componente costruisce e firma un JWT a partire dalla chiave privata contenuta nell'account di servizio, poi mantiene in cache il token di accesso finché non scade, così un'applicazione a lunga esecuzione non si autentica di nuovo a ogni frase.

TextToSpeech

TextToSpeech(aText) esegue l'intero ciclo: richiesta, decodifica, scrittura, riproduzione e pulizia del file temporaneo.

Ciclo di vita

OnStart e OnStop delimitano l'operazione, ed è questo che permette ai componenti chatbot e traduttore di riprendere la registrazione una volta pronunciata la risposta.

Intercambiabile

La stessa interfaccia dei componenti vocali di sistema e Amazon, quindi il chatbot, il traduttore e l'assistente li accettano tutti senza modifiche al codice.

Specifiche e riferimenti

Fonti autorevoli per i servizi e i protocolli usati da questo componente.

Continua a esplorare

Guida onlineRiferimento API completo e guida all'utilizzo dei componenti sgcAI.
Tutti i componenti sgcAIEsplora la matrice completa delle funzionalità di tutti e 15 i componenti.
Scarica la versione di prova gratuitaSintetizza il parlato con il tuo progetto Google Cloud.
PrezziLicenze Single, Team e Site, codice sorgente completo, nessun prodotto base richiesto.
La scelta più conveniente: All-AccessTutti i prodotti eSeGeCe, con Supporto Premium incluso, a partire da €1,059/anno.
Vedi i prezzi All-Access

Pronto per iniziare?

Scarica la versione di prova gratuita e dai alla tua applicazione una voce di Google Cloud.