Google tekst-naar-spraak-component — sgcAI | eSeGeCe

Tekst-naar-spraak (Google)

TsgcTextToSpeechGoogle synthetiseert spraak met Google Cloud Text-to-Speech. Het ondertekent een JWT van het serviceaccount, vraagt de audio op, decodeert die naar een bestand en speelt hem af via de audiospeler die je toewijst, zodat een brede catalogus met stemmen en talen één eigenschap ver weg is.

TsgcTextToSpeechGoogle

Een spraakbackend van Google Cloud. Plak de JSON van het serviceaccount in de opties, kies de taal, het geslacht en de stem en roep één methode aan.

Componentklasse

TsgcTextToSpeechGoogle

Doel

Spraaksynthese met Google Cloud

Platforms

Win32 en Win64

sgcAI is zelfstandig. Dit component zit in sgcAI, samen met de sgcWebSockets Core runtime waarop het gebouwd is, dus je hoeft geen basislicentie te kopen.

Spreken met een Google Cloud-stem

Geef de inloggegevens van het serviceaccount op, kies een stem en koppel een audiospeler.

uses
  sgcAI, sgcAI_TextToSpeech_Google, sgcAI_AudioPlayer_MCI;

var
  oTTS: TsgcTextToSpeechGoogle;
begin
  oTTS := TsgcTextToSpeechGoogle.Create(nil);
  oTTS.AudioPlayer := sgcAudioPlayerMCI1;

  // The service account JSON, pasted as-is.
  oTTS.GoogleOptions.Settings.LoadFromFile('service-account.json');
  oTTS.GoogleOptions.Language      := 'en-US';
  oTTS.GoogleOptions.VoiceId       := 'en-US-Neural2-C';
  oTTS.GoogleOptions.AudioEncoding := 'MP3';
  oTTS.GoogleOptions.FileName      := 'speech.mp3';

  oTTS.TextToSpeech('The order has been shipped.');
end;
// includes: sgcAI.hpp, sgcAI_TextToSpeech_Google.hpp

TsgcTextToSpeechGoogle *oTTS = new TsgcTextToSpeechGoogle(NULL);
oTTS->AudioPlayer = sgcAudioPlayerMCI1;

oTTS->GoogleOptions->Settings->LoadFromFile("service-account.json");
oTTS->GoogleOptions->Language = "en-US";
oTTS->GoogleOptions->VoiceId  = "en-US-Neural2-C";

oTTS->TextToSpeech("The order has been shipped.");

Belangrijkste eigenschappen & methoden

De leden die je het vaakst gebruikt.

GoogleOptions

Settings bevat de JSON van het serviceaccount, Language en VoiceId kiezen de stem, Gender kiest een standaardstem als er geen id is opgegeven, en AudioEncoding en FileName bepalen de gesynthetiseerde audio.

AudioPlayer

AudioPlayer speelt het gesynthetiseerde bestand af. Wijs een TsgcAudioPlayerMCI toe en het afspelen begint zodra het antwoord binnenkomt.

Authenticatie

Het component bouwt en ondertekent een JWT met de private sleutel uit het serviceaccount en bewaart het access token in de cache tot het verloopt, zodat een langlopende toepassing niet bij elke zin opnieuw hoeft te authenticeren.

TextToSpeech

TextToSpeech(aText) doorloopt de hele cyclus: verzoek, decoderen, wegschrijven, afspelen en het tijdelijke bestand opruimen.

Levenscyclus

OnStart en OnStop omsluiten de bewerking, en daardoor kunnen de chatbot- en vertalercomponenten de opname hervatten zodra het antwoord is uitgesproken.

Uitwisselbaar

Dezelfde interface als de systeem- en Amazon-spraakcomponenten, dus de chatbot, de vertaler en de assistent accepteren ze alle drie zonder codewijzigingen.

Specificaties & referenties

Gezaghebbende bronnen voor de diensten en protocollen die dit component gebruikt.

Blijf ontdekken

Online helpVolledige API-referentie en gebruiksgids voor de sgcAI-componenten.
Alle sgcAI-componentenBekijk de volledige functiematrix van alle 15 componenten.
Download de gratis proefversieSynthetiseer spraak met je eigen Google Cloud-project.
PrijzenSingle-, Team- en Site-licenties, volledige broncode, geen basisproduct vereist.
De beste deal: All-AccessElk eSeGeCe-product, inclusief Premium-ondersteuning, vanaf €1,059 per jaar.
Bekijk de All-Access-prijzen

Klaar om aan de slag te gaan?

Download de gratis proefversie en geef je toepassing een Google Cloud-stem.