Google Text-to-Speech-Komponente — sgcAI | eSeGeCe

Text-to-Speech (Google)

TsgcTextToSpeechGoogle erzeugt Sprache mit Google Cloud Text-to-Speech. Die Komponente signiert ein Dienstkonto-JWT, fordert das Audio an, dekodiert es in eine Datei und spielt es über den Audio-Player ab, den du zuweist. Ein umfangreicher Katalog an Stimmen und Sprachen ist damit nur eine Eigenschaft entfernt.

TsgcTextToSpeechGoogle

Ein Sprach-Backend von Google Cloud. Füge das Dienstkonto-JSON in die Optionen ein, wähle Sprache, Geschlecht und Stimme und rufe eine einzige Methode auf.

Komponentenklasse

TsgcTextToSpeechGoogle

Zweck

Sprachsynthese mit Google Cloud

Familie

Text-to-Speech

Plattformen

Win32 und Win64

sgcAI ist eigenständig. Diese Komponente wird in sgcAI zusammen mit der sgcWebSockets Core Runtime ausgeliefert, auf der sie aufbaut. Du musst also keine Basislizenz kaufen.

Mit einer Google-Cloud-Stimme sprechen

Hinterlege die Zugangsdaten des Dienstkontos, wähle eine Stimme und verknüpfe einen Audio-Player.

uses
  sgcAI, sgcAI_TextToSpeech_Google, sgcAI_AudioPlayer_MCI;

var
  oTTS: TsgcTextToSpeechGoogle;
begin
  oTTS := TsgcTextToSpeechGoogle.Create(nil);
  oTTS.AudioPlayer := sgcAudioPlayerMCI1;

  // The service account JSON, pasted as-is.
  oTTS.GoogleOptions.Settings.LoadFromFile('service-account.json');
  oTTS.GoogleOptions.Language      := 'en-US';
  oTTS.GoogleOptions.VoiceId       := 'en-US-Neural2-C';
  oTTS.GoogleOptions.AudioEncoding := 'MP3';
  oTTS.GoogleOptions.FileName      := 'speech.mp3';

  oTTS.TextToSpeech('The order has been shipped.');
end;
// includes: sgcAI.hpp, sgcAI_TextToSpeech_Google.hpp

TsgcTextToSpeechGoogle *oTTS = new TsgcTextToSpeechGoogle(NULL);
oTTS->AudioPlayer = sgcAudioPlayerMCI1;

oTTS->GoogleOptions->Settings->LoadFromFile("service-account.json");
oTTS->GoogleOptions->Language = "en-US";
oTTS->GoogleOptions->VoiceId  = "en-US-Neural2-C";

oTTS->TextToSpeech("The order has been shipped.");

Wichtige Eigenschaften & Methoden

Die Member, zu denen du am häufigsten greifst.

GoogleOptions

Settings enthält das Dienstkonto-JSON, Language und VoiceId wählen die Stimme aus, Gender bestimmt eine Standardstimme, wenn keine ID angegeben ist, und AudioEncoding sowie FileName steuern das erzeugte Audio.

AudioPlayer

AudioPlayer spielt die erzeugte Datei ab. Weise einen TsgcAudioPlayerMCI zu und die Wiedergabe startet, sobald die Antwort eintrifft.

Authentifizierung

Die Komponente baut aus dem privaten Schlüssel des Dienstkontos ein JWT und signiert es, danach hält sie das Zugriffstoken bis zum Ablauf im Cache. Eine lang laufende Anwendung authentifiziert sich also nicht bei jedem Satz erneut.

TextToSpeech

TextToSpeech(aText) führt den gesamten Ablauf aus: anfordern, dekodieren, schreiben, abspielen und die temporäre Datei wieder aufräumen.

Lebenszyklus

OnStart und OnStop klammern den Vorgang ein. Genau das erlaubt es den Chatbot- und Übersetzerkomponenten, die Aufnahme wieder aufzunehmen, sobald die Antwort zu Ende gesprochen ist.

Austauschbar

Dieselbe Schnittstelle wie bei der System- und der Amazon-Sprachkomponente. Chatbot, Übersetzer und Assistent akzeptieren daher jede von ihnen ohne Codeänderung.

Spezifikationen & Referenzen

Maßgebliche Quellen zu den Diensten und Protokollen, die diese Komponente nutzt.

Weiter entdecken

Online-HilfeVollständige API-Referenz und Anwendungsleitfaden für die sgcAI-Komponenten.
Alle sgcAI-KomponentenDurchstöbere die vollständige Funktionsmatrix aller 15 Komponenten.
Kostenlose Testversion herunterladenErzeuge Sprache mit deinem eigenen Google-Cloud-Projekt.
PreiseSingle-, Team- und Site-Lizenzen, vollständiger Quellcode, kein Basisprodukt erforderlich.
Bestes Preis-Leistungs-Verhältnis: All-AccessAlle eSeGeCe-Produkte, inklusive Premium-Support, ab €1,059 pro Jahr.
All-Access-Preise ansehen

Bereit loszulegen?

Lade die kostenlose Testversion herunter und gib deiner Anwendung eine Google-Cloud-Stimme.