Componente Text to Speech (Google) — sgcAI | eSeGeCe

Text to Speech (Google)

TsgcTextToSpeechGoogle sintetiza voz con Google Cloud Text-to-Speech. Firma un JWT de cuenta de servicio, solicita el audio, lo decodifica a un archivo y lo reproduce a través del reproductor de audio que le asignes, así que un amplio catálogo de voces e idiomas queda a una propiedad de distancia.

TsgcTextToSpeechGoogle

Un backend de voz de Google Cloud. Pega el JSON de la cuenta de servicio en las opciones, elige el idioma, el género y la voz, y llama a un solo método.

Clase del componente

TsgcTextToSpeechGoogle

Propósito

Síntesis de voz con Google Cloud

Familia

Texto a voz

Plataformas

Win32 y Win64

sgcAI es autónomo. Este componente se incluye dentro de sgcAI junto con el runtime sgcWebSockets Core sobre el que está construido, así que no hay ninguna licencia base que comprar.

Habla con una voz de Google Cloud

Aporta las credenciales de la cuenta de servicio, elige una voz y enlaza un reproductor de audio.

uses
  sgcAI, sgcAI_TextToSpeech_Google, sgcAI_AudioPlayer_MCI;

var
  oTTS: TsgcTextToSpeechGoogle;
begin
  oTTS := TsgcTextToSpeechGoogle.Create(nil);
  oTTS.AudioPlayer := sgcAudioPlayerMCI1;

  // The service account JSON, pasted as-is.
  oTTS.GoogleOptions.Settings.LoadFromFile('service-account.json');
  oTTS.GoogleOptions.Language      := 'en-US';
  oTTS.GoogleOptions.VoiceId       := 'en-US-Neural2-C';
  oTTS.GoogleOptions.AudioEncoding := 'MP3';
  oTTS.GoogleOptions.FileName      := 'speech.mp3';

  oTTS.TextToSpeech('The order has been shipped.');
end;
// includes: sgcAI.hpp, sgcAI_TextToSpeech_Google.hpp

TsgcTextToSpeechGoogle *oTTS = new TsgcTextToSpeechGoogle(NULL);
oTTS->AudioPlayer = sgcAudioPlayerMCI1;

oTTS->GoogleOptions->Settings->LoadFromFile("service-account.json");
oTTS->GoogleOptions->Language = "en-US";
oTTS->GoogleOptions->VoiceId  = "en-US-Neural2-C";

oTTS->TextToSpeech("The order has been shipped.");

Propiedades y métodos principales

Los miembros que usarás más a menudo.

GoogleOptions

Settings guarda el JSON de la cuenta de servicio, Language y VoiceId seleccionan la voz, Gender elige una voz por defecto cuando no se indica ningún identificador, y AudioEncoding y FileName controlan el audio sintetizado.

AudioPlayer

AudioPlayer reproduce el archivo sintetizado. Asigna un TsgcAudioPlayerMCI y la reproducción empieza en cuanto llega la respuesta.

Autenticación

El componente construye y firma un JWT a partir de la clave privada de la cuenta de servicio, y luego guarda en caché el token de acceso hasta que caduca, de modo que una aplicación de larga duración no vuelve a autenticarse en cada frase.

TextToSpeech

TextToSpeech(aText) realiza el ciclo completo: petición, decodificación, escritura, reproducción y limpieza del archivo temporal.

Ciclo de vida

OnStart y OnStop delimitan la operación, que es lo que permite a los componentes de chatbot y traductor reanudar la grabación una vez pronunciada la respuesta.

Intercambiable

La misma interfaz que los componentes de voz del sistema y de Amazon, así que el chatbot, el traductor y el assistant aceptan cualquiera de ellos sin cambios de código.

Especificaciones y referencias

Fuentes oficiales de los servicios y protocolos que utiliza este componente.

Sigue explorando

Ayuda en líneaReferencia completa de la API y guía de uso de los componentes sgcAI.
Todos los componentes sgcAIConsulta la matriz completa de características de los 15 componentes.
Descargar prueba gratuitaSintetiza voz con tu propio proyecto de Google Cloud.
PreciosLicencias Single, Team y Site, código fuente completo, sin producto base necesario.
La mejor opción: All-AccessTodos los productos de eSeGeCe, con Premium Support incluido, desde €1,059 al año.
Ver precios de All-Access

¿Listo para empezar?

Descarga la prueba gratuita y dale a tu aplicación una voz de Google Cloud.