Componente Text to Speech (Amazon) — sgcAI | eSeGeCe

Text to Speech (Amazon)

TsgcTextToSpeechAmazon sintetiza voz con Amazon Polly. Las peticiones a AWS se firman por ti, el motor, la voz y el formato de salida son propiedades, y el audio resultante se reproduce a través del reproductor de audio que le asignes.

TsgcTextToSpeechAmazon

Un backend de Amazon Polly. Rellena las credenciales y la región de AWS, elige un motor y una voz, y llama a un solo método.

Clase del componente

TsgcTextToSpeechAmazon

Propósito

Síntesis de voz con Amazon Polly

Familia

Texto a voz

Plataformas

Win32 y Win64

sgcAI es autónomo. Este componente se incluye dentro de sgcAI junto con el runtime sgcWebSockets Core sobre el que está construido, así que no hay ninguna licencia base que comprar.

Habla con una voz de Amazon Polly

Configura las credenciales y la región de AWS, elige un motor y una voz, y enlaza un reproductor de audio.

uses
  sgcAI, sgcAI_TextToSpeech_Amazon, sgcAI_AudioPlayer_MCI;

var
  oTTS: TsgcTextToSpeechAmazon;
begin
  oTTS := TsgcTextToSpeechAmazon.Create(nil);
  oTTS.AudioPlayer := sgcAudioPlayerMCI1;

  oTTS.AmazonOptions.AWSOptions.AccessKey := 'AKIA...';
  oTTS.AmazonOptions.AWSOptions.SecretKey := '...';
  oTTS.AmazonOptions.AWSOptions.Region    := 'eu-west-1';

  oTTS.AmazonOptions.Engine       := 'neural';
  oTTS.AmazonOptions.VoiceId      := 'Joanna';
  oTTS.AmazonOptions.OutputFormat := 'mp3';
  oTTS.AmazonOptions.FileName     := 'speech.mp3';

  oTTS.TextToSpeech('The order has been shipped.');
end;
// includes: sgcAI.hpp, sgcAI_TextToSpeech_Amazon.hpp

TsgcTextToSpeechAmazon *oTTS = new TsgcTextToSpeechAmazon(NULL);
oTTS->AudioPlayer = sgcAudioPlayerMCI1;

oTTS->AmazonOptions->AWSOptions->AccessKey = "AKIA...";
oTTS->AmazonOptions->AWSOptions->SecretKey = "...";
oTTS->AmazonOptions->AWSOptions->Region    = "eu-west-1";

oTTS->AmazonOptions->VoiceId = "Joanna";
oTTS->TextToSpeech("The order has been shipped.");

Propiedades y métodos principales

Los miembros que usarás más a menudo.

AmazonOptions

AWSOptions lleva la clave de acceso, la clave secreta y la región. Engine, VoiceId, OutputFormat, TextType y FileName definen la petición de síntesis.

Firma de peticiones

Las peticiones se firman con AWS Signature Version 4 mediante la misma pila de cliente AWS que usan los demás componentes de Amazon, así que no interviene ningún SDK ni CLI aparte.

SSML

TextType alterna entre texto plano y SSML, que es la forma de controlar las pausas, el énfasis y la pronunciación dentro de la salida hablada.

AudioPlayer

AudioPlayer reproduce el archivo que devuelve Polly. Asigna un TsgcAudioPlayerMCI y la reproducción empieza en cuanto se escribe la respuesta.

Gestión de errores

Cuando Polly devuelve un documento de error en lugar de audio, el archivo temporal se elimina y se lanza una excepción con el texto de error del servicio, de modo que un identificador de voz o una región incorrectos fallan de forma visible.

Intercambiable

La misma interfaz que los componentes de voz del sistema y de Google, así que cualquiera de ellos puede asignarse al chatbot, al traductor o al assistant.

Especificaciones y referencias

Fuentes oficiales de los servicios y protocolos que utiliza este componente.

Sigue explorando

Ayuda en líneaReferencia completa de la API y guía de uso de los componentes sgcAI.
Todos los componentes sgcAIConsulta la matriz completa de características de los 15 componentes.
Descargar prueba gratuitaSintetiza voz con tu propia cuenta de AWS.
PreciosLicencias Single, Team y Site, código fuente completo, sin producto base necesario.
La mejor opción: All-AccessTodos los productos de eSeGeCe, con Premium Support incluido, desde €1,059 al año.
Ver precios de All-Access

¿Listo para empezar?

Descarga la prueba gratuita y dale a tu aplicación una voz de Amazon Polly.