Componente de texto para fala do Google — sgcAI | eSeGeCe

Texto para fala (Google)

O TsgcTextToSpeechGoogle sintetiza voz com o Google Cloud Text-to-Speech. Ele assina um JWT de conta de serviço, solicita o áudio, decodifica em um arquivo e o reproduz pelo player de áudio que você atribuir, então um amplo catálogo de vozes e idiomas fica a uma propriedade de distância.

TsgcTextToSpeechGoogle

Um backend de voz do Google Cloud. Cole o JSON da conta de serviço nas opções, escolha o idioma, o gênero e a voz, e chame um único método.

Classe do componente

TsgcTextToSpeechGoogle

Finalidade

Síntese de voz com Google Cloud

Família

Texto para fala

Plataformas

Win32 e Win64

O sgcAI é autossuficiente. Este componente vem dentro do sgcAI junto com o runtime sgcWebSockets Core sobre o qual foi construído, então não há licença base para comprar.

Fale com uma voz do Google Cloud

Forneça as credenciais da conta de serviço, escolha uma voz e vincule um player de áudio.

uses
  sgcAI, sgcAI_TextToSpeech_Google, sgcAI_AudioPlayer_MCI;

var
  oTTS: TsgcTextToSpeechGoogle;
begin
  oTTS := TsgcTextToSpeechGoogle.Create(nil);
  oTTS.AudioPlayer := sgcAudioPlayerMCI1;

  // The service account JSON, pasted as-is.
  oTTS.GoogleOptions.Settings.LoadFromFile('service-account.json');
  oTTS.GoogleOptions.Language      := 'en-US';
  oTTS.GoogleOptions.VoiceId       := 'en-US-Neural2-C';
  oTTS.GoogleOptions.AudioEncoding := 'MP3';
  oTTS.GoogleOptions.FileName      := 'speech.mp3';

  oTTS.TextToSpeech('The order has been shipped.');
end;
// includes: sgcAI.hpp, sgcAI_TextToSpeech_Google.hpp

TsgcTextToSpeechGoogle *oTTS = new TsgcTextToSpeechGoogle(NULL);
oTTS->AudioPlayer = sgcAudioPlayerMCI1;

oTTS->GoogleOptions->Settings->LoadFromFile("service-account.json");
oTTS->GoogleOptions->Language = "en-US";
oTTS->GoogleOptions->VoiceId  = "en-US-Neural2-C";

oTTS->TextToSpeech("The order has been shipped.");

Principais propriedades e métodos

Os membros que você usa com mais frequência.

GoogleOptions

Settings guarda o JSON da conta de serviço, Language e VoiceId selecionam a voz, Gender escolhe uma voz padrão quando nenhum id é informado, e AudioEncoding e FileName controlam o áudio sintetizado.

AudioPlayer

AudioPlayer reproduz o arquivo sintetizado. Atribua um TsgcAudioPlayerMCI e a reprodução começa assim que a resposta chega.

Autenticação

O componente monta e assina um JWT a partir da chave privada da conta de serviço, e depois mantém o token de acesso em cache até ele expirar, então um aplicativo de longa duração não se reautentica a cada frase.

TextToSpeech

TextToSpeech(aText) executa o ciclo inteiro: requisição, decodificação, gravação, reprodução e limpeza do arquivo temporário.

Ciclo de vida

OnStart e OnStop delimitam a operação, e é isso que permite aos componentes de chatbot e tradutor retomar a gravação assim que a resposta é falada.

Intercambiável

A mesma interface dos componentes de fala do sistema e da Amazon, então o chatbot, o tradutor e o assistente aceitam qualquer um deles sem mudanças no código.

Especificações e referências

Fontes oficiais dos serviços e protocolos que este componente usa.

Continue explorando

Ajuda onlineReferência completa da API e guia de uso dos componentes sgcAI.
Todos os componentes sgcAIExplore a matriz de recursos completa dos 15 componentes.
Baixar avaliação gratuitaSintetize voz com seu próprio projeto do Google Cloud.
PreçosLicenças Single, Team e Site, código-fonte completo, sem necessidade de produto base.
Melhor custo-benefício: All-AccessTodos os produtos da eSeGeCe, com Suporte Premium incluído, a partir de €1,059/ano.
Ver preços do All-Access

Pronto para começar?

Baixe a versão de avaliação gratuita e dê ao seu aplicativo uma voz do Google Cloud.