|
FP Perception 0.1.2
|
This page documents the speech synthesis plugin in fp_perception_driver_speech.
Class: fp_perception::OpenAISpeechDriver (REST-based TTS)
fp_perception::text_data via synthesize().RestBase::call_tts() to request PCM audio from the configured REST endpoint.fp_perception::audio_data.driver.speech.OpenAISpeechDriver.name (string)driver.speech.OpenAISpeechDriver.model (string)driver.speech.OpenAISpeechDriver.test_text (string)driver.speech.OpenAISpeechDriver.test_file_path (string)driver.speech.OpenAISpeechDriver.voice (string)driver.speech.OpenAISpeechDriver.instructions (string)driver.speech.OpenAISpeechDriver.chunking_enabled (bool): enable long-text chunking before TTS requests.driver.speech.OpenAISpeechDriver.chunk_max_words (int): maximum number of words sent in a single TTS request.driver.speech.OpenAISpeechDriver.chunk_parallel_requests (int): maximum number of chunk requests to synthesize concurrently.REST base parameters:
driver.speech.OpenAISpeechDriver.rest.uridriver.speech.OpenAISpeechDriver.rest.methoddriver.speech.OpenAISpeechDriver.rest.ssl_verifydriver.speech.OpenAISpeechDriver.rest.auth_typeEnvironment:
OPENAI_API_KEY to be set.fp_perception_msgs/srv/PerceptionSpeech.use_device_audio=true, the server routes synthesized audio to the speaker driver.use_diagnostics=true, the driver publishes request health on /diagnostics via diagnostic_updater.