CartesiaEngine uses the Cartesia API over its WebSocket TTS connection.
Install RealtimeTTS with the Cartesia extra:
pip install "realtimetts[cartesia]"Set the API key in the environment or pass it to the constructor:
$env:CARTESIA_API_KEY = "..."from RealtimeTTS import TextToAudioStream, CartesiaEngine
if __name__ == "__main__":
engine = CartesiaEngine(voice_id="your-cartesia-voice-id")
stream = TextToAudioStream(engine)
stream.feed("Hello from Cartesia.")
stream.play()- Default
model_idissonic-3; valid model IDs in source includesonic-2,sonic-3,sonic-turbo, andsonic. - Default output is raw
pcm_f32leat 44100 Hz.pcm_s16leis also supported. languageandadd_timestampsare optional request fields.CartesiaVoice(id, name=None, language=None)can be used for voice selection.get_voices()fetches one page by default. Setfetch_all_voices=Truefor full pagination.
Missing Cartesia API key: passapi_keyor setCARTESIA_API_KEY.No voice set: passvoice_id, aCartesiaVoice, or a dict withid.