OptionalcloseReleases native session resources, when supported.
Runs one inference and returns mono float32 audio samples.
Phoneme ids including BOS/EOS padding.
[noiseScale, lengthScale, noiseWScale].
Speaker index, or null for single-voice models.
Raw audio samples at the voice sample rate.
High-level inference session: phoneme ids + scales to float32 audio (voice.py:498-575).