Production-Ready Korean Text-to-Speech API
Channel TTSë ėąëėŊíŧë ė´ė
ėė ę°ë°í ėí°íëŧė´ėĻę¸ íęĩė´ ėėą íŠėą ėė¤í
ė
ëë¤.
ė¤ėę° ëíí ėëšė¤ė ėĩė íë ëŽė ë ė´í´ėė ėė°ė¤ëŦė´ ėėą íė§ė ė ęŗĩíŠëë¤.
TTFA ~140-240ms
RTF ~0.2-0.3x
5-level optimization
(0-4 configurable)
PCM 16/24/44.1/48kHz
WAV output
Advanced normalization
Natural prosody
# ę¸°ëŗ¸ ėŦėŠ (ėĩęŗ íė§, optimize_streaming_latency=0)
curl -X POST "https://ch-tts-streaming-demo.channel.io/v1/external/text-to-speech/hana/stream?optimize_streaming_latency=0" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $API_TOKEN" \
-d '{"text":"ėë
íė¸ė. ėąëíĄė
ëë¤.","output_format":"pcm_24000"}' \
| ffplay -nodisp -autoexit -f s16le -ar 24000 -i -
curl -X POST "https://ch-tts-streaming-demo.channel.io/v1/external/text-to-speech/hana" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $API_TOKEN" \
-d '{"text":"ėë
íė¸ė","output_format":"wav_24000"}' \
-o output.wav
| Metric | Value | Description |
|---|---|---|
| TTFB | ~140-240ms | Time to First Byte (ė˛Ģ ë°ė´í¸ęšė§ 깸ëĻŦë ėę°) |
| TTFA | ~140-240ms | Time to First Audio (ė˛Ģ ė¤ëė¤ ė˛íŦęšė§ 깸ëĻŦë ėę°) |
| RTF | ~0.2-0.3x | Real-Time Factor (ė¤ėę° ëëš 3-5ë°° ëš ëĨ¸ ėėą ėë) |
Configure latency vs quality trade-off with optimize_streaming_latency parameter (0-4):
| Level | Quality | Speed | Use Case |
|---|---|---|---|
| 0 | âââââ | Slowest | High-quality voice generation |
| 1 | ââââ | Slow | Balanced quality and speed |
| 2 | âââ | Medium | General conversation |
| 3 | ââ | Fast | Real-time interaction |
| 4 | â | Fastest | Ultra-low latency required |