
We improved intonation reproduction and short-utterance response in MOSS TTS.
The issue of MOSS running excessively long on short inputs has been suppressed, making it respond more reliably even to low-volume or unclear speech (reduced missed triggers).
Benchmark results: exact 97/120, avgCER 0.0345. No regression compared to the existing baseline of exact 97/120, avgCER 0.0352 on Windows V2 reference (120 chunked samples). Naturalness and stability have improved.
MOSS TTSの抑揚再現と短い発話への応答性を改善しました。
短い入力でMOSSが長く話し続けてしまう問題を抑え、低音量や不明瞭な声でも安定して発話しやすくなりました(空振りも軽減)。
ベンチマーク結果は exact 97/120、avgCER 0.0345です。 既存基準のWindows V2 reference 120件 chunked(exact 97/120、avgCER 0.0352)と比べて劣化はありません。自然さと安定性が向上しています。
我们改进了MOSS TTS的抑扬再现和短句响应能力。
抑制了短促输入时MOSS长时间持续说话的问题,即使是低音量或不清晰的语音也能更稳定地正确发声(减少空振)。
基准测试结果:exact 97/120,avgCER 0.0345。 与现有基准 Windows V2 reference 120件 chunked(exact 97/120,avgCER 0.0352)相比没有劣化。自然度和稳定性都得到了提升。
MOSS TTS의 억양 재현과 짧은 발화 응답성을 개선했습니다.
짧은 입력에서 MOSS가 길게 이어서 말하는 문제를 억제하고, 낮은 음량이나 불명료한 발화에서도 안정적으로 발화하기 쉬워졌습니다(헛발 줄임).
벤치마크 결과: exact 97/120, avgCER 0.0345. 기존 기준 Windows V2 reference 120件 chunked(exact 97/120, avgCER 0.0352)대비 열화는 없습니다. 자연스러움과 안정성이 향상되었습니다.