
Text to Speech
Emotional TTS
情感 TTS 基准测试:Qwen3-TTS、CosyVoice、IndexTTS-2、Fish Audio 与 VoxCPM 在日语和中文上的表现
面向日语和中文六种目标情绪,对五个情感文本转语音模型进行 SenseVoice、emotion2vec 锚点、CER、自然度、运行时间和试听样本评估。
Kai-Teh Tzeng-VoicePing
4 min
VoicePing的见解、技巧和更新

面向日语和中文六种目标情绪,对五个情感文本转语音模型进行 SenseVoice、emotion2vec 锚点、CER、自然度、运行时间和试听样本评估。

Brave group通过VoicePing进行韩语实时翻译和会议转录,降低多语言会议中的口译负担,也降低员工参加海外会议的心理门槛。

VoicePing在SusHi Tech Tokyo 2026 Gathering Day的GLOBAL × SCALEUP TOKYO SU生态系统:Global VC Insights & Startup Showcase上提供了实时AI翻译。全球VC与日本创业公司跨越语言障碍实现无缝交流。

VoicePing在JETRO Startup Alumni Meetup 2026上提供了实时AI翻译支持。在这场日本最大规模的创业生态系统活动中,2,000多家初创企业、风险投资机构和支持组织齐聚一堂,实现了跨越语言障碍的无缝沟通。

开源跨平台移动端完全离线语音翻译应用,集成端侧 ASR(SenseVoice)、神经机器翻译和 TTS,支持 iOS 和 Android 系统音频捕获

英日双向语音翻译模型基准测试。将 Qwen3-ASR(1.7B 参数,最高质量)和 Distilled Whisper(756M,快 4 倍)与 OpenAI Whisper large-v3 及 Meta SeamlessM4T v2 进行比较。