博客 | VoicePing 跳转到主要内容

博客

VoicePing的见解、技巧和更新

从路演舞台到一对一对接:AI×MedTech如何在STATION Ai使用实时翻译
AI翻译 活动翻译

从路演舞台到一对一对接:AI×MedTech如何在STATION Ai使用实时翻译

Formula Consulting在名古屋AI×MedTech 2026的初创企业路演和一对一对接中,如何使用VoicePing进行日英实时翻译。

VoicePing Editorial
8 min
中文 TTS 模型如何朗读数字:600 个语音克隆样本基准测试
Text to Speech Mandarin TTS

中文 TTS 模型如何朗读数字:600 个语音克隆样本基准测试

我们使用包含小数、标识符、货币、公式和科学单位的 600 个中文语音克隆样本,测试了 Fish Audio S2.1、CosyVoice3-RL、IndexTTS2 和 Qwen3-TTS Base。

VoicePing- Kai-Teh Tzeng
3 min
Sony Open Innovation Day 2026 现场的实时日英翻译
AI 翻译

Sony Open Innovation Day 2026 现场的实时日英翻译

了解 VoicePing 如何在 Sony Open Innovation Day 2026 现场,通过主屏幕和二维码手机访问提供实时日英字幕。

VoicePing Editorial
4 min
多语言 OCR 基准测试:Hunyuan 与 Qwen 领先准确率,Paddle 领先吞吐量
OCR Document AI

多语言 OCR 基准测试:Hunyuan 与 Qwen 领先准确率,Paddle 领先吞吐量

在严格 GPU-only 条件下,用覆盖五种语言、六类文档的 900 页数据评估八个开源 OCR 系统,并比较 CER、延迟、吞吐量、VRAM、能耗、截断和结构化输出。

VoicePing - Akash Verma
4 min
大规模说话人识别为何困难?五种模型的多语言开放集基准测试
Speaker Identification Speaker Recognition

大规模说话人识别为何困难?五种模型的多语言开放集基准测试

一项以身份分离的留出评估为主要证据,并以干净语音条件和900人图库作为辅助检验的五模型多语言开放集说话人识别基准。

Arun Kumar - VoicePing
2 min
介绍 VoicePing Diarization v0.1
Speaker Diarization Benchmark

介绍 VoicePing Diarization v0.1

VoicePing Diarization v0.1 是一个多语言说话人分离模型。本次在 42 个文件的基准中与 NeMo、pyannoteAI precision-2、AssemblyAI 和 Deepgram 进行比较。

Arun Kumar - VoicePing
2 min

免费试用 VoicePing

通过实时语音翻译,体验跨越语言障碍的交流

免费开始