Bootstrap

java centos 离线使用sherpa-onnx文字转语音TTS

sherpa-onnx: https://github.com/k2-fsa/sherpa-onnx.git

文档链接;Java API — sherpa 1.3 文档

1. 项目基础介绍和主要编程语言
sherpa-onnx 是一个基于下一代 Kaldi 和 onnxruntime 的开源项目,专注于语音识别、文本转语音、说话人识别和语音活动检测(VAD)等功能。该项目支持在没有互联网连接的情况下本地运行,适用于嵌入式系统、Android、iOS、Raspberry Pi、RISC-V 和 x86_64 服务器等多种平台。

主要编程语言:

C++
C
Python
JavaScript
Java
C#
Kotlin
Swift
Go
Dart
Rust
Pascal


2. 项目的核心功能
sherpa-onnx 提供了以下核心功能:语音识别(Speech-to-Text, ASR):支持流式和非流式语音识别。
文本转语音(Text-to-Speech, TTS):将文本转换为语音。
说话人识别(Speaker Recognition):包括说话人验证和说话人识别。
语音活动检测(Voice Activity Detection, VAD):检测语音中的活动部分。
关键词检测(Keyword Spotting):识别语音中的特定关键词。
语音语言识别(Spoken Language Identification):识别语音的语言。
音频标签(Audio Tagging):为音频文件添加标签。

相关模型

语言

# 扬声器

模型文件大小 (MB)

采样率 (Hz)

vits-melo-tts-zh_en (中文 + 英文, 1 位演讲者)

中文 + 英文

1

163

44100

;