mirror of
https://github.com/geekwenjie/SmartJavaAI.git
synced 2026-09-10 03:28:49 +00:00
【通用视觉】新增 YOLO 图像分类模型支持 【ASR/TTS】集成 Sherpa TTS(语音合成)与 ASR(语音识别)模块,支持中文、粤语、方言、英文等多种语言 【目标检测】优化视频目标检测功能
OCR文字识别示例
我来为你写一个 speech-examples 项目的 README.md 文件。
🎤 语音识别示例
本项目展示了如何使用 SmartJavaAI SDK 进行语音识别,支持 Whisper 和 Vosk 两种语音识别引擎。
📁 项目结构
src
├── main
│ ├── java
│ │ └── smartai/examples/speech/asr
│ │ └── SpeechRecognizeDemo.java # 语音识别示例
│ └── resources
│ ├── logback.xml # 日志配置文件
│ ├── speech_zh.mp3 # 中文测试音频
│ ├── lff_zh.mp3 # 中文测试音频
│ └── jfk_en.wav # 英文测试音频
└── test
🚀 快速开始
-
克隆项目到本地:
-
导入项目至 IntelliJ IDEA。
-
根据需要修改模型路径(见各 demo 中注释)。
-
运行对应的 JUnit 测试类方法即可体验各项功能。
📄 文档
有关完整使用说明,请查阅 SmartJavaAI 官方文档: http://doc.smartjavaai.cn