Files
SmartJavaAI/examples/speech-examples
dengwenjie 8502b4dc79 【通用视觉】集成 OpenAI CLIP 模型,支持以图搜图、以文搜图、以图搜文等功能
【通用视觉】新增 YOLO 图像分类模型支持
【ASR/TTS】集成 Sherpa TTS(语音合成)与 ASR(语音识别)模块,支持中文、粤语、方言、英文等多种语言
【目标检测】优化视频目标检测功能
2025-10-24 11:22:39 +08:00
..

OCR文字识别示例

我来为你写一个 speech-examples 项目的 README.md 文件。

🎤 语音识别示例

本项目展示了如何使用 SmartJavaAI SDK 进行语音识别,支持 Whisper 和 Vosk 两种语音识别引擎。

📁 项目结构

src
├── main
│   ├── java
│   │   └── smartai/examples/speech/asr
│   │       └── SpeechRecognizeDemo.java  # 语音识别示例
│   └── resources
│       ├── logback.xml                  # 日志配置文件
│       ├── speech_zh.mp3                # 中文测试音频
│       ├── lff_zh.mp3                   # 中文测试音频
│       └── jfk_en.wav                   # 英文测试音频
└── test

🚀 快速开始

  1. 克隆项目到本地:

  2. 导入项目至 IntelliJ IDEA。

  3. 根据需要修改模型路径(见各 demo 中注释)。

  4. 运行对应的 JUnit 测试类方法即可体验各项功能。


📄 文档

有关完整使用说明,请查阅 SmartJavaAI 官方文档: http://doc.smartjavaai.cn