dengwenjie
|
a707e41d9d
|
解决vosk中文乱码问题
|
2025-12-23 14:24:21 +08:00 |
|
dengwenjie
|
2eb81ae6a8
|
升级1.0.27
|
2025-10-25 16:55:10 +08:00 |
|
dengwenjie
|
de2f57716d
|
修复tts问题
|
2025-10-25 10:51:40 +08:00 |
|
dengwenjie
|
8502b4dc79
|
【通用视觉】集成 OpenAI CLIP 模型,支持以图搜图、以文搜图、以图搜文等功能
【通用视觉】新增 YOLO 图像分类模型支持
【ASR/TTS】集成 Sherpa TTS(语音合成)与 ASR(语音识别)模块,支持中文、粤语、方言、英文等多种语言
【目标检测】优化视频目标检测功能
|
2025-10-24 11:22:39 +08:00 |
|
dengwenjie
|
a8e7ce6c4e
|
- 【人脸检测】新增6个模型(MTCNN、YOLOV5、RetinaFace小尺寸版),大幅提升性能
- 【人脸识别】新增Seetaface6轻量模型
- 【目标检测】支持视频流目标检测(rtsp、视频文件等)
- 【目标检测】支持tensorflow2目标检测模型
- 【目标检测】新增行人检测模型(yolo-person)
- 【通用视觉】新增4个动作识别模型
- 【通用视觉】新增语义分割模型
- 【通用视觉】新增5个实例分割模型(含yolov8-seg、yolov11-seg)
- 【通用视觉】新增yolo-obb11旋转框检测(含yolov11-obb)
- 【通用视觉】新增5个姿态估计模型(含yolov8-pose、yolov11-pose)
|
2025-09-07 17:19:19 +08:00 |
|
dengwenjie
|
ab30ad9f9d
|
新增实时语音识别案例
|
2025-08-27 16:11:21 +08:00 |
|
dengwenjie
|
166f0f9d20
|
- 新增 语音识别模块,集成 OpenAI 开源的 Whisper 和 Vosk
- 修复 质量评估模型的 Bug
- 修复 OCR 模块 recognizeAndDraw 方法的 Bug
- 修复 车牌识别在未检测到车牌时的报错问题
- 优化 OCR 表格识别功能,新增导出方式
|
2025-08-11 10:38:50 +08:00 |
|