From d834008bd41c7b96f66816436a777c623aea6b10 Mon Sep 17 00:00:00 2001 From: dengwenjie <775747758@qq.com> Date: Tue, 28 Oct 2025 23:02:35 +0800 Subject: [PATCH] =?UTF-8?q?=E6=9B=B4=E6=96=B0readme?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit --- README.md | 73 ++++++++++--------------------- examples/vision-example/README.md | 60 ++++++++++++++++++++----- 2 files changed, 72 insertions(+), 61 deletions(-) diff --git a/README.md b/README.md index cd86122..c718f5f 100644 --- a/README.md +++ b/README.md @@ -491,6 +491,30 @@ SmartJavaAI是专为JAVA 开发者打造的一个功能丰富、开箱即用的 [示例代码](https://gitee.com/dengwenjie/SmartJavaAI/tree/master/examples) +本项目在 `examples` 文件夹下提供了多个示例工程,用于演示各功能模块的使用方法: + +* `face-example`:人脸检测、人脸识别等功能示例 +* `vision-example`:通用视觉检测示例:目标检测、目标分割、图像分类等 +* `ocr-example`:OCR文字识别、车牌识别等功能示例 +* `translate-example`:机器翻译功能示例 +* `speech-example`:语音识别、语音合成功能示例 + +#### 运行方式 + +如果你只想运行某个示例,请按以下方式操作: + +1. 打开 IDEA(或你喜欢的 IDE) +2. 选择 **“Open”**,然后仅导入 `examples` 目录下对应的示例项目,例如: + + ``` + examples/face-example + ``` +3. IDEA 会自动识别并加载依赖。若首次导入,请等待 Maven 下载依赖完成。 +4. 请从我们提供的 百度网盘 中下载模型及其附带文件,并在示例代码中将模型路径修改为您本地的实际路径。 +5. 可通过查看每个 Java 文件顶部的注释了解对应功能,或参考 README 文件中对各 Java 文件功能的说明,运行相应的测试方法进行体验。 + + + ### 4、文档地址 [开发文档](http://doc.smartjavaai.cn) @@ -812,54 +836,5 @@ SmartJavaAI是专为JAVA 开发者打造的一个功能丰富、开箱即用的 6、等待维护者合并 -## 近期更新日志 - -## [v1.0.27] - 2025-10-24 -- 【通用视觉】集成 OpenAI CLIP 模型,支持以图搜图、以文搜图、以图搜文等功能 -- 【通用视觉】新增 YOLO 图像分类模型支持 -- 【ASR/TTS】集成 Sherpa TTS(语音合成)与 ASR(语音识别)模块,支持中文、粤语、方言、英文等多种语言 -- 【目标检测】优化视频目标检测功能 - -## [v1.0.25] - 2025-10-02 -- 【人脸识别】 新增多种人脸识别模型 -- 【底层优化】 支持自由选择 OpenCV 或 BufferedImage 作为图像引擎 -- 【通用图像】 全部模型启用 Image 输入,支持各类图片格式与 Image 的互转 -- 【模型管理】 优化模型生命周期,关闭后可重新创建 -- 【人脸识别】 支持在人脸查询结果中绘制姓名标注 -- 【人脸检测】 新增人脸裁剪功能 -- 【修复】 修复若干已知问题,提升系统稳定性 - -## [v1.0.24] - 2025-09-07 -- 【人脸检测】新增6个模型(MTCNN、YOLOV5、RetinaFace小尺寸版),大幅提升性能 -- 【人脸识别】新增Seetaface6轻量模型 -- 【目标检测】支持视频流目标检测(rtsp、视频文件等) -- 【目标检测】支持tensorflow2目标检测模型 -- 【目标检测】新增行人检测模型(yolo-person) -- 【通用视觉】新增4个动作识别模型 -- 【通用视觉】新增语义分割模型 -- 【通用视觉】新增5个实例分割模型(含yolov8-seg、yolov11-seg) -- 【通用视觉】新增yolo-obb11旋转框检测(含yolov11-obb) -- 【通用视觉】新增5个姿态估计模型(含yolov8-pose、yolov11-pose) - -## [v1.0.23] - 2025-08-09 -- 新增 语音识别模块,集成 OpenAI 开源的 Whisper 和 Vosk -- 修复 质量评估模型的 Bug -- 修复 OCR 模块 recognizeAndDraw 方法的 Bug -- 修复 车牌识别在未检测到车牌时的报错问题 -- 优化 OCR 表格识别功能,新增导出方式 - -## [v1.0.22] - 2025-07-28 -- 新增 Milvus 身份验证支持 -- 集成车牌识别模型,支持车牌检测与识别 -- 目标检测功能升级:可指定类别及topk -- 支持自定义线程池线程数量 -## [v1.0.20] - 2025-07-18 -- OCR:新增表格识别模型 -- OCR:新增9个通用模型 -- OCR:支持批量检测识别 -- OCR:新增更多参数,使用更加灵活 -- 人脸识别:支持ID查询及分页获取人脸信息 -- 活体检测:视频检测支持设置最大帧数 - diff --git a/examples/vision-example/README.md b/examples/vision-example/README.md index 45b23eb..2a3d7ea 100644 --- a/examples/vision-example/README.md +++ b/examples/vision-example/README.md @@ -1,27 +1,63 @@ -# 目标检测示例 +# 计算机视觉示例 +本项目包含了多个计算机视觉相关的示例代码,展示了如何使用 SmartJavaAI SDK 进行各种视觉任务。 ## 📁 项目结构 ``` - -objectdetection-example/ +vision-example/ ├── src/ │ ├── main/ │ │ ├── java/ -│ │ │ └── smartai/examples/objectdetection/ -│ │ │ ├── ObjectDetection.java -│ │ │ └── ViewerFrame.java - +│ │ │ └── smartai/examples/vision/ +│ │ │ ├── ActionRecognizeDemo.java # 动作识别示例 +│ │ │ ├── ClipDemo.java # CLIP模型示例(图文匹配) +│ │ │ ├── ClsDemo.java # 图像分类示例 +│ │ │ ├── InstanceSegDemo.java # 实例分割示例 +│ │ │ ├── ObbDetDemo.java # 旋转框检测示例 +│ │ │ ├── ObjectDetectionDemo.java # 目标检测示例 +│ │ │ ├── PersonDetectDemo.java # 行人检测示例 +│ │ │ ├── PoseDetDemo.java # 姿态检测示例 +│ │ │ ├── SemSegDemo.java # 语义分割示例 ``` - ---- - ## 🧩 功能模块说明 -### 1. 目标检测 [ObjectDetection.java] -- **功能**:核心目标检测类,包含多个测试方法,展示了如何使用不同的模型进行目标检测 +### 1. 目标检测 [ObjectDetectionDemo.java] +- **功能**:展示了如何使用目标检测模型进行物体检测 +- **特点**:支持图片检测、视频流检测、本地摄像头检测等多种场景 + +### 2. 动作识别 [ActionRecognizeDemo.java] +- **功能**:展示了如何使用动作识别模型识别图片或视频中的人物动作 +- **特点**:支持多种动作类别的识别 + +### 3. CLIP模型 [ClipDemo.java] +- **功能**:展示了如何使用CLIP模型进行图文匹配相关任务 +- **特点**:支持图片特征提取、文本特征提取、相似度计算、图文匹配等功能 + +### 4. 实例分割 [InstanceSegDemo.java] +- **功能**:展示了如何使用实例分割模型进行物体分割 +- **特点**:可以精确分割出图片中的每个物体实例 + +### 5. 旋转框检测 [ObbDetDemo.java] +- **功能**:展示了如何使用旋转框检测模型检测任意角度的物体 +- **特点**:适用于航拍图片等场景中的物体检测 + +### 6. 行人检测 [PersonDetectDemo.java] +- **功能**:展示了如何使用专门的行人检测模型进行人体检测 +- **特点**:针对行人检测场景优化,准确率更高 + +### 7. 姿态检测 [PoseDetDemo.java] +- **功能**:展示了如何使用姿态检测模型检测人体关键点 +- **特点**:可以识别人体的各个关节点位置 + +### 8. 语义分割 [SemSegDemo.java] +- **功能**:展示了如何使用语义分割模型进行场景分割 +- **特点**:可以对图片中的每个像素进行分类 + +### 9. 图像分类 [ClsDemo.java] +- **功能**:展示了如何使用分类模型对图片进行分类 +- **特点**:支持多种分类模型和类别 ---