公司动态
Java最强开源AI工具!支持人脸识别,活体检测,表情识别、目标检测(支持视频流)等,支持JDK8或更高版本免费使用!
个人网站:IT知识小屋 版权:本文由【IT学习日记】原创、在CSDN首发、需要转载请联系博主 如果文章对你有帮助、欢迎关注、点赞、收藏(一键三连)和订阅专栏哦文章目录简介项目特色AI集成方式对比功能列表项目截图项目架构开源地址使用手册写在最后简介Smart-JavaAI是专为JAVA开发者打造的一个功能丰富、开箱即用的JAVA AI算法工具包致力于帮助JAVA开发者零门槛使用各种AI算法模型开发者无需深入了解底层实现即可轻松在 Java 代码中调用人脸识别、目标检测、OCR 等功能。底层支持包括基于DJL (Deep Java Library) 封装的深度学习模型以及通过 JNI 接入的 C/Python 算法兼容多种主流深度学习框架如 PyTorch、TensorFlow、ONNX、Paddle等屏蔽复杂的模型部署与调用细节。开发者无需了解 AI 底层实现即可直接在 Java 项目中集成使用后续将持续扩展更多算法目标是构建一个“像 Hutool 一样人人可用的JAVA AI通用工具箱。项目特色开箱即用两行代码即可调用智能算法无需深入底层实现极大降低接入门槛。多引擎支持兼容 PyTorch、TensorFlow、MXNet、ONNX Runtime 等主流深度学习框架灵活应对多种部署需求。丰富的AI能力已支持人脸识别与目标检测未来将扩展至 OCR、图像分类、NLP 等多个任务打造通用智能算法库。专为 Java 打造为Java开发者量身打造统一封装多语言底层算法屏蔽实现差异提升开发效率。跨平台兼容支持Windows、Linux、macOS等操作系统兼容x86与ARM架构部署灵活无忧。弥合生态割裂有效桥接Python AI生态与Java业务体系让深度学习成果更易服务于Java应用。AI集成方式对比方案技术特点优点缺点OpenCV传统图像处理方案✅ 提供java接口✅ 轻量级部署✅ 社区资源丰富❌ 基于传统算法精度低(60%-75%)❌ 需本地安装环境商业闭源SDK如虹软等商业级闭源解决方案✅ 开箱即用✅ 提供完整文档和SDK✅ 支持离线活体检测❌ 免费版需年度授权更新❌ 商业授权费用高❌ 代码不可控云API(阿里云)SaaS化云端服务✅ 零部署成本✅ 支持高并发✅ 自带模型迭代❌ 网络延迟风险(200-800ms)❌ 按调用量计费❌ 有数据安全风险Python混合调用跨语言调用方案✅ 可集成PyTorch/TF等框架✅ 支持自定义算法✅ 识别精度高❌ 需维护双语言环境❌ 进程通信性能损耗(30%)❌ 异常处理复杂度翻倍JNI/JNA跨语言底层调用方案✅ 直接调用 C/C 高性能算法库✅ 支持调用各种原生成熟库✅ 可封装成通用工具Jar❌ 开发成本高JNI更复杂❌ 跨平台兼容性差DJL框架深度学习框架✅ 纯Java实现✅ 支持主流深度学习框架✅ 可加载预训练模型(99%)❌ 需掌握DL知识❌ 需处理模型加载、预处理、后处理等复杂技术细节Smart-JavaAIjava深度学习工具包✅ 支持主流深度学习框架✅ 提供丰富、开箱即用API✅ 上手简单单一Jar包集成无功能列表人脸识别人脸检测人脸区域检测、5点人脸关键点定位人脸识别人脸512维特征提取、人脸对齐、1:1 人脸比对、1:N 人脸识别人脸库人脸注册、更新、查询、删除支持向量数据库 milvus/sqlite人脸属性检测性别、年龄、口罩、眼睛状态、脸部姿态静默活体检测图片、视频活体检测人脸表情识别7种表情识别人脸质量评估亮度评估、清晰度评估、完整度评估、姿态评估、遮挡评估目标检测支持多种主流模型集成 YOLOv5、YOLOv8、YOLOv11、YOLOv12、Tensorflow Object Detection 等目标检测算法支持自定义模型加载可无缝加载并部署用户自行训练的目标检测模型集成行人检测模型语义分割集成 DeepLabV3 模型实例分割集成 YOLOv8-seg、YOLOv11-seg、Mask R-CNN 等模型OBB 旋转框目标检测集成 YOLOv11-obb 模型动作识别支持 KINETICS400 数据集中 400 个人类动作识别姿态估计集成 YOLOv8-pose、YOLOv11-pose 等模型OCR 文字识别支持 PaddleOCR 3.0 模型集成最新 PP-OCRv5、PP-OCRv4、表格结构识别模型SLANet_plus、文本行方向分类模型支持任意角度识别方向校准支持通用文字识别通用手写字识别支持表格识别支持中文车牌识别单层/双层检测颜色识别支持 12 种中文车牌机器翻译集成 NLLB-200 模型支持 200 语言互相翻译语音识别集成 openai 的 whisper 模型支持 100 种语言集成 vosk 语音识别项目截图人脸检测(Face Detection)人脸比对11人证核验人脸比对1N人脸属性检测性别检测(GenderDetection)年龄检测(AgeDetection)口罩检测(Face Mask Detection)眼睛状态检测(EyeClosenessDetection)脸部姿态检测(FacePoseEstimation)活体检测人脸表情识别目标检测(Object Detection)视频流目标检测rtsp、摄像头、视频文件等语义分割实例分割自定义目标训练检测行人检测(Person Detection)人类动作识别OBB旋转框检测姿态估计OCR文字识别支持任意角度文字识别支持印刷体识别支持手写字识别OCR文字识别表格识别车牌识别机器翻译200多种语言互相翻译语音识别支持100种语言支持实时语音识别项目架构架构图项目结构src/main/java/smartai/examples/ ├── face/ 人脸相关示例 │ ├── attribute/ 人脸属性检测模块 │ │ └── FaceAttributeDetDemo.java 示例检测性别、年龄等人脸属性 │ ├── facerec/ 人脸识别模块1:1、1:N │ │ ├── FaceNetDemo.java 示例使用 FaceNet 算法做人脸识别 │ │ ├── GpuFaceDemo.java 示例使用 GPU 加速的人脸识别 │ │ ├── LightFaceDemo.java 示例轻量级人脸识别模型适用于嵌入式场景 │ │ ├── RetinaFaceDemo.java 示例使用 RetinaFace 进行人脸检测 │ │ └── SeetaFace6Demo.java 示例集成 SeetaFace6 的人脸识别 │ └── liveness/ 活体检测模块 │ ├── LivenessDetDemo.java 示例基于图像进行活体检测 ├── objectdetection/ 目标检测模块 │ └── ObjectDetection.java 示例使用目标检测模型识别图像中的目标 └── ocr/ OCR文字识别模块 │ ├── OcrDetectionDemo.java 示例OCR通用文字检测示例 │ ├── OcrDirectionDetDemo.java 示例OCR方向检测示例 │ └── OcrRecognizeDemo.java 示例OCR通用文字识别示例 ├── nlp/ NLP │ ├── translate/ 机器翻译 │ └── TranslationDemo.java 示例机器翻译包含组件模块 介绍 common 基础通用模块封装了公共功能供各算法模块共享使用 bom 依赖管理模块 face 人脸功能模块 vision 通用视觉模块(目标检测等功能) ocr OCR文字识别模块 translate 机器翻译模块 speech 语音功能模块包含 ASR 和 TTS开源地址使用手册点击下方的【IT学习日记】回复【资源】领取如果这篇文章对您有帮助请一定帮我点个“关注”和“点赞”,这对我非常重要。我将会继续推荐更多优质项目和新闻。写在最后1000优质开源项目更新进度245/1000。如需更多类型优质项目推荐请在文章后留言。