Deeplearning4j【基础 01】初识Java深度学习框架DL4J_dl4j java

2401_86358637

于 2024-09-01 02:49:17 发布

阅读量1k

点赞数 28

文章标签： java 深度学习开发语言

本文链接：https://blog.csdn.net/2401_86358637/article/details/141762489

版权

初识Java深度学习框架DL4J

1.起因
2.简介
3.组件
- 3.1 Deeplearning4j/ScalNet
4.总结

内容来自网络，基于官方文档【
Deeplearning4j】、知乎【
DL4J开发者社区】、OSCHINA【
Deeplearning4j 分布式深度学习库】、科普中国·科学百科【
Deeplearning4j】等文章进行整理，简化了一些信息并通过深度学习菜鸟
我这个人形GPT〒_〒的思维方式进行阐述。

1.起因

LLM如火如荼地影响着整个互联网应用，AI也成为焦点，之前的大数据分析似乎热度过去了，大家都想学点儿ML，但是Python、GPU不是都具备的。
DL4J可以在JVM上运行，拥有了Java语言的一切优点，且支持GPU和大数据组建集成，不用担心性能和可扩展性。
由于是小白，需要进行基础知识的补充，这里整理一下分享给大家。

2.简介

Deeplearning4j是当前最大、最流行的基于JAVA的深度学习框架，正式诞生于2013年，在2017年加入Eclipse基金会，由美国的Skymind开源并维护。

支持神经网络模型的构建、模型训练和部署；
能够与现有大数据生态进行无缝衔接（Hadoop、Spark等），也是可以原生态支持分布式模型训练的框架之一；
支持多线程；
跨平台（硬件：CUDA GPU，x86，ARM，PowerPC；操作系统：Windows/Mac/Linux/Android）。

小结一下：模型构建、模型训练和部署一条龙，兼容性强，多线程，跨平台（特别注意Android平台，支持端侧模型）？

3.组件

Deeplearning4j实际上是一堆项目，旨在支持基于 JVM 的深度学习应用程序的所有需求。除了 Deeplearning4j 本身（高级 API），它还包括：

Deeplearning4j/ScalNet：JVM和Spark上运行神经网络构建、训练和部署的基础框架库；
ND4J/libND4J：支持CPU/GPU加速的高性能数值计算库，可以说是JVM上的Numpy；
SameDiff：用于符合微分和计算图库；
DataVec：数据处理库，提供采样、过滤、变换等操作；
Arbiter：神经网络超参数搜索和优化库；
RL4J：JVM上的强化学习库；
Model Import：模型导入库，可以导入ONNX，TensorFlow，Keras(Caffe)模型；
Jumpy：ND4J对应Python语言API；
Python4j：可以在JVM里运行Python脚本语言。

3.1 Deeplearning4j/ScalNet

前向神经网络（Feedforward Neural Networks, FNN）
自动编码器（AutoEncoders）
卷积神经网络（Convolutional Neural Networks, CNN）
循环神经网络（Recurrent Neural Networks ,RNN)
生成对抗网络（Generative Adversarial Networks）
递归神经网络（Recursive Neural Network ）
深度信念网络（Deep Belief Networks）和受限制玻尔兹曼机（Restricted Boltzmann Machines）
图神经网络（Graph Neural Networks）

3.1.1 Deeplearning4jf（Java）

神经网络高层API库，用于构建具有各种层的多层神经网络（MultiLayerNetworks）和计算图（ComputationGraphs），支持从其他框架导入模型和在Apache Spark上进行分布式训练

3.1.2 ScalNet（Scala）

ScalNet是受Keras启发而为Deeplearning4j开发的Scala语言包装。它通过Spark在多个GPU上运行。功能相当于Keras。
Keras是一个由Python编写的开源人工神经网络库，可以作为Tensorflow、Microsoft-CNTK和Theano的高阶应用程序接口，进行深度学习模型的设计、调试、评估、应用和可视化。

3.2 ND4J/LibND4J

ND4J是Deeplearning4j的数值处理库和张量库，在JVM中实现Numpy的功能：

Java科学运算引擎，用来驱动矩阵操作；
JavaCPP功能: Java 到 Objective-C 的桥，可像其他 Java 对象一样来使用 Objective-C 对象；
CPU 后瑞：OpenMP、OpenBlas 或 MKL、与SIMD的扩展；
GPU 后瑞：最新CUDA 及 CuDNN。

包含500多种数学、线性代数和神经网络操作。

3.3 SameDiff

SameDiff是具有自动微分功能的张量计算库，其自动微分方法是基于静态图的方法，提供神经网络运算中更为底层的接口，主要用于自定义神经网络拓扑结构。
另外，SameDiff支持导入Tensorflow冻结模型格式的.pd（protobuf）模型。对ONNX、TensorFlow SaveModel和Keras模型的导入正在完善中。可以简单的认为SameDiff和DL4J的关系类似于Tensorflow和Keras。
符合微分和计算图库是深度学习中的两个关键概念：