秦岭熊猫

常用31个Java机器学习、深度学习、自然语言处理学习库&工具

常用的Java机器学习库

在 MLOSS.org 网站上，列出了 70 多个基于 Java 的开源机器学习项目，可能还有更多未列出的项目，存于大学里的服务器、GitHub 或 Bitbucket 中。我们将在本文中回顾 Java 中的主流机器学习库和平台，它们能够解决的问题类型，支持的算法以及可以使用的数据类型。

本文节选自 Machine learning in Java，由 Bostjan Kaluza 编写，Packt Publishing Ltd. 出版

1、Weka

Weka 是 Waikato Environment for Knowledge Analysis（Waikato 智能分析环境）的缩写，是新西兰 Waikato 大学开发的机器学习库，也可能是最为有名的 Java 库。Weka 是一个通用的库，能够解决各种机器学习任务，如分类、回归和聚类。它具有丰富的图形用户界面、命令行界面和 Java API。有关 Weka 更多详情，请参阅：http://www.cs.waikato.ac.nz/ml/weka/

截止到本书写作之时，Weka 总共包含 267 个算法，其中：数据预处理（82），属性选择（33），分类和回归（133），聚类（12），关联规则挖掘（7）。图形界面非常适合用于探索数据，而 Java API 可以让你开发新的机器学习方案并在应用中使用这些算法。
Weka 是在 GNU 通用公共许可证（GNU GPL）下发布的，这意味着你可以复制、分发和修改它，只要你跟踪源文件中的更改并将其保存在 GNU GPL 下。你甚至可以进行商业分发，但前提是你必须公开源代码或获得商业许可证。

除了几种支持的文件格式外，Weka 还提供了自己的默认数据格式 ARFF，用于通过属性 - 数据对描述数据。它由两部分组成：第一部分包含标题头，它指定所有属性（即特性）及其类型；例如，标称、数字、日期和字符串。第二部分包含数据，其中每行对应于一个实例。标题头中的最后一个属性隐式地被视为目标变量，缺失的数据用问号标记。例如，用 ARFF 文件格式编写的 Bob 实例如下:

    @RELATION person_dataset
    
    @ATTRIBUTE `Name`  STRING
    @ATTRIBUTE `Height`  NUMERIC
    @ATTRIBUTE `Eye color`{blue, brown, green}
    @ATTRIBUTE `Hobbies`  STRING
    
    @DATA
    'Bob', 185.0, blue, 'climbing, sky diving'
    'Anna', 163.0, brown, 'reading'
    'Jane', 168.0, ?, ?

该文件由三个部分组成。第一部分以 @relation 关键字开始，指定数据集名称。下一部分以 @ATTRIBUTE 关键字开始，后面是属性名和类型。可用的类型是 STRING（字符串）、NUMERIC（数字）、DATE（日期）和一组分类值。最后一个属性被隐式假设为我们想要预测的目标变量。最后一部分以 @DATA 关键字开始，每行后面跟着一个实例。实例值用逗号分隔，并且必须遵循与第二部分中的属性相同的顺序。

Weka 的 Java API 由以下的顶层包组成：

weka.associations：这些是关联规则学习的数据结构和算法，包括 Apriori、 predictive apriori、FilteredAssociator、FP-Growth、Generalized Sequential Patterns (GSP)、Hotspot 和 Tertius。
weka.classifiers：这些是监督学习算法、评估期和数据结构。该包由以下几个部分组成：
- weka.classifiers.bayes：它实现了贝叶斯（Bayesian）方法，包括朴素贝叶斯、贝式网络、贝叶斯逻辑回归等。
- weka.classifiers.evaluation：这些是评价统计、混淆矩阵、ROC 曲线等标称和数值预测的监督评价算法。
- weka.classifiers.functions：这些是回归算法，包括线性回归、保序回归、高斯过程、支持向量机、多层感知器、表决感知器等。
- weka.classifiers.lazy：这些是基于实例的算法，比如 k- 最近邻、K*，惰性贝叶斯规则。
- weka.classifiers.meta：这些是监督学习元算法，包括 AdaBoost、bagging、加性回归、随机委员会（random committee）等。
- weka.classifiers.mi：这些是多实例算法，如 Citation-KNN、多样性密度、MI AdaBoost 等。
- weka.classifiers.rules：这些是基于变治法（separate-and-conquer）、Ripper、Part、Prism 的决策表和决策规格。
- weka.classifiers.trees：这些是各种决策树算法，包括 ID3、C4.5、M5、功能树、逻辑树、随机森林等。
weka.clusterers：这些是聚类算法，包括 k-means、Clope、Cobweb、DBSCAN 层次聚类、Farthest 等
weka.core：这些是各种实用类、数据表示、配置文件等。
weka.datagenerators：这些是用于分类、回归和聚类算法的数据生成器。
weka.estimators：这些是用于离散 / 标称域、条件概率估计等的各种数据分布估计。
weka.experiment：这是一组类，支持运行实验所需的配置、数据集、模型设置和统计信息。
weka.filters：这些是基于属性和基于实例的选择算法，用于监督和非监督数据预处理。
weka.gui：这些是实现 Explorer、Experimenter、和 Knowledge Flow 的图形界面。Explorer 允许你调查数据集、算法及其参数，并使用散点图和其他可视化的形式对数据集进行可视化。Experimenter 用于设计批量实验，但它只能用于分类和回归问题。Knowledge Flow 实现了可视化的拖放式用户界面来构建数据流，如：加载数据、应用过滤器、构建分类器和评估。

2、用于机器学习的 Java-ML

Java 机器学习库（Java-ML）是一组机器学习算法的集合，具备用于相同类型的算法的公共接口。它只提供 Java API，因此，它主要面向的是软件工程师和程序员。Java-ML 包含用于数据预处理、特征选择、分类和聚类的算法。此外，它还提供了几个 Weka 桥来直接通过 Java-ML API 访问 Weka 的算法。Java-ML 可从 http://java-ml.sourceforge.net 下载，截至本书完成之际，最近版本发布于 2012 年。
Java-ML 也是一个通用机器学习库。与 Weka 相比，它提供了更为一致的接口和最新算法的实现，在其他包中不存在这些算法，如一系列最先进的相似性度量和特征选择技术等，这些包含动态时间规整、随机森林属性评估等等。Java-ML 也可以在 GNU GPL 许可证下使用。

Java-ML 支持任何类型的文件，只要它每行包含一个数据样本，并且特征用逗号、分号和制表符分隔。

Java-ML 库由以下顶层包组成：

net.sf.javaml.classification：这些是分类算法，包括朴素贝叶斯、随机森林、Bagging、自组织映射、k- 最近邻等。
net.sf.javaml.clustering：这些是聚类算法，包括 kmeans、自组织映射、空间聚类、Cobweb、AQBC 等。
net.sf.javaml.core：这些表示实例和数据集。
net.sf.javaml.distance：这些是测量实例距离和相似度的算法，如切比雪夫距离（Chebyshev distance）、余弦距离 / 相似度、欧几里得距离（Euclidian distance）、杰卡德距离（Jaccard distance）/ 相似度、马氏距离（Mahalanobis distance）、曼哈顿距离（Manhattan distance）、明氏距离（Minkowski distance）、皮尔逊积矩相关系数（Pearson correlation coefficient）、斯皮尔曼简捷距离（Spearman’s footrule distance）、动态时间规整（dynamic time wrapping，DTW）等。
net.sf.javaml.featureselection：这些是用于特征评估、评分、选择和排名的算法，如增益比、ReliefF、Kullback-Liebler 散度、对称不确定性等。
net.sf.javaml.filter：这些是通过过滤、删除属性、设置类或属性值等操作实例的方法。
net.sf.javaml.matrix：实现内存或基于文件的数组。
net.sf.javaml.sampling：实现选择数据集子集的采样算法。net.sf.javaml.tools：这些是关于数据集、实例操作、序列化、Weka API 接口等的使用方法。
net.sf.javaml.utils：这些是算法的实用方法，如统计、数学方法、列联表等表等。

3、Apache Mahout

Apache Mahout 项目旨在构建可扩展的机器学习库。它是在可扩展分布式体系结构（如 Hadoop）上构建的，实用 MapReduce 范例，这是一种实用服务器集群处理和生成具有并行分布式算法的大型数据及的方法。
Mahout 提供了控制台界面和 Java API，可用于聚类、分类和写作过滤的可扩展算法。它可以解决这三个业务问题：项目推荐，如向喜欢某部电影的人推荐其他可能喜欢的电影；聚类，如将文本文档分组与主题相关的文档组中归档；分类，如学习将哪个主题分配给未标记的文档。

Mahout 提供了以下库：
org.apache.mahout.cf.taste：这些是基于用户和基于项目的协同过滤算法，及基于 ALS 的矩阵分解算法。

org.apache.mahout.classifier：这些是内存和分布式实现，包括逻辑回归、朴素贝叶斯、随机森林、隐马尔科夫模型（hidden Markov models，HMM）和多层感知器。
org.apache.mahout.clustering：这些是聚类算法，例如 Canopy 聚类、k-means、模糊 k-means、流式 K-means 和谱聚类。
org.apache.mahout.common：这些是算法的实用方法，包括距离、MapReduce 操作、迭代器等。
org.apache.mahout.driver：实现了通用驱动程序来运行其他类的主要方法。
org.apache.mahout.ep：这是使用记录步骤突变的进化优化。
org.apache.mahout.math：这些是 Hadoop 中的各种数据额实用方法和实现。
org.apache.mahout.vectorizer：这些是用于数据表示、操作和 MapReduce 任务的类。

4、Apache Spark

Apache Spark（或简称 Spark）是在 Hadoop 上构建大规模数据处理的平台，但与 Mahout 不同的是，它与 MapReduce 范式无关。相反，它使用内存缓存提取工作数据集，对其进行处理并重复查询。据报道，Spark 直接处理磁盘存储数据的速度是 Mahout 实现的十倍。可从 https://spark.apache.org 下载。
在 Spark 之上构建了许多模块，例如用于图形处理的 GraphX、用于处理实时数据流的 Spark Streaming 和用于机器学习库的 MLlib，这些模块具有分类、回归、协同过滤、聚类、降维和优化。

Spark 的 MLlib 可以使用基于 Hadoop 的数据源，例如 Hadoop 分布式文件系统（HDFS）或 HBase，以及本地文件。支持的数据类型包括以下几种：

局部向量存储在一台机器上。稠密向量表示为双类型值数组，如 (2.0,0.0,10.,0.0)；而稀疏向量由向量的大小、索引数组和值数组表示，如 [4, (0, 2), (2.0, 1.0)]。
标记点用于监督学习算法，由局部向量组成，用双类型的类值标记。标签可以是类索引、二进制结果或多个类索引的列表（多类分类）。例如，标记的稠密向量表示为 [1.0, (2.0, 0.0, 1.0, 0.0)]。
局部矩阵在单台机器上存储稠密矩阵。它由矩阵维数和以列主序排列的单个双数组定义。
分布式矩阵对存储在 Spark 的弹性分布式数据集（Resilient Distributed Dataset，RDD）中的数据进行操作，RDD 表示可以并行操作的元素集合。有三种表示：行矩阵，其中每一行都是可以存储在一台机器上的局部向量，但行索引没有意义；索引行矩阵，类似于行矩阵，但行索引是有意义的，即可以识别行并执行行连接；坐标矩阵，当行不能存储在一台机器上，且矩阵非常稀疏时才使用。

Spark 的 MLlib API 库提供了各种学习算法和实用工具的接口，如下所示：

org.apache.spark.mllib.classification：这些是二元和多类分类算法，包括线性 SVM、逻辑回归、决策树和朴素贝叶斯。
org.apache.spark.mllib.clustering：这些是 k-means 聚类。
org.apache.spark.mllib.linalg：这些是数据表示，包括稠密向量、稀疏向量和矩阵。
org.apache.spark.mllib.optimization：这是 MLlib 中作为低级基元的各种优化算法，包括梯度下降、随机梯度下降、分布式 SGD 的更新方案和有限内存 BFGS。
org.apache.spark.mllib.recommendation：这些是基于模型的协同过滤，通过交替最小二乘矩阵分解来实现。
org.apache.spark.mllib.regression：这些是回归学习算法，如线性最小二乘、决策树、Lasso 和 Ridge 回归。
org.apache.spark.mllib.stat：这些是稀疏或稠密向量格式的样本的统计函数，用于计算均值、方差、最小值、最大值、计数和非零计数。org.apache.spark.mllib.tree：实现了分类和回归决策树的算法。
org.apache.spark.mllib.util：这些是用于加载、保存、预处理、生成和验证数据的方法的集合。

5、Deeplearning4j

DeepLearning4j（或称 DL4J），是一个用 Java 编写的深度学习库。它具有分布式和单机深度学习框架，包括并支持各种神经网络结构，如前馈神经网络、RBM（Restricted Boltzmann Machine，受限玻尔兹曼机）、卷积神经网络、深度信念网络、自动编码器等。DL4J 可以解决不同的问题，比如识别面孔、声音、垃圾邮件和电子商务欺诈。

Deeplearning4j 也是在 Apache 2.0 许可下分发的，可从 http://deeplearning4j.org 下载。该库由以下组成：

org.deeplearning4j.base：这些是加载类。
org.deeplearning4j.berkeley：这些是数学使用方法。
org.deeplearning4j.clustering：k-means 的聚类实现。
org.deeplearning4j.datasets：这是数据集的操作，包括导入、创建、迭代等。
org.deeplearning4j.distributions：这是用于分发的实用方法。
org.deeplearning4j.eval：这些是评估类，包括混淆矩阵。
org.deeplearning4j.exceptions：实现异常处理程序。
org.deeplearning4j.models：这些是监督学习算法，包括深度信念网络、堆叠式自动编码器、堆叠去噪式自动编码器和 RBM。
org.deeplearning4j.nn：这些是基于神经网络的组件和算法的实现，例如神经网络、多层网络、卷积多层网络等。
org.deeplearning4j.optimize：这些是神经网络优化算法，包括反向传播、多层优化、输出层优化等。
org.deeplearning4j.plot：这些是用于呈现数据的各种方法。
org.deeplearning4j.rng：这是一个随机数据生成器。
org.deeplearning4j.util：这些是帮助和实用方法。

6、MALLET

机器学习语言工作包（Machine Learning for Language Toolkit，MALLET），是一个包含自然语言处理算法和实用程序的大型库。它可以用于各种任务，如文档分类、分档聚类、信息提取和主题建模。MALLET 提供了命令行界面和 Java API，适用于多种算法，如朴素贝叶斯、HMM（Hidden Markov Model，隐马尔可夫模型）、隐含狄利克主题模型（Latent Dirichlet topic model）、逻辑回归和条件随机域（conditional random fields）。
MALLET 可以在通用公共许可证 1.0 下使用，这意味着你甚至可以在商业应用程序中使用它。可以从 http://mallet.cs.umass.edu 下载。MALLET 实例由名称、标签、数据和源表示。但是，有两种方法可以将数据导入到 MALLET 格式中，如下所示:

Instance per file：每个文件（即文档）对应一个实例，MALLET 接受输入的目录名。
Instance per line：每行对应一个实例，假设使用以下格式：instance_name 标签令牌。数据将是一个特征向量，由作为标记出现的不同单词和它们出现次数组成。

该库由以下包组成：

cc.mallet.classify：这些是用于训练和分类实例的算法，包括 AdaBoost、Bagging、C4.5、以及其他决策树模型、多元逻辑回归、朴素贝叶斯和 Winnow2。
cc.mallet.cluster：这些是无监督聚类算法，包括贪心凝聚（ greedy agglomerative）、爬山算法（hill climbing）、k-best 和 k-means 聚类。
cc.mallet.extract：实现分词器（tokenizers）、文档提取器、文档查看器和清理器等。
cc.mallet.fst: 实现了序列模型，包括条件随机域、HMM、最大熵马尔科夫模型（maximum entropy Markov models），以及相应的算法和评估器。
cc.mallet.grmm：实现了如推理算法、学习和测试的图形模型和因子图。例如环状信念传播（loopy belief propagation）、吉布斯采样（Gibbs sampling）等。
cc.mallet.optimize：这些是用于寻找函数最大值的优化算法，例如梯度上升、有限内存 BFGS、随机元上升（stochastic meta ascent）等。
cc.mallet.pipe：这些方法是将数据处理为 MALLET 实例中的管道。cc.mallet.topics：这些是主题建模算法，例如隐含狄利克分布（Latent Dirichlet allocation）、四级弹球分布（four-level pachinko allocation）、分层 PAM、DMRT 等。
cc.mallet.types：实现了基本数据类型，如数据集、特征向量、实例和标签。
cc.mallet.util：这些是各种实用工具功能，如命令行处理、搜索、数学、测试等。

如果你想利用关键的 Java 机器学习库进行设计、构建和部署你自己的机器学习应用，请查阅 Packt Publishing 出版社出版的《Java 机器学习》（Machine Learning in Java）一书。

转载自：https://hub.packtpub.com/most-commonly-used-java-machine-learning-libraries/#

下一步阅读:

5 JavaScript machine learning libraries you need to know

A non programmer’s guide to learning Machine learning

Why use JavaScript for machine learning?

25个JAVA 机器学习工具包

本列表总结了25个Java机器学习工具&库：

Weka集成了数据挖掘工作的机器学习算法。这些算法可以直接应用于一个数据集上或者你可以自己编写代码来调用。Weka包括一系列的工具，如数据预处理、分类、回归、聚类、关联规则以及可视化。
Massive Online Analysis（MOA）是一个面向数据流挖掘的流行开源框架，有着非常活跃的成长社区。它包括一系列的机器学习算法（分类、回归、聚类、异常检测、概念漂移检测和推荐系统）和评估工具。关联了WEKA项目，MOA也是用Java编写的，其扩展性更强。
MEKA项目提供了一个面向多标签学习和评价方法的开源实现。在多标签分类中，我们要预测每个输入实例的多个输出变量。这与“普通”情况下只涉及一个单一目标变量的情形不同。此外，MEKA基于WEKA的机器学习工具包。
Advanced Data mining And Machine learning System（ADAMS）是一种新型的柔性工作流引擎，旨在迅速建立并保持真实世界的复杂知识流，它是基于GPLv3发行的。
Environment for Developing KDD-Applications Supported by Index-Structure（ELKI）是一款基于Java的开源（AGPLv3）数据挖掘软件。ELKI主要集中于算法研究，重点研究聚类分析中的无监督方法和异常检测。
Mallet是一个基于Java的面向文本文件的机器学习工具包。Mallet支持分类算法，如最大熵、朴素贝叶斯和决策树分类。
Encog是一个先进的机器学习框架，集成了支持向量机（SVM）、人工神经网络、遗传算法、贝叶斯网络、隐马尔可夫模型（HMM）、遗传编程和遗传算法。
Datumbox机器学习框架是一个用Java编写的开源框架，允许快速地开发机器学习和统计应用。该框架的核心重点包括大量的机器学习算法以及统计测试，能够处理中等规模的数据集。
Deeplearning4j是使用Java和Scala编写的第一个商业级的、开源的、分布式深入学习库。其设计的目的是用于商业环境中，而不是作为一个研究工具。
Mahout是一个内置算法的机器学习框架。Mahout-Samsara帮助人们创建他们自己的数学，并提供了一些现成的算法实现。
Rapid Miner是德国多特蒙特技术大学开发的。它为开发者开发应用程序提供了一个GUI（图形用户界面）和Java API。它还提供了一些机器学习算法，用来做数据处理、可视化以及建模。
Apache SAMOA是一个机器学习（ML）框架，内嵌面向分布式流ML算法的编程抽象，并且允许在没有直接处理底层分布式流处理引擎（DSPEe，如Apache Storm、Apache S4和Apache samza）复杂性的情况下，开发新的ML算法。用户可以开发分布式流ML算法，而且可以在多个DSPEs上执行。
Neuroph通过提供支持创建、训练和保存神经网络的Java网络库和GUI工具，简化了神经网络开发。
Oryx 2是一个建立在Apache Spark和Apache Kafka的Lambda架构实现，但随着实时大规模机器学习而逐渐开始专业化。这是一个用于构建应用程序的框架，但也包括打包，以及面向协同过滤、分类、回归和聚类的端到端的应用程序。
Stanford Classifier是一个机器学习工具，它可以将数据项归置到一个类别。一个概率分类器，比如这个，它可以对一个数据项给出类分配的概率分布。该软件是最大熵分类器的一个Java实现。
io是一个Retina API，有着快速精确的类似大脑的自然语言处理算法。
JSAT是一个快速入门的机器学习库。该库是我在业余时间开发的，基于GPL3发行的。库中的一部分内容可自主学习，例如所有的代码都是独立的。JSAT没有外部依赖，而且是纯Java编写的。
N-Dimensional Arrays for Java(ND4J)是一个用于JVM的科学计算库。它们是用来在生产环境中使用的，这表明例程的设计是以最小的内存需求来运行的。
Java Machine Learning Library（Java机器学习库）是一系列机器学习算法的相关实现。这些算法，无论是源代码还是文档，都编写的很出色。其主要语言是Java。
Java-ML是一个使用Java编写的一系列机器学习算法的Java API。它只提供了一个标准的算法接口。
MLlib (Spark)是Apache Spark的可扩展机器学习库。虽然是Java，但该库与平台还支持Java，Scala和Python绑定。此库是最新的，并且算法很多。
H2O是用于智能应用的机器学习API。它在大数据上对统计学、机器学习和数学进行了规模化。H2O可扩展，开发者可以在核心部分使用简单的数学知识。
WalnutiQ是人脑部分面向对象模型，有着理论常用的学习算法（正在向简单强烈的情感人工智能模型方向研究）。
RankLib是一个排名学习算法库。目前已经实现八种流行的算法。
htm.java（基于Java的Hierarchical Temporal Memory算法实现）是一个面向智能计算的Numenta平台的Java接口。

纸上得来终觉浅，绝知此事要躬行。

你可能感兴趣的:(Java)

Java 8 + Tomcat 9.0.102 的稳定环境搭建方案，适用于生产环境无极低码 java java tomcat 开发语言
一、安装Java8安装OpenJDK8bashsudoaptupdatesudoaptinstallopenjdk-8-jdk-y验证安装bashjava-version应输出类似：openjdkversion“1.8.0_412”OpenJDKRuntimeEnvironment(build1.8.0_412-8u412-ga-1~22.04-b08)OpenJDK64-BitServerVM(
Java对正则表达式的支持（手机、身份证校验）周里奥工具正则表达式 java
目录1【数量:单个】字符匹配2【数量:单个】字符集(可以从里面任选一个字符)。3【数量:单个】简化字符集;4【边界匹配】5【数量表示】默认情况下只有添加上了数量单位才可以匹配多位字符;6【逻辑表达式】可以连接多个正则7【理解字符\的含义】\在Java中的含义\在正则表达式中的含义\出现在Java的正则表达式中处理举例1：[email protected]举例2：ab\abJava对正则的支持类-常用方法
Java与Elasticsearch集成详解，以及使用指南 qzw1210 java elasticsearch jenkins
Java与Elasticsearch集成详解1.环境配置首先，你需要在Maven项目中添加ElasticsearchJava客户端依赖：co.elastic.clientselasticsearch-java8.10.0com.fasterxml.jackson.corejackson-databind2.15.2jakarta.jsonjakarta.json-api2.1.12.客户端初始化E
java中校验手机号码的正则表达式尼采呀 java 正则表达式开发语言
一.匹配说明：正则表达式是描述字符串内容格式，使用它来匹配一个字符串的内容是否符合要求1.[]:表示一个字符,该字符可以是[]中指定的内容例如:[abc]:这个字符可以是a或b或c[a-z]:表示任意一个小写字母[a-zA-Z]:表示任意一个字母[a-zA-Z0-9_]:表示任意一个数字字母下划线[^abc]:该字符只要不是a或b或c预定义字符:.:表示任意一个字符,没有范围限制\d:表示任意一个
回溯法--力扣第17题“电话号码的字母组合”(java) 27xixi 数据结构与算法 leetcode java 算法
力扣第17题“电话号码的字母组合”回溯法（DFS）回溯法通过递归遍历每个数字对应的字母，生成所有可能的组合。核心思想是构建搜索树，每次选择一个字母后进入下一层递归，回溯时撤销选择以尝试其他分支。实现步骤：构建数字到字母的映射表：使用数组或哈希表存储每个数字对应的字母。递归回溯：终止条件：当前路径长度等于输入数字字符串长度时，将结果加入列表。遍历当前数字对应的所有字母，依次选择、递归、撤销选择。Ja
Java突击小练习--利用正则表达式来简易的校验邮箱与手机号格式 CJH~ java 正则表达式 mysql
//校验邮箱publicclassTestEmail{publicstaticvoidmain(String[]args){Scannerinput=newScanner(System.in);//*号代表任意数量，放在0-9a-zA-Z后面，代表可以写任意数量的字母和数字//@是邮箱的符号，接在刚刚那串的后面//|代表或，也就是说@后可以跟着qq或163或sina中的任意字符串，代表哪家邮箱//
【Quarkus】通过Quarkus集成后端服务示例 Vesper63 Quarkus java 开发语言
说明：REST资源接口（AuthResource）。REST资源实现类（AuthResourceImpl）。服务接口（AuthService）。服务实现类（AuthServiceImpl）。配置文件（application.properties）。测试类（AuthResourceTest）。1.项目结构my-quarkus-app/├──src/│├──main/││├──java/│││└──c
Groovy语言的漏洞扫描花韵婷包罗万象 golang 开发语言后端
Groovy语言漏洞扫描：深入分析与实践引言Groovy是一种基于Java虚拟机（JVM）的动态编程语言，它结合了Python、Ruby和Smalltalk等语言的特性，提供了简洁的语法和强大的功能。Groovy广泛应用于脚本编写、自动化测试、构建工具（如Gradle）以及Web开发等领域。然而，随着Groovy的广泛应用，其安全性问题也逐渐显现出来。本文将深入探讨Groovy语言中的常见漏洞类型
详解PriorityQueue 27xixi 算法数据结构 java
PriorityQueue是Java集合框架中的一个类，它实现了优先级队列的数据结构。优先级队列是一种特殊的队列，其中的元素按照优先级顺序出队，而不是按照插入顺序（FIFO）。默认情况下，PriorityQueue是一个最小堆，即优先级最小的元素最先出队。1.PriorityQueue的特点基于堆实现:PriorityQueue通常基于二叉堆（最小堆或最大堆）实现。无界队列:PriorityQue
Java集合进阶 27xixi java 开发语言
在Java中，集合框架（CollectionsFramework）是用于存储和操作一组对象的强大工具。它提供了多种接口和类，用于处理不同类型的集合（如列表、集合、队列、映射等）。1.Java集合框架概述Java集合框架主要包括以下接口和类：核心接口Collection:所有集合类的根接口。List:有序集合，允许重复元素（如ArrayList,LinkedList）。Set:无序集合，不允许重复元
java Stream API中的聚合操作 27xixi java java18
聚合操作是指对一组数据进行处理，最终生成一个单一的结果。在编程中，聚合操作通常用于对集合（如列表、数组等）中的元素进行统计、计算或汇总。常见的聚合操作包括求和、求平均值、查找最大值/最小值、计数等。在Java的StreamAPI中，聚合操作是通过终端操作（TerminalOperations）来实现的。以下是一些常见的聚合操作及其用法：1.求和（Sum）对集合中的元素进行求和。示例：求整数列表的和
N个utils(处理日期) 庖丁解java java
解释一下为什么会在java学习教程中放js的代码.1,最直接的肯定是我有时候会写js,而一些经典的逻辑,又不想新开前端文章,索性就放一起.2,java的面向对象太完善了,这也是我写文章的原因,导致写java代码很难学习到面向过程的编程思想,正好,原生js的代码,很大程度上写起来用的思维方式,很雷同面向过程的思考方式.算个补全,对写java代码,理解java代码,大有裨益.(这不是作者胡乱找补,写j
庖丁解java(一篇文章学java) 庖丁解java java 开发语言
(大家不用收藏这篇文章,因为这篇文章会经常更新,也就是删除后重发)一篇文章学java,这是我滴一个执念...当然,真一篇文章就写完java基础,java架构,java业务实现,java业务扩展,根本不可能.所以,这篇文章,就是一个索引,索什么呢?请看下文...关于决定开始写博文的介绍(一切故事的起点源于这一次反省)中小技术公司的软扩展(微服务扩展是否有必要?)-CSDN博客SpringCloud(
Exception in thread “main“ java.lang.NoSuchMethodError: Awesome Baron java java vscode
在VScode中运行代码调试力扣程序报错：Exceptioninthread“main”java.lang.NoSuchMethodError:‘intSolution.subarraySum(int[],int)’attest_560.main(test_560.java:9)原因是因为在不同的.java程序中使用了同名的Solution类，导致编译器和运行时选择的类不一致。解决方案：只保留一个
这些 JavaScript 编码习惯，让你最大程度提高你的项目可维护性！快乐非自愿 javascript 开发语言 ecmascript
前言：因为JavaScript语言是一门极其松散、极其自由的语言，这意味着我们可以随心所欲的操作它，这是他的优点，但同时也是它的缺点。在编码过程中，我们需要一种良好的规范或者习惯来保持应用程序的一致性和可维护性。而今天我们要说的就是，怎么在日常编码中通过一些的良好的编码习惯，从你编码的基础层面就能使得你的JavaScript代码可以更好维护。什么是可维护性？很多人学习前端，可能是从各种不同的渠道获
什么是mybatis？十二.413 mybatis java 数据库
目录一、mybatis框架介绍二、mybatis配置三、mybatis逆向工程三、userMapper.xml配置一、mybatis框架介绍1.1mybatis本是apache的一个开源项目iBatis,2010年这个项目由apachesoftwareoundation迁移到了googlecode，并且改名为MyBatis。2013年11月迁移到Github。mybatis是一个基于Java的持久
基于asp.NET的病历管理系统 (源码+net+vue+部署文档+讲解等) qq_1406299528 计算机毕业设计 asp asp.net vue.js 后端
收藏关注不迷路！！文末获取源码+数据库感兴趣的可以先收藏起来，还有大家在毕设选题（免费咨询指导选题），项目以及论文编写等相关问题都可以给我留言咨询，希望帮助更多的人文章目录前言程序资料获取一、项目技术二、项目内容和功能介绍三、核心代码数据库参考四、效果图五、资料获取前言博主介绍：✨全网粉丝10W+,CSDN特邀作者、博客专家、CSDN新星计划导师，专注于Java/Python/小程序app/深度学
什么是 MyBatis？有哪些优点和缺点？码农落落 java基础 mybatis java 数据库
什么是MyBatis？有哪些优点和缺点？MyBatis是一款基于Java的开源持久化框架，可以帮助开发者轻松地将SQL语句与Java对象映射起来，使业务逻辑与数据持久化分离，提高开发效率。MyBatis的主要优点和缺点如下：优点：1.简单易用：MyBatis对开发者提供了简单易用的API，无需编写繁琐的JDBC代码，降低了学习和使用成本。2.灵活性强：MyBatis比较灵活，支持多种配置方式，可以
MyBatis高级查询：一对多查询详解蓝天资源分享 mybatis tomcat java
MyBatis高级查询：一对多查询详解MyBatis是一个优秀的持久层框架，它支持定制化SQL、存储过程以及高级映射。MyBatis免除了几乎所有的JDBC代码和手动设置参数以及获取结果集的工作。MyBatis可以使用简单的XML或注解用于配置和原始映射，将接口和Java的POJOs（PlainOldJavaObjects，普通的Java对象）映射成数据库中的记录。本文将深入探讨MyBatis中的
基于Asp.net的汽车租赁管理系统计算机学姐 Asp精选实战项目源码 asp.net 汽车后端 mysql sqlserver vue.js c#
作者：计算机学姐开发技术：SpringBoot、SSM、Vue、MySQL、JSP、ElementUI、Python、小程序等，“文末源码”。专栏推荐：前后端分离项目源码、SpringBoot项目源码、Vue项目源码、SSM项目源码、微信小程序源码精品专栏：Java精选实战项目源码、Python精选实战项目源码、大数据精选实战项目源码系统展示【2025最新】基于Asp.net的汽车租赁管理系统开发
提速 Java性能优化实战：6大技巧解锁丝滑体验墨瑾轩一起学学Java【一】java 性能优化开发语言
在Java应用程序性能优化的领域，有多种策略可以帮助提升程序运行效率和响应速度。以下是一些实用的技巧，涵盖代码层面、JVM调优、以及设计模式等方面，旨在全面优化应用性能。1.代码层面优化避免不必要的对象创建频繁的对象创建和销毁会占用大量的CPU时间和内存资源。尽量重用对象，特别是在循环中。Java//优化前for(inti=0;i
web开发技术栈个人总结蓝砖科技HR_金庆硕前端
编程：Spring是一个非常强大的Java框架，被设计为帮助开发者更快速、容易地创建复杂的应用程序。Spring框架的核心是控制反转（IoC）和依赖注入（DI），它们提供了一种方法，允许开发者定义对象的依赖关系，而不是硬编码这些关系。这增加了可维护性和可测试性Spring框架有很多模块和子项目，这些可以根据应用程序的需求进行选择。下面是一些主要的Spring项目及其用途：SpringFramewo
Java 将 byte[] 转换为 File 对象我真的不想做程序员 java java 开发语言后端数据结构算法
目录一、将byte[]转换为File对象二、完整示例三、总结在Java开发中，将字节数组（byte[]）转换为文件对象（File）是一个常见的需求。这种需求常见于处理文件上传、下载以及与其他系统集成的场景。本文将详细介绍如何实现这一功能，并提供具体代码示例。一、将byte[]转换为File对象在Java中，可以使用java.io包中的File类和FileOutputStream类来将字节数组转换为
正则表达式全解析 + Java常用示例我真的不想做程序员算法 java java 后端开发语言算法正则表达式
目录一、正则表达式基础（一）元字符（二）字符集（三）量词二、正则表达式常用示例（一）验证邮箱格式（二）验证电话号码格式（三）提取网页中的链接（四）验证日期格式（五）验证URL格式三、正则表达式在Java中的应用（一）匹配操作（二）替换操作（三）分割操作四、总结一、正则表达式基础正则表达式是一种用于匹配字符串的强大工具。它使用特定的语法来定义匹配模式，可以在文本处理、表单验证、数据提取等场景中发挥重
2025年Python生态全景：从AI霸主到量子计算，揭秘其不可替代的技术魅力南玖yy python 人工智能量子计算
在2025年的技术浪潮中，Python凭借其极简的语法、庞大的生态系统以及跨领域融合能力，依然稳坐编程语言界的“头把交椅”。尽管Java等语言在AI领域发起挑战，但Python通过持续的技术革新和生态扩展，展现出不可撼动的生命力。本文将从技术趋势、行业应用与未来挑战三个维度，解析Python的“常青”密码。一、AI领域的持续主导：生态优势与工具革新Python在AI领域的统治地位仍未动摇。尽管有观
JavaScript 内置对象-Math对象咖啡の猫 javascript 开发语言
在JavaScript编程中，处理各种数学运算和数值操作是不可避免的任务。幸运的是，JavaScript提供了一个非常有用的内置对象——Math对象，它包含了大量用于执行常见数学任务的方法和属性。本文将详细介绍Math对象的主要特性和使用方法，帮助你更高效地进行数学相关的编程工作。一、什么是Math对象？Math是一个内置的对象，提供了对数学常量和函数的访问。与其它全局对象不同，Math不是一个构
JavaScript基础-变量的作用域難釋懷 javascript 开发语言
在学习JavaScript的过程中，理解变量的作用域是至关重要的。作用域决定了变量的可见性和生命周期，即在程序的哪些部分可以访问这些变量。正确理解和应用变量作用域不仅能帮助编写更清晰、更高效的代码，还能避免一些常见的编程错误。本文将详细介绍JavaScript中的变量作用域概念、类型及其应用场景。一、什么是作用域？作用域（Scope）是指变量的有效范围，在这个范围内，变量是可以被访问和使用的。Ja
rapidocr-onnxruntime库及在open-webui上传PDF 图像处理 (使用 OCR)应用原野AI 大模型部署 pdf ocr 深度学习 open-webui
背景rapidocr-onnxruntime是一个跨平台的OCR库，基于ONNXRuntime推理框架。目前已知运行速度最快、支持最广，完全开源免费并支持离线快速部署的多平台多语言OCR。缘起：百度paddle工程化不是太好，为了方便大家在各种端上进行ocr推理，我们将它转换为onnx格式，使用Python/C++/Java/Swift/C#将它移植到各个平台。名称来源：轻快好省并智能。基于深度学
Java多线程与高并发专题——原子类和 volatile、synchronized 有什么异同？黄雪超技术基础 java 开发语言并发编程
原子类和volatile异同首先，通过我们对原子类和的了解，原子类和volatile都能保证多线程环境下的数据可见性。在多线程程序中，每个线程都有自己的工作内存，当多个线程访问共享变量时，可能会出现一个线程修改了共享变量的值，而其他线程不能及时看到最新值的情况。原子类和volatile关键字都能在一定程度上解决这个问题。例如，当一个变量被volatile修饰后，对该变量的写操作会立即刷新到主内存，
Vue3使用ECharts入门示例牧小七 Vue echarts 前端 javascript
ApacheECharts介绍一个基于JavaScript的开源可视化图表库。官方网址使用示例第一步：NPM安装EChartsnpminstallecharts--save第二步：使用EChartsimport*asechartsfrom'echarts';constmain=ref()consttu=()=>{//基于准备好的dom，初始化echarts实例varmyChart=echarts.
mongodb3.03开启认证 21jhf mongodb
下载了最新mongodb3.03版本，当使用--auth 参数命令行开启mongodb用户认证时遇到很多问题，现总结如下：（百度上搜到的基本都是老版本的，看到db.addUser的就是，请忽略） Windows下我做了一个bat文件，用来启动mongodb，命令行如下： mongod --dbpath db\data --port 27017 --directoryperdb --logp
【Spark103】Task not serializable bit1129 Serializable
Task not serializable是Spark开发过程最令人头疼的问题之一，这里记录下出现这个问题的两个实例，一个是自己遇到的，另一个是stackoverflow上看到。等有时间了再仔细探究出现Task not serialiazable的各种原因以及出现问题后如何快速定位问题的所在，至少目前阶段碰到此类问题，没有什么章法 1. package spark.exampl
你所熟知的 LRU(最近最少使用) dalan_123 java
关于LRU这个名词在很多地方或听说，或使用，接下来看下lru缓存回收的实现 1、大体的想法 a、查询出最近最晚使用的项 b、给最近的使用的项做标记通过使用链表就可以完成这两个操作，关于最近最少使用的项只需要返回链表的尾部；标记最近使用的项，只需要将该项移除并放置到头部，那么难点就出现你如何能够快速在链表定位对应的该项？这时候多
Javascript 跨域周凡杨 JavaScript jsonp 跨域 cross-domain
linux下安装apache服务器 g21121 apache
安装apache 下载windows版本apache，下载地址：http://httpd.apache.org/download.cgi 1.windows下安装apache Windows下安装apache比较简单，注意选择路径和端口即可，这里就不再赘述了。 2.linux下安装apache：下载之后上传到linux的相关目录，这里指定为/home/apach
FineReport的JS编辑框和URL地址栏语法简介老A不折腾 finereport web报表报表软件语法总结
JS编辑框： 1.FineReport的js。作为一款BS产品，browser端的JavaScript是必不可少的。 FineReport中的js是已经调用了finereport.js的。大家知道，预览报表时，报表servlet会将cpt模板转为html，在这个html的head头部中会引入FineReport的js，这个finereport.js中包含了许多内置的fun
根据STATUS信息对MySQL进行优化墙头上一根草 status
mysql 查看当前正在执行的操作，即正在执行的sql语句的方法为: show processlist 命令 mysql> show global status;可以列出MySQL服务器运行各种状态值，我个人较喜欢的用法是show status like '查询值%';一、慢查询mysql> show variab
我的spring学习笔记7-Spring的Bean配置文件给Bean定义别名 aijuans Spring 3
本文介绍如何给Spring的Bean配置文件的Bean定义别名？原始的 <bean id="business" class="onlyfun.caterpillar.device.Business"> <property name="writer"> <ref b
高性能mysql 之性能剖析 annan211 性能 mysql mysql 性能剖析剖析
1 定义性能优化 mysql服务器性能，此处定义为响应时间。在解释性能优化之前，先来消除一个误解，很多人认为，性能优化就是降低cpu的利用率或者减少对资源的使用。这是一个陷阱。资源时用来消耗并用来工作的，所以有时候消耗更多的资源能够加快查询速度，保持cpu忙绿，这是必要的。很多时候发现编译进了新版本的InnoDB之后，cpu利用率上升的很厉害，这并不
主外键和索引唯一性约束百合不是茶索引唯一性约束主外键约束联机删除
目标;第一步;创建两张表用户表和文章表第二步;发表文章 1,建表; ---用户表 BlogUsers --userID唯一的 --userName --pwd --sex create
线程的调度 bijian1013 java 多线程 thread 线程的调度 java多线程
1. Java提供一个线程调度程序来监控程序中启动后进入可运行状态的所有线程。线程调度程序按照线程的优先级决定应调度哪些线程来执行。 2. 多数线程的调度是抢占式的（即我想中断程序运行就中断，不需要和将被中断的程序协商） a)
查看日志常用命令 bijian1013 linux 命令 unix
一.日志查找方法，可以用通配符查某台主机上的所有服务器grep "关键字" /wls/applogs/custom-*/error.log 二.查看日志常用命令1.grep '关键字' error.log：在error.log中搜索'关键字'2.grep -C10 '关键字' error.log：显示关键字前后10行记录3.grep '关键字' error.l
【持久化框架MyBatis3一】MyBatis版HelloWorld bit1129 helloworld
MyBatis这个系列的文章，主要参考《Java Persistence with MyBatis 3》。样例数据本文以MySQL数据库为例，建立一个STUDENTS表，插入两条数据，然后进行单表的增删改查 CREATE TABLE STUDENTS ( stud_id int(11) NOT NULL AUTO_INCREMENT,
【Hadoop十五】Hadoop Counter bit1129 hadoop
1. 只有Map任务的Map Reduce Job File System Counters FILE: Number of bytes read=3629530 FILE: Number of bytes written=98312 FILE: Number of read operations=0 FILE: Number of lar
解决Tomcat数据连接池无法释放 ronin47 tomcat 连接池　优化
近段时间，公司的检测中心报表系统(SMC)的开发人员时不时找到我，说用户老是出现无法登录的情况。前些日子因为手头上有Jboss集群的测试工作，发现用户不能登录时，都是在Tomcat中将这个项目Reload一下就好了，不过只是治标而已，因为大概几个小时之后又会再次出现无法登录的情况。今天上午，开发人员小毛又找到我，要我协助将这个问题根治一下，拖太久用户难保不投诉。简单分析了一
java-75-二叉树两结点的最低共同父结点 bylijinnan java
import java.util.LinkedList; import java.util.List; import ljn.help.*; public class BTreeLowestParentOfTwoNodes { public static void main(String[] args) { /* * node data is stored in
行业垂直搜索引擎网页抓取项目 carlwu Lucene Nutch Heritrix Solr
公司有一个搜索引擎项目，希望各路高人有空来帮忙指导，谢谢！这是详细需求：（1）通过提供的网站地址(大概100-200个网站)，网页抓取程序能不断抓取网页和其它类型的文件（如Excel、PDF、Word、ppt及zip类型），并且程序能够根据事先提供的规则，过滤掉不相干的下载内容。（2）程序能够搜索这些抓取的内容，并能对这些抓取文件按照油田名进行分类，然后放到服务器不同的目录中。
[通讯与服务]在总带宽资源没有大幅增加之前,不适宜大幅度降低资费 comsci 资源
降低通讯服务资费，就意味着有更多的用户进入，就意味着通讯服务提供商要接待和服务更多的用户，在总体运维成本没有由于技术升级而大幅下降的情况下，这种降低资费的行为将导致每个用户的平均带宽不断下降，而享受到的服务质量也在下降，这对用户和服务商都是不利的。。。。。。。。 &nbs
Java时区转换及时间格式 Cwind java
本文介绍Java API 中 Date, Calendar, TimeZone和DateFormat的使用，以及不同时区时间相互转化的方法和原理。问题描述：向处于不同时区的服务器发请求时需要考虑时区转换的问题。譬如，服务器位于东八区（北京时间，GMT+8:00），而身处东四区的用户想要查询当天的销售记录。则需把东四区的“今天”这个时间范围转换为服务器所在时区的时间范围。
readonly,只读，不可用 dashuaifu js jsp disable readOnly readOnly
readOnly 和 readonly 不同，在做js开发时一定要注意函数大小写和jsp黄线的警告！！！我就经历过这么一件事：使用readOnly在某些浏览器或同一浏览器不同版本有的可以实现“只读”功能，有的就不行，而且函数readOnly有黄线警告！！！就这样被折磨了不短时间！！！（期间使用过disable函数，但是发现disable函数之后后台接收不到前台的的数据！！！）
LABjs、RequireJS、SeaJS 介绍 dcj3sjt126com js Web
LABjs 的核心是 LAB（Loading and Blocking）：Loading 指异步并行加载，Blocking 是指同步等待执行。LABjs 通过优雅的语法（script 和 wait）实现了这两大特性，核心价值是性能优化。LABjs 是一个文件加载器。RequireJS 和 SeaJS 则是模块加载器，倡导的是一种模块化开发理念，核心价值是让 JavaScript 的模块化开发变得更
[应用结构]入口脚本 dcj3sjt126com PHP yii2
入口脚本入口脚本是应用启动流程中的第一环，一个应用（不管是网页应用还是控制台应用）只有一个入口脚本。终端用户的请求通过入口脚本实例化应用并将将请求转发到应用。 Web 应用的入口脚本必须放在终端用户能够访问的目录下，通常命名为 index.php，也可以使用 Web 服务器能定位到的其他名称。控制台应用的入口脚本一般在应用根目录下命名为 yii（后缀为.php），该文
haoop shell命令 eksliang hadoop hadoop shell
cat chgrp chmod chown copyFromLocal copyToLocal cp du dus expunge get getmerge ls lsr mkdir movefromLocal mv put rm rmr setrep stat tail test text
MultiStateView不同的状态下显示不同的界面 gundumw100 android
只要将指定的view放在该控件里面，可以该view在不同的状态下显示不同的界面，这对ListView很有用，比如加载界面，空白界面，错误界面。而且这些见面由你指定布局，非常灵活。 PS：ListView虽然可以设置一个EmptyView，但使用起来不方便，不灵活，有点累赘。 <com.kennyc.view.MultiStateView xmlns:android=&qu
jQuery实现页面内锚点平滑跳转 ini JavaScript html jquery html5 css
平时我们做导航滚动到内容都是通过锚点来做，刷的一下就直接跳到内容了，没有一丝的滚动效果，而且 url 链接最后会有“小尾巴”，就像#keleyi，今天我就介绍一款 jquery 做的滚动的特效，既可以设置滚动速度，又可以在 url 链接上没有“小尾巴”。效果体验：http://keleyi.com/keleyi/phtml/jqtexiao/37.htmHTML文件代码： &
kafka offset迁移 kane_xie kafka
在早前的kafka版本中（0.8.0），offset是被存储在zookeeper中的。到当前版本（0.8.2）为止，kafka同时支持offset存储在zookeeper和offset manager（broker）中。从官方的说明来看，未来offset的zookeeper存储将会被弃用。因此现有的基于kafka的项目如果今后计划保持更新的话，可以考虑在合适
android > 搭建 cordova 环境 mft8899 android
1 , 安装 node.js http://nodejs.org node -v 查看版本 2, 安装 npm 可以先从 https://github.com/isaacs/npm/tags 下载源码解压到
java封装的比较器，比较是否全相同，获取不同字段名字 qifeifei
非常实用的java比较器，贴上代码： import java.util.HashSet; import java.util.List; import java.util.Set; import net.sf.json.JSONArray; import net.sf.json.JSONObject; import net.sf.json.JsonConfig; i
记录一些函数用法 .Aky. 位运算 PHP 数据库函数 IP
高手们照旧忽略。想弄个全天朝IP段数据库，找了个今天最新更新的国内所有运营商IP段，copy到文件，用文件函数，字符串函数把玩下。分割出startIp和endIp这样格式写入.txt文件，直接用phpmyadmin导入.csv文件的形式导入。（生命在于折腾，也许你们觉得我傻X，直接下载人家弄好的导入不就可以，做自己的菜鸟，让别人去说吧）当然用到了ip2long()函数把字符串转为整型数
sublime text 3 rust wudixiaotie Sublime Text
1.sublime text 3 => install package => Rust 2.cd ~/.config/sublime-text-3/Packages 3.mkdir rust 4.git clone https://github.com/sp0/rust-style 5.cd rust-style 6.cargo build --release 7.ctrl