Примеры кода на Java — различия между версиями

Текущая версия на 19:22, 4 сентября 2022

Основные особенности использования Java для задач машинного обучения

В отличие от Python, Java не обладает столь обширной экосистемой, ориентированной на решение задач машинного обучения и анализа данных. Большинство имеющихся инструментов являются узко специализированными (по сравнению, например, с scikit-learn^[4]) и хуже документированы. Ввиду более низкой популярности языка в сфере ML большинство онлайн курсов и обучающих материалов ориентированы на Python. Однако, несмотря на вышеперечисленные факторы, Java остается популярной альтернативой, особенно при необходимости интеграции с существующими JVM проектами. Также к достоинствам Java можно отнести статическую типизацию (и как следствие уменьшенную вероятность ошибок времени исполнения) и заметно более развитую поддержку в IDE.

Примеры кода

Для работы с приведенными ниже примерами необходим JDK версии не ниже 10 и система сборки Maven.
Каждый пример структурирован следующим образом:

Maven зависимость на необходимые библиотеки
Список необходимых import директив
Код примера с комментариями

Вариации регрессии

Основная статья: Вариации регрессии

Линейная регрессия

Основная статья: Линейная регрессия#Пример на языке Java

Логистическая регрессиия

Основная статья: Логистическая регрессия#Пример на языке Java

Гребневая регрессия (ридж-регрессия)

Основная статья: Вариации регрессии#Пример на языке Java

Лассо-регрессия

Основная статья: Вариации регрессии#Пример на языке Java_2

Метрический классификатор и метод ближайших соседей

Основная статья: Метрический классификатор и метод ближайших соседей#Пример на языке Java

Классификация при помощи MLP

Основная статья: Нейронные сети, перцептрон#Пример на языке Java

Рекуррентные нейронные сети

Основная статья: Рекуррентные нейронные сети#Пример на языке Java

Долгая краткосрочная память

Основная статья: Долгая краткосрочная память#Пример на языке Java

Метод опорных векторов

Основная статья: Метод опорных векторов (SVM)#Пример на языке Java

Деревья решений, случайный лес

Основная статья: Дерево решений и случайный лес#Пример на языке Java

Бустинг, Ada-boost

Основная статья: Бустинг, AdaBoost#Пример на языке Java

EM-алгоритм

Основная статья: EM-алгоритм

Пример кластеризации с применением weka.clusterers.EM^[5]

 <dependency>
   <groupId>nz.ac.waikato.cms.weka</groupId>
   <artifactId>weka-stable</artifactId>
   <version>3.8.0</version>
 </dependency>

 import weka.clusterers.ClusterEvaluation;
 import weka.clusterers.EM;
 import weka.core.Instances;
 import java.io.BufferedReader;
 import java.io.FileReader;
 import java.util.Random;

 //load data
 var data = new Instances(new BufferedReader(new FileReader("data/bank-data.arff")));
 // new instance of clusterer
 var model = new EM();
 // build the clusterer
 model.buildClusterer(data);
 System.out.println(model);
 var logLikelihood = ClusterEvaluation.crossValidateModel(model, data, 10, new Random(1));

Уменьшение размерности

Основная статья: Уменьшение размерности#Пример на языке Java

Байесовская классификация

Основная статья: Байесовская классификация#Пример на языке Java

См. также

Примечания

[1] Weka

[2] Smile, Statistical Machine Intelligence and Learning Engine

[3] rning4j, deep learning & linear algebra for Java/Scala with GPUs + Spark

[4] Библиотека scikit-learn

[5] Weka, EM

[1]

[2]

[3]

[4]

[5]

@@ Строка 1: / Строка 1: @@
 [[File:Java.jpeg|auto|thumb|Java: https://www.oracle.com/java/]]
 ==Популярные библиотеки==
-* <code>Weka</code><ref>[https://www.cs.waikato.ac.nz/~ml/weka/ Weka]</ref> {{---}} популярная библиотека, написанная на языке <code>Java</code> и содержащая в себе множество алгоритмов машинного обучения для задач анализа данных. Предоставляет инструменты для решения задач классификации, кластеризации данных, регрессионного анализа и др.
+* <code>Weka</code><ref>[https://www.cs.waikato.ac.nz/~ml/weka/ Weka]</ref> {{---}} популярная библиотека, написанная на языке <code>Java</code> и содержащая в себе множество алгоритмов машинного обучения для задач анализа данных. Предоставляет инструменты для решения задач классификации, кластеризации данных, регрессионного анализа и др. Основные возможности <code>Weka</code> можно сгруппировать в 3 категории: инструменты пре-процессинга данных, алгоритмы машинного обучения и инструменты оценки модели. Инструменты пре-процессинга в <code>Weka</code> называются фильтрами, <code>Weka</code> содержит фильтры для дискретиации, нормализации, уменьшения размерности, трансформации и комбинирования признаков. <code>Weka Machine Learning Toolkit</code> содержит алгоритмы классификации, регрессии, кластеризации. Реализованы следующие алгоритмы обучения: деревья решений, метод опорных векторов, <code>MLP</code>, логистическая регрессия, Байесовские сети, и др., мета-алгоритмы включают в себя: бэггинг, [[Бустинг, AdaBoost|бустинг]], стекинг, алгоритмы выбора признаков: [[Метод главных компонент (PCA)| PCA]]<sup>[на 28.01.19 не создан]</sup>, фильтрующие методы, основанные на information gain, коэффициенте корреляции Пирсона и <code>OneR</code> классификаторе.
 * <code>Smile</code><ref>[https://haifengl.github.io/smile/ Smile, Statistical Machine Intelligence and Learning Engine]</ref> {{---}} <code>Java</code> фреймворк для машинного обучения, анализа естественного языка, линейной алгебры и визуализации данных. <code>Smile</code> покрывает все основные аспекты машинного обучения и предоставляет высокопроизводительные алгоритмы и структуры данных.
 * <code>deeplearning4j</code><ref>[https://github.com/deeplearning4j/deeplearning4j deeplearning4j, deep learning & linear algebra for Java/Scala with GPUs + Spark]</ref> {{---}} <code>Java</code> библиотека для глубокого обучения, создания рекуррентых (в том числе распределенных) нейронных сетей.
 ==Основные особенности использования Java для задач машинного обучения==
-В отличие от <code>Python</code>, <code>Java</code> не обладает столь обширной экосистемой, ориентированной на решение задач машинного обучения и анализа данных. Большинство имеющихся инструментов являются узко специализированными (по сравнению, например, с <code>scikit-learn</code><ref>[https://scikit-learn.org/stable/ Библиотека scikit-learn]</ref>) и хуже документированы. Ввиду более низкой популярности языка в сфере <code>ML</code> большинство онлайн курсов и обучающих материалов ориентированы на <code>Python</code>. Однако, не смотря на вышеперечисленные факторы, <code>Java</code> остается
+В отличие от <code>Python</code>, <code>Java</code> не обладает столь обширной экосистемой, ориентированной на решение задач машинного обучения и анализа данных. Большинство имеющихся инструментов являются узко специализированными (по сравнению, например, с <code>scikit-learn</code><ref>[https://scikit-learn.org/stable/ Библиотека scikit-learn]</ref>) и хуже документированы. Ввиду более низкой популярности языка в сфере <code>ML</code> большинство онлайн курсов и обучающих материалов ориентированы на <code>Python</code>. Однако, несмотря на вышеперечисленные факторы, <code>Java</code> остается
 популярной альтернативой, особенно при необходимости интеграции с существующими <code>JVM</code> проектами. Также к достоинствам <code>Java</code> можно отнести статическую типизацию (и как следствие уменьшенную вероятность ошибок времени исполнения) и заметно более развитую поддержку в IDE.
 ==Примеры кода==
@@ Строка 76: / Строка 76: @@
 ==См. также==
 *[[:Примеры кода на Scala|Примеры кода на Scala]]
-*[[:Примеры кода на R|Примеры кода на R]]<sup>[на 08.04.19 не создан]</sup>
+*[[:Примеры кода на R|Примеры кода на R]]
 *[[:Обзор библиотек для машинного обучения на Python|Обзор библиотек для машинного обучения на Python]]