123 читали · 2 года назад
Категориальные признаки в машинном обучении
#machine learning #анализ данных #python #sklearn Существует несколько способов преобразовать категории в числа, каждый из них имеет свои плюсы и минусы. Выбор метода зависит от типа и смысла ваших данных, мощности множества категорий, алгоритма машинного обучения. Ниже приведена схема, как выбрать подходящий метод кодирования. Рассмотрим наиболее популярные методы преобразования категорий в числа. Самый простой способ – обычная нумерация значений (0, 1, 2, …). У данного подхода есть существенный недостаток...
10 месяцев назад
Прямое кодирование в машинном обучении
Прямое кодирование представляет собой способ преобразования категориальных признаков в численные. Используется в машинном обучении, в том числе подходит для логистической регрессии, когда все признаки должны стать количественными. Рассмотрим на примерах. Преобразуйте колонку Gender техникой OHE...