Regresión Lineal – Variables Dummy

Las regresiones lineales multivariables, consisten en una variable dependiente y varias independientes. Por ejemplo:

regresion lineal python machine learning

En este caso, x1, x2, x3, representan valores numéricos de la tabla pero D4 es una representación de la columna State que es Categórico. Para procesarlo, se genera una columna New York Dummy booleana que guarda 1 si es NY y 0 si es California.

NO hace falta hacer una columna por cada estado en este caso. Generalizando, se deben hacer n-1 columnas donde n es la cantidad de valores diferentes que puede tomar la variable categórica. Si se incluyen todas, no se tratarían de variables independientes y el modelo no funcionaría bien.

Check Also

Métodos de Filtro para Selección de Características en Machine Learning

1. Introducción y Justificación La selección de características es una etapa fundamental en el preprocesamiento …

Leave a Reply

Your email address will not be published. Required fields are marked *