Ejercicios: Regresión lineal múltiple
Si no te acordás cómo se usa, repasá la teoría.
Las 12 actividades recorren los distintos tipos de ejercicio del tema, con tres variantes de cada uno. Si te trabás en una, mirá la solución y seguí con la siguiente.
1. Se ajustó el modelo , donde es el sueldo, en miles, es los años de experiencia y es los años de estudio. Predecí el valor de para y .
Ver solución
1. Escribimos el modelo. : en vez de una recta, el ajuste es un plano.
2. Reemplazamos los dos valores.
3. Calculamos los términos. y .
4. Sumamos. miles de pesos.
5. Marcamos el mismo límite que en la regresión simple. La predicción vale solo dentro del rango donde se observaron las dos variables explicativas. Con dos variables el rango es una región del plano, no dos intervalos por separado.
6. Un cuidado extra del caso múltiple. y pueden ser valores razonables por separado y aun así esa combinación puede no haberse observado nunca.
Respuesta: miles de pesos
2. En el modelo , donde es el sueldo, en miles, es los años de experiencia y es los años de estudio, interpretá el coeficiente y explicá qué cambia respecto de la regresión simple.
Ver solución
1. Escribimos la interpretación. significa que por cada unidad más de los años de experiencia, el sueldo, en miles aumenta en promedio miles de pesos, manteniendo la otra variable constante.
2. Marcamos la parte que cambia todo. «Manteniendo la otra variable constante». En regresión simple no había nada que mantener fijo; acá el coeficiente mide el efecto propio de esa variable, ya descontado lo que aporta la otra.
3. Interpretamos el segundo coeficiente. : por cada unidad más de los años de estudio, el sueldo, en miles baja miles de pesos en promedio, con los años de experiencia fija.
4. Vemos por qué la diferencia importa. Si las dos variables explicativas están relacionadas entre sí, el coeficiente de una en el modelo múltiple puede ser muy distinto del que tendría en un modelo simple, y hasta cambiar de signo.
5. Interpretamos la constante. es el valor predicho cuando las dos explicativas valen cero, y casi nunca corresponde a un caso real.
6. Lo que sigue sin decir el modelo. Nada sobre causa. Que un coeficiente sea grande no prueba que esa variable empuje a la respuesta.
Respuesta: : cambio promedio de el sueldo, en miles por unidad de los años de experiencia, manteniendo los años de estudio constante
3. Un modelo de regresión múltiple para el precio de la vivienda, en miles con variables explicativas y casos dio . Calculá el ajustado y explicá para qué sirve.
Ver solución
1. Escribimos la fórmula.
2. Identificamos los datos. , variables explicativas, .
3. Reemplazamos.
4. Comparamos. : el ajustado siempre queda por debajo, y la diferencia es de .
5. Explicamos para qué sirve. El común nunca baja al agregar variables, así que no sirve para comparar modelos con distinta cantidad de explicativas. El ajustado penaliza por cada variable agregada.
6. Cómo se usa. Si al sumar una variable el sube pero el ajustado baja, esa variable no aporta lo suficiente para justificar el grado de libertad que consume.
Respuesta: , menor que el
4. Con casos, un modelo con variables explicativas dio . Se agrega una tercera variable, sin relación aparente con las ventas mensuales, en miles, y el pasa a . Decidí si conviene incorporarla.
Ver solución
1. Observamos qué pasó con el . Subió de a , o sea .
2. Explicamos por qué siempre sube. Agregar una variable nunca puede empeorar el ajuste dentro de la muestra: en el peor caso el método le asigna un coeficiente cercano a cero. El solo puede subir o quedarse igual, aunque la variable sea puro ruido.
3. Calculamos el ajustado del modelo original.
4. Calculamos el ajustado del modelo ampliado.
5. Comparamos. El ajustado bajó de a .
6. Decidimos. No conviene incorporarla: la mejora del ajuste no compensa el grado de libertad que consume.
Respuesta: El sube siempre, pero el ajustado va de a : no conviene incorporarla
5. Se ajustó el modelo , donde es el rendimiento del cultivo, es los kilos de fertilizante y es los milímetros de lluvia. Predecí el valor de para y .
Ver solución
1. Escribimos el modelo. : en vez de una recta, el ajuste es un plano.
2. Reemplazamos los dos valores.
3. Calculamos los términos. y .
4. Sumamos. quintales.
5. Marcamos el mismo límite que en la regresión simple. La predicción vale solo dentro del rango donde se observaron las dos variables explicativas. Con dos variables el rango es una región del plano, no dos intervalos por separado.
6. Un cuidado extra del caso múltiple. y pueden ser valores razonables por separado y aun así esa combinación puede no haberse observado nunca.
Respuesta: quintales
6. En el modelo , donde es el precio de la vivienda, en miles, es los metros cuadrados y es la antigüedad en años, interpretá el coeficiente y explicá qué cambia respecto de la regresión simple.
Ver solución
1. Escribimos la interpretación. significa que por cada unidad más de los metros cuadrados, el precio de la vivienda, en miles aumenta en promedio miles de pesos, manteniendo la otra variable constante.
2. Marcamos la parte que cambia todo. «Manteniendo la otra variable constante». En regresión simple no había nada que mantener fijo; acá el coeficiente mide el efecto propio de esa variable, ya descontado lo que aporta la otra.
3. Interpretamos el segundo coeficiente. : por cada unidad más de la antigüedad en años, el precio de la vivienda, en miles sube miles de pesos en promedio, con los metros cuadrados fija.
4. Vemos por qué la diferencia importa. Si las dos variables explicativas están relacionadas entre sí, el coeficiente de una en el modelo múltiple puede ser muy distinto del que tendría en un modelo simple, y hasta cambiar de signo.
5. Interpretamos la constante. es el valor predicho cuando las dos explicativas valen cero, y casi nunca corresponde a un caso real.
6. Lo que sigue sin decir el modelo. Nada sobre causa. Que un coeficiente sea grande no prueba que esa variable empuje a la respuesta.
Respuesta: : cambio promedio de el precio de la vivienda, en miles por unidad de los metros cuadrados, manteniendo la antigüedad en años constante
7. Un modelo de regresión múltiple para las ventas mensuales, en miles con variables explicativas y casos dio . Calculá el ajustado y explicá para qué sirve.
Ver solución
1. Escribimos la fórmula.
2. Identificamos los datos. , variables explicativas, .
3. Reemplazamos.
4. Comparamos. : el ajustado siempre queda por debajo, y la diferencia es de .
5. Explicamos para qué sirve. El común nunca baja al agregar variables, así que no sirve para comparar modelos con distinta cantidad de explicativas. El ajustado penaliza por cada variable agregada.
6. Cómo se usa. Si al sumar una variable el sube pero el ajustado baja, esa variable no aporta lo suficiente para justificar el grado de libertad que consume.
Respuesta: , menor que el
8. Con casos, un modelo con variables explicativas dio . Se agrega una tercera variable, sin relación aparente con el rendimiento del cultivo, y el pasa a . Decidí si conviene incorporarla.
Ver solución
1. Observamos qué pasó con el . Subió de a , o sea .
2. Explicamos por qué siempre sube. Agregar una variable nunca puede empeorar el ajuste dentro de la muestra: en el peor caso el método le asigna un coeficiente cercano a cero. El solo puede subir o quedarse igual, aunque la variable sea puro ruido.
3. Calculamos el ajustado del modelo original.
4. Calculamos el ajustado del modelo ampliado.
5. Comparamos. El ajustado bajó de a .
6. Decidimos. No conviene incorporarla: la mejora del ajuste no compensa el grado de libertad que consume.
Respuesta: El sube siempre, pero el ajustado va de a : no conviene incorporarla
9. Se ajustó el modelo , donde es las ventas mensuales, en miles, es el gasto en publicidad, en miles y es la cantidad de vendedores. Predecí el valor de para y .
Ver solución
1. Escribimos el modelo. : en vez de una recta, el ajuste es un plano.
2. Reemplazamos los dos valores.
3. Calculamos los términos. y .
4. Sumamos. miles de pesos.
5. Marcamos el mismo límite que en la regresión simple. La predicción vale solo dentro del rango donde se observaron las dos variables explicativas. Con dos variables el rango es una región del plano, no dos intervalos por separado.
6. Un cuidado extra del caso múltiple. y pueden ser valores razonables por separado y aun así esa combinación puede no haberse observado nunca.
Respuesta: miles de pesos
10. En el modelo , donde es las ventas mensuales, en miles, es el gasto en publicidad, en miles y es la cantidad de vendedores, interpretá el coeficiente y explicá qué cambia respecto de la regresión simple.
Ver solución
1. Escribimos la interpretación. significa que por cada unidad más de el gasto en publicidad, en miles, las ventas mensuales, en miles aumenta en promedio miles de pesos, manteniendo la otra variable constante.
2. Marcamos la parte que cambia todo. «Manteniendo la otra variable constante». En regresión simple no había nada que mantener fijo; acá el coeficiente mide el efecto propio de esa variable, ya descontado lo que aporta la otra.
3. Interpretamos el segundo coeficiente. : por cada unidad más de la cantidad de vendedores, las ventas mensuales, en miles sube miles de pesos en promedio, con el gasto en publicidad, en miles fija.
4. Vemos por qué la diferencia importa. Si las dos variables explicativas están relacionadas entre sí, el coeficiente de una en el modelo múltiple puede ser muy distinto del que tendría en un modelo simple, y hasta cambiar de signo.
5. Interpretamos la constante. es el valor predicho cuando las dos explicativas valen cero, y casi nunca corresponde a un caso real.
6. Lo que sigue sin decir el modelo. Nada sobre causa. Que un coeficiente sea grande no prueba que esa variable empuje a la respuesta.
Respuesta: : cambio promedio de las ventas mensuales, en miles por unidad de el gasto en publicidad, en miles, manteniendo la cantidad de vendedores constante
11. Un modelo de regresión múltiple para el rendimiento del cultivo con variables explicativas y casos dio . Calculá el ajustado y explicá para qué sirve.
Ver solución
1. Escribimos la fórmula.
2. Identificamos los datos. , variables explicativas, .
3. Reemplazamos.
4. Comparamos. : el ajustado siempre queda por debajo, y la diferencia es de .
5. Explicamos para qué sirve. El común nunca baja al agregar variables, así que no sirve para comparar modelos con distinta cantidad de explicativas. El ajustado penaliza por cada variable agregada.
6. Cómo se usa. Si al sumar una variable el sube pero el ajustado baja, esa variable no aporta lo suficiente para justificar el grado de libertad que consume.
Respuesta: , menor que el
12. Con casos, un modelo con variables explicativas dio . Se agrega una tercera variable, sin relación aparente con el sueldo, en miles, y el pasa a . Decidí si conviene incorporarla.
Ver solución
1. Observamos qué pasó con el . Subió de a , o sea .
2. Explicamos por qué siempre sube. Agregar una variable nunca puede empeorar el ajuste dentro de la muestra: en el peor caso el método le asigna un coeficiente cercano a cero. El solo puede subir o quedarse igual, aunque la variable sea puro ruido.
3. Calculamos el ajustado del modelo original.
4. Calculamos el ajustado del modelo ampliado.
5. Comparamos. El ajustado bajó de a .
6. Decidimos. No conviene incorporarla: la mejora del ajuste no compensa el grado de libertad que consume.
Respuesta: El sube siempre, pero el ajustado va de a : no conviene incorporarla
Integradores de Inferencia estadística: practicá este tema junto con el resto de la unidad
Las cuentas de este material están verificadas una por una. Si aun así encontrás algo raro, .