Pandas: cómo agrupar y agregar por varias columnas

A menudo, es posible que desee agrupar y agregar por varias columnas de un DataFrame de pandas. Afortunadamente, esto es fácil de hacer usando las funciones pandas .groupby () y .agg () . Este tutorial explica varios ejemplos de cómo utilizar estas funciones en la práctica. Ejemplo 1: agrupar por dos columnas y encontrar el … Leer más

Cómo probar la normalidad en SPSS

Muchas pruebas estadísticas requieren que una o más variables se distribuyan normalmente para que los resultados de la prueba sean fiables. Este tutorial explica dos métodos diferentes que puede utilizar para probar la normalidad entre variables en SPSS. Cada método utilizará el siguiente conjunto de datos, que muestra el promedio de puntos por juego anotados … Leer más

Cómo encontrar el coeficiente de determinación (R-cuadrado) en R

El coeficiente de determinación (comúnmente denominado R 2 ) es la proporción de la varianza en la variable de respuesta que puede explicarse por las variables explicativas en un modelo de regresión. Este tutorial proporciona un ejemplo de cómo encontrar e interpretar R 2 en un modelo de regresión en R. Relacionado: ¿Qué es un … Leer más

Cómo realizar un ANOVA anidado en Excel (paso a paso)

Un ANOVA anidado es un tipo de ANOVA («análisis de varianza») en el que al menos un factor está anidado dentro de otro factor. Por ejemplo, suponga que un investigador quiere saber si tres fertilizantes diferentes producen diferentes niveles de crecimiento de las plantas. Para probar esto, tiene tres técnicos diferentes que rocían fertilizante A … Leer más

Cómo realizar una prueba de Breusch-Pagan en Stata

La regresión lineal múltiple es un método que podemos utilizar para comprender la relación entre varias variables explicativas y una variable de respuesta. Desafortunadamente, un problema que ocurre a menudo en la regresión se conoce como heterocedasticidad , en el que hay un cambio sistemático en la varianza de los residuos en un rango de … Leer más