Statistiques et Big Data

Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données


3
Régression modérée: pourquoi calculons-nous un terme * produit * entre les prédicteurs?
Les analyses de régression modérée sont souvent utilisées en sciences sociales pour évaluer l'interaction entre deux ou plusieurs prédicteurs / covariables. En règle générale, avec deux variables prédictives, le modèle suivant est appliqué: Y=β0+β1∗X+β2∗M+β3∗XM+eY=β0+β1∗X+β2∗M+β3∗XM+eY = β_0 + β_1*X + β_2*M + β_3*XM + e Notez que le test de modération …

2
Comment pouvons-nous obtenir une distribution normale comme si la plage de valeurs de notre variable aléatoire est bornée?
Disons que nous avons une variable aléatoire avec une plage de valeurs délimitées par et , où est la valeur minimale et la valeur maximale.b a buneaabbbuneaabbb On m'a dit que comme , où est notre taille d'échantillon, la distribution d'échantillonnage de nos moyennes d'échantillon est une distribution normale. Autrement …



4
Le pari de Blackwell
J'ai lu le paradoxe des paris de Blackwell sur le placard Futility . Voici le résumé: vous êtes présenté avec deux enveloppes, et . Les enveloppes contiennent une somme d'argent aléatoire, mais vous ne savez rien de la distribution de l'argent. Vous en ouvrez un, vérifiez combien il y a …




2
Quelle fraction des expériences répétées aura une taille d'effet dans l'intervalle de confiance à 95% de la première expérience?
Restons sur une situation idéale avec un échantillonnage aléatoire, des populations gaussiennes, des variances égales, pas de piratage P, etc. Étape 1. Vous exécutez une expérience, par exemple en comparant deux moyennes d'échantillon, et calculez un intervalle de confiance à 95% pour la différence entre les deux moyennes de population. …

2
Sens réel de l'ellipse de confiance
En lisant la vraie signification de l'ellipse de confiance à 95%, j'ai tendance à trouver 2 explications: L'ellipse qui contient 95% des données Pas ce qui précède, mais l'ellipse qui explique la variance des données. Je ne suis pas sûr de bien comprendre, mais ils semblent signifier que si un …




1
Sélection variable vs sélection de modèle
Je comprends donc que la sélection des variables fait partie de la sélection du modèle. Mais en quoi consiste exactement la sélection du modèle? Est-ce plus que ce qui suit: 1) choisissez une distribution pour votre modèle 2) choisir des variables explicatives,? Je pose cette question parce que je lis …

En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.