Statistiques et Big Data

Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données



5
Que signifie «réellement» la variance groupée?
Je suis un noob en statistiques, alors pourriez-vous m'aider ici. Ma question est la suivante: que signifie réellement la variance groupée ? Lorsque je recherche une formule pour la variance groupée sur Internet, je trouve beaucoup de littérature utilisant la formule suivante (par exemple ici: http://math.tntech.edu/ISR/Mathematical_Statistics/Introduction_to_Statistical_Tests/thispage/newnode19.html ): S2p= S21( n1- …
15 variance  mean  pooling 



2
Pourquoi la maximisation des attentes est importante pour les modèles de mélange?
De nombreuses publications mettent l'accent sur la méthode de maximisation des attentes sur les modèles de mélange (mélange de gaussien, modèle de Markov caché, etc.). Pourquoi l'EM est important? EM est juste un moyen d'optimisation et n'est pas largement utilisé comme méthode basée sur un gradient (gradient décent ou méthode …

5
Est-ce de la triche de laisser tomber les valeurs aberrantes basées sur la boîte à moustaches de l'erreur absolue moyenne pour améliorer un modèle de régression
J'ai un modèle de prédiction testé avec quatre méthodes, comme vous pouvez le voir dans la figure ci-dessous. L'attribut prédit par le modèle est compris entre 0 et 8. Vous pouvez remarquer qu'il existe une valeur aberrante supérieure et trois valeurs aberrantes inférieures indiquées par toutes les méthodes. Je me …


5
Erreur d'approximation de l'intervalle de confiance pour la moyenne lorsque
Soit {Xi}ni=1{Xi}i=1n\{X_i\}_{i=1}^n une famille de variables aléatoires iid prenant des valeurs dans [0,1][0,1][0,1] , ayant une moyenne μμ\mu et une variance σ2σ2\sigma^2 . Un intervalle de confiance simple pour la moyenne, utilisant σσ\sigma chaque fois qu'elle est connue, est donné par P(|X¯−μ|>ε)≤σ2nε2≤1nε2(1).P(|X¯−μ|>ε)≤σ2nε2≤1nε2(1). P( | \bar X - \mu| > \varepsilon) …

2
Bonne précision malgré une valeur de perte élevée
Au cours de la formation d'un classificateur binaire de réseau neuronal simple, j'obtiens une valeur de perte élevée, en utilisant l'entropie croisée. Malgré cela, la valeur de la précision sur l'ensemble de validation est assez bonne. Cela a-t-il un sens? Il n'y a pas de corrélation stricte entre la perte …

1
Quelle est la différence entre l'APC régulière et l'APC probabiliste?
Je sais que l'APC régulière ne suit pas le modèle probabiliste pour les données observées. Quelle est donc la différence fondamentale entre PCA et PPCA ? En PPCA, le modèle de variable latente contient par exemple les variables observées , latentes (variables non observées ) et une matrice qui n'a …
15 pca 

1
Un estimateur non biaisé du rapport de deux coefficients de régression?
Supposons que vous ajustiez une régression linéaire / logistique , dans le but d'une estimation non biaisée de . Vous êtes très confiant que et sont très positifs par rapport au bruit dans leurs estimations.a 1g(y)=a0+a1⋅x1+a2⋅x2g(y)=a0+a1⋅x1+a2⋅x2g(y) = a_0 + a_1\cdot x_1 + a_2\cdot x_2 a1a2a1a2a1a2\frac{a_1}{a_2}a1a1a_1a2a2a_2 Si vous avez la covariance …




En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.