Statistiques et Big Data

Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données



6
Multicolinéarité lorsque les régressions individuelles sont significatives, mais que les VIF sont faibles
J'ai 6 variables ( X1. . . X6x1...X6x_{1}...x_{6} ) que j'utilise pour prédire yyy . Lors de l'analyse de mes données, j'ai d'abord essayé une régression linéaire multiple. De là, seules deux variables étaient significatives. Cependant, lorsque j'ai effectué une régression linéaire comparant chaque variable individuellement à yyy , toutes …



3
Pourquoi est-il souvent supposé une distribution gaussienne?
Citant un article de Wikipédia sur l' estimation des paramètres pour un classificateur Bayes naïf : "une hypothèse typique est que les valeurs continues associées à chaque classe sont distribuées selon une distribution gaussienne." Je comprends qu'une distribution gaussienne est pratique pour des raisons analytiques. Cependant, y a-t-il une autre …

2
Variables dépendantes phylogénétiques: ANOVA?
Je comprends que dériver une matrice de covariance à partir de données phylogénétiques pour faire pour deux variables sur lesquelles vous effectuez une régression. Mais que se passe-t-il si vous avez une variable continue, que vous avez précédemment montrée comme dépendante de la phylogénie, et une variable ordinale? Ce dernier …
13 anova  phylogeny 








2
Sélection de modèles non imbriqués
Le test du rapport de vraisemblance et l'AIC sont tous deux des outils pour choisir entre deux modèles et les deux sont basés sur le log-vraisemblance. Mais pourquoi le test du rapport de vraisemblance ne peut-il pas être utilisé pour choisir entre deux modèles non imbriqués alors que l'AIC le …

En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.