Statistiques et Big Data

Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données


2
Quel est le problème avec l'autocorrélation?
Pour commencer, j'ai une formation mathématique assez approfondie, mais je n'ai jamais vraiment traité de séries chronologiques ou de modélisation statistique. Vous n'avez donc pas besoin d'être très gentil avec moi :) Je lis cet article sur la modélisation de la consommation d'énergie dans les bâtiments commerciaux, et l'auteur fait …




1
Algèbre de LDA. Pouvoir de discrimination de Fisher d'une variable et analyse discriminante linéaire
Apparemment, l'analyse de Fisher vise à maximiser simultanément la séparation entre les classes, tout en minimisant la dispersion à l'intérieur des classes. Une mesure utile du pouvoir de discrimination d'une variable est donc donnée par la quantité diagonale: .Bii/WiiBii/WiiB_{ii}/W_{ii} http://root.cern.ch/root/htmldoc/TMVA__MethodFisher.html Je comprends que la taille ( p x p) du …

3
PCA sur les données textuelles de grande dimension avant la classification aléatoire des forêts?
Est-il judicieux de faire de l'ACP avant d'effectuer une classification aléatoire des forêts? J'ai affaire à des données de texte de grande dimension, et je veux faire une réduction de fonctionnalités pour éviter la malédiction de la dimensionnalité, mais Random Forests ne fait-il pas déjà une sorte de réduction de …




2
poisson vs régression logistique
J'ai une cohorte de patients dont la durée de suivi est différente. Jusqu'à présent, je fais abstraction de l'aspect du temps et j'ai juste besoin de modéliser un résultat binaire-maladie / pas de maladie. Je fais habituellement une régression logistique dans ces études, mais un autre collègue m'a demandé si …





En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.