Statistiques et Big Data

Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données

1
Utilisation de LASSO sur une forêt aléatoire
Je voudrais créer une forêt aléatoire en utilisant le processus suivant: Construisez un arbre sur un échantillon aléatoire des données et des fonctionnalités en utilisant le gain d'informations pour déterminer les divisions Terminer un nœud feuille s'il dépasse une profondeur prédéfinie OU toute scission entraînerait un nombre de feuilles inférieur …






2
Autocorrélation spatiale versus stationnarité spatiale
Supposons que nous ayons des points dans un espace à deux dimensions, et nous souhaitons mesurer les effets des attributs XXX sur l'attribut . Le modèle de régression linéaire typique est bien sûr yyyy= Xβ+ ϵy=Xβ+ϵy= X\beta + \epsilon Il y a deux problèmes ici: le premier est que les …


3
Questions sur le bootstrap paramétrique et non paramétrique
Je lis le chapitre sur les statistiques fréquentes du livre de Kevin Murphy " Machine Learning - A Probabilistic Perspective ". La section sur le bootstrap se lit comme suit: Le bootstrap est une technique Monte Carlo simple pour approximer la distribution d'échantillonnage. Ceci est particulièrement utile dans les cas …






3
Avantages et inconvénients des méta-analyses
J'ai envisagé de faire une méta-analyse pour un domaine d'étude particulier en évolution, mais avant d'aller plus loin, j'aimerais savoir; quels sont les points positifs et négatifs du processus? Par exemple, pas besoin d'une expérience pratique n'est un avantage (temps et argent) mais il y aura un biais de publication …

En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.