Statistiques et Big Data

Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données







2
Schémas de pondération alternatifs pour la méta-analyse des effets aléatoires: écarts-types manquants
Je travaille sur une méta-analyse des effets aléatoires couvrant un certain nombre d'études qui ne rendent pas compte des écarts-types; toutes les études indiquent la taille de l'échantillon. Je ne pense pas qu'il soit possible d'approximer ou d'imputer les données SD manquantes. Comment pondérer une méta-analyse qui utilise des différences …

2
Lors de l'utilisation de SVM, pourquoi dois-je faire évoluer les fonctionnalités?
Selon la documentation de l' objet StandardScaler dans scikit-learn: Par exemple, de nombreux éléments utilisés dans la fonction objective d'un algorithme d'apprentissage (comme le noyau RBF des machines à vecteurs de support ou les régularisateurs L1 et L2 des modèles linéaires) supposent que toutes les fonctionnalités sont centrées autour de …



1
Comment utiliser anova pour comparer deux modèles?
Comment dois-je comprendre le anovarésultat lors de la comparaison de deux modèles? Exemple: Res.Df RSS Df Sum of Sq F Pr(>F) 1 9 54.032 2 7 4.632 2 49.4 37.329 0.0001844 *** La page de manuel indique: "Calculez l'analyse des tables de variance (ou de déviance) pour un ou plusieurs …
9 r  regression  anova 

1
Réconciliation des arbres de régression boostés (BRT), des modèles boostés généralisés (GBM) et de la machine de boosting de gradient (GBM)
Des questions: Quelle est la différence entre les arbres de régression boostés (BRT) et les modèles boostés généralisés (GBM)? Peuvent-ils être utilisés de manière interchangeable? L'un est-il une forme spécifique de l'autre? Pourquoi Ridgeway a-t-il utilisé l'expression "modèles de régression généralisée boostée" (GBM) pour décrire ce que Friedman avait précédemment …

2
Rétro-test ou validation croisée lorsque le processus de création de modèle était interactif
J'ai quelques modèles prédictifs dont je voudrais tester les performances (c.-à-d. Prendre mon jeu de données, le «rembobiner» à un point antérieur dans le temps et voir comment le modèle aurait fonctionné de manière prospective). Le problème est que certains de mes modèles ont été construits via un processus interactif. …



En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.