Statistiques et Big Data

Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données



4
Comment représenter graphiquement les résultats de l'ordre de classement subjectif?
Je cherche un moyen de visualiser les classements subjectifs, séparés de mes tests non paramétriques. J'ai demandé à 12 participants de classer 8 éléments différents en fonction de différents critères subjectifs (classements séparés pour chacun). Pour tout ensemble individuel de classements, je cherche un bon moyen de visualiser les tendances …

2
Tables de contingence: quels tests faire et quand?
Je voudrais voir une extension de cette discussion sur le débat séculaire du chi carré contre le test exact de Fisher, élargissant un peu la portée. Il existe de nombreux tests d'interactions dans une table de contingence, assez pour faire tourner la tête. J'espère avoir une explication sur le test …

2
Fréquentisme et prieurs
Robby McKilliam dit dans un commentaire à ce post: Il convient de souligner que, du point de vue des fréquentistes, il n'y a aucune raison pour que vous ne puissiez pas intégrer les connaissances antérieures dans le modèle. En ce sens, la vue fréquentiste est plus simple, vous n'avez qu'un …





3
Comparaison de deux résultats d'exactitude de classificateur pour la signification statistique avec le test t
Je veux comparer l'exactitude de deux classificateurs pour la signification statistique. Les deux classificateurs sont exécutés sur le même ensemble de données. Cela m'amène à croire que je devrais utiliser un test t à échantillon unique d'après ce que j'ai lu . Par exemple: Classifier 1: 51% accuracy Classifier 2: …

1
Les paramètres d'entrée pour l'utilisation de l'allocation Dirichlet latente
Lors de l'utilisation de la modélisation de sujet (allocation Dirichlet latente), le nombre de sujets est un paramètre d'entrée que l'utilisateur doit spécifier. Il me semble que nous devrions également fournir une collection d'ensembles de sujets candidats que le processus Dirichlet doit échantillonner? Ma compréhension est-elle correcte? En pratique, comment …

4
Termes d'erreur du modèle à moyenne mobile
Il s'agit d'une question de base sur les modèles Box-Jenkins MA. Si je comprends bien, un modèle MA est essentiellement une régression linéaire des valeurs de séries temporelles YYY rapport aux termes d'erreur précédents . Autrement dit, l'observation est d'abord régressée par rapport à ses valeurs précédentes , puis une …


4
Confirmation de la distribution des résidus en régression linéaire
Supposons que nous ayons exécuté une régression linéaire simple y=β0+β1x+uy=β0+β1x+uy=\beta_0+\beta_1x+u , enregistré les résidus et dessiné un histogramme de distribution des résidus. Si nous obtenons quelque chose qui ressemble à une distribution familière, pouvons-nous supposer que notre terme d'erreur a cette distribution? Disons, si nous avons découvert que les résidus …

1
Intervalle de confiance basé sur le bootstrap
En étudiant l'intervalle de confiance basé sur le bootstrap, j'ai lu une fois la déclaration suivante: Si la distribution de bootstrap est biaisée vers la droite, l'intervalle de confiance basé sur le bootstrap incorpore une correction pour déplacer les points d'extrémité encore plus vers la droite; cela peut sembler contre-intuitif, …

En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.