Statistiques et Big Data

Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données

2
Indice de stabilité de la population - division par zéro
L'indice de stabilité de la population quantifie le changement d'une distribution d'une variable en comparant des échantillons de données sur deux périodes. Il est très couramment utilisé pour mesurer les changements dans les scores. Il est calculé comme suit: 1) L'échantillon de la période de base est discrétisé. Habituellement, il …

1
Coefficients de corrélation pour les données ordonnées: Tau de Kendall vs Polychoric vs Rho de Spearman
Il semble que pour la gestion avec des mesures ordonnées, les chercheurs traitent généralement de la corrélation polychorique . (Par exemple, pour faire une matrice avant de faire une analyse factorielle.) Pourquoi? Le coefficient de corrélation de rang de Kendall Tau et le coefficient de corrélation de rang de Spearman …




1
R: Anova et régression linéaire
Je suis nouveau dans les statistiques et j'essaie de comprendre la différence entre l'ANOVA et la régression linéaire. J'utilise R pour explorer cela. J'ai lu divers articles sur les raisons pour lesquelles l'ANOVA et la régression sont différentes mais toujours les mêmes et comment elles peuvent être visualisées, etc. Je …
9 r  regression  anova 

4
Lasso-ing l'ordre d'un décalage?
Supposons que j'ai des données longitudinales de la forme (j'ai plusieurs observations, ce n'est que la forme d'une seule). Je suis intéressé par les restrictions sur . Un sans restriction équivaut à prendre avec .Y =( Y1, … , YJ) ∼ N( μ , Σ )Y=(Y1,…,YJ)∼N(μ,Σ)\mathbf Y = (Y_1, \ldots, …

2
Attente du quotient des sommes des variables aléatoires IID (feuille de travail de l'Université de Cambridge)
Je me prépare pour un entretien qui nécessite une connaissance décente des probabilités de base (au moins pour passer l'entretien lui-même). Je travaille à travers la feuille ci-dessous de mes jours d'étudiant comme révision. Cela a surtout été assez simple, mais je suis complètement perplexe sur la question 12. http://www.trin.cam.ac.uk/dpk10/IA/exsheet2.pdf …




2
Trois problèmes philosophiques ouverts en statistique
J'ai récemment fini de lire The Lady Tasting Tea , un livre amusant sur l'histoire des statistiques. À la fin du livre, l'auteur, David Salsburg , propose trois problèmes philosophiques ouverts en statistique, dont les solutions selon lui auraient des implications plus importantes pour l'application de la théorie statistique à …


6
Comment estimer la fonction d'autorégression vectorielle et de réponse impulsionnelle avec les données du panel
Je travaille sur l'auto-régression vectorielle (VAR) et l'estimation de la fonction de réponse impulsionnelle (IRF) basée sur des données de panel avec 33 individus sur 77 trimestres. Comment analyser ce type de situation? Quels algorithmes existent à cet effet? Je préférerais effectuer ces analyses en R, donc si quelqu'un connaît …

1
Modèle de Markov caché pour la prédiction d'événements
Question : La configuration ci-dessous est-elle une implémentation sensée d'un modèle de Markov caché? J'ai un ensemble de données d' 108,000observations (prises sur une période de 100 jours) et approximativement des 2000événements tout au long de la période d'observation. Les données ressemblent à la figure ci-dessous où la variable observée …

En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.