Statistiques et Big Data

Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données

1
L'utilisation de la transformation box-cox sur des ensembles de données individuels empêche-t-elle que ces données soient comparables?
J'ai utilisé la transformation box-cox pour normaliser les données à saisir dans un logiciel d'analyse des facteurs de niche écologiques, comme recommandé par les créateurs du logiciel. Cependant, il m'est venu à l'esprit que la méthode de transformation box-cox a (évidemment!) Sélectionné des valeurs lambda différentes pour chaque transformation. Par …

1
Comment effectuer la fiabilité inter-évaluateurs avec plusieurs évaluateurs, différents évaluateurs par participant et les changements possibles au fil du temps?
Les participants ont été notés deux fois, les 2 notes étant séparées de 3 ans. Pour la plupart des participants, les évaluations ont été faites par différents évaluateurs, mais pour certains (<10%), le même évaluateur a effectué les deux évaluations. Il y avait au total 8 évaluateurs, dont 2 notés …




3
Une question sur les paramètres de la distribution gamma en économétrie bayésienne
L'article de Wikipédia sur la distribution Gamma répertorie deux méthodes de paramétrage différentes, l'une d'entre elles fréquemment utilisée en économétrie bayésienne avec et , est le paramètre de forme, est le paramètre de taux.α>0α>0\alpha>0β>0β>0\beta>0αα\alphaββ\beta X∼ G a m m a ( α , β) .X∼Gamma(α,β).X\sim \mathrm{Gamma}(\alpha,\beta). Dans un manuel d'économétrie …

3
Base du coefficient de corrélation de Pearson
Le coefficient de corrélation de Pearson est calculé à l'aide de la formule r =c o v ( X, Y)v a r ( X)√v a r ( Y)√r=cov(X,Y)var(X)var(Y)r = \frac{cov(X,Y)}{\sqrt{var(X)} \sqrt{var(Y)}}. Comment cette formule contient-elle les informations selon lesquelles les deux variables et sont corrélées ou non? Ou, comment obtenir …


3
Modèles de mélanges et mélanges de procédés Dirichlet (conférences ou articles pour débutants)
Dans le contexte du clustering en ligne, je trouve souvent de nombreux articles qui parlent de "processus dirichlet" et "modèles de mélange fini / infini". Étant donné que je n'ai jamais utilisé ni lu de processus de dirichlet ou de modèles de mélange. Connaissez-vous des suggestions de conférences d'introduction ou …




1
Règles simples de base pour les statistiques
Dans une expérience binomiale, si nous observons individu positif parmi individus, alors la proportion d'individus positifs est significativement inférieure à avec une erreur de type 1 inférieure et très proche de . Ce fait, parfois appelé "règle des trois", est une conséquence des inégalitésx=0x=0x=0nnn3/n3/n3/n5%5%5\%exp(−np1−p)≤Pr(X=0)≤exp(−np).exp⁡(−np1−p)≤Pr(X=0)≤exp⁡(−np).\exp\left(-\frac{np}{1-p}\right) \leq \Pr(X=0) \leq \exp(-np). Connaissez-vous d'autres …



En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.