Statistiques et Big Data

Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données

1
Que signifie échantillonner un vecteur de probabilité à partir d'une distribution de Dirichlet?
J'apprends essentiellement l'allocation Dirichlet latente. Je regarde une vidéo ici: http://videolectures.net/mlss09uk_blei_tm/ et bloqué à la minute 45 quand il a commencé à expliquer sur l'échantillonnage de la distribution. J'ai également essayé de consulter un livre d'apprentissage machine qui n'a pas d'introduction détaillée sur la distribution Dirichelt. Dans le livre que …

1
Lasso sur le modèle de régression binomiale négative
Existe-t-il de toute façon que je peux exécuter LASSO avec une régression binomiale négative sur R? J'effectue une régression binomiale négative sur mon ensemble de données car les données sont trop dispersées pour imposer une régression de poisson. Pendant ce temps, je suis également confronté à un problème de multicolinéarité. …


2
Pourquoi seule la valeur moyenne est utilisée dans la méthode de regroupement (K-means)?
Dans les méthodes de clustering telles que K-means , la distance euclidienne est la métrique à utiliser. Par conséquent, nous calculons uniquement les valeurs moyennes au sein de chaque cluster. Et puis des ajustements sont effectués sur les éléments en fonction de leur distance à chaque valeur moyenne. Je me …

1
Expliquer la décomposition de Beveridge Nelson
Quelqu'un peut-il expliquer comment fonctionne la décomposition Beveridge-Nelson? Jusqu'à présent, tout ce que je sais, c'est qu'il estime les cycles de tendance dans les données de séries chronologiques non stationnaires. J'ai regardé plusieurs articles de revues et je suis toujours confus sur la façon dont cela fonctionne http://research.economics.unsw.edu.au/jmorley/bn.pdf

2
Ratio de vraisemblance pour la distribution exponentielle à deux échantillons
Soit et deux variables aléatoires indépendantes avec des pdfs respectifs:XXXYYY f(x;θi)={1θie−x/θi0&lt;x&lt;∞,0&lt;θi&lt;∞0elsewheref(x;θi)={1θie−x/θi0&lt;x&lt;∞,0&lt;θi&lt;∞0elsewheref \left(x;\theta_i \right) =\begin{cases} \frac{1}{\theta_i} e^{-x/ {\theta_i}} \quad 0<x<\infty, 0<\theta_i< \infty \\ 0 \quad \text{elsewhere} \end{cases} pour . Deux échantillons indépendants sont tirés afin de tester contre de tailles et partir de ces distributions. Je dois montrer que le LRT …

1
Nombre de permutations requis pour une valeur de p basée sur la permutation
Si j'ai besoin de calculer une valeur basée sur la permutation avec un niveau de signification , de combien de permutations ai-je besoin?pppαα\alpha De l'article "Tests de permutation pour étudier les performances du classificateur" , page 5: En pratique, la borne supérieure est généralement utilisée pour déterminer le nombre d'échantillons …


2
La correction de Bonferroni est-elle trop anti-conservatrice / libérale pour certaines hypothèses dépendantes?
J'ai souvent lu que la correction de Bonferroni fonctionne également pour les hypothèses dépendantes. Cependant, je ne pense pas que ce soit vrai et j'ai un contre-exemple. Quelqu'un peut-il me dire (a) où est mon erreur ou (b) si j'ai raison sur ce point. Configuration de l'exemple de compteur Supposons …

1
Comment et pourquoi les MLP pour la classification différeraient-ils des MLP pour la régression? Différentes fonctions de rétropropagation et de transfert?
J'utilise deux perceptrons multicouches à action directe (MLP). Avec les mêmes données d'entrée (14 neurones d'entrée), je fais une classification (vrai / faux) et une régression (si vrai, "combien") ¹. Jusqu'à présent, je l' ai utilisé paresseusement Matlabs patternnet et FITNET , respectivement. Paresseusement, parce que je n'ai pas pris …


2
Test du chi carré avec 0 valeurs attendues
Ma table de contingence: heterozygous homozygous.minor homozygous.major observed 2 0 3 expected 0 0 5 La population attendue est composée uniquement de génotype AA, mais dans la population observée, nous observons 2 génotypes AB. Pour calculer le chi carré pour cela, est-ce que j'ignorerais simplement les deux cas où l'attendu …

4
Kurtosis de distribution composée
Regardez l'image ci-dessous. La ligne bleue indique le pdf normal standard. La zone rouge est censée être égale à la somme des zones grises (désolé pour un dessin horrible). Je me demande si nous pouvons créer une nouvelle distribution avec un pic plus élevé en déplaçant les zones grises vers …

2
Cause de singularité dans la matrice pour la régression quantile
J'effectue des régressions quantiles dans R en utilisant le paquet quantreg. Mon ensemble de données comprend 12 328 observations allant de 0,12 à 330. Les points temporels de mes données ne sont pas exactement continus; toutes les données se trouvent dans l'une des quelques dizaines de casiers allant de 73 …
8 r  regression 


En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.