Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
J'apprends essentiellement l'allocation Dirichlet latente. Je regarde une vidéo ici: http://videolectures.net/mlss09uk_blei_tm/ et bloqué à la minute 45 quand il a commencé à expliquer sur l'échantillonnage de la distribution. J'ai également essayé de consulter un livre d'apprentissage machine qui n'a pas d'introduction détaillée sur la distribution Dirichelt. Dans le livre que …
Existe-t-il de toute façon que je peux exécuter LASSO avec une régression binomiale négative sur R? J'effectue une régression binomiale négative sur mon ensemble de données car les données sont trop dispersées pour imposer une régression de poisson. Pendant ce temps, je suis également confronté à un problème de multicolinéarité. …
Imaginez une sorte d'enchère où l'on vous présente, disons, 1000 clients potentiels. Sur la base d'informations sur ces perspectives - âge, sexe, race, revenu, niveau de scolarité, etc. - vous pouvez «enchérir» pour présenter votre produit à une fraction d'entre eux, disons 250. (Ignorez le coût de l'offre). maximiser vos …
Dans les méthodes de clustering telles que K-means , la distance euclidienne est la métrique à utiliser. Par conséquent, nous calculons uniquement les valeurs moyennes au sein de chaque cluster. Et puis des ajustements sont effectués sur les éléments en fonction de leur distance à chaque valeur moyenne. Je me …
Quelqu'un peut-il expliquer comment fonctionne la décomposition Beveridge-Nelson? Jusqu'à présent, tout ce que je sais, c'est qu'il estime les cycles de tendance dans les données de séries chronologiques non stationnaires. J'ai regardé plusieurs articles de revues et je suis toujours confus sur la façon dont cela fonctionne http://research.economics.unsw.edu.au/jmorley/bn.pdf
Soit et deux variables aléatoires indépendantes avec des pdfs respectifs:XXXYYY f(x;θi)={1θie−x/θi0<x<∞,0<θi<∞0elsewheref(x;θi)={1θie−x/θi0<x<∞,0<θi<∞0elsewheref \left(x;\theta_i \right) =\begin{cases} \frac{1}{\theta_i} e^{-x/ {\theta_i}} \quad 0<x<\infty, 0<\theta_i< \infty \\ 0 \quad \text{elsewhere} \end{cases} pour . Deux échantillons indépendants sont tirés afin de tester contre de tailles et partir de ces distributions. Je dois montrer que le LRT …
Si j'ai besoin de calculer une valeur basée sur la permutation avec un niveau de signification , de combien de permutations ai-je besoin?pppαα\alpha De l'article "Tests de permutation pour étudier les performances du classificateur" , page 5: En pratique, la borne supérieure est généralement utilisée pour déterminer le nombre d'échantillons …
J'ai calculé les valeurs ICC pour deux groupes et je voudrais maintenant comparer les valeurs ICC pour déterminer si les groupes diffèrent dans leur répétabilité. Dans la littérature, les gens ont simplement utilisé des tests t pour comparer la répétabilité, mais je ne sais pas comment procéder. Par exemple, avec …
J'ai souvent lu que la correction de Bonferroni fonctionne également pour les hypothèses dépendantes. Cependant, je ne pense pas que ce soit vrai et j'ai un contre-exemple. Quelqu'un peut-il me dire (a) où est mon erreur ou (b) si j'ai raison sur ce point. Configuration de l'exemple de compteur Supposons …
J'utilise deux perceptrons multicouches à action directe (MLP). Avec les mêmes données d'entrée (14 neurones d'entrée), je fais une classification (vrai / faux) et une régression (si vrai, "combien") ¹. Jusqu'à présent, je l' ai utilisé paresseusement Matlabs patternnet et FITNET , respectivement. Paresseusement, parce que je n'ai pas pris …
Je suis venu par plusieurs articles et documents affirmant que l'élagage des arbres dans un ensemble d'arbres "ensachés" n'était pas nécessaire (voir 1 ). Cependant, est-ce nécessairement (ou du moins dans certains cas connus) dommageable d'effectuer l'élagage (par exemple, avec l'échantillon OOB) sur les arbres individuels dans un ensemble? Merci!
Ma table de contingence: heterozygous homozygous.minor homozygous.major observed 2 0 3 expected 0 0 5 La population attendue est composée uniquement de génotype AA, mais dans la population observée, nous observons 2 génotypes AB. Pour calculer le chi carré pour cela, est-ce que j'ignorerais simplement les deux cas où l'attendu …
Regardez l'image ci-dessous. La ligne bleue indique le pdf normal standard. La zone rouge est censée être égale à la somme des zones grises (désolé pour un dessin horrible). Je me demande si nous pouvons créer une nouvelle distribution avec un pic plus élevé en déplaçant les zones grises vers …
J'effectue des régressions quantiles dans R en utilisant le paquet quantreg. Mon ensemble de données comprend 12 328 observations allant de 0,12 à 330. Les points temporels de mes données ne sont pas exactement continus; toutes les données se trouvent dans l'une des quelques dizaines de casiers allant de 73 …
J'essaie de trouver un modèle en utilisant la régression binomiale négative (GLM binomial négatif). J'ai une taille d'échantillon relativement petite (supérieure à 300) et les données ne sont pas mises à l'échelle. J'ai remarqué qu'il existe deux façons de mesurer la qualité de l'ajustement - l'une est la déviance et …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.