Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
Quelle est la distribution du carré d'une variable aléatoire normalement distribuée avec ? Je sais est un argument valable pour la mise au carré d'une distribution normale standard , mais qu'en est-il du cas de la variance non unitaire?X2X2X^2X∼N(0,σ2/4)X∼N(0,σ2/4)X\sim N(0,\sigma^2/4)χ2(1)=Z2χ2(1)=Z2\chi^2(1)=Z^2
Considérez la probabilité logarithmique d'un mélange de gaussiens: l(Sn;θ)=∑t=1nlogf(x(t)|θ)=∑t=1nlog{∑i=1kpif(x(t)|μ(i),σ2i)}l(Sn;θ)=∑t=1nlogf(x(t)|θ)=∑t=1nlog{∑i=1kpif(x(t)|μ(i),σi2)}l(S_n; \theta) = \sum^n_{t=1}\log f(x^{(t)}|\theta) = \sum^n_{t=1}\log\left\{\sum^k_{i=1}p_i f(x^{(t)}|\mu^{(i)}, \sigma^2_i)\right\} Je me demandais pourquoi il était difficile de calculer directement cette équation? Je cherchais soit une claire intuition solide sur pourquoi il devrait être évident que c'est difficile, soit peut-être une explication plus …
Supposons que est le vecteur qui maximise la variance de la projection des données avec la matrice de conception XuuuXXX . Maintenant, j'ai vu des documents qui font référence à uuu comme le (premier) composant principal des données, qui est également le vecteur propre avec la plus grande valeur propre. …
Fermé. Cette question est hors sujet . Il n'accepte pas actuellement les réponses. Voulez-vous améliorer cette question? Mettez à jour la question afin qu'elle soit sur le sujet pour la validation croisée. Fermé il y a 5 ans . J'essaie de compiler une liste d'algorithmes de clustering qui sont: Mis …
J'utilise scikit-learn de Python pour former et tester une régression logistique. scikit-learn renvoie les coefficients de régression des variables indépendantes, mais il ne fournit pas les erreurs standard des coefficients. J'ai besoin de ces erreurs standard pour calculer une statistique de Wald pour chaque coefficient et, à son tour, comparer …
J'essaie de décider si un composant d'un PCA doit être conservé ou non. Il existe des millions de critères basés sur l’ampleur de la valeur propre, décrits et comparés par exemple ici ou ici . Cependant, dans ma demande, je sais que la petite (est) valeur propre sera petite par …
Quelle est la différence entre une régression linéaire avec une fonction de base radiale gaussienne (RBF) et une régression linéaire avec un noyau gaussien?
Je viens de couvrir l'hypothèse non linéaire d'Andrew Ng sur les réseaux neuronaux, et nous avons eu une question à choix multiples pour déterminer le nombre de caractéristiques pour une image de résolution 100x100 d' intensités en échelle de gris . Et la réponse était 50 millions, x10 7555dixseptdixsept10^7 Cependant, …
À plusieurs endroits, j'ai vu une affirmation selon laquelle la MANOVA est comme l'ANOVA plus l'analyse discriminante linéaire (LDA), mais elle a toujours été faite en agitant la main. Je voudrais savoir ce que cela signifie exactement . J'ai trouvé divers manuels décrivant tous les détails des calculs MANOVA, mais …
Que recommanderiez-vous comme galerie complète de techniques de présentation des données? Une source à laquelle vous pourriez vous référer lorsque vous réfléchissez à de meilleures façons de présenter vos données? J'ai identifié les suivants, mais serais heureux si vous pouviez ajouter le vôtre: Galeries en ligne: http://www.mathworks.com/discovery/gallery.html http://www.idlcoyote.com/gallery/ https://developers.google.com/chart/interactive/docs/gallery?csw=1 http://www.walkingrandomly.com/?p=4788 …
Aujourd'hui , je remarqué cette question , et je pensais que ce serait utile si nous avions un fil que les ressources énumérées que les gens puissent accéder facilement pour les calculs d' analyse de puissance / taille de l' échantillon, peut - être analogue à ce fil: Ressources pour …
J'ai parcouru plusieurs livres (Raudenbush & Bryk, Snijders & Bosker, Gelman & Hill, etc.) et plusieurs articles (Gelman, Jusko, Primo & Jacobsmeier, etc.), et je n'ai toujours pas vraiment fait le tour de ma tête les principales différences entre l'utilisation d'erreurs standard groupées et la modélisation à plusieurs niveaux. Je …
Je veux effectuer une régression linéaire très simple dans R. La formule est aussi simple que . Cependant, je voudrais que la pente ( ) soit à l'intérieur d'un intervalle, disons, entre 1,4 et 1,6.ay= a x + by=ax+by = ax + buneaa Comment cela peut-il être fait?
J'ai un ensemble de données avec des dizaines de milliers d'observations de données sur les coûts médicaux. Ces données sont fortement asymétriques vers la droite et comportent de nombreux zéros. Il ressemble à ceci pour deux ensembles de personnes (dans ce cas, deux tranches d'âge avec> 3000 obs chacune): Min. …
J'ai un espace de 35 dimensions (attributs). Mon problème analytique est un problème de classification simple. Sur 35 dimensions, plus de 25 sont catégoriques et chaque attribut prend plus de 50 types de valeurs. Dans ce scénario, l'introduction d'une variable fictive ne fonctionnera pas non plus pour moi. Comment puis-je …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.