Statistiques et Big Data

Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données

1
Variable aléatoire univariée X, Y avec : sont-ils indépendants?
Soit et des variables aléatoires univariées avec CDF telles que: où , sont des fonctions connues.X:Ω→RX:Ω→RX:\Omega\to\mathbb{R}Y:Ω→RY:Ω→RY:\Omega\to\mathbb{R}FX,Y(x,y)FX,Y(x,y)F_{X,Y}(x,y)FX,Y(x,y)=G1(x)G2(y),∀(x,y)∈R×RFX,Y(x,y)=G1(x)G2(y),∀(x,y)∈R×R F_{X,Y}(x,y)=G_1(x)G_2(y),\forall (x,y)\in\mathbb{R}\times\mathbb{R} G1:R→RG1:R→RG_1:\mathbb{R}\to\mathbb{R}G2:R→RG2:R→RG_2:\mathbb{R}\to\mathbb{R} Question : Est-il vrai que et sont des VR indépendants?XXXYYY Quelqu'un peut-il me donner quelques indices? J'ai essayé de: mais je ne sais pas pourquoi (ou si) \ lim_ {y \ …


1
estimation de la densité du noyau du paquet np avec le noyau Epanechnikov
Je travaille avec l'ensemble de données "geyser" du package MASS et compare les estimations de densité du noyau du package np. Mon problème est de comprendre l'estimation de la densité en utilisant la validation croisée des moindres carrés et le noyau Epanechnikov: blep<-npudensbw(~geyser$waiting,bwmethod="cv.ls",ckertype="epanechnikov") plot(npudens(bws=blep)) Pour le noyau gaussien, cela semble …




1
Pouvez-vous utiliser le test de Kolmogorov-Smirnov pour tester directement l'équivalence de deux distributions?
Il y a eu des discussions sur d'autres questions sur la façon dont on pourrait utiliser l'approche des deux tests unilatéraux (TOST) pour le test de Kolmogorov-Smirnov (KS), mais je me demandais s'il était possible d'utiliser directement la statistique de test pour montrer que deux les distributions étaient similaires? Si …







2
Pourquoi certaines estimations de régression diffèrent-elles par un changement de signe, mais d'autres non, lorsque je change de niveau de référence?
Supposons que j'ai un résultat continu yet deux prédicteurs factoriels, chacun avec deux niveaux. L'un de mes prédicteurs catégoriques drug, peut avoir deux niveaux ("A" ou "B"), l'autre l'est smokeYes. Lorsque j'exécute un modèle de régression, je peux choisir la ligne de base ou le niveau de référence d' drugêtre …


En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.