Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
Je suis à la recherche de ressources théoriques (livres, tutoriels, etc.) pour apprendre à faire de solides inférences statistiques à partir de (nombreuses) données de conversion de site Web multivariées. Je suis après le calcul et je ne trouve aucun bon contenu non marketing sur le Web. Le genre de …
Veuillez d'abord examiner le petit problème suivant: Il y a deux ampoules indiscernables A et B. A clignote en rouge avec prob .8 et bleu avec prob .2; B rouge avec .2 et bleu .8. Maintenant, avec 0,5 prob, vous êtes présenté avec A ou B. Vous êtes censé observer …
J'utilise la régression logistique pour prédire y étant donné x1 et x2: z = B0 + B1 * x1 + B2 * x2 y = e^z / (e^z + 1) Comment la régression logistique est-elle censée traiter les cas dans lesquels mes variables ont des échelles très différentes? Les gens …
La forme la plus simple d'un processus de bruit blanc est l'endroit où ses observations ne sont pas corrélées. Nous pouvons vérifier cela en appliquant par exemple un test de portemanteau tel que Lung - Box ou Box - Pierce. La série pourrait être un bruit blanc gaussien où les …
Y a-t-il une raison statistique pour laquelle la théorie de l'analyse / réponse des éléments n'est pas plus largement appliquée? Par exemple, si un enseignant donne un test à choix multiple de 25 questions et constate que 10 questions ont été répondues correctement par tout le monde, 10 questions ont …
Le contexte. Je voudrais ajuster une droite de régression pour étudier la relation entre une variable de réponse et une covariable continue . En raison de la présence de mauvais points de levier, j'ai opté pour un estimateur MM au lieu de l'estimateur LS habituel.yyyXxx Méthodologie. Fondamentalement, l'estimation MM est …
Deux choses m'ont toujours dérangé à propos des tests d'hypothèses: La chance que la moyenne de la population soit exactement un nombre donné (à condition que la variable aléatoire en question soit continue) est toujours nulle, n'est-ce pas? Par conséquent, nous devons toujours rejeter l'hypothèse nulle ... Si le résultat …
J'ai récemment commencé à lire Gelman et Hill's, "Data Analysis Using Regression and Multilevel / Hierarchical Models" et la question est basée sur cela: L'échantillon contient 6 observations sur les proportions: p1,p2,…,p6p1,p2,…,p6p_{1}, p_{2}, \dots, p_{6} Chaque pipip_{i} a signifie πiπi\pi_{i} et variance πi(1−πi)niπi(1−πi)ni\frac{\pi_{i}(1-\pi_{i})}{n_i}, où ninin_{i} est le nombre d'observations utilisées …
Disons que vous avez un large échantillon aléatoire de joueurs de football en Europe, mais que vous ne vous intéressez qu'à ce qui se passe en Espagne. Pourriez-vous réduire votre échantillon à des joueurs en Espagne et toujours l'appeler un échantillon aléatoire (mais d'une population différente)? Sinon, comment qualifieriez-vous ce …
Dans ESL , Section 9.7, il y a un paragraphe indiquant que le temps de calcul d'une scission dans la croissance d'un arbre de classification (ou de régression) s'échelonne généralement comme où est le nombre de prédicteurs et est le nombre de échantillons.pNlogNpNlogNp N \log NpppNNN Une approche naïve se …
J'ai besoin d'expliquer le concept de modèles mixtes linéaires dans un article destiné à un public grand public. Existe-t-il un moyen de communiquer l'essentiel du concept en une phrase ou deux?
J'ai la sortie de précision du classificateur en pourcentage et le nombre d'échantillons d'entrée. Existe-t-il un test qui puisse dire à quel point le résultat est statistiquement significatif d'après ces informations? Merci
Le test z pour comparer deux proportions est . Il est généralement défini quez=p^1−p^2Var(p^1−p^2)√z=p^1−p^2Var(p^1−p^2)\newcommand{\p}{\hat{p}}\newcommand{\v}{\mathrm{Var}} z=\frac{\p_1-\p_2}{\sqrt{\v(\p_1-\p_2)}} Var(p^1−p^2)=p^(1−p^)(1/n1+1/n2),Var(p^1−p^2)=p^(1−p^)(1/n1+1/n2),\v(\p_1-\p_2)=\p(1-\hat{p})(1/n_1+1/n_2), où p^=n1p^1+n2p^2n1+n2.p^=n1p^1+n2p^2n1+n2.\p=\frac{n_1 \p_1+n_2 \p_2}{n_1+n_2}. Y a-t-il une référence écrite qui me légitime à la place d'utiliser la variance non regroupée, c'est-à-dire V a r (p^1-p^2) =p^1( 1 -p^1)n1+p^2( 1 -p^2)n2?Vuner(p^1-p^2)=p^1(1-p^1)n1+p^2(1-p^2)n2?\v(\p_1-\p_2)=\frac{\p_1(1-\p_1)}{n_1}+\frac{\p_2(1-\p_2)}{n_2}?
J'essaie de comprendre comment les gens utilisent les packages R et je me demandais s'il existe des cas documentés où les packages R ont produit des réponses différentes. Clarification: La motivation derrière cette question vient d'un effort dans lequel je suis impliqué où le but de comprendre l'importance de la …
J'ai posté cela plus tôt dans la semaine, puis j'ai retiré la question lorsque j'ai trouvé une bonne source, ne voulant pas perdre le temps des gens. Je n'ai pas fait beaucoup de progrès, je le crains. En essayant d'être un bon citoyen ici, je rendrai le problème aussi clair …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.