Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
Si je tire des variables iid de N (0,1), la moyenne ou la médiane convergeront-elles plus rapidement? Combien plus rapide? Pour être plus précis, soit une séquence de variables iid tirées de N (0,1). Définissez et \ tilde {x} _n comme étant la médiane de \ {x_1, x_2, \ ldots …
J'ai généré un tracé qq en utilisant le code suivant. Je sais que le tracé qq est utilisé pour vérifier si les données sont distribuées normalement ou non. Ma question est de savoir ce que les étiquettes des axes x et y indiquent dans le tracé qq et quelle est …
J'ai des données ordinales qui ne sont pas normalement distribuées, j'ai donc décidé de faire des tests non paramétriques en utilisant le test U de Mann-Whitney. Je regarde les différences entre les groupes pour sept scores - ces scores sont soit 0, 1, 2 ou 3 pour chaque sujet. J'ai …
J'essaie actuellement d'adresser les violations aux hypothèses de l'ANOVA. J'ai utilisé Shapiro-Wilk pour tester la normalité et j'ai essayé le test de Levene et le test d'égalité de variance de Bartlett. Depuis lors, j'ai transformé mes données pour essayer de remédier aux inégalités. J'ai relancé le test de Bartlett sur …
Lors de la modélisation de proportions continues (par exemple, couverture végétale proportionnelle aux quadrats d'enquête, ou proportion de temps consacré à une activité), la régression logistique est considérée comme inappropriée (par exemple Warton et Hui (2011) L'arc sinus est asinin: l'analyse des proportions en écologie ). Plutôt, une régression OLS …
Je veux faire ce qui suit: 1) Régression OLS (pas de terme de pénalisation) pour obtenir les coefficients bêta ; représente les variables utilisées pour régresser. Je le fais enb∗jbj∗b_{j}^{*}jjj lm.model = lm(y~ 0 + x) betas = coefficients(lm.model) 2) Régression au lasso avec un terme de pénalisation, les critères …
J'effectuais une régression de Poisson en SAS et j'ai découvert que la valeur du chi carré de Pearson divisée par les degrés de liberté était d'environ 5, indiquant une surdispersion significative. J'ai donc ajusté un modèle binomial négatif avec proc genmod et j'ai trouvé que la valeur du chi carré …
Contexte Afin d'analyser les différences dans une variable continue entre différents groupes (donnée par une variable catégorielle), on peut effectuer une ANOVA à sens unique. S'il existe plusieurs variables explicatives (catégorielles), on peut effectuer une ANOVA factorielle. Si l'on veut analyser les différences entre les groupes dans plusieurs variables continues …
Je lance un glmm avec une variable de réponse binomiale et un prédicteur catégorique. L'effet aléatoire est donné par le plan imbriqué utilisé pour la collecte de données. Les données ressemblent à ceci: m.gen1$treatment [1] sucrose control protein control no_injection ..... Levels: no_injection control sucrose protein m.gen1$emergence [1] 1 0 …
Dans une classe de statistiques élémentaires pour laquelle j'étais TA, le professeur a déclaré que lorsque la probabilité d'une erreur de type I augmente, la probabilité d'une erreur de type II β diminue et l'inverse est également vrai. Cela me suggère donc que ρ α , β < 0 .αα\alphaββ\betaρα …
J'ai une expérience dans laquelle je prends des mesures d'une variable normalement distribuée OuiYY, Oui∼ N( μ , σ)Oui∼N(μ,σ)Y \sim N(\mu,\sigma) Cependant, des expériences antérieures ont fourni des preuves que l'écart-type est une fonction affine d'une variable indépendante , c'est-à-direXσσ\sigmaXXX σ= a | X| +bσ=une|X|+b\sigma = a|X| + b Oui∼ …
Quelqu'un peut-il m'expliquer quand utiliser l'impureté Gini et le gain d'informations pour les arbres de décision? Pouvez-vous me donner des situations / des exemples de la meilleure façon de les utiliser?
En lisant les réponses à ce fil , j'ai commencé à me demander comment le test d'hypothèse est lié à la méthode scientifique . Bien que je comprenne bien les deux, j'ai du mal à établir le lien précis entre eux. À un niveau élevé, la méthode scientifique se résume …
Dans Elements of Statistical Learning , un problème est introduit pour mettre en évidence les problèmes de k-nn dans les espaces de grande dimension. Il y a NNN points de données qui sont uniformément distribués dans une boule d'unité ppp dimensionnelle. La distance médiane de l'origine au point de données …
Je regardais cette page sur l'implémentation Monte Carlo du test Lillefors. Je ne comprends pas cette phrase: Il y a une erreur aléatoire dans ce calcul à partir de la simulation. Cependant, en raison de l'astuce d'ajouter 1 au numérateur et au dénominateur dans le calcul de la valeur P, …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.