Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
Ici, «tronquer» implique de réduire la précision des nombres aléatoires et de ne pas tronquer la série de nombres aléatoires. Par exemple, si j'ai nombres vraiment aléatoires (tirés de n'importe quelle distribution, par exemple, normale, uniforme, etc.) avec une précision arbitraire et que je tronque tous les nombres de sorte …
Récemment, j'ai été très gêné lorsque j'ai donné une réponse spontanée sur les estimations sans biais de la variance minimale pour les paramètres d'une distribution uniforme qui étaient complètement faux. Heureusement, j'ai été immédiatement corrigé par le cardinal et Henry avec Henry fournissant les bonnes réponses pour l'OP . Cela …
J'ai récemment rencontré une mise à l'échelle multidimensionnelle. J'essaie de mieux comprendre cet outil et son rôle dans les statistiques modernes. Voici donc quelques questions directrices: À quelles questions répond-il? Quels chercheurs sont souvent intéressés à l'utiliser? Existe-t-il d'autres techniques statistiques qui remplissent des fonctions similaires? Quelle théorie se développe …
Juste pour clarifier, quand je veux parler de statistiques sommaires, je me réfère à la gamme moyenne, quartile médian, variance, écart-type. En résumant une univariée qui est catégorique ou qualitative , compte tenu des cas nominaux et ordinaux , est-il logique de trouver sa moyenne, sa médiane, ses plages de …
Quelle est la valeur donnée dans le résumé d'un modèle coxph dans R? Par exemple,R2R2R^2 Rsquare= 0.186 (max possible= 0.991 ) Je l'ai insensément inclus un manuscrit en tant que valeur et le critique a sauté dessus en disant qu'il n'était pas au courant d'un analogue de la statistique de …
J'utilise SAS professionnellement depuis près de 5 ans maintenant. Je l'ai installé sur mon ordinateur portable et je dois fréquemment analyser des ensembles de données avec 1 000 à 2 000 variables et des centaines de milliers d'observations. Je cherchais des alternatives à SAS qui me permettent de réaliser des …
Il semble que les experts en visualisation de données désapprouvent généralement les graphiques de jauge (voir ici: Comment appelez-vous un graphique qui ressemble à un demi-graphique à secteurs avec une aiguille indiquant un pourcentage? ). La principale raison est qu'un graphique de jauge a un faible rapport données / encre. …
J'ai une variable distribuée non gaussienne et je dois vérifier s'il existe des différences significatives entre les valeurs de cette variable dans 5 groupes différents. J'ai effectué une analyse unidirectionnelle de la variance de Kruskal-Wallis (qui s'est avérée significative) et après cela j'ai dû vérifier quels groupes étaient significativement différents. …
Je travaille sur une application d'enquête de santé ouverte, qui devrait être utilisée dans les pays en développement. L'idée de base est que les entretiens d' enquête sont externalisés - ils sont réalisés par des volontaires non organisés qui soumettent des données de formulaires des entretiens qu'ils ont effectués en …
J'ai appris que la somme des variables aléatoires exponentielles suit la distribution gamma. Mais partout où je lis, le paramétrage est différent. Par exemple, Wiki décrit la relation, mais ne dites pas ce que leurs paramètres signifient réellement? Forme, échelle, taux, 1 / taux? Distribution exponentielle: ~xxxexp(λ)exp(λ)exp(\lambda) f(x|λ)=λe−λxf(x|λ)=λe−λxf(x|\lambda )=\lambda {{e}^{-\lambda …
Je ne sais pas si c'est juste moi, mais je suis très sceptique vis-à-vis des statistiques en général. Je peux le comprendre dans les jeux de dés, les jeux de poker, etc. Les jeux répétés très petits, simples et pour la plupart autonomes sont très bien. Par exemple, une pièce …
Dans l'état actuel des choses, cette question ne convient pas à notre format de questions / réponses. Nous nous attendons à ce que les réponses soient étayées par des faits, des références ou une expertise, mais cette question suscitera probablement un débat, des arguments, des sondages ou une discussion approfondie. …
J'ai joué avec R an ANOVA et j'ai eu des différences significatives. Cependant, en vérifiant quelles paires étaient significativement différentes en utilisant la procédure de Tukey, je n'en ai pas obtenu. Comment cela est-il possible? Voici le code: fit5_snow<- lm(Response ~ Stimulus, data=audio_snow) anova(fit5_snow) > anova(fit5_snow) Analysis of Variance Table …
Je suis confus sur la façon de calculer la perplexité d'un échantillon d'exclusion lors de l'allocation de Dirichlet latente (LDA). Les articles sur le sujet passent dessus, me faisant penser que je manque quelque chose d'évident ... La perplexité est considérée comme une bonne mesure de la performance de LDA. …
Deux questions connexes de moi. J'ai un cadre de données qui contient le nombre de patients dans une colonne (plage de 10 à 17 patients) et 0 et 1 indiquant si un incident s'est produit ce jour-là. J'utilise un modèle binomial pour régresser la probabilité d'incident sur le nombre de …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.