Statistiques et Big Data

Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données

1
Séquence de Halton vs séquence de Sobol?
À partir d'une réponse à une question précédente , j'ai été orienté vers la séquence de Halton, pour créer un ensemble de vecteurs qui couvraient un espace d'échantillonnage uniforme de manière assez uniforme. Mais la page wikipedia mentionne que les nombres premiers supérieurs en particulier sont souvent fortement corrélés au …



2
Prédiction de régression quantile
Je suis intéressé à utiliser la régression quantile pour certains de mes modèles, mais j'aimerais avoir des clarifications sur ce que je peux réaliser en utilisant cette méthodologie. Je comprends que je peux obtenir une analyse plus robuste de la relation IV / DV , en particulier face aux valeurs …

5
Pourquoi prétend-on qu'un échantillon est souvent plus précis qu'un recensement?
Lors de l'apprentissage du cours d'échantillonnage, je rencontre les deux énoncés suivants: 1) L'erreur d'échantillonnage entraîne principalement une variabilité, les erreurs de non-échantillonnage entraînent un biais. 2) En raison d'une erreur de non-échantillonnage, un échantillon est souvent plus précis qu'un RECENSEMENT. Je ne sais pas comment comprendre ces deux déclarations. …


4
Sidak ou Bonferroni?
J'utilise un modèle linéaire généralisé dans SPSS pour examiner les différences dans le nombre moyen de chenilles (non normales, en utilisant la distribution de Tweedie) sur 16 espèces différentes de plantes. Je veux effectuer plusieurs comparaisons mais je ne sais pas si je dois utiliser un test de correction Sidak …



5
lme4 ou autre code de package R open source équivalent à asreml-R
Je veux adapter un modèle mixte à l'aide de lme4, nlme, package de régression baysian ou tout autre disponible. Modèle mixte dans les conventions de codage Asreml-R avant d'entrer dans les détails, nous pourrions vouloir avoir des détails sur les conventions asreml-R, pour ceux qui ne sont pas familiers avec …
13 r 




2
Faire face à la multicolinéarité
J'ai appris qu'en utilisant la vif()méthode du carpackage, nous pouvons calculer le degré de multicolinéarité des entrées dans un modèle. D'après wikipedia , si la vifvaleur est supérieure à celle-ci, 5nous pouvons considérer que l'entrée souffre d'un problème de multicolinéarité. Par exemple, j'ai développé un modèle de régression linéaire en …

3
Distribution des probabilités de clustering - méthodes et métriques?
J'ai quelques points de données, contenant chacun 5 vecteurs de résultats discrets agglomérés, les résultats de chaque vecteur générés par une distribution différente, (le type spécifique dont je ne suis pas sûr, ma meilleure supposition est Weibull, avec un paramètre de forme variant quelque part autour de l'exponentielle de puissance …

En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.