Statistiques et Big Data

Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données


1
Paramétrage des distributions de Behrens – Fisher
"Sur le problème Behrens – Fisher: un examen" par Seock-Ho Kim et Allen S. Cohen Journal of Educational and Behavioral Statistics , volume 23, numéro 4, hiver 1998, pages 356–377 Je regarde cette chose et elle dit: Fisher (1935, 1939) a choisi la statistique [oùtiest lastatistiquet àun échantillonhabituelle pouri=1,2] oùθest …







2
Certains de mes prédicteurs sont à des échelles très différentes - dois-je les transformer avant d'ajuster un modèle de régression linéaire?
Je voudrais exécuter une régression linéaire sur un ensemble de données multidimensionnelles. Il existe des différences entre les différentes dimensions en termes de leur ordre de grandeur. Par exemple, la dimension 1 a généralement une plage de valeurs de [0, 1] et la dimension 2 a une plage de valeurs …

1
Modèle de risque proportionnel de Cox et interprétation des coefficients lorsqu'une interaction avec des cas plus élevés est impliquée
Voici le résumé-sortie du modèle de Coxph que j'ai utilisé (j'ai utilisé R et la sortie est basée sur le meilleur modèle final, c'est-à-dire que toutes les variables explicatives significatives et leurs interactions sont incluses): coxph(formula = Y ~ LT + Food + Temp2 + LT:Food + LT:Temp2 + Food:Temp2 …

1
Modélisation d'une tendance spatiale par régression avec les
Je prévois d'inclure les coordonnées comme covariables dans l'équation de régression afin de s'adapter à la tendance spatiale qui existe dans les données. Après cela, je veux tester les résidus sur l'autocorrélation spatiale en variation aléatoire. J'ai plusieurs questions: Dois-je effectuer une régression linéaire dans laquelle seules les variables indépendantes …


1
Problèmes avec une étude de simulation de l'explication des expériences répétées d'un intervalle de confiance à 95% - où vais-je mal?
J'essaie d'écrire un script R pour simuler l'interprétation des expériences répétées d'un intervalle de confiance à 95%. J'ai trouvé qu'il surestime la proportion de fois où la valeur réelle de la population d'une proportion est contenue dans l'IC à 95% de l'échantillon. Pas une grande différence - environ 96% vs …



En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.