Statistiques et Big Data

Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données



6
Comment regrouper / standardiser des variables dans R?
Verrouillé . Cette question et ses réponses sont verrouillées car la question est hors sujet mais a une signification historique. Il n'accepte pas actuellement de nouvelles réponses ou interactions. Les fonctions que je connais incluent l' échelle à partir de la base R, la mise à l' échelle à partir …


1
Comment interpréter les valeurs de p de 0 ou 1?
J'ai effectué une analyse ANOVA, par exemple une interaction entre le sexe et le grade que je veux savoir dans quelles notes les garçons et les filles diffèrent, mais dans de nombreux cas, je trouve des valeurs de p (ajustées) de 0 et 1. Comment / pourquoi est-ce possible? Cela …
9 r 

3
Les effets aléatoires peuvent-ils s'appliquer uniquement aux variables catégorielles?
Cette question peut sembler stupide, mais ... est-il exact que les effets aléatoires ne peuvent s'appliquer qu'aux variables catégorielles (comme l'identifiant individuel, l'identifiant de la population, ...), par exemple, disons que est une variable catégorielle:xixix_i yiyiy_i ~βxiβxi\beta_{x_i} βxiβxi\beta_{x_i} ~Norm(μ,δ2)Norm(μ,δ2)Norm(\mu, \delta^2) mais d'après le principe, l' effet aléatoire ne peut pas …

3
Comment puis-je simuler des microdonnées de recensement pour de petites régions en utilisant un échantillon de microdonnées de 1% à grande échelle et des statistiques agrégées à petite échelle?
Je voudrais effectuer une analyse multivariée au niveau individuel à de petits niveaux d'agrégation géographique (districts de collecte du recensement australien). De toute évidence, le recensement n'est pas disponible à ces petits niveaux d'agrégation pour des raisons de confidentialité, donc j'examine d'autres alternatives. Presque toutes les variables d'intérêt sont catégoriques. …

2
Comprendre les hypothèses ANOVA de mesure répétée pour une interprétation correcte de la sortie SPSS
J'étudie si différentes conditions de récompense peuvent affecter les performances de la tâche. J'ai des données d'une petite étude avec deux groupes, chacun avec n = 20. J'ai collecté des données sur une tâche qui impliquait des performances dans 3 conditions de "récompense" différentes. La tâche impliquait des performances dans …



1
La différence entre contrôle et traitement doit-elle être modélisée explicitement ou implicitement?
Étant donné la configuration expérimentale suivante: Plusieurs échantillons sont prélevés sur un sujet et chaque échantillon est traité de plusieurs façons (y compris un traitement témoin). Ce qui est principalement intéressant, c'est la différence entre le contrôle et chaque traitement. Je peux penser à deux modèles simples pour ces données. …


2
Régression logistique pondérée par cas
J'examine quelques problèmes de régression logistique. ("régulier" et "conditionnel"). Idéalement, je voudrais pondérer chacun des cas d'entrée afin que le GLM se concentre davantage sur la prédiction correcte des cas à pondération plus élevée au détriment d'une éventuelle mauvaise classification des cas à pondération inférieure. Cela a sûrement été fait …
9 logistic 



En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.