Statistiques et Big Data

Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données


1
Qu'est-ce que la correction de biais? [fermé]
Fermé . Cette question a besoin de détails ou de clarté . Il n'accepte pas actuellement les réponses. Voulez-vous améliorer cette question? Ajoutez des détails et clarifiez le problème en modifiant ce message . Fermé il y a 4 ans . J'ai vu de nombreux endroits où ils ont des …

2
Analyse résiduelle de régression logistique
Cette question est en quelque sorte générale et de longue haleine, mais veuillez me supporter. Dans mon application, j'ai de nombreux jeux de données, chacun composé de ~ 20 000 points de données avec ~ 50 fonctionnalités et d'une seule variable binaire dépendante. J'essaie de modéliser les ensembles de données …

1
Comment puis-je optimiser l'efficacité de calcul lors de l'adaptation répétée d'un modèle complexe à un grand ensemble de données?
J'ai des problèmes de performances en utilisant le MCMCglmmpackage dans R pour exécuter un modèle d'effets mixtes. Le code ressemble à ceci: MC1<-MCMCglmm(bull~1,random=~school,data=dt,family="categorical" , prior=list(R=list(V=1,fix=1), G=list(G1=list(V=1, nu=0))) , slice=T, nitt=iter, ,burnin=burn, verbose=F) Il y a environ 20 000 observations dans les données et elles sont regroupées dans environ 200 écoles. …


2
Comment simuler des données fonctionnelles?
J'essaie de tester différentes approches d'analyse de données fonctionnelles. Idéalement, je voudrais tester le panel d'approches que j'ai sur des données fonctionnelles simulées. J'ai essayé de générer une FD simulée en utilisant une approche basée sur une sommation des bruits gaussiens (code ci-dessous), mais les courbes résultantes semblent beaucoup trop …

2
Comment gérer l'effet de plafond grâce à l'outil de mesure?
J'ai collecté des données psychophysiologiques mesurant la capacité des sujets (deux groupes) à percevoir les vibrations. Une sonde vibrante se déplace contre la peau à des déplacements de plus en plus petits, et le sujet indique quand il ressent la vibration. Malheureusement, à des fréquences élevées, la sonde ne peut …

2
Déterminer automatiquement la distribution de probabilité à partir d'un ensemble de données
Étant donné un ensemble de données: x <- c(4.9958942,5.9730174,9.8642732,11.5609671,10.1178216,6.6279774,9.2441754,9.9419299,13.4710469,6.0601435,8.2095239,7.9456672,12.7039825,7.4197810,9.5928275,8.2267352,2.8314614,11.5653497,6.0828073,11.3926117,10.5403929,14.9751607,11.7647580,8.2867261,10.0291522,7.7132033,6.3337642,14.6066222,11.3436587,11.2717791,10.8818323,8.0320657,6.7354041,9.1871676,13.4381778,7.4353197,8.9210043,10.2010750,11.9442048,11.0081195,4.3369520,13.2562675,15.9945674,8.7528248,14.4948086,14.3577443,6.7438382,9.1434984,15.4599419,13.1424011,7.0481925,7.4823108,10.5743730,6.4166006,11.8225244,8.9388744,10.3698150,10.3965596,13.5226492,16.0069239,6.1139247,11.0838351,9.1659242,7.9896031,10.7282936,14.2666492,13.6478802,10.6248561,15.3834373,11.5096033,14.5806570,10.7648690,5.3407430,7.7535042,7.1942866,9.8867927,12.7413156,10.8127809,8.1726772,8.3965665) .. Je voudrais déterminer la distribution de probabilité la plus appropriée (gamma, bêta, normale, exponentielle, poisson, chi carré, etc.) avec une estimation des paramètres. Je suis déjà au courant de la question sur le lien suivant, où une solution est fournie …


1
Comment générer des prédictions avec rjags?
J'ai utilisé rjags pour exécuter MCMC sur un modèle, spécifié dans le langage JAGS. Existe-t-il un bon moyen d'extraire ce modèle et d'effectuer des prédictions avec lui (en utilisant les distributions postérieures de mes paramètres)? Je peux re-spécifier le modèle en R et brancher les modes de mes paramètres postérieurs; …
12 r  jags 


1
Différences entre PROC Mixed et lme / lmer en R - degrés de liberté
Remarque: cette question est une rediffusion, car ma question précédente a dû être supprimée pour des raisons juridiques. En comparant PROC MIXED de SAS avec la fonction lmedu nlmepackage dans R, je suis tombé sur des différences assez confuses. Plus précisément, les degrés de liberté dans les différents tests diffèrent …
12 r  mixed-model  sas  degrees-of-freedom  pdf  unbiased-estimator  distance-functions  functional-data-analysis  hellinger  time-series  outliers  c++  relative-risk  absolute-risk  rare-events  regression  t-test  multiple-regression  survival  teaching  multiple-regression  regression  self-study  t-distribution  machine-learning  recommender-system  self-study  binomial  standard-deviation  data-visualization  r  predictive-models  pearson-r  spearman-rho  r  regression  modeling  r  categorical-data  data-visualization  ggplot2  many-categories  machine-learning  cross-validation  weka  microarray  variance  sampling  monte-carlo  regression  cross-validation  model-selection  feature-selection  elastic-net  distance-functions  information-theory  r  regression  mixed-model  random-effects-model  fixed-effects-model  dataset  data-mining 




En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.