Statistiques et Big Data

Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données

3
Prévision de la fonction de densité
Je fais des recherches sur la prévision de séries chronologiques de fonctions de densité de probabilité. Nous visons à prévoir un PDF à partir d'un PDF historiquement observé (généralement estimé). La méthode de prévision que nous développons fonctionne assez bien dans les études de simulation. Cependant, j'ai besoin d'un exemple …

1
Estimation des coefficients de régression logistique dans un plan cas-témoins lorsque la variable de résultat n'est pas le statut cas / contrôle
Considérons l'échantillonnage des données d'une population de taille de la manière suivante: PourNNNk=1,...,Nk=1,...,Nk=1, ..., N Observer individu statut de « maladie » de l »kkk S'ils ont la maladie, incluez-les dans l'échantillon avec la probabilitépk1pk1p_{k1} S'ils n'ont pas la maladie, incluez-les avec la probabilité .pk0pk0p_{k0} Supposons que vous ayez observé …

3
Comment obtenir l'intervalle de confiance sur le changement du carré de la population
Pour un exemple simple, supposons qu'il existe deux modèles de régression linéaire Modèle 1 a trois prédicteurs, x1a, x2betx2c Le modèle 2 a trois prédicteurs du modèle 1 et deux prédicteurs supplémentaires x2aetx2b Il existe une équation de régression de la population où la variance de la population expliquée est …



1
Comment intégrer une valeur aberrante innovante à l'observation 48 dans mon modèle ARIMA?
Je travaille sur un ensemble de données. Après avoir utilisé certaines techniques d'identification de modèle, je suis sorti avec un modèle ARIMA (0,2,1). J'ai utilisé la detectIOfonction dans le package TSAen R pour détecter une valeur aberrante innovante (IO) à la 48e observation de mon ensemble de données d'origine. Comment …
10 r  time-series  arima  outliers  hypergeometric  fishers-exact  r  time-series  intraclass-correlation  r  logistic  glmm  clogit  mixed-model  spss  repeated-measures  ancova  machine-learning  python  scikit-learn  distributions  data-transformation  stochastic-processes  web  standard-deviation  r  machine-learning  spatial  similarities  spatio-temporal  binomial  sparse  poisson-process  r  regression  nonparametric  r  regression  logistic  simulation  power-analysis  r  svm  random-forest  anova  repeated-measures  manova  regression  statistical-significance  cross-validation  group-differences  model-comparison  r  spatial  model-evaluation  parallel-computing  generalized-least-squares  r  stata  fitting  mixture  hypothesis-testing  categorical-data  hypothesis-testing  anova  statistical-significance  repeated-measures  likert  wilcoxon-mann-whitney  boxplot  statistical-significance  confidence-interval  forecasting  prediction-interval  regression  categorical-data  stata  least-squares  experiment-design  skewness  reliability  cronbachs-alpha  r  regression  splines  maximum-likelihood  modeling  likelihood-ratio  profile-likelihood  nested-models 

1
Que signifie la bande passante?
J'ai tracé la fonction de densité dans R et sous le tracé est le nombre de bande passante. Que signifie ce chiffre?
10 r 


1
Je journal transformé ma variable dépendante, puis-je utiliser la distribution normale GLM avec la fonction de lien LOG?
J'ai une question concernant les modèles linéaires généralisés (GLM). Ma variable dépendante (DV) est continue et non normale. Je l'ai donc transformé (toujours pas normal mais amélioré). Je veux relier le DV avec deux variables catégorielles et une covariable continue. Pour cela, je veux effectuer un GLM (j'utilise SPSS) mais …

1
Comment interpréter ce biplot PCA issu d'une enquête sur les domaines qui intéressent les gens?
Contexte: J'ai demandé à des centaines de participants à mon enquête à quel point ils étaient intéressés par des domaines sélectionnés (par échelles de Likert à cinq points, 1 indiquant «pas intéressé» et 5 indiquant «intéressé»). Ensuite, j'ai essayé PCA. L'image ci-dessous est une projection des deux premières composantes principales. …



2
Plusieurs régressions logistiques vs régression multinomiale
Est-il viable de faire plusieurs régressions logistiques binaires au lieu de faire une régression multinomiale? De cette question: régression logistique multinomiale vs régression logistique binaire un contre repos Je vois que la régression multinomiale pourrait avoir des erreurs standard plus faibles. Cependant, le package que j'aimerais utiliser n'a pas été …



En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.