Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
J'essaie d'adapter un modèle hiérarchique à l'aide de jags et du package rjags. Ma variable de résultat est y, qui est une séquence d'essais bernoulli. J'ai 38 sujets humains qui se produisent sous deux catégories: P et M. D'après mon analyse, chaque locuteur a une probabilité de succès dans la …
Je veux appliquer une PCA sur un ensemble de données, qui se compose de variables de type mixte (continu et binaire). Pour illustrer la procédure, je colle un exemple reproductible minimal dans R ci-dessous. # Generate synthetic dataset set.seed(12345) n <- 100 x1 <- rnorm(n) x2 <- runif(n, -2, 2) …
J'essaie de comprendre comment R calcule l'autocorrélation lag-k (apparemment, c'est la même formule utilisée par Minitab et SAS), afin de pouvoir le comparer à l'utilisation de la fonction CORREL d'Excel appliquée à la série et à sa version k-lagged. R et Excel (en utilisant CORREL) donnent des valeurs d'autocorrélation légèrement …
Je travaille sur une régression logistique multiple dans R en utilisant glm. Les variables prédictives sont continues et catégoriques. Un extrait du résumé du modèle montre ce qui suit: Coefficients: Estimate Std. Error z value Pr(>|z|) (Intercept) 2.451e+00 2.439e+00 1.005 0.3150 Age 5.747e-02 3.466e-02 1.658 0.0973 . BMI -7.750e-02 7.090e-02 …
Existe-t-il une telle formule? Étant donné un ensemble de données dont la moyenne, la variance, l'asymétrie et le kurtosis sont connus ou peuvent être mesurés, existe-t-il une formule unique qui peut être utilisée pour calculer la densité de probabilité d'une valeur supposée provenir des données susmentionnées?
En lisant quelques articles, je suis tombé sur le terme "jeu d'or" ou "étalon or". Ce que je ne comprends pas, c'est ce qui fait de l'étalon-or un ensemble de données? L'acceptation par les pairs, le nombre de citations et si c'est la liberté du chercheur et la pertinence du …
J'ai du mal à comprendre ce plot.stlque signifient exactement les barres de plage . J'ai trouvé le post de Gavin sur cette question et j'ai également lu la documentation, je comprends qu'ils indiquent l'ampleur relative des composants décomposés, mais je ne sais toujours pas comment ils fonctionnent. Par exemple: données: …
Si vous pouvez mesurer une série chronologique d'observations à n'importe quel niveau de précision dans le temps, et que votre objectif de l'étude est d'identifier une relation entre X et Y, existe-t-il une justification empirique pour choisir un niveau spécifique d'agrégation plutôt qu'un autre, ou devrait le choix se fait …
Problème Je voudrais tracer la variance expliquée par chacun des 30 paramètres, par exemple sous forme de graphique à barres avec une barre différente pour chaque paramètre, et la variance sur l'axe y: Cependant, les variances sont fortement biaisées vers de petites valeurs, y compris 0, comme on peut le …
J'ai plusieurs codeurs indépendants qui essaient d'identifier les événements dans une série chronologique - dans ce cas, je regarde une vidéo de conversation en face à face et je recherche des comportements non verbaux particuliers (par exemple, des hochements de tête) et le codage de l'heure et de la catégorie …
L'une des hypothèses de régression logistique est la linéarité du logit. Donc, une fois mon modèle opérationnel, je teste la non-linéarité en utilisant le test de Box-Tidwell. Un de mes prédicteurs continus (X) s'est révélé positif pour la non-linéarité. Que dois-je faire ensuite? Comme il s'agit d'une violation des hypothèses, …
Comment savoir si les corrélations à différents décalages obtenues à partir de la corrélation croisée (fonction ccf) de deux séries chronologiques sont significatives.
Ayant récemment commencé à m'enseigner moi-même l'apprentissage automatique et l'analyse des données, je me retrouve à frapper un mur de briques sur la nécessité de créer et d'interroger de grands ensembles de données. Je voudrais prendre des données que j'ai agrégées dans ma vie professionnelle et personnelle et les analyser, …
J'ai un tas d'articles présentant "OR" avec un IC à 95% (intervalles de confiance). Je veux estimer à partir des articles la valeur P pour le OU observé. Pour cela, j'ai besoin d'une hypothèse concernant la distribution OR. Quelle distribution puis-je assumer / utiliser en toute sécurité?
Quelqu'un peut-il m'expliquer la différence entre la méthode des moments et la GMM (méthode générale des moments), leur relation, et quand doit-on utiliser l'une ou l'autre?
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.