Utilisez cette balise pour toute question * sur le sujet * qui (a) implique «R» en tant que partie critique de la question ou réponse attendue, et (b) n'est pas * seulement * sur la façon d'utiliser «R».
Je suis nouveau dans les statistiques et j'essaie de comprendre la différence entre l'ANOVA et la régression linéaire. J'utilise R pour explorer cela. J'ai lu divers articles sur les raisons pour lesquelles l'ANOVA et la régression sont différentes mais toujours les mêmes et comment elles peuvent être visualisées, etc. Je …
Je veux évaluer l'exactitude des tests de normalité sur différentes tailles d'échantillon dans R (je me rends compte que les tests de normalité peuvent être trompeurs ). Par exemple, pour examiner le test de Shapiro-Wilk, je procède à la simulation suivante (ainsi que le traçage des résultats) et je m'attends …
J'essaie d'estimer l'effet de 2 médicaments ( drug1, drug2) sur la probabilité de chute d'un patient ( event). Les patients peuvent tomber plus d'une fois et peuvent être mis ou retirés des médicaments à tout moment. Ma question est de savoir comment les données doivent être structurées en fonction de …
Je travaille sur l'auto-régression vectorielle (VAR) et l'estimation de la fonction de réponse impulsionnelle (IRF) basée sur des données de panel avec 33 individus sur 77 trimestres. Comment analyser ce type de situation? Quels algorithmes existent à cet effet? Je préférerais effectuer ces analyses en R, donc si quelqu'un connaît …
J'ai un modèle de régression logistique (ajustement via glmnet en R avec régularisation nette élastique), et je voudrais maximiser la différence entre les vrais positifs et les faux positifs. Pour ce faire, la procédure suivante est venue à l'esprit: Ajuster le modèle de régression logistique standard En utilisant un seuil …
Dans Dixon, Coles ( 1997 ), ils ont utilisé l'estimation du maximum de vraisemblance pour les deux modèles de Poisson indépendants modifiés en (4.3) pour modéliser les scores au soccer. J'essaie d'utiliser R afin de "reproduire" les paramètres alpha et bêta ainsi que les paramètres de l'effet home (p. 274, …
Je souhaite trouver une procédure pour simuler des données cohérentes avec un modèle de médiation spécifié. Selon le cadre général du modèle d'équation structurelle linéaire pour tester les modèles de médiation décrit pour la première fois par Barron et Kenny (1986) et décrit ailleurs comme Judd, Yzerbyt et Muller (2013) …
J'analyse un ensemble de données concernant les communautés intertidales. Les données sont le pourcentage de couverture (d'algues, bernaches, moules, etc.) en quadrats. J'ai l'habitude de penser à l'analyse des correspondances (AC) en termes de dénombrement des espèces et à l'analyse en composantes principales (ACP) comme quelque chose de plus utile …
J'ai les données suivantes situées ici . J'essaie de calculer l'intervalle de confiance à 95% sur la pureté moyenne lorsque le pourcentage d'hydrocarbures est de 1,0. Dans R, je saisis ce qui suit. > predict(purity.lm, newdata=list(hydro=1.0), interval="confidence", level=.95) fit lwr upr 1 89.66431 87.51017 91.81845 Cependant, comment puis-je obtenir ce …
Cela peut être peut-être une question stupide, mais lors de la génération d'un modèle avec caret et en utilisant quelque chose comme LOOCVou (plus précisément) LGOCV, quel est l'avantage de diviser les données en trains et ensembles de test si c'est essentiellement ce que l'étape de validation croisée fait de …
Je mène une méta-analyse des tailles d'effet d dans R en utilisant le package metafor. d représente les différences de scores de mémoire entre les patients et les sains. Cependant, certaines études ne rapportent que des sous-scores de la mesure d'intérêt d (par exemple, plusieurs scores de mémoire différents ou …
J'aimerais comprendre l'utilisation de la simulation de Monte Carlo dans la chisq.test()fonction de R. J'ai une variable qualitative qui a 128 niveaux / classes. La taille de mon échantillon est de 26 (je n'ai pas pu échantillonner plus de "personnes"). Alors évidemment, j'aurai quelques niveaux avec 0 "individus". Mais le …
J'ai un randomForestmodèle de classification fine que j'aimerais utiliser dans une application qui prédit la classe d'un nouveau cas. Le nouveau cas a inévitablement des valeurs manquantes. Predict ne fonctionnera pas comme tel pour les AN. Comment dois-je faire alors? data(iris) # create first the new case with missing values …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.