Utilisez cette balise pour toute question * sur le sujet * qui (a) implique «R» en tant que partie critique de la question ou réponse attendue, et (b) n'est pas * seulement * sur la façon d'utiliser «R».
J'ai des données de séries chronologiques où la variable mesurée est des entiers positifs discrets (comptes). Je veux tester s'il y a une tendance à la hausse dans le temps (ou non). La variable indépendante (x) est comprise entre 0 et 500 et la variable dépendante (y) est comprise entre …
Si j'ai une variable à 4 niveaux, en théorie, je dois utiliser 3 variables fictives. En pratique, comment cela se fait-il réellement? Dois-je utiliser 0-3, dois-je utiliser 1-3 et laisser les 4 vides? Aucune suggestion? REMARQUE: je vais travailler dans R. MISE À JOUR: Que se passerait-il si j'utilisais juste …
J'essaie de visualiser certaines données de consommation, qui ont 4 catégories. Les utilisateurs sont libres de basculer entre les différentes catégories. Je voudrais visualiser les trois ou quatre derniers commutateurs pour chaque individu. Nous commencerions donc par un tracé avec une colonne avec 4 proportions empilées. Après cela, nous aurions …
J'ai le vecteur x <- c(1,2,3,4,5,5,5,6,6,6,6, 7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7,7, 7,7,7,7,7,7,7,7,8,8,8,8,9,9,9,10) (mon vecteur réel a une longueur> 10 000) et je voudrais trouver les intervalles où se trouvent les 90% de la densité. Est-ce quantile(x, probs=c(0.05,0.95), type=5)le plus approprié ou existe-t-il une autre manière?
Wikipedia suggère qu'une façon d'examiner la fiabilité inter-évaluateurs consiste à utiliser un modèle à effets aléatoires pour calculer la corrélation intraclasse . L'exemple de la corrélation intraclasse parle de regarder σ2ασ2α+ σ2ϵσα2σα2+σϵ2\frac{\sigma_\alpha^2}{\sigma_\alpha^2+\sigma_\epsilon^2} à partir d'un modèle Ouije j= μ + αje+ ϵje jOuijej=μ+αje+ϵjejY_{ij} = \mu + \alpha_i + \epsilon_{ij} "où …
Je passe en revue le livre «Introductory Time Series with R» de Cowpertwait et Metcalfe. À la page 36, il indique que les lignes sont à: . J'ai lu ici R forum que les lignes sont à . −1/n±2/n−−√−1/n±2/n-1/n \pm 2/\sqrt{n}±1.96/n−−√±1.96/n\pm 1.96/\sqrt{n} J'ai exécuté le code suivant: b = c(3,1,4,1) …
Verrouillé . Cette question et ses réponses sont verrouillées car la question est hors sujet mais a une signification historique. Il n'accepte pas actuellement de nouvelles réponses ou interactions. Les fonctions que je connais incluent l' échelle à partir de la base R, la mise à l' échelle à partir …
J'ai effectué une analyse ANOVA, par exemple une interaction entre le sexe et le grade que je veux savoir dans quelles notes les garçons et les filles diffèrent, mais dans de nombreux cas, je trouve des valeurs de p (ajustées) de 0 et 1. Comment / pourquoi est-ce possible? Cela …
J'ai besoin de dessiner 20 distributions dans un seul graphique en R, et cela ne me semble pas bien (encombré) avec boxplot régulier (20 cases) même avec boxwex = 0.3. Pourriez-vous me suggérer comment puis-je tracer une sorte de boxplot en R pour les 20 distributions, avec des points pour …
J'utilise R depuis plusieurs années, mais j'ai toujours utilisé une interface graphique comme Tinn-R, JGR et plus récemment R-Studio. Bien que j'aime l'interface de R-Studio, je pense que pour les programmes plus longs avec peu / pas de graphiques, je pourrais coder plus efficacement en profitant des raccourcis offerts par …
Je l' ai utilisé rpart.controlpour minsplit=2, et a obtenu les résultats suivants de la rpart()fonction. Pour éviter de sur-ajuster les données, dois-je utiliser les divisions 3 ou 7? Ne devrais-je pas utiliser le fractionnement 7? S'il vous plaît, faites-moi savoir. Variables réellement utilisées dans la construction des arbres: [1] ct_a …
On m'a demandé d'analyser certaines données d'un essai clinique à la recherche de deux méthodes de mesure de la pression artérielle. J'ai des données de 50 sujets, chacun avec entre 2 et 57 mesures utilisant chaque méthode. Je me demande comment procéder. Évidemment, j'ai besoin d'une solution qui tiendra compte …
J'essaie de résoudre un problème qui concerne l'imputation des données manquantes d'une étude de données de panel (je ne sais pas si j'utilise correctement «l'étude de données de panel» - telle que je l'ai apprise aujourd'hui.) J'ai des données sur le nombre total de décès pour les années 2003 jusqu'en …
Dans R, pourquoi les paramètres par défaut qqplot(linear model)utilisent-ils les résidus normalisés sur l'axe des y? Pourquoi R n'utilise-t-il pas les résidus "réguliers"?
cette question a commencé comme " Clustering spatial data in R " et est maintenant passée à la question DBSCAN. Comme les réponses à la première question l'ont suggéré, j'ai cherché des informations sur DBSCAN et j'ai lu quelques documents. De nouvelles questions ont surgi. DBSCAN nécessite certains paramètres, l'un …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.