Utilisez cette balise pour toute question * sur le sujet * qui (a) implique «R» en tant que partie critique de la question ou réponse attendue, et (b) n'est pas * seulement * sur la façon d'utiliser «R».
Il existe de nombreuses méthodes pour effectuer la régularisation - la régularisation basée sur la norme , et par exemple. Selon Friedman Hastie & Tibsharani , le meilleur régularisateur dépend du problème: à savoir la nature de la véritable fonction cible, la base particulière utilisée, le rapport signal / bruit …
J'ai effectué une mesure répétée à trois voies ANOVA; quelles analyses post-hoc sont valables? Il s'agit d'une conception entièrement équilibrée (2x2x2) avec l'un des facteurs ayant une mesure répétée intra-sujets. Je connais les approches multivariées des mesures répétées de l'ANOVA dans R, mais mon premier instinct est de procéder avec …
Je modélise certaines données où je pense avoir deux effets aléatoires croisés. Mais l'ensemble de données n'est pas équilibré, et je ne suis pas sûr de ce qui doit être fait pour en tenir compte. Mes données sont un ensemble d'événements. Un événement se produit lorsqu'un client rencontre un fournisseur …
J'ai beaucoup de problèmes avec un ensemble de données auquel j'essaie d'appliquer SEM. Nous supposons l'existence de 5 facteurs latents A, B, C, D, E, avec des indicateurs resp. A1 à A5 (facteurs ordonnés), B1 à B3 (quantitatifs), C1, D1, E1 (tous les trois derniers facteurs ordonnés, avec seulement 2 …
Considérez le code R suivant: example <- function(n) { X <- 1:n Y <- rep(1,n) return(lm(Y~X)) } #(2.13.0, i386-pc-mingw32) summary(example(7)) #R^2 = .1963 summary(example(62)) #R^2 = .4529 summary(example(4540)) #R^2 = .7832 summary(example(104))) #R^2 = 0 #I did a search for n 6:10000, the result for R^2 is NaN for #n …
J'ai besoin d'analyser un ensemble de données de données de réadaptation clinique. Je m'intéresse aux relations fondées sur des hypothèses entre les «intrants» quantifiés (quantité de thérapie) et les changements de l'état de santé. Bien que l'ensemble de données soit relativement petit (n ~ 70), nous avons des données répétées …
J'essaie de trouver une solution pour comparer deux tests de "qualité d'ajustement du chi carré". Plus précisément, je veux comparer les résultats de deux expériences indépendantes. Dans ces expériences, les auteurs ont utilisé le khi carré de l'ajustement pour comparer les suppositions aléatoires (fréquences attendues) avec les fréquences observées. Les …
J'ai un ensemble de données avec environ 70 variables que j'aimerais réduire. Ce que je cherche à faire, c'est d'utiliser CV pour trouver les variables les plus utiles de la manière suivante. 1) Sélectionnez au hasard disons 20 variables. 2) Utilisez stepwise/ LASSO/ lars/ etc pour choisir les variables les …
L'amplification des arbres à gradient comme proposé par Friedman utilise des arbres de décision avec Jdes nœuds terminaux (= feuilles) comme apprenants de base. Il existe un certain nombre de façons de faire pousser un arbre avec exactement des Jnœuds, par exemple, on peut faire pousser l'arbre en premier lieu …
J'utilise R pour créer des graphiques soignés que j'utilise dans les documents Microsoft Office. Selon cette page , la meilleure qualité est obtenue avec le pilote PDF. Malheureusement, Word ne prend pas en charge l'importation de figures PDF. Que dois-je utiliser?
Fermé. Cette question est hors sujet . Il n'accepte pas actuellement les réponses. Voulez-vous améliorer cette question? Mettez à jour la question afin qu'elle soit sur le sujet pour la validation croisée. Fermé il y a 3 ans . Cela m'a semblé être basique, mais je n'arrive pas à trouver …
Fondamentalement, tout ce que je veux faire, c'est prédire une réponse scalaire à l'aide de certaines courbes. Je suis allé jusqu'à faire une régression (en utilisant fRegress du package fda) mais je n'ai aucune idée de comment appliquer les résultats à un NOUVEAU jeu de courbes (pour la prédiction). J'ai …
J'ai créé quelques modèles de régression de Cox et j'aimerais voir à quel point ces modèles fonctionnent et j'ai pensé qu'une courbe ROC ou une statistique c pourrait être utile de la même manière que ces articles: JN Armitage et JH van der Meulen, «Identification de la comorbidité chez les …
432607 × 136432607×136432607 \times 136Y11 %11%11\%N89 %89%89\% J'utilise uniquement 15des 136variables indépendantes de l'ensemble de données. L'une des raisons de la réduction de l'ensemble de données était d'avoir plus d'échantillons d'apprentissage lorsque les lignes contenant NAs sont omises. Ces 15variables ont été sélectionnées après l'exécution de méthodes statistiques telles que …
J'utilise le package randomForest dans R pour développer un modèle de forêt aléatoire pour essayer d'expliquer un résultat continu dans un ensemble de données "large" avec plus de prédicteurs que d'échantillons. Plus précisément, j'adapte un modèle RF permettant à la procédure de sélectionner parmi un ensemble de ~ 75 variables …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.