Utilisez cette balise pour toute question * sur le sujet * qui (a) implique «R» en tant que partie critique de la question ou réponse attendue, et (b) n'est pas * seulement * sur la façon d'utiliser «R».
J'exécute une simulation sur R et un cluster d'ordinateurs et j'ai le problème suivant. Sur chacun des ordinateurs X, je lance: fxT2 <- function(i) runif(10) nessay <- 100 c(mclapply(1:nessay, fxT2), recursive=TRUE) Il y a 32 ordinateurs, chacun avec 16 cœurs. Cependant, environ 2% des nombres aléatoires sont identiques. Quelles stratégies …
J'ai du mal à comprendre un ou deux aspects du package de cluster. Je suis de près l'exemple de Quick-R , mais je ne comprends pas un ou deux aspects de l'analyse. J'ai inclus le code que j'utilise pour cet exemple particulier. ## Libraries library(stats) library(fpc) ## Data mydata = …
Cette question peut sembler très large, mais voici ce que je recherche. Je sais qu'il existe de nombreux excellents livres sur les méthodes économétriques et de nombreux excellents articles de présentation sur les techniques économétriques. Il existe même d'excellents exemples reproductibles d'économétrie, comme décrit dans cette question CrossValidated . En …
J'envisage la construction d' interfaces et R MATLAB® à Ross Quinlan de C5.0 (pour ceux qui ne le connaissent pas, C5.0 est un algorithme d'arbre de décision et progiciel, une extension de C4.5 ), et je suis en train de avoir une idée des composants que j'aurais besoin d'écrire. La …
J'ai lu la description de la régression des crêtes dans Applied Linear Statistical Models , 5e Ed chapitre 11. La régression des crêtes est effectuée sur les données de graisse corporelle disponibles ici . Le manuel correspond à la sortie dans SAS, où les coefficients transformés en arrière sont donnés …
Existe-t-il un moyen de tracer la ligne de régression d'un modèle par morceaux comme celui-ci, autre que d'utiliser linespour tracer chaque segment séparément ou en utilisant geom_smooth(aes(group=Ind), method="lm", fill=FALSE)? m.sqft <- mean(sqft) model <- lm(price~sqft+I((sqft-m.sqft)*Ind)) # sqft, price: continuous variables, Ind: if sqft>mean(sqft) then 1 else 0 plot(sqft,price) abline(reg = …
J'ai un ensemble de données avec beaucoup de zéros qui ressemble à ceci: set.seed(1) x <- c(rlnorm(100),rep(0,50)) hist(x,probability=TRUE,breaks = 25) Je voudrais tracer une ligne pour sa densité, mais la density()fonction utilise une fenêtre mobile qui calcule les valeurs négatives de x. lines(density(x), col = 'grey') Il y a des …
Vous vous demandez si quelqu'un a traversé un package / une fonction dans R qui combinera les niveaux d'un facteur dont la proportion de tous les niveaux d'un facteur est inférieure à un certain seuil? Plus précisément, l'une des premières étapes de la préparation des données que je mène est …
J'ajuste un modèle linéaire dans R en utilisant glmnet. Le modèle original (non régularisé) a été ajusté en utilisant lmet n'avait pas de terme constant (c'est-à-dire qu'il était sous la forme lm(y~0+x1+x2,data)). glmnetprend une matrice de prédicteurs et un vecteur de réponses. J'ai lu la glmnetdocumentation et je ne trouve …
Fermé. Cette question est hors sujet . Il n'accepte pas actuellement les réponses. Voulez-vous améliorer cette question? Mettez à jour la question afin qu'elle soit sur le sujet pour la validation croisée. Fermé il y a 2 ans . Je voudrais apprendre à utiliser Rcpp . J'ai parcouru les documents …
Si l'on teste l'hypothèse d'homoscédasticité, des tests paramétriques (test de Bartlett d'homogénéité des variances bartlett.test) et non paramétriques (test de Figner-Killeen d'homogénéité des variances fligner.test) sont disponibles. Comment savoir quel type utiliser? Cela devrait-il dépendre, par exemple, de la normalité des données?
J'examine quelques données de couverture génomique qui sont essentiellement une longue liste (quelques millions de valeurs) d'entiers, chacun indiquant dans quelle mesure (ou "profondément") cette position dans le génome est couverte. Je voudrais rechercher dans ces données des "vallées", c'est-à-dire des régions nettement "inférieures" à leur environnement. Notez que la …
J'ai besoin d'analyser avec R les données d'une enquête médicale (avec plus de 100 colonnes codées) qui vient dans un CSV. Je vais utiliser le hochet pour une première analyse mais en coulisses c'est toujours R. Si je lis.csv () le fichier, les colonnes avec des codes numériques sont traitées …
J'ai un ensemble de données avec des colonnes a b c(3 attributs). aest numérique et continue tandis que bet csont catégoriques chacun avec deux niveaux. J'utilise la méthode K-Neighbors la plus proche de classer aet bsur c. Donc, pour pouvoir mesurer les distances, je transforme mon ensemble de données en …
C'est plus une question conceptuelle, mais comme je l'utilise, Rje ferai référence aux packages de R. Si l'objectif est d'adapter un modèle linéaire à des fins de prédiction, puis de faire des prédictions là où les effets aléatoires pourraient ne pas être disponibles, y a-t-il un avantage à utiliser un …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.