Utilisez cette balise pour toute question * sur le sujet * qui (a) implique «R» en tant que partie critique de la question ou réponse attendue, et (b) n'est pas * seulement * sur la façon d'utiliser «R».
J'ai appliqué quelques données pour trouver la meilleure solution de variables du modèle de régression en utilisant la régression de crête dans R. J'ai utilisé lm.ridgeet glmnet(quand alpha=0), mais les résultats sont très différents, surtout quand lambda=0. Il suppose que les deux estimateurs de paramètres ont les mêmes valeurs. Alors, …
J'ai une question concernant l'interprétation de l'appel tsboot dans R. J'ai vérifié la documentation du Kendall et du paquet de démarrage, mais je ne suis pas plus intelligent qu'avant. Quand je lance un bootstrap en utilisant par exemple l'exemple dans le paquet Kendall, où la statistique de test est le …
J'ai utilisé le code R suivant pour s'adapter à un modèle probit: p1 <- glm(natijeh ~ ., family=binomial(probit), data=data1) stepwise(p1, direction='backward/forward', criterion='BIC') Je veux savoir ce que fait stepwiseet backward/forwardfait exactement et comment sélectionner les variables?
En utilisant Amelia dans R, j'ai obtenu plusieurs jeux de données imputés. Après cela, j'ai effectué un test de mesures répétées dans SPSS. Maintenant, je veux regrouper les résultats des tests. Je sais que je peux utiliser les règles de Rubin (implémentées via n'importe quel package d'imputation multiple dans R) …
Existe-t-il une stratégie pour choisir le nombre d'arbres dans un GBM? Plus précisément, l' ntreesargument dans Rla gbmfonction de. Je ne vois pas pourquoi vous ne devriez pas définir ntreesla valeur raisonnable la plus élevée. J'ai remarqué qu'un plus grand nombre d'arbres réduit clairement la variabilité des résultats de plusieurs …
J'essaie d'utiliser le neuralnetpackage de R (documentation ici ) pour la prédiction. Voici ce que j'essaie de faire: library(neuralnet) x <- cbind(runif(50, min=1, max=500), runif(50, min=1, max=500)) y <- x[, 1] * x[, 2] train <- data.frame(x, y) n <- names(train) f <- as.formula(paste('y ~', paste(n[!n %in% 'y'], collapse = …
J'ai un ensemble de données sur 20 ans d'un décompte annuel de l'abondance des espèces pour un ensemble de polygones (~ 200 polygones de forme irrégulière et continue). J'ai utilisé une analyse de régression pour inférer les tendances (changement du nombre par an) pour chaque polygone, ainsi que des agrégations …
Considérez le code et la sortie suivants: par(mfrow=c(3,2)) # generate random data from weibull distribution x = rweibull(20, 8, 2) # Quantile-Quantile Plot for different distributions qqPlot(x, "log-normal") qqPlot(x, "normal") qqPlot(x, "exponential", DB = TRUE) qqPlot(x, "cauchy") qqPlot(x, "weibull") qqPlot(x, "logistic") Il semble que ce tracé QQ pour log-normal soit …
Pour les données de comptage que j'ai collectées, j'utilise la régression de Poisson pour construire des modèles. Je le fais en utilisant la glmfonction dans R, où j'utilise family = "poisson". Pour évaluer les modèles possibles (j'ai plusieurs prédicteurs) j'utilise l'AIC. Jusqu'ici tout va bien. Maintenant, je veux effectuer une …
J'ai un ensemble de données contenant le nombre d'actions effectuées par des individus au cours de 7 jours. L'action spécifique ne devrait pas être pertinente pour cette question. Voici quelques statistiques descriptives pour l'ensemble de données: GammeSignifierVarianceNombre d'observations0 - 77218,22791696Range0−772Mean18.2Variance2791Number of observations696 \begin{array}{|c|c|} \hline \text{Range} & 0 - 772 \\ …
L'implémentation randomForest ne permet pas l'échantillonnage au-delà du nombre d'observations, même lors d'un échantillonnage avec remplacement. Pourquoi est-ce? Fonctionne bien: rf <- randomForest(Species ~ ., iris, sampsize=c(1, 1, 1), replace=TRUE) rf <- randomForest(Species ~ ., iris, sampsize=3, replace=TRUE) Ce que je veux faire: rf <- randomForest(Species ~ ., iris, sampsize=c(51, …
Pour analyser les dénombrements d'oiseaux gonflés à zéro, j'aimerais appliquer des modèles de comptage à gonflage nul en utilisant le package R pscl . Cependant, après avoir regardé l'exemple fourni dans la documentation pour l'une des principales fonctions ( ? Zeroinfl ), je commence à douter du véritable avantage de …
Je voudrais utiliser lme4pour ajuster une régression à effets mixtes et multcomppour calculer les comparaisons par paire. J'ai un ensemble de données complexe avec plusieurs prédicteurs continus et catégoriques, mais ma question peut être démontrée en utilisant l' ChickWeightensemble de données intégré comme exemple: m <- lmer(weight ~ Time * …
Je voudrais tester dans quelle régression correspond le mieux à mes données. Ma variable dépendante est un nombre et a beaucoup de zéros. Et j'aurais besoin d'aide pour déterminer le modèle et la famille à utiliser (poisson ou quasipoisson, ou régression poisson zéro gonflé), et comment tester les hypothèses. Régression …
Je souhaite visualiser les résultats d'un clustering (produit avec protoclust{protoclust}) en créant des graphiques de scater pour chaque paire de variables utilisées pour classer mes données, en coloriant par classes et en chevauchant les ellipses pour l'intervalle de confiance à 95% pour chacune des classes (pour vérifier qui elipses-classes se …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.