Utilisez cette balise pour toute question * sur le sujet * qui (a) implique «R» en tant que partie critique de la question ou réponse attendue, et (b) n'est pas * seulement * sur la façon d'utiliser «R».
Quels sont les avantages et les inconvénients de l'utilisation de LARS [1] par rapport à l'utilisation de la descente de coordonnées pour ajuster la régression linéaire régularisée L1? Je m'intéresse principalement aux aspects de performance (mes problèmes ont tendance à avoir Ndes centaines de milliers et p<20). Cependant, toute autre …
J'ai posé cette question hier sur StackOverflow, et j'ai obtenu une réponse, mais nous avons convenu que cela semble un peu hack et il pourrait y avoir une meilleure façon de voir les choses. La question: je voudrais calculer les erreurs-types de Newey-West (HAC) pour un vecteur (dans ce cas …
Je voudrais automatiser le choix du burn-in pour une chaîne MCMC, par exemple en supprimant les n premières lignes sur la base d'un diagnostic de convergence. Dans quelle mesure cette étape peut-elle être automatisée en toute sécurité? Même si je vérifie toujours l'autocorrélation, la trace mcmc et les fichiers PDF, …
J'ai lu et vu beaucoup de tracés de coordonnées parallèles. Quelqu'un peut-il répondre à l'ensemble des questions suivantes: Que sont les tracés de coordonnées parallèles (PCP) en termes simples, pour qu'un profane puisse comprendre? Une explication mathématique avec une certaine intuition si possible Quand le PCP est-il utile et quand …
Disons que j'ai une population de 50 millions de choses uniques, et je prends 10 millions d'échantillons (avec remplacement) ... Le premier graphique que j'ai joint montre combien de fois j'échantillonne la même "chose", ce qui est relativement rare que le la population est plus grande que mon échantillon. Cependant, …
Suite aux récentes questions que nous avions ici . Je sautais pour savoir si quelqu'un était tombé sur ou pouvait partager du code R pour effectuer une analyse de puissance personnalisée basée sur la simulation d'un modèle linéaire? Plus tard, je voudrais évidemment l'étendre à des modèles plus complexes, mais …
Dans R, il existe trois méthodes pour formater les données d'entrée pour une régression logistique à l'aide de la glmfonction: Les données peuvent être dans un format "binaire" pour chaque observation (par exemple, y = 0 ou 1 pour chaque observation); Les données peuvent être au format «Wilkinson-Rogers» (p. Ex. …
Les fonctions CDF empiriques sont généralement estimées par une fonction de pas. Y a-t-il une raison pour laquelle cela se fait de cette manière et non en utilisant une interpolation linéaire? La fonction pas a-t-elle des propriétés théoriques intéressantes qui nous font la préférer? Voici un exemple des deux: ecdf2 …
J'ai ajusté le modèle à l'aide caret, mais j'ai ensuite réexécuté le modèle à l'aide du gbmpackage. Je crois comprendre que le caretpackage utilise gbmet que la sortie doit être la même. Cependant, un simple test rapide utilisant data(iris)montre une différence dans le modèle d'environ 5% en utilisant RMSE et …
J'ai googlé et recherché sur stats.stackexchange mais je ne trouve pas la formule pour calculer un intervalle de confiance à 95% pour une valeur pour une régression linéaire. Quelqu'un peut-il le fournir?R2R2R^2 Mieux encore, disons que j'ai exécuté la régression linéaire ci-dessous dans R. Comment calculer un intervalle de confiance …
Je révise un document sur la pollinisation, où les données sont distribuées de façon binomiale (le fruit mûrit ou non). J'ai donc utilisé glmerun effet aléatoire (plante individuelle) et un effet fixe (traitement). Un critique veut savoir si la plante a eu un effet sur la nouaison - mais j'ai …
La fonction lm dans R peut imprimer la covariance estimée des coefficients de régression. Que nous fournissent ces informations? Pouvons-nous maintenant mieux interpréter le modèle ou diagnostiquer les problèmes qui pourraient être présents dans le modèle?
Je voudrais extraire les pentes de chaque individu dans un modèle à effets mixtes, comme indiqué dans le paragraphe suivant Des modèles à effets mixtes ont été utilisés pour caractériser les voies individuelles de changement dans les mesures cognitives sommaires, y compris les termes pour l'âge, le sexe et les …
J'ai lu sur le calcul des valeurs dans des modèles mixtes et après avoir lu la FAQ R-sig, d'autres articles sur ce forum (j'en lierais quelques-uns mais je n'ai pas assez de réputation) et plusieurs autres références je comprends que l'utilisation valeurs de dans le contexte des modèles mixtes sont …
J'ai une distribution empirique . Je le calcule comme suitG(x)G(x)G(x) x <- seq(0, 1000, 0.1) g <- ecdf(var1) G <- g(x) Je note , c'est-à-dire que h est le pdf tandis que G est le cdf.h(x)=dG/dxh(x)=dG/dxh(x) = dG/dxhhhGGG Je veux maintenant résoudre une équation pour la limite supérieure d'intégration (disons, …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.