Utilisez cette balise pour toute question * sur le sujet * qui (a) implique «R» en tant que partie critique de la question ou réponse attendue, et (b) n'est pas * seulement * sur la façon d'utiliser «R».
Un rapide coup d' oeil à la page d'aide du générateur de nombres aléatoires de R montre que vous pouvez choisir parmi 7 générateurs prédéfinis ( Wichmann-Hill, Marsaglia-Multicarry, Super-Duper, Mersenne-Twister, Knuth-TAOCP-2002, Knuth-TAOCP, L'Ecuyer-CMRG). ?Random La valeur par défaut est Mersenne-Twister , qui semble très bonne. Alors pourquoi auriez-vous besoin d'en …
J'ai le modèle que j'ai besoin d'estimer, avec et \ pi_k \ ge0 \ text {for} k \ geq 1 .Y=π0+π1X1+π2X2+π3X3+ε,Y=π0+π1X1+π2X2+π3X3+ε, Y = \pi_0 + \pi_1 X_1 + \pi_2 X_2 + \pi_3 X_3 + \varepsilon, ∑kπk=1 for k≥1∑kπk=1 for k≥1\sum_k \pi_k = 1 \text{ for }k \geq 1πk≥0 for k≥1πk≥0 …
Mise à jour : Puisque je sais maintenant que mon problème est appelé séparation quasi-complète, j'ai mis à jour la question pour refléter cela (merci à Aaron). J'ai un ensemble de données provenant d'une expérience dans laquelle 29 participants humains (facteur code) ont travaillé sur un ensemble d'essais et la …
J'ai un problème de régression multiple, que j'ai essayé de résoudre en utilisant une régression multiple simple: model1 <- lm(Y ~ X1 + X2 + X3 + X4 + X5, data=data) Cela semble expliquer les 85% de variance (selon R au carré), ce qui semble assez bon. Cependant, ce qui …
Supposons que je construis un classificateur de régression logistique qui prédit si quelqu'un est marié ou célibataire. (1 = marié, 0 = célibataire) Je veux choisir un point sur la courbe précision-rappel qui me donne au moins 75% de précision, donc je veux choisir les seuils et , de sorte …
Je calcule des probabilités conditionnelles et des intervalles de confiance à 95% associés. Pour bon nombre de mes cas, j'ai un décompte simple des xsuccès des nessais (à partir d'un tableau de contingence), donc je peux utiliser un intervalle de confiance binomial, tel que celui fourni par binom.confint(x, n, method='exact')dans …
Je dois faire quelques comparaisons moyennes simples entre les groupes (tests F ANOVA de base) sur des données avec des valeurs manquantes. J'utilise le package de souris dans R pour l'imputation multiple, mais je ne peux regrouper les résultats que pour les coefficients du modèle linéaire, ou le .R2R2R^2 Quelqu'un …
Je veux que R affiche les données qu'il me donne de la summary()fonction dans un tableau afin que je puisse facilement les partager. Je suis actuellement en train de faire summary()dans la console, puis de prendre une capture d'écran, mais je préfère que cela soit généré comme un joli tableau, …
Une variable de réponse y est une fonction non linéaire d'un certain nombre de variables prédictives X (dans mes données réelles, la réponse est distribuée de façon binomiale, mais ici j'utilise une valeur normalement distribuée pour plus de simplicité). Je peux modéliser les relations entre les prédicteurs et la réponse …
Lors du calcul de modèles de régression avec R, j'utilise régulièrement la fonction relevel pour que mon modèle me donne également des résultats pour l'autre niveau. J'ai remarqué que parfois, mais pas souvent, cela changeait le modèle dans le sens où les niveaux d'autres facteurs qui étaient significatifs avant la …
J'ai énormément de difficulté à évaluer avec le package en R. Dans mon cas, les valeurs de , , sont toujours des nombres réels positifs. Même ainsi, la fonction hypergéométrique est incroyablement sensible à leurs valeurs. Je ne recherche pas une précision extrême; Je peux utiliser Excel pour obtenir une …
J'analyse un certain ensemble de données et j'ai besoin de comprendre comment choisir le meilleur modèle qui correspond à mes données. J'utilise R. Un exemple de données dont je dispose est le suivant: corr <- c(0, 0, 10, 50, 70, 100, 100, 100, 90, 100, 100) Ces chiffres correspondent au …
J'ai le plmpaquet et je voudrais exécuter des tests de racine unitaire sur certaines variables. J'obtiens l'erreur suivante: > purtest(data$tot.emp) Error in data.frame(baldwin = c(59870, 61259, 60397, 58919, 57856, 57227, : arguments imply differing number of rows: 14, 19, 11, 12, 1, 20, 18, 10, 13 Je suppose que j'obtiens …
En tant qu'institution financière, nous nous heurtons souvent à l'analyse de données chronologiques. Souvent, nous finissons par faire une régression en utilisant des variables de séries chronologiques. Dans ce cas, nous rencontrons souvent des résidus avec une structure de séries chronologiques qui viole l'hypothèse de base d'erreurs indépendantes dans la …
J'essaie d'adapter une distribution gamma inverse à trois paramètres à mes données en R ou en Python. Je voudrais le faire en utilisant l'estimation du maximum de vraisemblance (MLE). Le pdf du gamma inverse à trois paramètres est donné par: Où Γ est la fonction gamma, ρ est la forme, …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.