Questions marquées «r»

Utilisez cette balise pour toute question * sur le sujet * qui (a) implique «R» en tant que partie critique de la question ou réponse attendue, et (b) n'est pas * seulement * sur la façon d'utiliser «R».

2
Pourquoi lrtest () ne correspond pas à anova (test = “LRT”)
Je cherchais des moyens de faire un test de rapport de vraisemblance en R pour comparer les ajustements du modèle. Je l'ai d'abord codé moi-même, puis j'ai trouvé la anova()fonction par défaut et également lrtest()dans le lmtestpackage. Cependant, lorsque j'ai vérifié, anova()produit toujours une valeur de p légèrement différente des …

1
La régression logistique glmnet peut-elle gérer directement les variables factorielles (catégorielles) sans avoir besoin de variables fictives? [fermé]
Fermé. Cette question est hors sujet . Il n'accepte pas actuellement les réponses. Voulez-vous améliorer cette question? Mettez à jour la question afin qu'elle soit sur le sujet pour la validation croisée. Fermé il y a 3 ans . Je construis une régression logistique en R en utilisant la méthode …

1
Comment les effets aléatoires avec une seule observation affecteront-ils un modèle mixte linéaire généralisé?
J'ai un ensemble de données dans lequel la variable que j'aimerais utiliser comme effet aléatoire n'a qu'une seule observation pour certains niveaux. Sur la base des réponses aux questions précédentes, j'ai compris que, en principe, cela peut convenir. Puis-je adapter un modèle mixte avec des sujets qui n'ont qu'une seule …

3
Quelle est la distribution du CDF normal inverse d'une variable aléatoire bêta?
Supposons que vous définissiez: X∼Beta(α,β)X∼Beta(α,β)X\sim\mbox{Beta}(\alpha,\beta) Y∼Φ−1(X)Y∼Φ−1(X)Y\sim \Phi^{-1}(X) où Φ−1Φ−1\Phi^{-1} est l'inverse du CDF de la distribution normale standard . Ma question est: Y aYYYYYY - t-il une distribution simple que Y suit, ou qui peut approximer Y ? Je demande parce que j'ai une forte suspicion basée sur les résultats …



3
Comment calculer le chevauchement entre les densités de probabilité empiriques?
Je cherche une méthode pour calculer la zone de chevauchement entre deux estimations de densité de noyau dans R, comme mesure de similitude entre deux échantillons. Pour clarifier, dans l'exemple suivant, il me faudrait quantifier l'aire de la région de chevauchement violacé: library(ggplot2) set.seed(1234) d <- data.frame(variable=c(rep("a", 50), rep("b", 30)), …


3
Puis-je reconstruire une distribution normale à partir de la taille de l'échantillon et des valeurs min et max? Je peux utiliser le point médian pour représenter la moyenne
Je sais que cela pourrait être un peu compliqué, statistiquement, mais c'est mon problème. J'ai beaucoup de données de plage, c'est-à-dire la taille minimum, maximum et échantillon d'une variable. Pour certaines de ces données, j'ai également une moyenne, mais pas beaucoup. Je veux comparer ces gammes entre elles pour quantifier …

3
Pondération des données plus récentes dans le modèle de forêt aléatoire
J'entraîne un modèle de classification avec Random Forest pour faire la distinction entre 6 catégories. Mes données transactionnelles ont environ 60k + observations et 35 variables. Voici un exemple de son apparence approximative. _________________________________________________ |user_id|acquisition_date|x_var_1|x_var_2| y_vay | |-------|----------------|-------|-------|--------| |111 | 2013-04-01 | 12 | US | group1 | |222 | …






En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.