Questions marquées «r»

Utilisez cette balise pour toute question * sur le sujet * qui (a) implique «R» en tant que partie critique de la question ou réponse attendue, et (b) n'est pas * seulement * sur la façon d'utiliser «R».


2
Regroupement d'une donnée bruyante ou avec des valeurs aberrantes
J'ai des données bruyantes de deux variables comme celle-ci. x1 <- rep(seq(0,1, 0.1), each = 3000) set.seed(123) y1 <- rep (c(0.2, 0.8, 0.3, 0.9, 0.65, 0.35,0.7,0.1,0.25, 0.3, 0.95), each = 3000) set.seed(1234) e1 = rnorm(length(x1), 0.07,0.07) set.seed(1223) e2 = rnorm(length(x1), 0.07,0.07) set.seed(1334) yn <- rnorm(20000, 0.5,0.9) set.seed(2344) xn <- rnorm(20000, …

1
Comment générer des données de survie avec des covariables dépendantes du temps en utilisant R
Je veux générer le temps de survie à partir d'un modèle de risques proportionnels de Cox qui contient une covariable dépendante du temps. Le modèle est h(t|Xi)=h0(t)exp(γXi+αmi(t))h(t|Xi)=h0(t)exp⁡(γXi+αmi(t))h(t|X_i) =h_0(t) \exp(\gamma X_i + \alpha m_{i}(t)) où est généré à partir de Binomial (1,0,5) et .m i ( t ) = β 0 …

1
Comprendre la décomposition en valeurs singulières dans le contexte de LSI
Ma question porte généralement sur la décomposition en valeurs singulières (SVD), et en particulier sur l'indexation sémantique latente (LSI). Dis, j'ai qui contient des fréquences de 5 mots pour 7 documents.Aword×documentAword×document A_{word \times document} A = matrix(data=c(2,0,8,6,0,3,1, 1,6,0,1,7,0,1, 5,0,7,4,0,5,6, 7,0,8,5,0,8,5, 0,10,0,0,7,0,0), ncol=7, byrow=TRUE) rownames(A) <- c('doctor','car','nurse','hospital','wheel') J'obtenir la matrice factorisation …

2
Estimation des ratios de risque ajustés dans les données binaires à l'aide de la régression de Poisson
Je m'intéresse à l'estimation d'un rapport de risque ajusté, analogue à la façon dont on estime un rapport de cotes ajusté en utilisant la régression logistique. Certaines publications (par exemple, ceci ) indiquent que l'utilisation de la régression de Poisson avec les erreurs standard de Huber-White est une façon basée …


1
test anova type III pour un GLMM
Je monte un glmermodèle dans le lme4package R. Je cherche une table anova avec une valeur de p montrée ici, mais je ne trouve aucun paquet qui lui convient. Est-il possible de le faire en R? Le modèle que je monte est de la forme: model1<-glmer(dmn~period*teethTreated+(1|fullName), family="poisson", data=subset(dataset, group=='Four times …


2
Estimation des paramètres avec des modèles linéaires généralisés
Par défaut, lorsque nous utilisons une glmfonction dans R, elle utilise la méthode des moindres carrés itérativement repondérés (IWLS) pour trouver l'estimation du maximum de vraisemblance des paramètres. Maintenant, j'ai deux questions. Les estimations IWLS garantissent-elles le maximum global de la fonction de vraisemblance? D'après la dernière diapositive de cette …

4
Comment faire un apprentissage automatique multivarié? (prédire plusieurs variables dépendantes)
Je cherche à prédire les groupes d'articles que quelqu'un achètera ... c'est-à-dire que j'ai plusieurs variables dépendantes colinéaires. Plutôt que de construire environ 7 modèles indépendants pour prédire la probabilité que quelqu'un achète chacun des 7 articles, puis de combiner les résultats, quelles méthodes devrais-je étudier pour avoir un modèle …




1
Étrange façon de calculer le chi carré dans Excel vs R
Je regarde une feuille Excel qui prétend calculer le , mais je ne reconnais pas cette façon de faire, et je me demandais si je manquais quelque chose.χ2χ2\chi^2 Voici les données qu'il analyse: +------------------+----------+----------+ | Total Population | Observed | Expected | +------------------+----------+----------+ | 2000 | 42 | 32.5 | …
9 r  chi-squared  excel 


En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.