Questions marquées «r»

Utilisez cette balise pour toute question * sur le sujet * qui (a) implique «R» en tant que partie critique de la question ou réponse attendue, et (b) n'est pas * seulement * sur la façon d'utiliser «R».

2
Poids dans la régression quantile pour une enquête complexe dans R
Je veux inclure des échantillons de poids dans mon modèle de régression quantile, mais je ne sais pas comment procéder. J'ai déjà défini mon poids, qui sont des poids répliqués déjà donnés dans l'ensemble de données d'enquête (calculé dans le package d'enquête): w<-svrepdesign(variables=data[,1:10],repweights=data[,11:30],type="BRR", combined.weights=TRUE, weights=r.weights, rho=0.5,dbname="") et mon modèle rq …

2
Comment combiner plusieurs jeux de données imputés?
J'ai besoin d'un seul ensemble de données imputées (par exemple, pour créer un mannequin de groupe de pays à partir des données imputées sur le revenu par habitant du pays). R propose des packages de packages pour créer plusieurs données imputées (par exemple Amelia) et combiner les résultats de plusieurs …

2
Comment appliquer la correction de tests multiples pour le chevauchement de la liste de gènes à l'aide de R
J'ai 2 études examinant la réponse du patient au même médicament. L'étude 1 a trouvé 10 000 gènes exprimés au-dessus du fond et 500 d'entre eux sont différentiellement exprimés et appelés signature de réponse au médicament. L'étude 2 a trouvé 1 000 gènes représentant la signature de la réponse au …

2
Régression de Cox à grande échelle avec R (Big Data)
J'essaie d'exécuter une régression de Cox sur un échantillon de données de 2 000 000 lignes comme suit en utilisant uniquement R. Il s'agit d'une traduction directe d'un PHREG dans SAS. L'échantillon est représentatif de la structure de l'ensemble de données d'origine. ## library(survival) ### Replace 100000 by 2,000,000 test …

2
Naive Bayes sur les variables continues
Veuillez me permettre de poser une question de base. Je comprends la mécanique des Naive Bayes pour les variables discrètes, et peux refaire les calculs "à la main". (code de HouseVotes84 tout le chemin ci-dessous). Cependant - j'ai du mal à voir comment la mécanique fonctionne pour les variables continues …
8 r  naive-bayes  bayes 

1
Comment peut-on effectuer une analyse de puissance binomiale à deux groupes sans utiliser d'approximations normales?
Je voudrais faire des analyses de puissance pour des tests d'hypothèses de (non) égalité de proportions dans lesquelles les proportions sont très petites. Je voudrais le faire sans utiliser d'approximations normales (ou Poisson) de la distribution binomiale. Il y a plusieurs types généraux de questions de pouvoir que j'aimerais pouvoir …

2
Pourquoi est-ce que j'obtiens les mêmes résultats pour OLS et GLS dans R?
Lorsque j'exécute ce code: require(nlme) a <- matrix(c(1,3,5,7,4,5,6,4,7,8,9)) b <- matrix(c(3,5,6,2,4,6,7,8,7,8,9)) res <- lm(a ~ b) print(summary(res)) res_gls <- gls(a ~ b) print(summary(res_gls)) J'obtiens les mêmes coefficients et la même signification statistique sur les coefficients: Loading required package: nlme Call: lm(formula = a ~ b) Residuals: Min 1Q Median 3Q …

3
Pourquoi y a-t-il un coude pointu dans mes courbes ROC?
J'ai quelques ensembles de données EEG que je teste contre deux classes. Je peux obtenir un taux d'erreur décent de LDA (les distributions conditionnelles de classe ne sont pas gaussiennes, mais ont des queues similaires et une séparation suffisamment bonne), et donc je veux tracer le ROC du prédicteur LDA …



2
Calcul de la probabilité lorsque
J'essaie de calculer cette distribution postérieure: ( θ | - ) =∏ni = 1pyjeje( 1 -pje)1 -yje∑toutθ ,pje| θ∏ni = 1pyjeje( 1 -pje)1 -yje(θ|−)=∏i=1npiyi(1−pi)1−yi∑allθ,pi|θ∏i=1npiyi(1−pi)1−yi (\theta|-)=\frac{\prod_{i=1}^{n}p_i^{y_i}(1-p_i)^{1-y_i}}{\sum_{\text{all}\,\theta,p_i|\theta}\prod_{i=1}^{n}p_i^{y_i}(1-p_i)^{1-y_i}} Le problème est que le numérateur, qui est le produit d'un tas de Bernoulli (pje,yje)Bernoulli(pi,yi)\text{Bernoulli}(p_i,y_i)les probabilités sont trop faibles. (Mannn est grande, environ 1500). Par …



2
R comme alternative à SAS pour les données volumineuses
Je sais que R n'est pas particulièrement utile pour analyser de grands ensembles de données étant donné que R charge toutes les données en mémoire alors que quelque chose comme SAS fait une analyse séquentielle. Cela dit, il existe des packages tels que bigmemory qui permettent aux utilisateurs d'effectuer une …
8 r  sas  large-data 

1
Impossible d'ajuster la régression binomiale négative dans R (tentative de réplication des résultats publiés)
Tenter de reproduire les résultats de l'article récemment publié, Aghion, Philippe, John Van Reenen et Luigi Zingales. 2013. «Innovation and Institutional Ownership». American Economic Review, 103 (1): 277-304. (Les données et le code stata sont disponibles sur http://www.aeaweb.org/aer/data/feb2013/20100973_data.zip ). Je n'ai aucun problème à recréer les 5 premières régressions dans …

En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.