Questions marquées «r»

Utilisez cette balise pour toute question * sur le sujet * qui (a) implique «R» en tant que partie critique de la question ou réponse attendue, et (b) n'est pas * seulement * sur la façon d'utiliser «R».


4
détecter le nombre de pics dans l'enregistrement audio
J'essaie de comprendre comment détecter le nombre de syllabes dans un corpus d'enregistrements audio. Je pense qu'un bon proxy pourrait être des pics dans le fichier wave. Voici ce que j'ai essayé avec un fichier de moi parlant en anglais (mon cas d'utilisation réel est en kiswahili). La transcription de …


1
Quelle est la façon la plus appropriée de transformer des proportions lorsqu'elles sont une variable indépendante?
Je pensais avoir compris ce problème, mais maintenant je ne suis pas aussi sûr et je voudrais vérifier avec les autres avant de continuer. J'ai deux variables, Xet Y. Yest un rapport, et il n'est pas limité par 0 et 1 et est généralement distribué normalement. Xest une proportion, délimitée …

1
Coefficients identiques estimés dans le modèle Poisson vs Quasi-Poisson
En modélisant les données du nombre de sinistres dans un environnement d'assurance, j'ai commencé avec Poisson mais j'ai ensuite remarqué une surdispersion. Un Quasi-Poisson modélisait mieux la relation moyenne-variance plus élevée que le Poisson de base, mais j'ai remarqué que les coefficients étaient identiques dans les modèles de Poisson et …

2
Comment transformer des valeurs négatives en logarithmes?
Je voudrais savoir comment transformer des valeurs négatives en Log(), car j'ai des données hétéroscédastiques. J'ai lu que cela fonctionne avec la formule Log(x+1)mais cela ne fonctionne pas avec ma base de données et je continue à obtenir des NaN en conséquence. Par exemple, je reçois ce message d'avertissement (je …
12 r  logarithm 

1
Quel est le nom de la méthode d'estimation de la densité où toutes les paires possibles sont utilisées pour créer une distribution de mélange normale?
Je viens de penser à une façon soignée (pas nécessairement bonne) de créer des estimations de densité unidimensionnelles et ma question est: Cette méthode d'estimation de la densité a-t-elle un nom? Sinon, s'agit-il d'un cas particulier d'une autre méthode dans la littérature? Voici la méthode: Nous avons un vecteur que …

1
L'optimiseur lme4 par défaut nécessite de nombreuses itérations pour les données de grande dimension
TL; DR: l' lme4optimisation semble être linéaire dans le nombre de paramètres du modèle par défaut, et est beaucoup plus lente qu'un glmmodèle équivalent avec des variables factices pour les groupes. Puis-je faire quelque chose pour l'accélérer? J'essaie d'adapter un modèle logit hiérarchique assez grand (~ 50k lignes, 100 colonnes, …

1
Comment lire les résultats du test de Dunn?
Comment lire les résultats du test de Dunn ? Plus précisément, que m'indiquent les valeurs du tableau ci-dessous? J'ai des données non paramétriques dans 4 groupes, et j'ai d'abord fait un test de Kruskal-Wallis pour confirmer que les distributions des groupes étaient différentes les unes des autres et de l'ensemble …


1
Régression logistique avec splines de régression dans R
J'ai développé un modèle de régression logistique basé sur des données rétrospectives d'une base de données nationale sur les traumatismes des traumatismes crâniens au Royaume-Uni. Le résultat clé est la mortalité à 30 jours (dénommée mesure de «survie»). D'autres mesures avec des preuves publiées d'effet significatif sur les résultats dans …

1
t.test renvoie une erreur «les données sont essentiellement constantes»
R version 3.1.1 (2014-07-10) -- "Sock it to Me" > bl <- c(140, 138, 150, 148, 135) > fu <- c(138, 136, 148, 146, 133) > t.test(fu, bl, alternative = "two.sided", paired = TRUE) Error in t.test.default(fu, bl, alternative = "two.sided", paired = TRUE) : data are essentially constant Ensuite, …
12 r  t-test 

2
Pourquoi SAS PROC GLIMMIX me donne-t-il des pentes aléatoires TRÈS différentes de glmer (lme4) pour un glmm binomial
Je connais mieux R et j'essaie d'estimer les pentes aléatoires (coefficients de sélection) pour environ 35 individus sur 5 ans pour quatre variables d'habitat. La variable de réponse est de savoir si un emplacement a été «utilisé» (1) ou «disponible» (0) de l'habitat («utilisation» ci-dessous). J'utilise un ordinateur Windows 64 …

3
tester les coefficients de régression logistique en utilisant et les degrés de liberté de déviance résiduelle
Résumé: Existe - t-il une théorie statistique pour soutenir l'utilisation de la distribution (avec des degrés de liberté basés sur la déviance résiduelle) pour les tests des coefficients de régression logistique, plutôt que la distribution normale standard?ttt Il y a quelque temps, j'ai découvert qu'en ajustant un modèle de régression …

1
Comprendre les résultats de l'analyse de médiation dans R
J'essaie de comprendre le package de médiation dans R, en utilisant la vignette du package. J'ai du mal à comprendre la sortie de la mediate()fonction. require("mediation") require("sandwich") data("framing") med.fit <- lm(emo ~ treat + age + educ + gender + income, data = framing) out.fit <- glm(cong_mesg ~ emo + …
12 r  mediation 

En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.