Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
Après avoir exécuté une régression du formulaire reg <- lm(y ~ x1 + x2, data=example)sur un ensemble de données, je peux obtenir des valeurs prédites en utilisant predict(reg, example, interval="prediction", level=0.95) Je me demande à quoi les valeurs prédites se réfèrent réellement lorsque j'utilise la régression pour prédire l'ensemble de …
Il y a beaucoup de choses sur la colinéarité en ce qui concerne les prédicteurs continus, mais pas tellement que je peux trouver sur les prédicteurs catégoriques. J'ai des données de ce type illustrées ci-dessous. Le premier facteur est une variable génétique (nombre d'allèles), le second est une catégorie de …
Disons qu'en tant que propriétaire d'entreprise (ou de marketing ou de toute personne qui comprend un nuage de points), un nuage de points de deux variables s'affiche: nombre de publicités vs nombre de ventes de produits par mois au cours des 5 dernières années (ou une autre échelle de temps …
Contexte: Je suis un biostatisticien aux prises avec un ensemble de données sur les taux d'expression cellulaire. L'étude a exposé une foule de cellules, collectées en groupes de divers donneurs, à certains peptides. Les cellules expriment certains biomarqueurs en réponse, ou elles ne le font pas. Les taux de réponse …
Verrouillé . Cette question et ses réponses sont verrouillées car la question est hors sujet mais a une signification historique. Il n'accepte pas actuellement de nouvelles réponses ou interactions. Comment puis-je tracer un graphique gaufré comme alternative à l'utilisation de morceaux dans R? help.search("waffle") No help files found with alias …
Supposons que j'ai un ensemble d'observations univariées indépendantes et distribuées de manière identique et deux hypothèses sur la façon dont été généré:xxxxxx H0H0H_0 : est tiré d'une distribution gaussienne unique avec une moyenne et une variance inconnues.xxx HAHAH_A : est tiré d'un mélange de deux Gaussiennes avec une moyenne, une …
J'aimerais savoir s'il est logique d'étudier les graphiques des résidus par rapport à la variable dépendante lorsque j'ai une régression univariée. Si cela a du sens, que signifie une forte corrélation croissante linéaire entre les résidus (sur l'axe des y) et les valeurs estimées de la variable dépendante (sur l'axe …
J'utilise un modèle OLS avec une variable d'indice d'actif continue comme DV. Mes données sont agrégées à partir de trois communautés similaires à proximité géographique les unes des autres. Malgré cela, j'ai pensé qu'il était important d'utiliser la communauté comme variable de contrôle. Il s'avère que la communauté est significative …
J'ai un modèle stochastique utilisé pour simuler des séries chronologiques de certains processus. Je m'intéresse à l'effet de changer un paramètre à une valeur spécifique et je veux montrer la différence entre la série chronologique (par exemple le modèle A et le modèle B) et une sorte d'intervalle de confiance …
On me fait un exercice et je n'arrive pas à le comprendre. Le paradoxe des prisonniersTrois détenus en isolement cellulaire, A, B et C, ont été condamnés à mort le même jour mais, en raison de la fête nationale, le gouverneur décide que l'un d'eux se verra accorder une grâce. …
Je recherche l'équivalent bayésien du test t à deux échantillons avec des variances inégales (le test de Welch). Je recherche également un test multivarié, comme la statistique T de Hotelling. Références appréciées. Pour le cas multivarié, supposons que nous ayons et , où (resp ) est un raccourci pour une …
Il existe un modèle de régression où avec et , qui a un coefficient de corrélation de .Oui= a + b XOui=une+bXY = a + bXa = 1,6une=1,6a = 1.6b = 0,4b=0,4b=0.4r = 0,60302r=0,60302r = 0.60302 Si et sont alors et que l'équation devient où et , elle a également …
Je suis un R noob qui est tenu de faire divers types d'analyses sur de grands ensembles de données dans R. Donc, en regardant autour de ce site et ailleurs, il m'a semblé qu'il y avait beaucoup de problèmes ésotériques et moins connus impliqués ici - comme quel package utiliser …
Utilisateur débutant de R aux prises avec une ANOVA de mesures répétées. J'ai un ensemble de données qui comprend un facteur entre les sujets avec 4 niveaux (codé dans une seule variable appelée «groupes») et un facteur entre les sujets avec 4 niveaux (codé en quatre variables distinctes «DV1», «DV2», …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.