Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
Une façon de résumer la comparaison de deux courbes de survie est de calculer le rapport de risque (HR). Il existe (au moins) deux méthodes pour calculer cette valeur. Méthode Logrank. Dans le cadre des calculs de Kaplan-Meier, calculer le nombre d'événements observés (décès, généralement) dans chaque groupe ( OaOaOa …
J'essaie de savoir comment effectuer des tests d'hypothèse sur une régression linéaire (l'hypothèse nulle étant sans corrélation). Chaque guide et page sur le sujet que je rencontre semble utiliser un test t. Mais je ne comprends pas ce que signifie réellement le test t pour la régression linéaire. Un test …
Je suis à la recherche de priors non informatifs pour la distribution bêta pour travailler avec un processus binomial (Hit / Miss). Au début, j'ai pensé à utiliser α=1,β=1α=1,β=1\alpha=1, \beta=1 qui génèrent un PDF uniforme, ou Jeffrey avant α=0.5,β=0.5α=0.5,β=0.5\alpha=0.5, \beta=0.5 . Mais je recherche en fait des prieurs qui ont …
En pratique, l'utilisation d'un test T standard pour vérifier la signification d'un coefficient de régression linéaire est une pratique courante. La mécanique du calcul a du sens pour moi. Pourquoi la distribution T peut-elle être utilisée pour modéliser la statistique de test standard utilisée dans les tests d'hypothèse de régression …
J'ai un ensemble de 150 fonctionnalités, et beaucoup d'entre elles sont fortement corrélées les unes aux autres. Mon objectif est de prédire la valeur d'une variable discrète, dont la plage est 1-8 . La taille de mon échantillon est de 550 et j'utilise une validation croisée 10 fois . AFAIK, …
Existe-t-il des méthodes de clustering "non paramétriques" pour lesquelles nous n'avons pas besoin de spécifier le nombre de clusters? Et d'autres paramètres comme le nombre de points par cluster, etc.
Comment procéder pour calculer un postérieur avec un N ~ (a, b) antérieur après avoir observé n points de données? Je suppose que nous devons calculer la moyenne et la variance de l'échantillon des points de données et faire une sorte de calcul qui combine le postérieur avec le précédent, …
Si les données sont 1d, la variance montre dans quelle mesure les points de données sont différents les uns des autres. Si les données sont multidimensionnelles, nous obtiendrons une matrice de covariance. Existe-t-il une mesure qui donne un nombre unique de différences entre les points de données les uns des …
J'ai des données de densité de poisson que j'essaie de comparer entre plusieurs techniques de collecte différentes, les données ont beaucoup de zéros et l'histogramme semble approprié pour une distribution de poisson, sauf que, comme densités, ce ne sont pas des données entières. Je suis relativement nouveau dans les GLM …
Disons que j'ai des données, puis j'ajuste les données avec un modèle (une régression non linéaire). Ensuite, je calcule le R au carré ( ).R2R2R^2 Lorsque le R au carré est négatif, qu'est-ce que cela signifie? Est-ce à dire que mon modèle est mauvais? Je sais que la plage de …
Un groupe de personnes répond à une question. La réponse peut être "oui" ou "non". Le chercheur souhaite savoir si l'âge est associé au type de réponse. L'association a été évaluée en effectuant une régression logistique où l'âge est la variable explicative et le type de réponse (oui, non) est …
Les graphiques acycliques dirigés (DAG; par exemple, Groenland, et al, 1999) font partie d'un formalisme d'inférence causale à partir de l'interprétation contrefactuelle du camp de causalité. Dans ces graphiques, la présence d'une flèche de la variable à la variable B affirme que la variable A provoque directement (une certaine variation …
Il y a quelques jours, un de mes psychologues-chercheurs m'a parlé de sa méthode pour sélectionner des variables dans un modèle de régression linéaire. Je suppose que ce n'est pas bon, mais je dois demander à quelqu'un d'autre de m'en assurer. La méthode est: Examinez la matrice de corrélation entre …
Je fais des études d'association GWAS SNP sur les maladies en utilisant un logiciel appelé plink ( http://pngu.mgh.harvard.edu/~purcell/plink/download.shtml ). Avec les résultats d'association, j'obtiens des valeurs de p pour tous les SNP qui ont été analysés. Maintenant, j'utilise un tracé QQ de ces valeurs de p pour montrer si une …
Dans R, j'utilise la ldafonction de la bibliothèque MASSpour faire la classification. Si je comprends bien LDA, l'entrée verra attribuer l'étiquette , ce qui maximisera p (y | x) , non?XXxyyyp ( y| x)p(y|X)p(y|x) Mais quand le modèle, dans lequel y = Direction, je ne comprends pas très bien la …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.