Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
Je me familiarise avec les statistiques bayésiennes en lisant le livre Doing Bayesian Data Analysis , de John K. Kruschke, également connu sous le nom de "chiot livre". Dans le chapitre 9, des modèles hiérarchiques sont présentés avec cet exemple simple: et les observations de Bernoulli sont de 3 pièces, …
Le rapport de deux distributions normales indépendantes donne une distribution de Cauchy. La distribution t est une distribution normale divisée par une distribution chi carré indépendante. Le rapport de deux distributions khi-deux indépendantes donne une distribution F. Je recherche un rapport de distributions continues indépendantes qui donne une variable aléatoire …
Je travaille avec des modèles GBM en utilisant le package caret et cherche à trouver une méthode pour résoudre les intervalles de prédiction pour mes données prédites. J'ai beaucoup cherché, mais je n'ai trouvé que quelques idées pour trouver des intervalles de prédiction pour Random Forest. Tout code d'aide / …
Je voudrais appliquer la fonction de base gaussienne dans une implémentation de régression linéaire. Malheureusement, j'ai du mal à comprendre quelques paramètres dans la fonction de base. Plus précisément et .σμμ\muσσ\sigma Mon ensemble de données est une matrice de 10 000 x 31. 10 000 échantillons et 31 fonctionnalités. J'ai …
Pour une partie d'une question de devoirs, on m'a demandé de calculer la moyenne ajustée pour un ensemble de données en supprimant l'observation la plus petite et la plus grande, et d'interpréter le résultat. La moyenne ajustée était inférieure à la moyenne non ajustée. Mon interprétation était que c'était parce …
(J'ai posté une question similaire sur math.se. ) En géométrie de l'information, le déterminant de la matrice d'information de Fisher est une forme volumique naturelle sur une variété statistique, donc elle a une belle interprétation géométrique. Le fait qu'il apparaisse dans la définition d'un a priori de Jeffreys, par exemple, …
R version 3.1.1 (2014-07-10) -- "Sock it to Me" > bl <- c(140, 138, 150, 148, 135) > fu <- c(138, 136, 148, 146, 133) > t.test(fu, bl, alternative = "two.sided", paired = TRUE) Error in t.test.default(fu, bl, alternative = "two.sided", paired = TRUE) : data are essentially constant Ensuite, …
Je connais mieux R et j'essaie d'estimer les pentes aléatoires (coefficients de sélection) pour environ 35 individus sur 5 ans pour quatre variables d'habitat. La variable de réponse est de savoir si un emplacement a été «utilisé» (1) ou «disponible» (0) de l'habitat («utilisation» ci-dessous). J'utilise un ordinateur Windows 64 …
Je travaille sur les statistiques des builds de logiciels. J'ai des données pour chaque build sur réussite / échec et le temps écoulé et nous générons ~ 200 de ces / semaine. Le taux de réussite est facile à agréger, je peux dire que 45% ont réussi une semaine donnée. …
Résumé: Existe - t-il une théorie statistique pour soutenir l'utilisation de la distribution (avec des degrés de liberté basés sur la déviance résiduelle) pour les tests des coefficients de régression logistique, plutôt que la distribution normale standard?ttt Il y a quelque temps, j'ai découvert qu'en ajustant un modèle de régression …
J'ai une question / confusion sur les séries stationnaires requises pour la modélisation avec ARIMA (X). Je pense plus à cela en termes d'inférence (effet d'une intervention), mais j'aimerais savoir si la prévision par rapport à l'inférence fait une différence dans la réponse. Question: Toutes les ressources introductives que j'ai …
J'essaie de comprendre le package de médiation dans R, en utilisant la vignette du package. J'ai du mal à comprendre la sortie de la mediate()fonction. require("mediation") require("sandwich") data("framing") med.fit <- lm(emo ~ treat + age + educ + gender + income, data = framing) out.fit <- glm(cong_mesg ~ emo + …
Je vois souvent des gens qui font d'une dimension / caractéristique d'un ensemble de données une moyenne nulle en supprimant la moyenne de tous les éléments. Mais je n'ai jamais compris pourquoi le faire? Quel effet cela fait-il en tant qu'étape de prétraitement? Améliore-t-il les performances de classification? Cela aide-t-il …
J'ai souvent vu des ensembles de données discrets tracés comme des tracés linéaires, mais il me semble que la ligne infère une valeur à un point entre les intervalles de mesure, ce qui n'a pas de sens pour les ensembles de données discrets. Est-ce donc le cas que l'utilisation des …
Je suis assistante de recherche pour un laboratoire (bénévole). Moi et un petit groupe avons été chargés de l'analyse des données pour un ensemble de données tirées d'une grande étude. Malheureusement, les données ont été collectées avec une application en ligne, et elle n'était pas programmée pour produire les données …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.