Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
J'essaie d'apprendre quelques statistiques en utilisant le livre, Biometry by Sokal and Rohlf (3e). Il s'agit d'un exercice du 5ème chapitre qui couvre la probabilité, la distribution binomiale et la distribution de Poisson. Je me rends compte qu'il existe une formule pour produire une réponse à cette question: Cependant, cette …
J'essaie simplement de recalculer avec dnorm () la log-vraisemblance fournie par la fonction logLik à partir d'un modèle lm (dans R). Cela fonctionne (presque parfaitement) pour un grand nombre de données (par exemple n = 1000): > n <- 1000 > x <- 1:n > set.seed(1) > y <- 10 …
Dans de nombreux algorithmes d'apprentissage automatique, la mise à l'échelle des fonctionnalités (aka mise à l'échelle variable, normalisation) est une étape de pré-traitement courante Wikipedia - Mise à l'échelle des fonctionnalités - cette question était proche Question # 41704 - Comment et pourquoi la normalisation et la mise à l'échelle …
Au cours des dernières années, divers chercheurs ont soulevé un problème préjudiciable de test d'hypothèse scientifique, surnommé "degré de liberté du chercheur", ce qui signifie que les scientifiques ont de nombreux choix à faire lors de leur analyse qui biaisent vers la recherche avec une valeur p <5%. Ces choix …
Je suis confus quant à la formule correcte pour les degrés approximatifs de liberté à utiliser pour le test t de Welch. La formule de Satterthwaite (1946) est la formule la plus citée, mais Welch a donné une alternative en 1947. Je ne sais pas laquelle est préférable (ou utilisée …
Je lis un article qui montre les risques pour les variables continues, mais je ne sais pas comment interpréter les valeurs données. Ma compréhension actuelle des ratios de risque est que le nombre représente la probabilité relative de [événement] dans certaines conditions. Par exemple: si le rapport de risque de …
Configuration du problème L'un des premiers problèmes de jouets auquel j'ai voulu appliquer PyMC est le clustering non paramétrique: étant donné certaines données, modélisez-le comme un mélange gaussien et apprenez le nombre de clusters et la moyenne et la covariance de chaque cluster. La plupart de ce que je sais …
Quelles sont les étapes de l'utilisation des filtres de Kalman dans les modèles d'espace d'état? J'ai vu quelques formulations différentes , mais je ne suis pas sûr des détails. Par exemple, Cowpertwait commence par cet ensemble d'équations: θt=Gtθt-1+wtyt=F′tθt+vtyt=Ft′θt+vty_{t} = F^{'}_{t}\theta_{t}+v_{t} θt=Gtθt−1+wtθt=Gtθt−1+wt\theta_{t} = G_{t}\theta_{t-1}+w_{t} où et , sont nos estimations inconnues …
Voici la description de mon étude. J'expérimente avec trois plantes: A, B et C. Ces plantes sont censées réduire la glycémie des patients diabétiques. Je veux déterminer laquelle de ces trois plantes a un effet plus long sur la réduction de la glycémie après une seule administration à des souris. …
J'ai 3 à 5 mesures d'un trait par individu dans deux conditions différentes (A et B). Je trace la moyenne de chaque individu dans chaque condition et j'utilise l'erreur standard ( c. -à- d . , avecN= nombre de mesures) sous forme de barres d'erreur.SD/N−−√SD/NSD/\sqrt{N}NNN Maintenant, je veux tracer la …
Est-il judicieux de calculer des intervalles de confiance et de tester des hypothèses lorsque des données de l'ensemble de la population sont disponibles? À mon avis, la réponse est non, car nous pouvons calculer avec précision les vraies valeurs des paramètres. Mais alors, quelle est la proportion maximale de données …
Je suis tombé sur une question simple sur la comparaison des modèles flexibles (c'est-à-dire des splines) et des modèles inflexibles (par exemple la régression linéaire) dans différents scénarios. La question est: En général, nous attendons-nous à ce que les performances d'une méthode d'apprentissage statistique flexible soient meilleures ou moins bonnes …
Je suis intéressé par une bonne référence pour les résultats concernant les propriétés asymptotiques des estimateurs du maximum de vraisemblance. Considérons un modèle où est une densité à dimensions, et est le MLE basé sur un exemple de où est la "vraie" valeur de . Il y a deux irrégularités …
Je lis des pages Web pour des tests d'adéquation, quand je suis arrivé au test d'Anderson – Darling et au critère de Cramér – von Mises . Jusqu'à présent, j'ai compris; il semble que le test d'Anderson – Darling et le critère de Cramér – von Mises soient similaires, simplement …
Un instrument utilisé pour mesurer les niveaux de glucose dans le sang d'une personne est surveillé sur un échantillon aléatoire de 10 personnes. Les niveaux sont également mesurés à l'aide d'une procédure de laboratoire très précise. La mesure de l'instrument est notée x. La mesure de la procédure de laboratoire …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.