Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
Quand j'ai entendu parler du prieur des Jeffreys dans ma classe d'inférence en statistique, mes professeurs ont fait un peu penser que c'était intéressant surtout pour des raisons historiques plutôt que parce que n'importe qui l'utiliserait jamais. Puis, quand j'ai fait l'analyse des données bayésiennes, on ne nous a jamais …
Étant donné la formule d'estimation MAP d'un paramètre Pourquoi une approche MCMC (ou similaire) est-elle nécessaire, ne pourrais-je pas simplement prendre la dérivée, la mettre à zéro, puis résoudre le paramètre?
Je pense à quelque chose depuis un certain temps maintenant, et comme je ne suis pas très compétent en théorie des probabilités, je pensais que cela pourrait être un bon endroit pour poser cette question. C'est quelque chose qui m'est venu dans les longues files d'attente des transports publics. Supposons …
J'utilise le processus gaussien (GP) pour la régression. Dans mon problème, il est assez courant que deux ou plusieurs points de données soient proches l'un de l'autre, relativement aux échelles de longueur du problème. De plus, les observations peuvent être extrêmement bruyantes. Pour accélérer les calculs et améliorer la précision …
Si une équipe de chercheurs effectue plusieurs tests (d'hypothèse) sur un ensemble de données donné, il existe un volume de littérature affirmant qu'ils devraient utiliser une certaine forme de correction pour les tests multiples (Bonferroni, etc.), même si les tests sont indépendants. Ma question est la suivante: cette même logique …
Je sais que nous utilisons pour estimer la variance d'une population. Je me souviens d'une vidéo de Khan Academy où l'intuition donnée était que notre moyenne estimée est probablement un peu différente de la réelle, de sorte que les distances seraient en fait plus grandes, donc nous divisons par moins …
J'utilise PyMC3 pour exécuter des modèles bayésiens sur mes données. Je suis nouveau dans la modélisation bayésienne mais selon certains articles de blogs , Wikipedia et QA de ce site, il semble que ce soit une approche valable pour utiliser le facteur Bayes et le critère BIC pour pouvoir choisir …
J'ai identifié plusieurs endroits dans les manuels où le GLM est décrit avec 5 distributions (à savoir, Gamma, gaussienne, binomiale, gaussienne inverse et Poisson). Ceci est également illustré dans la fonction familiale dans R. Parfois, je rencontre des références au GLM où des distributions supplémentaires sont incluses ( exemple ). …
Je dois avouer que je n'avais jamais entendu parler de ce terme dans aucune de mes classes, de premier cycle ou de cycle supérieur. Que signifie qu'une régression logistique soit bayésienne? Je cherche une explication avec une transition de la logistique régulière à la logistique bayésienne similaire à la suivante: …
Je passe par la section LAB §6.6 sur Ridge Regression / Lasso dans le livre 'An Introduction to Statistical Learning with Applications in R' de James, Witten, Hastie, Tibshirani (2013). Plus précisément, j'essaie d'appliquer le Ridgemodèle scikit-learn au jeu de données «Hitters» du package R «ISLR». J'ai créé le même …
Je voudrais simuler un processus d'excursion brownienne (un mouvement brownien conditionné est toujours positif quand à à ). Puisqu'un processus d'excursion brownienne est un pont brownien qui est conditionné pour être toujours positif, j'espérais simuler le mouvement d'une excursion brownienne en utilisant un pont brownien.0 t = 10 < t …
J'ai ajusté un modèle linéaire général dont la probabilité logarithmique est .L uy= β0+ β1X1+ β2X2+ β3X3,y=β0+β1X1+β2X2+β3X3,y=\beta_0+\beta_1x_1+\beta_2x_2+\beta_3x_3,LuLuL_u Maintenant, je souhaite tester si les coefficients sont les mêmes. Tout d'abord, test global : la probabilité logarithmique du modèle réduit est . Par test de rapport de vraisemblance, le modèle complet est …
Ceci est similaire à Bootstrap: l'estimation est en dehors de l'intervalle de confiance J'ai quelques données qui représentent le nombre de génotypes dans une population. Je veux estimer la diversité génétique à l'aide de l'indice de Shannon et générer également un intervalle de confiance à l'aide du bootstrap. J'ai remarqué, …
Je lis le document de théorie de Doug Bates sur le package lme4 de R pour mieux comprendre les moindres détails des modèles mixtes, et suis tombé sur un résultat intrigant que j'aimerais mieux comprendre, à propos de l'utilisation du maximum de vraisemblance restreint (REML) pour estimer la variance . …
Ici, je demande ce que les autres font couramment pour utiliser le test du chi carré pour la sélection des fonctionnalités par rapport au résultat de l'apprentissage supervisé. Si je comprends bien, testent-ils l'indépendance entre chaque fonctionnalité et le résultat, et comparent-ils les valeurs de p entre les tests pour …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.