Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
Ceci est un extrait de "Statistiques mathématiques modernes avec applications" de Devore et al. Ce qui m'intrigue, c'est que l'estimateur ne peut s'empêcher d'être dépendant de , puisque l'échantillon dépend du paramètre.θθ\theta
Je mène des recherches sur la relation entre le rang de naissance d'une personne et le risque ultérieur d'obésité en utilisant les données de plusieurs cohortes de naissance d'un an (par exemple http://www.ncbi.nlm.nih.gov/pmc/articles/PMC2908417/ ). Un défi majeur est que l'ordre de naissance est lié à d'autres caractéristiques telles que l'âge …
J'ai une question très basique sur le clustering. Après avoir trouvé k clusters avec leurs centroïdes, comment dois-je procéder pour interpréter les classes des points de données que j'ai groupés (en attribuant des étiquettes de classe significatives à chaque cluster). Je ne parle pas de validation des clusters trouvés. Peut-on …
Je me demande si quelqu'un pourrait donner un aperçu de la raison pour laquelle l'imputation des données manquantes est meilleure que de simplement construire différents modèles pour les cas avec des données manquantes. Surtout dans le cas des modèles linéaires [généralisés] (je peux peut-être voir dans les cas non linéaires …
Pour un problème de régression logistique bayésienne, j'ai créé une distribution prédictive postérieure. J'échantillonne à partir de la distribution prédictive et reçois des milliers d'échantillons de (0,1) pour chaque observation que j'ai. Visualiser la qualité de l'ajustement est loin d'être intéressant, par exemple: Ce graphique montre les 10 000 échantillons …
J'ai une formation en programmation informatique et en théorie des nombres élémentaires, mais aucune formation en statistique réelle, et j'ai récemment "découvert" que le monde étonnant de toute une gamme de techniques est en fait un monde statistique. Il semble que les factorisations matricielles, l'achèvement de la matrice, les tenseurs …
Une façon de trouver la précision du modèle de régression logistique à l'aide de «glm» consiste à trouver le tracé AUC. Comment vérifier la même chose pour le modèle de régression trouvé avec la variable de réponse continue (famille = «gaussienne»)? Quelles méthodes sont utilisées pour vérifier dans quelle mesure …
Soit observations tirées d'une distribution de probabilité inconnue (mais certainement asymétrique).{ x1, … , XN}{X1,…,XN}\{x_1,\ldots,x_N\} Je voudrais trouver la distribution de probabilité en utilisant l'approche KDE: Cependant, j'ai essayé d'utiliser un noyau gaussien, mais il a mal fonctionné, car il est symétrique. Ainsi, j'ai vu que certains travaux sur les …
Étant donné une pièce avec un biais inconnu , comment puis-je générer des variations - aussi efficacement que possible - qui sont distribuées par Bernoulli avec une probabilité de 0,5? Autrement dit, en utilisant le nombre minimum de flips par variable générée.ppp
J'ai un peu de mal à comprendre les lignes pointillées bleues dans l'image suivante de la fonction d'autocorrélation: Quelqu'un pourrait-il me donner une explication simple, ce qu'ils me disent?
Je voudrais savoir comment interpréter correctement les graphiques de densité conditionnelle. J'en ai inséré deux ci-dessous que j'ai créé en R avec cdplot. Par exemple, la probabilité que le résultat soit égal à 1 lorsque Var 1 est 150 est-elle d'environ 80%? La zone gris foncé est celle qui est …
Je fais actuellement une analyse sur un site Web qui nécessite que je crée un diagramme d'arbre de décision montrant la route probable que les gens prennent chaque fois qu'ils arrivent sur le site Web. Je traite un data.framequi montre les chemins de tous les clients vers le site, à …
J'ai du mal à comprendre quelle est la différence entre le krigeage et les processus gaussiens. Je veux dire que wiki dit qu'ils sont les mêmes, mais leurs formules de prédiction sont tellement différentes. Je suis un peu confus pourquoi ils sont appelés similaires. Des clarifications?
Les méthodes d'ensemble basées sur des arbres telles que la forêt aléatoire et les dérivés subséquents (par exemple, la forêt conditionnelle), prétendent toutes être utiles dans les problèmes dits «petits n , grands p », pour identifier l'importance relative des variables. En effet, cela semble être le cas, mais ma …
Disons que je fais 10 000 tours d'une pièce. Je voudrais connaître la probabilité du nombre de flips nécessaires pour obtenir 4 têtes consécutives ou plus d'affilée. Le décompte fonctionnerait comme suit, vous compteriez un tour de flips successifs étant seulement des têtes (4 têtes ou plus). Quand une queue …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.