Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
La théorie du score de propension (PS) suggère qu'il ne devrait être utilisé que pour l'étude de cohorte car PS correspond aux groupes "traités / exposés" aux groupes "non traités / non exposés". Cependant, les cas et les témoins sont les résultats (et non les expositions) d'une étude cas-témoins. Quels …
Des recherches récentes ont tenté de déterminer si certaines constructions psychologiques sont de dimension latente ou taxoniques (c'est-à-dire, y compris les taxons ou les classes). Par exemple, les chercheurs pourraient être intéressés à découvrir s'il existe une certaine «classe» de personnes qui sont plus susceptibles de développer une douleur chronique …
Ma compréhension de l'approche bootstrap est basée sur le cadre de Wasserman (presque mot pour mot): Soit une statistique ( est l'échantillon iid tiré de la distribution ). Supposons que nous voulons estimer - la variance de donné .Tn=g(X1,...,Xn)Tn=g(X1,...,Xn)T_n = g(X_1, ..., X_n)XiXiX_iFFFVF(Tn)VF(Tn)V_F(T_n)TnTnT_nFFF L'approche bootstrap suit ces deux étapes: Estimer …
Il est connu que le bootstrap peut échouer. J'ai lu dans la section 6 de Bickel et Freedman (1981) que le bootstrap échoue lorsque vous voulez l'utiliser pour évaluer le MLE pour estimer le paramètre d'une distribution uniforme continue. J'ai lu la section 7.4 du livre d'Efron et Tibshirani, mais …
Je suis tout nouveau en statistiques et j'étudie les mathématiques derrière les tests fractionnés (A / B et multivariés). J'ai appris à calculerχ2χ2\chi^2avec des données de test données, et je comprends comment traduire cela en probabilité via une table, mais j'aimerais pouvoir calculer la probabilité moi-même. J'ai lu quelques explications …
Je me souviens avoir vu / lu quelque part que pour les SVM multiclasses avec des données non équilibrées, il y avait un moyen de déterminer les poids de classe à partir des données de formation (plutôt que la validation X). Quelqu'un sait-il quelle est la méthode ou de quel …
Le G-Test est un moyen d'obtenir des estimations rapides d'une distribution chi au carré, et est recommandé par l'auteur de ce tutoriel de test A / B bien connu . Cet outil suppose une distribution normale et utilise la différence de moyens pour calculer la confiance. Quelle est la différence …
Les algorithmes de stimulation, tels que AdaBoost , combinent plusieurs classificateurs «faibles» pour former un seul classificateur plus fort. Bien qu'en théorie, le renforcement devrait être possible avec n'importe quel classificateur de base, en pratique, il semble que les classificateurs basés sur des arbres soient les plus courants. Pourquoi est-ce? …
Je ne comprends pas comment interpréter le coefficient d'une régression de Poisson par rapport au coefficient d'une régression OLS. Supposons que j'ai des données de séries chronologiques, ma variable de gauche est le nombre de matchs gagnés par an et ma principale variable de droite est la valeur NASDAQ. Si …
Supposons que j'ai construit un système de recommandation qui (étant donné, par exemple, le classement des films ou celui de nombreux utilisateurs) produira une liste de 10 films recommandés pour chaque utilisateur à regarder. Imaginez que j'ai également un grand nombre d'articles de film, ainsi qu'un journal des notes des …
Y a-t-il une limite qui est la moins acceptable lors de l'utilisation de l'imputation multiple (MI)? Par exemple, puis-je utiliser MI si les valeurs manquantes dans une variable représentent 20% des cas alors que d'autres variables ont des valeurs manquantes mais pas à un niveau aussi élevé?
Chaque fois que je lis sur les mesures répétées ou la conception intra-sujets dans différents livres et sur des pages Web, l'exemple qui est toujours évoqué est une sorte de conception de mesures longitudinales ou répétées (par exemple, les personnes sont mesurées sur la même échelle plusieurs fois dans la …
Soit , , ..., iid RV avec une plage mais une distribution inconnue. (Je suis d'accord avec l'hypothèse que la distribution est continue, etc., si nécessaire.)X1X1X_1X2X2X_2XnXnX_n[0,1][0,1][0,1] Définissez .Sn=X1+⋯+XnSn=X1+⋯+XnS_n = X_1 + \cdots + X_n On me donne et je demande: que puis-je déduire, de manière bayésienne, à propos de ?SkSkS_kSnSnS_n …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.