Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
J'ai une question que je voudrais poser à la communauté. On m'a récemment demandé de fournir une analyse statistique pour une étude pronostique des marqueurs tumoraux . J'ai principalement utilisé ces deux références pour guider mon analyse: McShane LM et al. Rapports de recommandations pour les études pronostiques des marqueurs …
Supposons que nous ayons nnn points dans un rectangle avec lié [ 0 , a ] × [ 0 , b ][0,a]×[0,b][0,a] \times [0,b], et ces points sont uniformément répartis dans ce plan. (Je ne connais pas très bien les statistiques, donc je ne connais pas la différence entre choisir …
De nombreux manuels et articles ont déclaré que l'interception ne devait pas être supprimée. Récemment, j'ai utilisé un ensemble de données d'apprentissage pour construire un modèle de régression linéaire avec ou sans interception. J'ai été surpris de constater que le modèle sans interception prédit mieux que celui avec une interception …
J'utilise la régression Softmax pour un problème de classification multi-classes. Je n'ai pas de probabilités antérieures égales pour chacune des classes. Je sais par régression logistique (régression softmax avec 2 classes) que les probabilités antérieures des classes sont implicitement ajoutées au biais ( ).log(p0/p1)log(p0/p1)\log(p_0/p_1) Habituellement, ce que je fais est …
Je recherche un bon ouvrage de référence en épidémiologie. J'ai Rothman's Epidemiology: An introduction et Porta's A Dictionary of Epidemiology . Rothman était une grosse déception car il est très simpliste et manque de tout ce qui est au-delà de l'évidence après les études de base. J'ai entendu dire que …
Comment un classificateur d'ensemble fusionne-t-il les prédictions de ses classificateurs constituants? J'ai du mal à trouver une description claire. Dans certains exemples de code que j'ai trouvés, l'ensemble fait simplement la moyenne des prédictions, mais je ne vois pas comment cela pourrait rendre possible une "meilleure" précision globale. Considérez le …
Certains où j'ai lu une note que si vous avez beaucoup de paramètres et que vous essayez de trouver une "métrique de similitude" entre ces vecteurs, vous pouvez avoir une "malédiction de dimensioalité". Je crois que cela signifiait que la plupart des scores de similitude seront égaux et ne vous …
Je teste la différence dans un résultat continu sous trois conditions différentes. Sous condition, l'IA mesure le résultat. Je le fais deux fois pour le même échantillon. Des exemples de valeurs pourraient être 2.2, 2.1. Ce sont des répliques "techniques" qui proviennent de la même source biologique Je fais de …
J'ai reçu un ensemble de 20 articles de Likert (allant de 1 à 5, taille d'échantillon n = 299) dans le domaine de la recherche organisationnelle. Les articles sont destinés à mesurer un concept latent qui est multidimensionnel, multiforme et hétérogène dans sa nature même. Le but est de créer …
J'essaie de déterminer une méthode pour comparer une série chronologique particulière à environ 10 000+ séries chronologiques de référence par programme, et de présélectionner ces séries chronologiques de référence qui peuvent être intéressantes. La méthode que j'utilisais était la corrélation de Pearson . Pour chacune des séries chronologiques de référence, …
Les données sur la proportion, le rapport et le pourcentage sont très courantes en écologie (par exemple,% de fleurs pollinisées, sex-ratio mâle: femelle,% de mortalité en réponse à un traitement,% de feuilles mangées par un herbivore). Un article a été récemment publié par des statisticiens appliqués dans la revue Ecology …
J'ai essayé d'utiliser R pour s'adapter à certains modèles longitudinaux, principalement via lmeret nlmepackages. Cependant, il semble que de nombreux modèles standard font défaut, tels que les modèles d'antidépendance ou les modèles analytiques factoriels pour les matrices de covariance. Ces modèles sont facilement disponibles dans SAS. Quelqu'un recommanderait-il d'autres packages …
J'ai rencontré une condition nécessaire sur une distribution de probabilité continue définie sur et je me demande si elle a un nom. Pour une distribution avec CDF et pdf j'ai besoin que la quantité: soit monotone non croissante. En mettant la condition sous une autre forme (en prenant des dérivées), …
Cela peut être une question élémentaire, c'est pourquoi je n'ai pas pu le trouver sur Stackexchange ou Mathoverflow, mais j'ai des problèmes avec l'arithmétique impliquée dans la mise à jour des probabilités en utilisant le théorème de Bayes pour un problème sur lequel je travaille. Contexte: J'essaie de donner des …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.