Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
Je modélise un événement avec deux résultats, a et b. J'ai créé un modèle qui estime la probabilité que a ou b se produise (c'est-à-dire que le modèle calculera que a se produira avec 40% de chance et b se produira avec 60% de chance). J'ai un grand dossier de …
J'ai récemment suivi un cours d'introduction à la modélisation multi-niveaux. La plupart des ensembles de données et des exemples que nous avons utilisés provenaient des sciences sociales. Je viens de faire un stage de 2 semaines dans un service de biostatistique, où ils veulent que je démarre un projet concernant …
Quelles sont les meilleures méthodes pour ajuster le «mode» des données échantillonnées à partir d'une distribution continue? Étant donné que le mode est techniquement indéfini (non?) Pour une distribution continue, je me demande vraiment `` comment trouvez-vous la valeur la plus courante ''? Si vous supposez que la distribution parente …
Quelle est la meilleure fonction de coût pour un arbre forestier aléatoire: indice de Gini ou entropie? J'essaie d'implémenter une forêt aléatoire à Clojure.
Si nous souhaitons effectuer un test t par paires, l'exigence est (si je comprends bien) que la différence moyenne entre les unités de mesure appariées soit distribuée normalement. Dans le test t apparié, cela est articulé (AFAIK) dans la demande que la différence entre les unités de mesure appariées soit …
En règle générale, lorsque l'on rencontre des mesures de résultats continues mais asymétriques dans un plan longitudinal (par exemple, avec un effet inter-sujets), l'approche courante consiste à transformer le résultat en normalité. Si la situation est extrême, comme dans le cas d'observations tronquées, on peut se montrer fantaisiste et utiliser …
Y a-t-il un analogue aux inégalités du moment supérieur de Tchebychev dans le cas unilatéral? L'inégalité de Chebyshev-Cantelli ne semble fonctionner que pour la variance, tandis que l'inégalité de Chebyshev peut facilement être produite pour tous les exposants. Quelqu'un connaît-il une inégalité unilatérale en utilisant les moments supérieurs?
Si le Hosmer-Lemeshow indique un manque d'ajustement mais l'AIC est le plus bas de tous les modèles .... devriez-vous toujours utiliser le modèle? Si je supprime une variable, la statistique Hosmer-Lemeshow n'est pas significative (ce qui signifie qu'il n'y a pas de manque brutal d'ajustement). Mais l'AIC augmente. Edit : …
J'essaie de comprendre comment l'algorithme Lars peut être modifié pour générer Lasso. Bien que je comprenne le LARS, je ne suis pas en mesure de voir la modification au Lasso de l'article de Tibshirani et al. En particulier, je ne vois pas pourquoi la condition de signe en ce que …
Par exemple. tels que ceux sur cette page http://store.steampowered.com/hwsurvey Y a-t-il un logiciel prêt à l'emploi qui peut le faire? Sinon, des recommandations pour d'autres logiciels qui font quelque chose de similaire? Je sais que ce n'est pas vraiment une question de statistiques, mais je suis très convaincu que les …
Je suis curieux de connaître l'implémentation pratique d'une division binaire dans un arbre de décision - en ce qui concerne les niveaux d'un prédicteur catégorique .XjXjX{j} Plus précisément, j'utilise souvent une sorte de schéma d'échantillonnage (par exemple, ensachage, suréchantillonnage, etc.) lors de la construction d'un modèle prédictif à l'aide d'un …
Vous avez donc décidé de soutenir l'idée d'une recherche reproductible et souhaitez rendre vos données disponibles en ligne pour que les gens puissent les voir et les utiliser. La question est, où l'hébergez-vous? Ma première inclination est bien sûr l'espace Web privé que j'ai sur un serveur universitaire, mais ces …
J'essaie de construire un SVM à partir de données de formation où un groupe est représenté plus que l'autre. Cependant, les groupes seront également représentés dans les éventuelles données de test. Par conséquent, je voudrais utiliser le class.weightsparamètre de l' e1071interface du package R libsvmpour équilibrer l'influence des deux groupes …
Comment puis-je approximer l'intégrale suivante à l'aide de la simulation MC? ∫1- 1∫1- 1| x-y|d xd y∫−11∫−11|x−y|dxdy \int_{-1}^{1} \int_{-1}^{1} |x-y| \,\mathrm{d}x \,\mathrm{d}y Merci! Modifier (un certain contexte): j'essaie d'apprendre à utiliser la simulation pour approximer les intégrales et je m'entraîne quand j'ai rencontré des difficultés. Edit 2 + 3 : …
Je cherche à modéliser certaines données, mais je ne sais pas quel type de modèle je peux utiliser. J'ai des données de comptage et je veux un modèle qui donnera des estimations paramétriques de la moyenne et de la variance des données. Autrement dit, j'ai divers facteurs prédictifs et je …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.