Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
Une forêt aléatoire est une collection d' arbres de décision formés en sélectionnant de manière aléatoire uniquement certaines fonctionnalités avec lesquelles construire chaque arbre (et parfois en ensachant les données d'entraînement). Apparemment, ils apprennent et se généralisent bien. Quelqu'un a-t-il effectué un échantillonnage MCMC de l'espace de l'arbre de décision …
J'essaie d'exécuter une régression zéro gonflée pour une variable de réponse continue dans R. Je connais une implémentation gamlss, mais j'aimerais vraiment essayer cet algorithme de Dale McLerran qui est conceptuellement un peu plus simple. Malheureusement, le code est en SAS et je ne sais pas comment le réécrire pour …
Disons que j'ai un ami (appelons-le "George") qui dit qu'il peut contrôler le lancer de dés en utilisant son esprit (c'est-à-dire, rendre les dés plus susceptibles de tomber sur un nombre spécifique auquel il pense). Comment puis-je concevoir un test scientifiquement rigoureux pour déterminer s'il peut réellement le faire? (Je …
Dans un article que j'ai écrit, je modélise les variables aléatoires et plutôt que et pour éliminer efficacement les problèmes qui surviennent lorsque et sont fortement corrélés et ont une variance égale (comme ils le sont dans mon application). Les arbitres veulent que je donne une référence. Je pourrais facilement …
J'ai fouillé un peu dans les archives de Cross Validated et je n'ai pas semblé trouver de réponse à ma question. Ma question est la suivante: Wikipedia donne trois hypothèses qui doivent être vérifiées pour le test de classement signé de Wilcoxon (légèrement modifié pour mes questions): Soit Zi = …
Le contexte Je veux planter le décor avant d'étendre quelque peu la question. J'ai des données longitudinales, des mesures sont prises sur des sujets environ tous les 3 mois, le résultat principal est numérique (comme en continu à 1dp) dans la plage de 5 à 14, la masse (de tous …
Supposons que vous ayez un ensemble de données d'une distribution continue avec une densité supportée sur qui n'est pas connue, mais est assez grand donc une densité de noyau (par exemple) l'estimation, , est assez précise. Pour une application particulière, je dois transformer les données observées en un nombre fini …
Mes données sont les suivantes. J'ai deux groupes de patients. Les patients de chaque groupe ont subi un type différent de chirurgie oculaire. 5 variables ont été mesurées sur les patients de chaque groupe. Je veux comparer ces variables entre les deux groupes en utilisant un test de permutation ou …
Fermé. Cette question est hors sujet . Il n'accepte pas actuellement les réponses. Voulez-vous améliorer cette question? Mettez à jour la question afin qu'elle soit sur le sujet pour la validation croisée. Fermé l'année dernière . J'utilise la décomposition vectorielle singulière sur une matrice et j'obtiens les matrices U, S …
J'ai besoin d'adapter une distribution gaussienne généralisée à un nuage de points à 7 dim contenant un nombre assez important de valeurs aberrantes avec un effet de levier élevé. Connaissez-vous un bon package R pour ce travail?
Je traite généralement des données où plusieurs individus sont chacun mesurés plusieurs fois dans chacune de 2 conditions ou plus. J'ai récemment joué avec la modélisation à effets mixtes pour évaluer les preuves des différences entre les conditions, la modélisation individualcomme un effet aléatoire. Pour visualiser l'incertitude concernant les prédictions …
C'est ma première fois ici, alors faites-moi savoir si je peux clarifier ma question de quelque manière que ce soit (y compris le formatage, les balises, etc.). (Et j'espère pouvoir éditer plus tard!) J'ai essayé de trouver des références, et j'ai essayé de me résoudre en utilisant l'induction, mais j'ai …
Cela me vient à l'esprit depuis au moins quelques heures. J'essayais de trouver un k optimal pour la sortie de l'algorithme k-means (avec une métrique de similitude cosinus ), donc j'ai fini par tracer la distorsion en fonction du nombre de grappes. Mon ensemble de données est une collection de …
Existe-t-il un moyen, une fois qu'un arbre de classification complexe est construit à l'aide de rpart (dans R), d'organiser les règles de décision produites pour chaque classe? Donc, au lieu d'obtenir un énorme arbre, nous obtenons un ensemble de règles pour chacune des classes? (si c'est le cas, comment?) Voici …
Vous avez peut-être entendu parler de la récente éclosion d' E. Coli entérohémorragique ( EHEC ) en Allemagne . Quelles questions un statisticien poserait-il sur l'analyse EHEC? Je pense à Q + Comme entre les journalistes / fonctionnaires ↔ les non-experts, disent les enseignants et les ingénieurs avec un diplôme …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.