Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
Je sais que les modèles statistiques traditionnels comme la régression des risques proportionnels de Cox et certains modèles de Kaplan-Meier peuvent être utilisés pour prédire jours jusqu'à la prochaine occurrence d'une panne par exemple d'événements , etc. -à- dire l' analyse de survie Des questions Comment la version de régression …
Tout en lisant avec désinvolture certains travaux du marché de masse sur la théorie du chaos au cours des dernières années, j'ai commencé à me demander comment divers aspects de celui-ci pouvaient être appliqués à l'exploration de données et à des domaines connexes, comme les réseaux de neurones, la reconnaissance …
Richard Dawkins a décrit Ronald Fisher comme "le père des statistiques modernes et de la conception expérimentale", une ligne qui est citée dans la biographie Wikipedia de Fisher . Et aussi Anders Hald l'a appelé "un génie qui a presque à lui seul créé les bases de la science statistique …
Lorsque nous évaluons la qualité d'une forêt aléatoire, par exemple en utilisant l'AUC, est-il plus approprié de calculer ces quantités sur les échantillons hors sac ou sur l'ensemble de validation croisée? J'entends que le calculer sur les échantillons OOB donne une évaluation plus pessimiste, mais je ne vois pas pourquoi.
Dans la section 3.2 de Bishop's Pattern Recognition and Machine Learning , il discute de la décomposition biais-variance, déclarant que pour une fonction de perte au carré, la perte attendue peut être décomposée en un terme de biais au carré (qui décrit la distance entre les prévisions moyennes et la …
J'ai lu ce qu'est la censure et comment elle doit être prise en compte dans l'analyse de survie, mais j'aimerais en entendre une définition moins mathématique et une définition plus intuitive (les images seraient super!). Quelqu'un peut-il me fournir une explication de 1) la censure et 2) comment cela affecte …
J'essaie d'obtenir ma tête autour de la preuve suivante que le gaussien a l'entropie maximale. En quoi l'étape suivie est-elle logique? Une covariance spécifique ne fixe que le deuxième moment. Qu'arrive-t-il aux troisième, quatrième, cinquième moments, etc.?
J'ai un petit ensemble de données de 14 temps distincts pour terminer une tâche. Cependant, j'ai du mal à trouver un graphique approprié à utiliser pour représenter graphiquement les données. Si l'échantillon était plus grand, j'utiliserais une boîte à moustaches ou un histogramme, mais je ne sais pas s'il serait …
Quelle est la différence entre Outlier et Anomaly dans le contexte de l'apprentissage automatique. Je crois comprendre que les deux se réfèrent à la même chose.
Je ne comprends pas comment cette équation a été dérivée. P(I|M1∩M2)≤P(I)P(I′)⋅P(M1|I)P(M2|I)P(M1|I′)P(M2|I′)P(I|M1∩M2)≤P(I)P(I′)⋅P(M1|I)P(M2|I)P(M1|I′)P(M2|I′)P(I|M_{1}\cap M_{2}) \leq \frac{P(I)}{P(I')}\cdot \frac{P(M_{1}|I)P(M_{2}|I)}{P(M_{1}|I')P(M_{2}|I')} Cette équation est tirée de l'étude "Trial by Probability" où le cas d'OJ Simpson a été donné comme exemple de problème. Le prévenu est jugé pour double meurtre et deux preuves sont présentées contre lui. …
Je vois mentionné à divers endroits que l'ANOVA fait son estimation en utilisant la méthode des moments. Je suis confus par cette affirmation parce que, même si je ne suis pas familier avec la méthode des moments, ma compréhension est que c'est quelque chose de différent et non équivalent à …
Dans Statistical Methods in the Atmospheric Sciences , Daniel Wilks note que la régression linéaire multiple peut entraîner des problèmes s'il existe de très fortes intercorrélations entre les prédicteurs (3e édition, pages 559-560): Une pathologie qui peut se produire dans une régression linéaire multiple est qu'un ensemble de variables prédictives …
Je lisais les modèles linéaires de manuels de Faraway avec R (1ère édition) le week-end dernier. Loin avait un chapitre intitulé "Stratégie statistique et incertitude du modèle". Il a décrit (page 158) qu'il avait généré artificiellement des données à l'aide d'un modèle très compliqué, puis il a demandé à ses …
Je travaille sur un projet de filtrage collaboratif (CF), c'est-à-dire compléter une matrice partiellement observée ou plus généralement tenseur. Je suis un débutant dans le domaine, et pour ce projet, je dois finalement comparer notre méthode à d'autres méthodes bien connues qui, de nos jours, comparent les méthodes proposées, à …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.