Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
J'utilise R (et le package d'arules) pour extraire des transactions pour les règles d'association. Ce que je veux faire, c'est construire les règles, puis les appliquer à de nouvelles données. Par exemple, disons que j'ai de nombreuses règles, dont l'une est canonique {Beer=YES} -> {Diapers=YES}. Ensuite, j'ai de nouvelles données …
Cet article sur Adaboost donne quelques suggestions et code (page 17) pour étendre les modèles à 2 classes aux problèmes de classe K. Je voudrais généraliser ce code, de sorte que je puisse facilement brancher différents modèles à 2 classes et comparer les résultats. Étant donné que la plupart des …
Une pièce doit être testée pour l'équité. 30 têtes arrivent après 50 flips. En supposant que la pièce soit juste, quelle est la probabilité que vous obteniez au moins 30 têtes en 50 flips? Selon mon professeur, la bonne façon de résoudre ce problème est de faire normalcdf(min = .6, …
Je cherche une implémentation de python (en python pur ou en encapsulant des trucs existants) de HMM et Baum-Welch. Quelques idées? Je viens de chercher dans google et j'ai trouvé du matériel vraiment médiocre par rapport aux autres techniques d'apprentissage automatique. Pourquoi?
Existe-t-il une bibliothèque de tracés pour R qui pourrait transformer une trame de données des heures de début et de fin en un tracé chronologique quelque chose comme ceci: L'axe Y signifie uniquement qu'il se cumule avec la concurrence, mais ne représente pas toujours la concurrence (voir l'écart au milieu). …
J'ai besoin d'un peu d'aide pour aller dans la bonne direction. Cela fait longtemps que je n'ai étudié aucune statistique et le jargon semble avoir changé. Imaginez que j'ai un ensemble de données liées à la voiture telles que Temps de trajet de la ville A à la ville B …
Ma coiffeuse Stacey a toujours un visage heureux, mais elle est souvent stressée par la gestion de son temps. Aujourd'hui, Stacey était en retard pour ma nomination et très excusée. Tout en obtenant ma coupe de cheveux, je me suis demandé: combien de temps ses rendez-vous standard devraient-ils être? (si …
Je souhaite savoir s'il existe ou non un consensus sur la meilleure façon d'analyser les données sur la durée de séjour à l'hôpital à partir d'un ECR. Il s'agit généralement d'une distribution très asymétrique, où la plupart des patients sortent en quelques jours à une semaine, mais les autres patients …
Considérez ∑Ni=1|Xi|∑i=1N|Xi|\sum_{i=1}^N |X_i| où X1,…,XNX1,…,XNX_1, \ldots, X_N sont iid et le CLT est valide . Combien des termes les plus importants représentent jusqu'à la moitié de la somme totale? Par exemple, 10 + 9 + 8 ≈≈\approx (10 + 9 + 8 ……\dots + 1) / 2: 30% des termes …
Dans une application d'exploration de texte, une approche simple consiste à utiliser l' heuristique pour créer des vecteurs sous forme de représentations compactes et clairsemées des documents. C'est très bien pour le réglage par lots, où l'ensemble du corpus est connu a priori, car l' i d f nécessite l'ensemble …
J'étudie les notes de cours de Larry Wasserman sur les statistiques qui utilisent Casella et Berger comme texte principal. Je travaille sur ses notes de cours ensemble 2 et je suis resté coincé dans la dérivation du lemme utilisé dans l'inégalité de Hoeffding (pp.2-3). Je reproduis la preuve dans les …
Je suis un peu nouveau dans l'exploration de données et je travaille sur un modèle de classification pour la prévision de la cote des films. J'ai collecté des ensembles de données de l'IMDB et je prévois d'utiliser des arbres de décision et des approches de voisin le plus proche pour …
J'ai commencé à creuser un peu dans la fonction plot.lm , cette fonction donne six tracés pour lm, ce sont: un tracé des résidus par rapport aux valeurs ajustées un graphique Scale-Location de sqrt (| résidus |) par rapport aux valeurs ajustées un tracé QQ normal, un tracé des distances …
Quelqu'un peut-il montrer comment la valeur et la variance attendues du Poisson gonflé zéro, avec la fonction de masse de probabilité f(y)={π+(1−π)e−λ,(1−π)λye−λy!,if y=0if y=1,2....f(y)={π+(1−π)e−λ,if y=0(1−π)λye−λy!,if y=1,2.... f(y) = \begin{cases} \pi+(1-\pi)e^{-\lambda}, & \text{if }y=0 \\ (1-\pi)\frac{\lambda^{y}e^{-\lambda}}{y!}, & \text{if }y=1,2.... \end{cases} où est la probabilité que l'observation soit nulle par un processus …
Étant donné une série chronologique, on peut estimer la fonction d'autocorrélation et la représenter, par exemple, comme indiqué ci-dessous: Que peut-on alors lire sur la série temporelle, à partir de cette fonction d'autocorrélation? Est-il par exemple possible de raisonner sur la stationnarité des séries temporelles? Modifié : Ici, j'ai inclus …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.