Statistiques et Big Data

Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données

2
Qu'est-ce que l'entropie empirique?
Dans la définition des ensembles communs typiques (dans "Elements of Information Theory", ch. 7.6, p. 195), nous utilisons −1nlogp(xn)−1nlog⁡p(xn)-\frac{1}{n} \log{p(x^n)} comme entropie empirique d'une séquence avec . Je n'ai jamais rencontré cette terminologie auparavant. Il n'est défini explicitement nulle part selon l'index du livre.nnnp(xn)=∏ni=1p(xi)p(xn)=∏i=1np(xi)p(x^n) = \prod_{i=1}^{n}{p(x_i)} Ma question est essentiellement …


3
Apprentissage semi-supervisé, apprentissage actif et apprentissage profond pour la classification
Édition finale avec toutes les ressources mises à jour: Pour un projet, j'applique des algorithmes d'apprentissage automatique pour la classification. Défi: données étiquetées assez limitées et beaucoup plus de données non étiquetées. Buts: Appliquer la classification semi-supervisée Appliquer un processus d'étiquetage en quelque sorte semi-supervisé (appelé apprentissage actif) J'ai trouvé …


2
Comment prédire quand le prochain événement se produit, en fonction des heures des événements précédents?
Je suis un lycéen et je travaille sur un projet de programmation informatique, mais je n'ai pas beaucoup d'expérience en statistique et en modélisation de données au-delà d'un cours de statistique au lycée donc je suis un peu confus. Fondamentalement, j'ai une liste raisonnablement longue (supposons qu'elle soit suffisamment grande …


5
Analogue 2D d'écart type?
Considérez l'expérience suivante: un groupe de personnes reçoit une liste de villes et est invité à marquer les emplacements correspondants sur une carte du monde (autrement non étiquetée). Pour chaque ville, vous obtiendrez une dispersion de points grossièrement centrés sur la ville respective. Certaines villes, par exemple Istanbul, présenteront moins …






7
Moyenne d'une fenêtre coulissante en R
J'ai un vecteur de valeurs que je voudrais signaler la moyenne dans les fenêtres le long d'une petite diapositive. Par exemple, pour un vecteur des valeurs suivantes: 4, 5, 7, 3, 9, 8 Une taille de fenêtre de 3 et une diapositive de 2 feraient ce qui suit: (4+5+7)/3 = …
19 r 

2
Quelle est la définition d'une distribution symétrique?
Quelle est la définition d'une distribution symétrique? Quelqu'un m'a dit qu'une variable aléatoire XXX provenait d'une distribution symétrique si et seulement si XXX et −X−X-X la même distribution. Mais je pense que cette définition est en partie vraie. Parce que je peux présenter un contre-exemple X∼N(μ,σ2)X∼N(μ,σ2)X\sim N(\mu,\sigma^{2}) et μ≠0μ≠0\mu\neq0 . …

4
Quand dois-je utiliser un encodeur automatique variationnel par opposition à un encodeur automatique?
Je comprends la structure de base de l'autoencodeur variationnel et de l'autoencodeur normal (déterministe) et les mathématiques qui les sous-tendent, mais quand et pourquoi préférerais-je un type d'autoencodeur à l'autre? Tout ce que je peux penser, c'est que la distribution préalable des variables latentes de l'autoencodeur variationnel nous permet d'échantillonner …

En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.