Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
Dans la définition des ensembles communs typiques (dans "Elements of Information Theory", ch. 7.6, p. 195), nous utilisons −1nlogp(xn)−1nlogp(xn)-\frac{1}{n} \log{p(x^n)} comme entropie empirique d'une séquence avec . Je n'ai jamais rencontré cette terminologie auparavant. Il n'est défini explicitement nulle part selon l'index du livre.nnnp(xn)=∏ni=1p(xi)p(xn)=∏i=1np(xi)p(x^n) = \prod_{i=1}^{n}{p(x_i)} Ma question est essentiellement …
En réponse à cette question, à savoir si ma conception où j'ai présenté au hasard des photos de différentes catégories aux participants était un exemple où je devrais utiliser une mesure répétée ANOVA, j'ai obtenu la réponse que je devrais utiliser un modèle mixte à la place, avec l'un des …
Édition finale avec toutes les ressources mises à jour: Pour un projet, j'applique des algorithmes d'apprentissage automatique pour la classification. Défi: données étiquetées assez limitées et beaucoup plus de données non étiquetées. Buts: Appliquer la classification semi-supervisée Appliquer un processus d'étiquetage en quelque sorte semi-supervisé (appelé apprentissage actif) J'ai trouvé …
Je construis un modèle prédictif qui prévoit la probabilité de réussite d'un étudiant à la fin d'un trimestre. Je m'intéresse particulièrement à savoir si l'étudiant réussit ou échoue, où le succès est généralement défini comme la réussite du cours et l'obtention de 70% ou plus de points sur le total …
Je suis un lycéen et je travaille sur un projet de programmation informatique, mais je n'ai pas beaucoup d'expérience en statistique et en modélisation de données au-delà d'un cours de statistique au lycée donc je suis un peu confus. Fondamentalement, j'ai une liste raisonnablement longue (supposons qu'elle soit suffisamment grande …
J'ai 82 répondants dans 2 groupes (43 dans le groupe A et 39 dans le groupe B) qui ont répondu à un sondage de 65 questions Likert allant de 1 à 5 (tout à fait d'accord - tout à fait en désaccord). J'ai donc un dataframe avec 66 colonnes (1 …
Considérez l'expérience suivante: un groupe de personnes reçoit une liste de villes et est invité à marquer les emplacements correspondants sur une carte du monde (autrement non étiquetée). Pour chaque ville, vous obtiendrez une dispersion de points grossièrement centrés sur la ville respective. Certaines villes, par exemple Istanbul, présenteront moins …
... et pourquoi ? En supposant que , sont des variables aléatoires indépendantes avec respectivement la moyenne et la variance . Mon livre de statistiques de base me dit que la distribution du a les propriétés suivantes:X 2 μ 1 , μ 2 σ 2 1 , σ 2 2 …
Imaginez que vous répétiez une expérience trois fois. Dans chaque expérience, vous collectez des mesures en triple. Les triplicats ont tendance à être assez proches les uns des autres, par rapport aux différences entre les trois moyens expérimentaux. Le calcul de la moyenne est assez facile. Mais comment calculer un …
C'est un exercice donné dans Probability Theory: The Logic of Science par Edwin Jaynes, 2003. Il y a une solution partielle ici . J'ai élaboré une solution partielle plus générale et je me demandais si quelqu'un d'autre l'avait résolue. J'attendrai un peu avant de poster ma réponse, pour essayer les …
Nassim Taleb, de renommée Black Swan (ou infamie), a développé le concept et développé ce qu'il appelle "une carte des limites de la statistique" . Son argument de base est qu'il existe un type de problème de décision où l'utilisation de n'importe quel modèle statistique est nuisible. Il s'agirait de …
Pour une analyse de taille d'effet, je remarque qu'il existe des différences entre le d de Cohen, le g de Hedges et le g * de Hedges. Ces trois mesures sont-elles normalement très similaires? Quel serait un cas où ils produiraient des résultats différents? Est-ce aussi une question de préférence …
J'ai un vecteur de valeurs que je voudrais signaler la moyenne dans les fenêtres le long d'une petite diapositive. Par exemple, pour un vecteur des valeurs suivantes: 4, 5, 7, 3, 9, 8 Une taille de fenêtre de 3 et une diapositive de 2 feraient ce qui suit: (4+5+7)/3 = …
Quelle est la définition d'une distribution symétrique? Quelqu'un m'a dit qu'une variable aléatoire XXX provenait d'une distribution symétrique si et seulement si XXX et −X−X-X la même distribution. Mais je pense que cette définition est en partie vraie. Parce que je peux présenter un contre-exemple X∼N(μ,σ2)X∼N(μ,σ2)X\sim N(\mu,\sigma^{2}) et μ≠0μ≠0\mu\neq0 . …
Je comprends la structure de base de l'autoencodeur variationnel et de l'autoencodeur normal (déterministe) et les mathématiques qui les sous-tendent, mais quand et pourquoi préférerais-je un type d'autoencodeur à l'autre? Tout ce que je peux penser, c'est que la distribution préalable des variables latentes de l'autoencodeur variationnel nous permet d'échantillonner …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.