Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
Quelqu'un peut-il fournir une explication simple (profane) de la relation entre les distributions de Pareto et le théorème central limite (par exemple, s'applique-t-il? Pourquoi / pourquoi pas?)? J'essaie de comprendre la déclaration suivante: "Le théorème de la limite centrale ne fonctionne pas avec chaque distribution. Cela est dû à un …
Je fais une analyse Matlab sur des données d'IRM où j'ai effectué l'ACP sur une matrice de taille 10304x236 où 10304 est le nombre de voxels (pensez-y comme pixels) et 236 est le nombre de points temporels. L'ACP me donne 236 valeurs propres et leurs coefficients associés. Tout va bien. …
J'étudie l'analyse discriminante, mais j'ai du mal à concilier plusieurs explications différentes. Je crois que je dois manquer quelque chose, car je n'ai jamais rencontré ce niveau (apparent) de divergence auparavant. Cela étant dit, le nombre de questions sur l'analyse discriminante sur ce site Web semble être un témoignage de …
Chargez le package nécessaire. library(ggplot2) library(MASS) Générez 10 000 nombres adaptés à la distribution gamma. x <- round(rgamma(100000,shape = 2,rate = 0.2),1) x <- x[which(x>0)] Dessinez la fonction de densité de probabilité, supposant que nous ne savons pas à quelle distribution x correspond. t1 <- as.data.frame(table(x)) names(t1) <- c("x","y") t1 …
Je suis toujours un peu surpris de voir des publicités psychologiques pour participer à des études expérimentales. Bien sûr, les personnes qui répondent à ces publicités ne sont pas échantillonnées au hasard et sont donc une population auto-sélectionnée. Parce que l'on sait que la randomisation résout le problème d'auto-sélection, je …
Je veux apprendre l'ANOVA. Avant de commencer à apprendre comment fonctionne l'algorithme (quels calculs doivent être effectués) et pourquoi il fonctionne, je voudrais d'abord savoir quel problème résolvons-nous réellement avec ANOVA, ou quelle réponse essayons-nous de répondre. En d'autres termes: qu'est-ce que l'entrée et quelle est la sortie de l'algorithme? …
Dans mes notes de cours, il est dit: La distribution en t semble normale, mais avec des queues légèrement plus lourdes. Je comprends pourquoi cela aurait l'air normal (à cause du théorème de la limite centrale). Mais j'ai du mal à comprendre comment prouver mathématiquement qu'il a des queues plus …
Je veux quantifier la relation entre deux variables, A et B, en utilisant des informations mutuelles. Le moyen de le calculer est de regrouper les observations (voir l'exemple de code Python ci-dessous). Cependant, quels facteurs déterminent quel nombre de bacs est raisonnable? J'ai besoin que le calcul soit rapide, donc …
J'essaie de comprendre l'architecture des RNN. J'ai trouvé ce tutoriel qui a été très utile: http://colah.github.io/posts/2015-08-Understanding-LSTMs/ Surtout cette image: Comment cela s'intègre-t-il dans un réseau à action directe? Cette image est-elle juste un autre nœud dans chaque couche?
Le contexte J'essaie de comprendre comment coxph () de R accepte et gère les entrées répétées pour les sujets (ou le patient / client si vous préférez). Certains appellent ce format long, d'autres l'appellent «mesures répétées». Voir par exemple l'ensemble de données qui inclut la colonne ID dans la section …
J'ai une variable aléatoire 1-D qui est extrêmement asymétrique. Afin de normaliser cette distribution, je veux utiliser la médiane plutôt que la moyenne. ma question est la suivante: puis-je calculer la variance de la distribution en utilisant la médiane dans la formule au lieu de la moyenne? c'est à dire …
Que pensez-vous de l'utilisation de la régression pour projeter en dehors de la plage de données? Si nous sommes sûrs qu'il suit une forme de modèle linéaire ou de puissance, le modèle ne pourrait-il pas être utile au-delà de la plage de données? Par exemple, j'ai un volume déterminé par …
Je lis sur les Bayes variationnels, et si je comprends bien, cela revient à l'idée que vous approximez (où z sont les variables latentes de votre modèle et les données observées) avec une fonction , en faisant l'hypothèse que factorise comme où est un sous-ensemble des variables latentes. On peut …
J'essaie de me frayer un chemin à travers le premier ensemble de problèmes du matériel de cours en ligne stanford cs224d et j'ai des problèmes avec le problème 3A: lorsque j'utilise le modèle skip gram word2vec avec la fonction de prédiction softmax et la fonction de perte d'entropie croisée, nous …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.