Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
Peut-on utiliser le test d'ajustement de Kolmogorov-Smirnov pour comparer deux distributions empiriques afin de déterminer si elles semblent provenir de la même distribution sous-jacente, plutôt que de comparer une distribution empirique à une distribution de référence prédéfinie? Permettez-moi d'essayer de poser cette question d'une autre manière. Je collecte N échantillons …
J'essaie d'effectuer un clustering au niveau du document. J'ai construit la matrice de fréquence terme-document et j'essaie de regrouper ces vecteurs de haute dimension en utilisant k-means. Au lieu de regrouper directement, ce que j'ai fait, j'ai d'abord appliqué la décomposition vectorielle singulière de LSA (Latent Semantic Analysis) pour obtenir …
J'essaie de générer des échantillons aléatoires à partir d'un pdf personnalisé à l'aide de R. Mon pdf est: fX(x)=32(1−x2),0≤x≤1fX(x)=32(1−x2),0≤x≤1f_{X}(x) = \frac{3}{2} (1-x^2), 0 \le x \le 1 J'ai généré des échantillons uniformes, puis j'ai essayé de le transformer en ma distribution personnalisée. J'ai fait cela en trouvant le cdf de …
Je pensais que «regrouper les données» signifiait simplement combiner des données qui étaient auparavant divisées en catégories ... essentiellement, ignorer les catégories et faire de l'ensemble de données un «pool» géant de données. Je suppose que c'est une question plus sur la terminologie que sur l'application des statistiques. Par exemple: …
Verrouillé . Cette question et ses réponses sont verrouillées car la question est hors sujet mais a une signification historique. Il n'accepte pas actuellement de nouvelles réponses ou interactions. Grâce à la question de Tormod (publiée ici ), je suis tombé sur l' intrigue des ensembles parallèles . Voici un …
Quelqu'un pourrait-il me dire ce que le terme «persistance» signifie dans l'analyse des séries chronologiques? Il s'agit d'économétrie et de régression appliquée.
J'analyse les scores donnés par les participants à une expérience. Je souhaite estimer la fiabilité de mon questionnaire qui est composé de 6 items visant à estimer l'attitude des participants envers un produit. J'ai calculé l'alpha de Cronbach en traitant tous les éléments comme une seule échelle (l'alpha était d'environ …
Fermé. Cette question est hors sujet . Il n'accepte pas actuellement de réponses. Vous souhaitez améliorer cette question? Mettez à jour la question afin qu'elle soit sur le sujet pour la validation croisée. Fermé il y a 4 ans . J'ai une trame de données qui contient des identifiants en …
En général, je standardise mes variables indépendantes en régressions, afin de comparer correctement les coefficients (de cette façon ils ont les mêmes unités: les écarts-types). Cependant, avec des données de panel / longitudinales, je ne sais pas comment je devrais standardiser mes données, surtout si j'évalue un modèle hiérarchique. Pour …
J'ai besoin de quelques ressources pour commencer à utiliser les réseaux de neurones pour la prévision des séries chronologiques. Je me méfie de mettre en œuvre du papier et de découvrir ensuite qu'ils ont largement surestimé le potentiel de leurs méthodes. Donc, si vous avez de l'expérience avec les méthodes …
J'ai effectué une analyse dans laquelle j'ai modélisé différentes composantes de la variance. Lors de la déclaration des résultats dans un tableau, il est beaucoup plus concis de signaler les écarts-types au lieu des écarts. Donc, cela m'amène à la question - y a-t-il jamais une raison de signaler la …
Si j'ai deux variables aléatoires indépendantes normalement distribuées et avec des moyennes \ mu_X et \ mu_Y et des écarts-types \ sigma_X et \ sigma_Y et je découvre que X + Y = c , alors (en supposant que je n'ai pas fait d'erreur) la distribution conditionnelle de X et …
J'ai calculé le d de Cohen pour les coefficients de régression (à partir de la statistique t), les rapports de cotes et les différences de moyennes, en espérant regrouper les résultats dans une méta-analyse et voir comment cela fonctionne. Cependant, dans Stata, il ne semble pas que vous puissiez regrouper …
Toutes mes excuses pour la question rudimentaire, je suis nouveau dans cette forme d'analyse et j'ai une compréhension très limitée des principes jusqu'à présent. Je me demandais simplement si bon nombre des hypothèses paramétriques pour les tests multivariés / univariés s'appliquent à l'analyse de cluster? De nombreuses sources d'informations que …
Je ne suis pas dans le domaine des statistiques. J'ai vu le mot «données liées» en lisant les coefficients de corrélation de rang. Qu'est-ce que les données liées? Qu'est-ce qu'un exemple de données liées?
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.