Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
L'application directe des méthodes de bootstrap pour les tests d'hypothèses est d'estimer l'intervalle de confiance de la statistique de test θ en calculant de façon répétée sur les échantillons bootstrap de (Soit la statistique θ échantillonné à partir bootstrap être appelé ^ θ * ). Nous rejetons H 0 si …
Quelqu'un peut-il m'expliquer le concept de distance de Mahalanobis? Par exemple, quelle est la distance de Mahalanobis entre deux points x et y, et surtout, comment est-elle interprétée pour la reconnaissance des formes?
Je veux vérifier si j'ai vraiment compris l' analyse factorielle (FA) [classique, linéaire] , en particulier les hypothèses qui sont faites avant (et éventuellement après) FA. Certaines des données doivent être initialement corrélées et il existe une relation linéaire possible entre elles. Après avoir effectué une analyse factorielle, les données …
Je suis tombé sur cette distribution dans un jeu vidéo et je voulais en savoir plus sur son comportement. Cela vient de la décision de savoir si un certain événement doit se produire après un certain nombre d'actions de joueurs. Les détails au-delà de cela ne sont pas pertinents. Il …
J'ai trouvé un article qui présente la version multidimensionnelle (bivariée ici) du boxplot - un bagplot. Qu'est-ce que cette parcelle exactement? Je peux voir la série de polygones imbriqués basés sur des sommets, l'un de ces polygones étant déclaré comme un bagplot. Quelle est l'idée de la construction de polygones …
Je voudrais tester dans quelle régression correspond le mieux à mes données. Ma variable dépendante est un nombre et a beaucoup de zéros. Et j'aurais besoin d'aide pour déterminer le modèle et la famille à utiliser (poisson ou quasipoisson, ou régression poisson zéro gonflé), et comment tester les hypothèses. Régression …
Je me demande si quelqu'un peut expliquer quelle est la principale différence entre les fiabilités oméga et alpha? Je comprends qu'une fiabilité oméga est basée sur un modèle de facteur hiérarchique comme indiqué dans l'image suivante, et alpha utilise des corrélations inter-éléments moyennes. Ce que je ne comprends pas, c'est …
Je souhaite visualiser les résultats d'un clustering (produit avec protoclust{protoclust}) en créant des graphiques de scater pour chaque paire de variables utilisées pour classer mes données, en coloriant par classes et en chevauchant les ellipses pour l'intervalle de confiance à 95% pour chacune des classes (pour vérifier qui elipses-classes se …
J'essaie d'appliquer une série chronologique aux données échantillonnées trimestriellement (biomasse animale) sur une période de 10 ans avec 3 répétitions par trimestre. Donc 40 dates mais 120 observations au total. J'ai lu SARIMA'a dans Shumway et Stoffer's Time Series Analysis et ses applications, ainsi que survolé Woodward, et. l'analyse appliquée …
Salut, je prends un cours d'études supérieures en statistique et nous avons couvert les statistiques de test et d'autres concepts. Cependant, je suis souvent en mesure d'appliquer les formules et de développer une sorte d'intuition sur le fonctionnement des choses, mais j'ai souvent le sentiment que si je soutenais mon …
J'ai des données sous la forme . Pour l'estimation de à j'utilise les formules de cet article: John Fox - Régression non linéaire et moindres carrés non linéaires Dans cet article, est estimé en regardant les données. Si je fais ça, ça marche bien, même si je n'ai que trois …
Nous avons demandé à 60 personnes de répertorier autant de franchises de restaurants à Atlanta que possible. La liste globale comprenait plus de 70 restaurants, mais nous avons éliminé ceux qui étaient mentionnés par moins de 10% des gens, nous en laissant 45. Pour ces 45, nous avons calculé la …
Quels sont les applications ou les avantages des techniques de régression par réduction de dimension (DRR) ou de réduction de dimensionnalité supervisée (SDR) par rapport aux techniques de régression traditionnelles (sans réduction de dimensionnalité)? Ces classes de techniques trouvent une représentation de faible dimension de l'ensemble des caractéristiques du problème …
Salut, je voulais savoir s'il y avait de bons livres sur l'exploration de texte et la classification avec quelques études de cas?. Sinon, certains articles / revues accessibles au public feraient l'affaire. S'ils illustrent encore mieux leurs exemples avec R. Je ne cherche pas un manuel étape par étape mais …
J'essaie de calculer l'index Gini sur la distribution de réputation SO à l'aide de SO Data Explorer. L'équation que j'essaie de mettre en œuvre est la suivante: Où:n= nombre d'utilisateurs sur le site; i= identifiant de série de l'utilisateur (1 - 1 225 000); yi= réputation de l'utilisateuri.G(S)=1n−1(n+1−2(∑ni=1(n+1−i)yi∑ni=1yi))G(S)=1n−1(n+1−2(∑i=1n(n+1−i)yi∑i=1nyi)) G(S)=\frac{1}{n-1}\left(n+1-2\left(\frac{\sum^n_{i=1}(n+1-i)y_i}{\sum^n_{i=1}y_i}\right)\right) nnniiiyiyiy_iiii …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.