Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
J'essaie de trouver la meilleure spécification pour mon jeu de données. J'essaie de sonder l'efficacité des zones économiques spéciales en Pologne dans le sens de la croissance de l'économie dans trois modèles de données de panel similaires pour les variables expliquées: a) taux de chômage enregistré b) PIB par habitant …
J'ai obtenu la question suivante comme question test pour mon examen et je ne comprends tout simplement pas la réponse. Un diagramme de dispersion des données projetées sur les deux premières composantes principales est présenté ci-dessous. Nous souhaitons examiner s'il existe une structure de groupe dans l'ensemble de données. Pour …
J'ai des données qui représentent un aspect du comportement humain. Je veux le regrouper (sans surveillance) en profils comportementaux d'une certaine sorte. maintenant, certaines de mes variables sont catégoriques (avec 2 catégories ou plus), et certaines sont continues (la plupart sont des pourcentages). Quelques variables sont encore plus complexes dans …
Je réalise une régression logistique avec variables indépendantes et observations. J'évalue l'ajustement du modèle afin de déterminer si les données répondent aux hypothèses du modèle et ont produit le tracé résiduel groupé suivant à l'aide du package:242424123,996123,996123,996arm R Évidemment, il y a de mauvais signes dans ce graphique: de nombreux …
Comment peut-on objectivement (lire "algorithmiquement") sélectionner un modèle approprié pour effectuer une régression linéaire des moindres carrés simple avec deux variables? Par exemple, disons que les données semblent montrer une tendance quadratique et qu'une parabole est générée, qui correspond assez bien aux données. Comment justifions-nous d'en faire la régression? Ou …
Pour l'analyse de régression, il est souvent utile de connaître le processus de génération de données pour vérifier le fonctionnement de la méthode utilisée. Bien qu'il soit assez simple de le faire pour une régression linéaire simple, ce n'est pas le cas lorsque la variable dépendante doit suivre une distribution …
J'ai deux processus de Poisson indépendants et avec les taux d'arrivée et , respectivement. Maintenant, l'heure prévue pour l'arrivée de l'élément suivant pour le processus fusionné doit être .UNEAABBBλUNEλA\lambda_AλBλB\lambda_B1λUNE+λB1λA+λB\frac {1}{\lambda_A+\lambda_B} En supposant que soit l'heure d'arrivée pour l'élément suivant du processus combiné, et ou comme les événements que les éléments …
J'ai essayé de trouver des informations sur ce type de graphique et je continue à obtenir des résultats inattendus. Existe-t-il un nom ou un terme de recherche pour trouver des graphiques à barres qui remplacent les barres par des objets à code couleur comme dans cet exemple: Si quelqu'un est …
J'utilise R pour l'analyse des données. R fournit une corrfonction pour calculer la corrélation. Cette fonction fournit trois approches / algorithmes différents pour estimer les corrPearson, Spearman et Kendall. Quand dois-je utiliser chacune de ces méthodes? Quels facteurs déterminent la méthode à utiliser?
J'ai un ensemble de données avec une variable de réponse binaire (survie) et 3 variables explicatives ( A= 3 niveaux, B= 3 niveaux, C= 6 niveaux). Dans cet ensemble de données, les données sont bien équilibrées, avec 100 individus par ABCcatégorie. J'ai déjà étudié l'effet de ceux A- ci Bet …
Disons que j'ai un grand échantillon de valeurs dans . Je voudrais estimer la distribution sous-jacente . La majorité des échantillons proviennent de cette distribution supposée , tandis que les autres sont des valeurs aberrantes que je voudrais ignorer dans l'estimation de et .[0,1][0,1][0,1]Beta(α,β)Beta(α,β)\text{Beta}(\alpha, \beta)Beta(α,β)Beta(α,β)\text{Beta}(\alpha, \beta)αα\alphaββ\beta Quelle est la bonne …
J'ai exécuté une courbe de survie de censure d'intervalle avec R, JMP et SAS. Ils m'ont tous deux donné des graphiques identiques, mais les tableaux différaient un peu. Voici le tableau que JMP m'a donné. Start Time End Time Survival Failure SurvStdErr . 14.0000 1.0000 0.0000 0.0000 16.0000 21.0000 0.5000 …
Doit-on toujours s'attendre à ce que la tendance centrale (c.-à-d. La moyenne et / ou la médiane) d'un échantillon bootstrap soit similaire à la valeur observée? Dans ce cas particulier, j'ai des réponses qui sont distribuées de façon exponentielle pour les sujets dans deux conditions (je n'ai pas exécuté l'expérience, …
J'utilise le paquet bnlearn en R pour apprendre la structure de mon réseau bayésien et ses paramètres. Ce que je veux faire, c'est "prédire" la valeur d'un nœud étant donné la valeur des autres nœuds comme preuve (évidemment, à l'exception du nœud dont nous prédisons les valeurs). J'ai des variables …
Certains articles scientifiques rapportent les résultats d'une analyse parallèle de l'analyse factorielle de l'axe principal d'une manière incompatible avec ma compréhension de la méthodologie. Qu'est-ce que je rate? Ai-je tort ou est-ce qu'ils sont. Exemple: Données: La performance de 200 humains individuels a été observée sur 10 tâches. Pour chaque …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.