Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
J'étudie actuellement le cas suivant de Neil Owen, sur la base de l'article suivant, j'ai trouvé un journal: "Un étudiant de 20 ans a été emprisonné à perpétuité hier pour le viol brutal et le meurtre d'une écolière, après l'un des plus grands programmes de tests ADN de l'histoire criminelle …
Disons que j'ai une matrice de données centrée avec SVD .n×mn×mn \times mAAAA=UΣVTA=UΣVTA = U \Sigma V^{T} Par exemple, colonnes (mesures) qui sont des spectres avec n = 100 fréquences différentes. La matrice est centrée de sorte que les lignes de la matrice ont leur moyenne soustraite. C'est pour interpréter …
Voici quatre ensembles de nombres différents: A = {95,47, 87,90, 99,00} B = {79,2, 75,3, 66,3} C = {38,4, 40,4, 32,8} D = {1,8, 1,2, 1,1} En utilisant un test t à deux échantillons sans supposer des variances égales, je compare B, C et D à A et j'obtiens les …
J'essaie d'adapter une régression logistique où il y a une énorme différence dans le nombre de points de données dans les deux groupes (70 Vs 10 000). Un de mes amis statisticien m'a dit que c'est un problème connu de régression logistique et que pour ces types de chiffres, il …
Conception de l'étude: J'ai montré aux participants des informations sur l'élévation du niveau de la mer, en concentrant les informations de différentes manières, à la fois en termes d'échelle de temps et d'amplitude de l'élévation potentielle. J'ai donc eu un design 2 (Time: 2050 ou 2100) par 2 (Magnitude: Medium …
Supposons que A est un facteur fixe et B est un facteur aléatoire. A et B sont croisés. Un autre facteur aléatoire C est imbriqué dans B. Compte tenu des interactions AB et AC, comment dois-je adapter le modèle en utilisant la fonction lme dans le package nlme? Merci.
Dans certaines études de marché, les consommateurs sont invités à classer les caractéristiques d'un produit en fonction de leur priorité. Par exemple, Classez les fonctionnalités suivantes pour un appareil en fonction de votre priorité (1 étant la priorité la plus élevée) Storage capacity 6 Portability 5 Touch interface 1 Keyboard …
Fermé. Cette question est hors sujet . Il n'accepte pas actuellement de réponses. Voulez-vous améliorer cette question? Mettez à jour la question afin qu'elle soit sur le sujet pour la validation croisée. Fermé il y a 3 ans . Estimate Std. Error t value Pr(>|t|) (Intercept) 10.2758 0.5185 19.817 < …
J'ai de petits ensembles de données de taille 40-50 points. Sans supposer que les données sont normalement distribuées, j'ai voulu découvrir les valeurs aberrantes avec une confiance de 90% au moins. Je pensais que le boxplot pourrait être un bon moyen de le faire, mais je ne suis pas sûr. …
La régression logistique binomiale a des asymptotes supérieures et inférieures de 1 et 0 respectivement. Cependant, les données de précision (à titre d'exemple) peuvent avoir des asymptotes supérieures et inférieures très différentes de 1 et / ou 0. Je peux voir trois solutions potentielles à cela: Ne vous inquiétez pas …
J'essaie d'écrire mon propre code Python pour calculer les statistiques t et les valeurs p pour des tests t indépendants à une et deux queues. Je peux utiliser l'approximation normale, mais pour le moment, j'essaie simplement d'utiliser la distribution t. Je n'ai pas réussi à faire correspondre les résultats de …
J'ai un ensemble de nombres qui sont supposés provenir d'une distribution de Poisson. L'ensemble a également des valeurs aberrantes et, à cause de cela, les estimations du maximum de probabilité sont gravement affectées. J'ai entendu dire que des procédures d'estimation robustes peuvent aider dans une telle situation. Quelqu'un peut-il expliquer …
Quelles méthodes existe-t-il pour mesurer la force de relations arbitraires hautement non linéaires entre deux variables appariées? Par hautement non linéaire, j'entends des relations qui ne peuvent pas être modélisées de manière sensible ou fiable par régression vers un modèle connu. Je suis particulièrement intéressé par les séries chronologiques, mais …
J'utilise la régression vectorielle de support pour modéliser certaines données assez asymétriques (avec un kurtosis élevé). J'ai essayé de modéliser les données directement, mais je reçois des prédictions erronées, je pense principalement en raison de la distribution des données, qui est faussée à droite avec des queues très grasses. Je …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.