Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
J'ai des parcelles de 13 groupes que je montre dans une parcelle. Les groupes ont des populations déséquilibrées et ne sont pas normalement distribués. Je veux montrer quelles paires sont statistiquement similaires (c'est-à-dire, ont une valeur de p kruskal.test <0,05) en mettant a, b, c, etc. au-dessus des cases qui …
Dans R, comment spécifier le modèle lmer sans effet fixe global? Par exemple, si je dis quelque chose comme lmer(y ~ (1 | group) + (0 + x | group), data = my_df) le modèle équipé sera yje j= a +αje+βjeXje jyij=a+αi+βixijy_{ij} = a + \alpha_{i} + \beta_{i} x_{ij} Comment …
Cette question a déjà des réponses ici : Quel type d'information est l'information Fisher? (3 réponses) Fermé il y a 7 mois . Wikipédia nous apprend que la partition joue un rôle important dans l'inégalité Cramér-Rao. Il énonce également la définition: V=∂∂θlogL(θ;X)V=∂∂θlogL(θ;X)V = \frac{\partial}{\partial \theta} \log{L(\theta; X)} Cependant, je ne …
Y a-t-il une différence entre les termes suivants ou ils sont identiques? Biais Biais systématique Erreurs systématiques S'il existe des différences, veuillez les expliquer. Ces erreurs peuvent-elles être réduites lorsque l'on augmente la taille de l'échantillon? MISE À JOUR: Mon domaine d'intérêt est l'inférence statistique. Je veux dire que la …
J'ai le type de données suivant. J'ai évalué 10 individus chacun répété 10 fois. J'ai une matrice de relations 10x10 (relation entre toutes les combinaisons des individus). set.seed(1234) mydata <- data.frame (gen = factor(rep(1:10, each = 10)), repl = factor(rep(1:10, 10)), yld = rnorm(10, 5, 0.5)) Cette génération est constituée …
J'ai deux questions liées au concept de "cohérence d'apprentissage" pour ceux qui connaissent la théorie de l'apprentissage statistique à la Vapnik. Question 1. Le processus d'apprentissage est appelé cohérent (pour la classe de fonctions et la distribution de probabilité ) siFF\mathcal{F}PPP Remp(f∗l)→Pinff∈FR(f),l→∞Remp(fl∗)→Pinff∈FR(f),l→∞ R_{emp}(f^*_l) \buildrel P \over \to \inf_{f \in \mathcal{F}} …
Andrew Gelman, dans le livre qu'il a écrit avec Jennifer Hill, déclare au chapitre 9, (section 9.3), à la page 177: Il convient uniquement de contrôler les prédicteurs avant le traitement ou, plus généralement, les prédicteurs qui ne seraient pas affectés par le traitement (comme la race ou l'âge). Ce …
J'utilise le test à deux échantillons de Kolmogorov – Smirnov pour comparer les distributions, et j'ai remarqué qu'une valeur de est fréquemment indiquée comme statistique de test. Comment cette valeur est-elle déterminée? Je sais que c'est la probabilité d'obtenir un résultat au moins aussi grand que celui obtenu, mais comment …
Sur la figure suivante à gauche, deux réalisations de processus ponctuels avec une densité (intensité) différente et sont mélangées en faisant correspondre le centre des zones d'appartenance pour construire un processus ponctuel au milieu avec une intensité . Ensuite, des points sélectionnés au hasard sous forme de deux ensembles extraits …
Je travaille mon chemin (auto-apprentissage) à travers le livre d'ET Jaynes Probability Theory - The Logic of Science Problème d'origine L'exercice 2.1 dit: "Est-il possible de trouver une formule générale pour analogue à [la formule ] à partir des règles de produit et de somme. Si oui, dérivez-la; sinon, expliquez …
Je développe des systèmes de trading automatisés pour le marché boursier. Le grand défi a été le sur-ajustement. Pouvez-vous recommander des ressources décrivant des méthodes pour mesurer et éviter le sur-ajustement? J'ai commencé avec des ensembles de formation / validation, mais l'ensemble de validation est toujours vicié. De plus, les …
Je viens de lire que vous pouvez désormais acheter un ordinateur quantique (bien qu'il n'y en ait eu qu'un vendu jusqu'à présent!). L'informatique quantique aura-t-elle des applications en statistique? {edit - pour les besoins de la question, supposons que finalement les ordinateurs quantiques (sous une forme ou une autre) fonctionneront}
J'exécute un test AB sur une page qui ne reçoit que 5 000 visites par mois. Il faudrait trop de temps pour atteindre les niveaux de trafic nécessaires pour mesurer une différence de + -1% entre le test et le contrôle. J'ai entendu dire que je peux utiliser les statistiques …
Supposons que, dans une étude de 15 sujets, la variable de réponse (res) est modélisée avec deux variables explicatives, une (niveau) est catégorique avec 5 niveaux et l'autre (temps de réponse: RT) est continue. Avec lmer dans le package lme4 de R, j'ai: fm1 <- lmer(res ~ level * RT …
La formulation d'un modèle mathématique pour un problème est l'un des aspects les plus subjectifs de la statistique, mais aussi l'un des plus importants. Quelles sont les meilleures références traitant de ce sujet crucial mais souvent négligé? Et quel célèbre statisticien a dit quelque chose dans le sens de: "Que …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.