Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
Lors du test d'hypothèses nulles ou alternatives par une statistique de test , où , appliquez le test de permutation avec l'ensemble de permutations sur et nous avons une nouvelle statistique U(X)U(X)U(X)X={xi,...,xn}X={xi,...,xn}X = \{ x_i, ..., x_n\}GGGXXXT(X):=#{π∈G:U(πX)≥U(X)}|G|.T(X):=#{π∈G:U(πX)≥U(X)}|G|. T(X) := \frac{\# \{\pi \in G: U(\pi X) \geq U(X)\}}{|G|}. Quel est l'avantage …
cela ressemble à une question très naïve mais j'ai du mal à voir la réponse. J'ai un ensemble de 30 valeurs. Indépendamment, j'ai obtenu une 31e valeur. L'hypothèse nulle est que la 31e valeur fait partie de la même distribution. L'alternative est que c'est différent. Je veux une sorte de …
Les modèles pénalisés peuvent être utilisés pour estimer les modèles où le nombre de paramètres est égal ou même supérieur à la taille de l'échantillon. Cette situation peut se produire dans les modèles log-linéaires de grandes tables clairsemées de données catégorielles ou de dénombrement. Dans ces paramètres, il est souvent …
J'ai un modèle de régression logistique binaire avec une DV (maladie: oui / non) et 5 prédicteurs (démographie [âge, sexe, tabagisme (oui / non)], un index médical (ordinale) et un traitement aléatoire [oui / non ]). J'ai également modélisé tous les termes d'interaction bilatérale. Les principales variables sont centrées et …
J'aimerais comprendre quelques faits sur les estimateurs du maximum de vraisemblance (MLE) pour les régressions logistiques. Est-il vrai qu'en général, le MLE pour la régression logistique est biaisé? Je dirais "oui". Je sais, par exemple, que la dimension de l'échantillon est liée au biais asymptotique des MLE. Connaissez-vous des exemples …
Je mène une étude clinique où je détermine une mesure anthropométrique des patients. Je sais comment gérer la situation où j'ai une mesure par patient: je fais un modèle, où j'ai un échantillon aléatoire d'une certaine densité , et je fais le truc habituel: écrire la probabilité de l'échantillon, estimer …
J'ai le problème suivant: J'ai 100 articles uniques (n), et j'en sélectionne 43 (m) un à la fois (avec remplacement). Je dois résoudre pour le nombre attendu d'uniques (sélectionné une seule fois, k = 1), doubles (sélectionnés exactement deux fois k = 2), tripples (exactement k = 3), quads etc …
J'essaie d'adapter un modèle à temps discret dans R, mais je ne sais pas comment le faire. J'ai lu que vous pouvez organiser la variable dépendante dans différentes lignes, une pour chaque observation de temps, et utiliser la glmfonction avec un lien logit ou cloglog. En ce sens, j'ai trois …
Je lis un livre d'analyse de séries chronologiques et la formule de l'échantillon d'autocovariance est définie dans le livre comme: γˆ(h)=n−1∑t=1n−h(xt+h−x¯)(xt−x¯)γ^(h)=n−1∑t=1n−h(xt+h−x¯)(xt−x¯)\widehat{\gamma}(h) = n^{-1}\displaystyle\sum_{t=1}^{n-h}(x_{t+h}-\bar{x})(x_t-\bar{x}) avecpour . est la moyenne.γˆ(−h)=γˆ(h)γ^(−h)=γ^(h)\widehat{\gamma}(-h) = \widehat{\gamma}(h)\;ˉ xh=0,1,...,n−1h=0,1,...,n−1\;h = 0,1, ..., n-1x¯x¯\bar{x} Quelqu'un peut-il expliquer intuitivement pourquoi nous divisons la somme par et non par ? Le …
J'ai vérifié la réponse à cette question sur stats.stackexchange: Quelles sont les bonnes ressources fournissant un historique des statistiques? En effet, le livre de Stigler "Statistics on the Table" est excellent et j'ai hâte de le lire. Mais je suis plus intéressé par le développement de modèles ARIMA modernes. Je …
Je me demande si c'est une bonne idée de supprimer ces variables avec une valeur d'importance de variable négative ("% IncMSE") dans un contexte de régression. Et si cela me donne une meilleure prédiction? Qu'est-ce que tu penses?
J'ai des problèmes avec la définition des termes d'erreur pour une mesure répétée bidirectionnelle ANOVA dans R. Mes données consistent en des estimations de la densité du bois pour trois positions radiales (intérieure, moyenne et extérieure) le long d'un noyau extrait d'un arbre. Il y a un total de 20 …
J'ai un ensemble d'éléments que je peux décrire selon caractéristiques. Donc:XXXnnn Xje: { cje 1, cje 2, … , Cje n} ∣ xje∈ XXje:{cje1,cje2,…,cjen}∣Xje∈Xx_i: \{c_{i1}, c_{i2}, \ldots, c_{in}\} \mid x_i \in X où est l'évaluation (numérique) de l'élément selon les caractéristiques . Ainsi, mes éléments peuvent être considérés comme des …
J'ai des données pour deux groupes (c'est-à-dire des échantillons) que je souhaite comparer mais la taille totale de l'échantillon est petite (n = 29) et fortement déséquilibrée (n = 22 vs n = 7). Ces données sont logistiquement difficiles et coûteuses à collecter, donc bien que «collecter plus de données» …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.