Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
J'ai du mal à interpréter les valeurs z pour les variables catégorielles dans la régression logistique. Dans l'exemple ci-dessous, j'ai une variable catégorielle avec 3 classes et selon la valeur z, CLASS2 peut être pertinent tandis que les autres ne le sont pas. Mais qu'est-ce que cela signifie maintenant? Que …
Certains livres indiquent qu'un échantillon de taille 30 ou plus est nécessaire pour que le théorème de la limite centrale donne une bonne approximation de . X¯X¯\bar{X} Je sais que cela ne suffit pas pour toutes les distributions. Je souhaite voir quelques exemples de distributions où, même avec un échantillon …
Quelle est la meilleure façon de montrer une relation entre: variable continue et discrète, deux variables discrètes? Jusqu'à présent, j'ai utilisé des diagrammes de dispersion pour examiner la relation entre les variables continues. Cependant, dans le cas de variables discrètes, les points de données sont cumulés à certains intervalles. Ainsi, …
J'ai un tableau de données T1, qui contient près d'un millier de variables (V1) et environ 200 millions de points de données. Les données sont rares et la plupart des entrées sont NA. Chaque point de données a un identifiant et une paire de dates uniques pour se distinguer les …
Souvent, les gens utilisent des programmes pour obtenir des valeurs de p, mais parfois - pour une raison quelconque - il peut être nécessaire d'obtenir une valeur critique à partir d'un ensemble de tables. Étant donné un tableau statistique avec un nombre limité de niveaux de signification et un nombre …
Le scénario suivant est devenu la plupart des FAQ dans le trio d'enquêteur (I), réviseur / éditeur (R, non lié au CRAN) et moi (M) en tant que créateur de l'intrigue. Nous pouvons supposer que (R) est le réviseur de big boss médical typique, qui sait seulement que chaque intrigue …
Cela semble si élémentaire, mais je suis toujours coincé à ce stade… La plupart des données que je traite ne sont pas normales et la plupart des analyses sont basées sur une structure GLM. Pour mon analyse actuelle, j'ai une variable de réponse qui est la "vitesse de marche" (mètres …
Pour un projet d'écologie, mon groupe de laboratoire a ajouté du vinaigre à 4 réservoirs contenant des volumes égaux d'eau d'étang, 1 témoin sans élodée (une plante aquatique) et 3 traitements avec la même quantité d'élodée dans chacun. L'ajout de vinaigre avait pour but de réduire le pH. L'hypothèse était …
Existe-t-il une description très simple des différences pratiques entre ces deux techniques? Les deux semblent être utilisés pour l'apprentissage supervisé (bien que les règles d'association puissent également gérer sans supervision). Les deux peuvent être utilisés pour la prédiction Le plus proche que j'ai trouvé à une «bonne» description est du …
Il est assez courant d'utiliser des cartes de chaleur / contour lors de la présentation des résultats EEG temps-fréquence. Le schéma de couleurs souvent choisi (et que j'aime et utilise) est le schéma de couleurs "jet" (voir par exemple, EEG google -time recherche fréquence-fréquence ). Je me demande s'il existe …
Dans un commentaire récemment publié ici, un commentateur a signalé un blog de Larry Wasserman qui souligne (sans aucune source) que l'inférence fréquentiste se heurte au principe de vraisemblance. Le principe de vraisemblance dit simplement que les expériences produisant des fonctions de vraisemblance similaires devraient produire une inférence similaire. Deux …
Supposons que nous travaillons sur un modèle à effets aléatoires de certaines données de comptage au fil du temps, et que nous voulons contrôler certaines tendances. Normalement, vous feriez quelque chose comme: lmer(counts ~ dependent_variable + (1+t+I(t^2)|ID), family="poisson") pour inclure une forme quadratique pour t. Est-il possible d'utiliser des techniques …
Je travaille sur une simulation physique 2D et je collecte des données dans le temps en plusieurs points. Ces points discrets sont le long de lignes verticales, avec plusieurs lignes dans la direction axiale. Cela rend l'ensemble de données 4D efficace. Par exemple, supposons que j'ai des points de collecte …
Il y a une distinction qui me fait trébucher avec des modèles mixtes, et je me demande si je pourrais obtenir une certaine clarté. Supposons que vous ayez un modèle mixte de données de comptage. Il y a une variable que vous voulez comme effet fixe (A) et une autre …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.