Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
Disons que j'ai une population de 50 millions de choses uniques, et je prends 10 millions d'échantillons (avec remplacement) ... Le premier graphique que j'ai joint montre combien de fois j'échantillonne la même "chose", ce qui est relativement rare que le la population est plus grande que mon échantillon. Cependant, …
Fermé. Cette question est hors sujet . Il n'accepte pas actuellement les réponses. Voulez-vous améliorer cette question? Mettez à jour la question afin qu'elle soit sur le sujet pour la validation croisée. Fermé il y a 5 mois . Existe-t-il une bonne bibliothèque python pour l'entraînement des arbres de décision …
Lors de la présentation de statistiques, il peut être utile d'incorporer la courte vidéo occasionnelle. Mes premières pensées ont inclus: Animations et visualisations de concepts statistiques Histoires concernant l'application d'une technique particulière Vidéos humoristiques pertinentes pour une idée statistique Entrevues avec un statisticien ou un chercheur qui utilise des statistiques …
Suite aux récentes questions que nous avions ici . Je sautais pour savoir si quelqu'un était tombé sur ou pouvait partager du code R pour effectuer une analyse de puissance personnalisée basée sur la simulation d'un modèle linéaire? Plus tard, je voudrais évidemment l'étendre à des modèles plus complexes, mais …
Quels tests sont disponibles pour tester deux échantillons indépendants pour l'hypothèse nulle qu'ils proviennent de populations avec le même biais? Il existe un test classique à 1 échantillon pour savoir si le biais est égal à un nombre fixe (le test implique le 6ème moment de l'échantillon!); y a-t-il une …
J'ai eu du mal avec le problème suivant avec, je l'espère, un problème facile pour les statisticiens (je suis un programmeur avec une certaine exposition aux statistiques). Je dois résumer les réponses à une enquête (pour la direction). L'enquête comprend plus de 100 questions, regroupées dans différents domaines (avec environ …
Pour certaines mesures, les résultats d'une analyse sont présentés de manière appropriée sur l'échelle transformée. Dans la plupart des cas, cependant, il est souhaitable de présenter les résultats sur l'échelle de mesure d'origine (sinon votre travail est plus ou moins sans valeur). Par exemple, dans le cas de données transformées …
Je suis tombé sur un vaste corpus de littérature qui préconise d'utiliser la métrique de l'information de Fisher comme métrique locale naturelle dans l'espace des distributions de probabilité, puis de l'intégrer pour définir les distances et les volumes. Mais ces quantités «intégrées» sont-elles réellement utiles à quelque chose? Je n'ai …
Quelqu'un connaît-il des recherches qui examinent l'efficacité (compréhensibilité?) De différentes techniques de visualisation? Par exemple, à quelle vitesse les gens comprennent-ils une forme de visualisation par rapport à une autre? L'interactivité avec la visualisation aide-t-elle les gens à se souvenir des données? N'importe quoi dans ce sens. Un exemple de …
Dans les statistiques circulaires, la valeur attendue d'une variable aléatoire avec des valeurs sur le cercle S est définie comme m 1 ( Z ) = ∫ S z P Z ( θ ) d θ (voir wikipedia ). Il s'agit d'une définition très naturelle, tout comme la définition de …
J'utilise la décomposition en valeurs singulières comme technique de réduction de dimensionnalité. Étant donné des Nvecteurs de dimension D, l'idée est de représenter les entités dans un espace transformé de dimensions non corrélées, qui condense la plupart des informations des données dans les vecteurs propres de cet espace dans un …
J'ai souvent entendu que les modèles LME sont plus solides dans l'analyse des données de précision (c'est-à-dire dans les expériences de psychologie), en ce sens qu'ils peuvent fonctionner avec des distributions binomiales et autres distributions non normales que les approches traditionnelles (par exemple, l'ANOVA) ne peuvent pas. Quelle est la …
J'essaie de séparer deux groupes de valeurs d'un même ensemble de données. Je peux supposer que l'une des populations est normalement distribuée et représente au moins la moitié de la taille de l'échantillon. Les valeurs du second sont à la fois inférieures ou supérieures aux valeurs du premier (la distribution …
Verrouillé . Cette question et ses réponses sont verrouillées car la question est hors sujet mais a une signification historique. Il n'accepte pas actuellement de nouvelles réponses ou interactions. Quelqu'un connaît-il un bon logiciel d'anonymisation des données? Ou peut-être un package pour R qui fait l'anonymisation des données? Évidemment, ne …
C'est une question un peu désinvolte, mais j'ai un sérieux intérêt pour la réponse. Je travaille dans un hôpital psychiatrique et j'ai trois ans de données, collectées chaque jour dans chaque service sur le niveau de violence dans ce service. De toute évidence, le modèle qui correspond à ces données …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.