Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
Dans les études d'expression génique utilisant des puces à ADN, les données d'intensité doivent être normalisées afin que les intensités puissent être comparées entre les individus, entre les gènes. Sur le plan conceptuel et algorithmique, comment fonctionne la «normalisation quantile» et comment expliqueriez-vous cela à un non-statisticien?
C'est en quelque sorte une question ouverte mais je veux être clair. Étant donné une population suffisante, vous pourriez être en mesure d'apprendre quelque chose (c'est la partie ouverte), mais quoi que vous appreniez sur votre population, quand est-il jamais applicable à un membre de la population? D'après ce que …
Je suis tombé sur l'article d' Hervé Abdi sur la SVD généralisée. L'auteur a mentionné: Le SVD généralisé (GSVD) décompose une matrice rectangulaire et prend en compte les contraintes imposées aux lignes et aux colonnes de la matrice. Le GSVD donne une estimation généralisée pondérée des moindres carrés d'une matrice …
Je connais assez bien les modèles à effets mixtes (MEM), mais un collègue m'a récemment demandé comment ils se comparent aux modèles de croissance latente (LGM). J'ai fait un peu de recherche sur Google, et il semble que LGM soit une variante de la modélisation des équations structurelles qui est …
Fermé. Cette question est hors sujet . Il n'accepte pas actuellement les réponses. Voulez-vous améliorer cette question? Mettez à jour la question afin qu'elle soit sur le sujet pour la validation croisée. Fermé il y a 2 ans . Quelqu'un pourrait-il trouver du code R pour tracer une ellipse à …
J'utilise le clustering hiérarchique pour analyser les données de séries chronologiques. Mon code est implémenté à l'aide de la fonction MathematicaDirectAgglomerate[...] , qui génère des clusters hiérarchiques compte tenu des entrées suivantes: une matrice de distance D le nom de la méthode utilisée pour déterminer la liaison inter-cluster. J'ai calculé …
Je fais l'analyse de données de séries chronologiques par des méthodes d'espace d'état. Avec mes données, le modèle stochastique au niveau local a totalement surpassé le modèle déterministe. Mais le modèle de niveau et de pente déterministe donne de meilleurs résultats qu'avec le niveau stochastique et la pente stochastique / …
Je regroupe les distributions de probabilité en utilisant l' algorithme de propagation d'affinité et je prévois d'utiliser la divergence de Jensen-Shannon comme métrique de distance. Est-il correct d'utiliser JSD lui-même comme distance ou JSD au carré? Pourquoi? Quelles différences résulteraient du choix de l'un ou de l'autre?
Qu'est-ce qu'un test t couplé et dans quelles circonstances dois-je utiliser le test t couplé? Y a-t-il une différence entre le test t apparié et le test t par paire?
Quelqu'un peut-il me renvoyer à une bonne référence qui explique le lien entre les statistiques bayésiennes et les techniques de modélisation générative? Pourquoi utilisons-nous habituellement des modèles génératifs avec des techniques bayésiennes? Pourquoi est-il particulièrement intéressant d'utiliser les statistiques bayésiennes en l'absence de données complètes, voire pas du tout? Notez …
Comment obtiendriez-vous des moyennes horaires pour plusieurs colonnes de données, pour une période quotidienne, et afficheriez-vous les résultats pour douze "hôtes" dans le même graphique? Autrement dit, j'aimerais représenter graphiquement à quoi ressemble une période de 24 heures, pour une semaine de données. L'objectif final serait de comparer deux ensembles …
J'écris sur l'utilisation d'une «distribution de probabilité conjointe» pour un public qui serait plus susceptible de comprendre la «distribution multivariée», donc j'envisage d'utiliser la dernière. Cependant, je ne veux pas perdre de sens en faisant cela. Wikipédia semble indiquer qu'il s'agit de synonymes. Sont-ils? Sinon, pourquoi pas?
Il existe des formules en ligne bien connues pour calculer des moyennes mobiles pondérées exponentiellement et des écarts-types d'un processus . Pour la moyenne,(xn)n=0,1,2,…(xn)n=0,1,2,…(x_n)_{n=0,1,2,\dots} μn=(1−α)μn−1+αxnμn=(1−α)μn−1+αxn\mu_n = (1-\alpha) \mu_{n-1} + \alpha x_n et pour la variance σ2n=(1−α)σ2n−1+α(xn−μn−1)(xn−μn)σn2=(1−α)σn−12+α(xn−μn−1)(xn−μn)\sigma_n^2 = (1-\alpha) \sigma_{n-1}^2 + \alpha(x_n - \mu_{n-1})(x_n - \mu_n) à partir de laquelle vous …
J'utilise GNU R sur un PC Ubuntu-Lucid qui dispose de 4 processeurs. Afin d'utiliser les 4 CPU, j'ai installé le package "r-cran-multicore". Comme le manuel du paquet manque d'exemples pratiques que je comprends, j'ai besoin de conseils pour optimiser mon script afin d'utiliser les 4 CPU. Mon jeu de données …
Je recueille actuellement des données pour une expérience sur les caractéristiques psychosociales associées à l'expérience de la douleur. Dans le cadre de cela, je recueille électroniquement les mesures GSR et BP de mes participants, ainsi que diverses mesures autodéclarées et implicites. J'ai une formation psychologique et je suis à l'aise …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.