Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
J'ai un ensemble de données qui contient environ 7 500 analyses de sang d'environ 2 500 personnes. J'essaie de savoir si la variabilité des tests sanguins augmente ou diminue avec le temps entre deux tests. Par exemple - je prélève votre sang pour le test de base, puis je tire …
Je suis intéressé à obtenir un intervalle de confiance bootstrap sur la quantité X, lorsque cette quantité est mesurée 10 fois pour chacun des 10 individus. Une approche consiste à obtenir la moyenne par individu, puis à amorcer les moyennes (par exemple, rééchantillonner les moyennes avec remplacement). Une autre approche …
Il existe de nombreuses références dans la littérature statistique aux " données fonctionnelles " (c'est-à-dire les données qui sont des courbes) et, en parallèle, aux " données de haute dimension " (c'est-à-dire lorsque les données sont des vecteurs de grande dimension). Ma question concerne la différence entre les deux types …
Les tests de Wald, de rapport de vraisemblance et de multiplicateur de Lagrange dans le contexte de l'estimation du maximum de vraisemblance sont asymptotiquement équivalents. Cependant, pour les petits échantillons, ils ont tendance à diverger un peu, et dans certains cas, ils aboutissent à des conclusions différentes. Comment peuvent-ils être …
Une autre question sur les séries chronologiques de ma part. J'ai un ensemble de données qui donne des enregistrements quotidiens des incidents violents dans un hôpital psychiatrique sur trois ans. Avec l'aide de ma question précédente, je l'ai manipulé et j'en suis un peu plus heureux maintenant. Ce que j'ai …
Quelles sont les bonnes bibliothèques de visualisation pour une utilisation en ligne? Sont-ils faciles à utiliser et existe-t-il une bonne documentation?
Je propose d'essayer de trouver une tendance dans certaines données à long terme très bruyantes. Les données sont essentiellement des mesures hebdomadaires de quelque chose qui s'est déplacé d'environ 5 mm sur une période d'environ 8 mois. Les données ont une précision de 1 mm et sont très bruyantes, changeant …
Dans l'apprentissage informatique, le théorème de la NFL déclare qu'il n'y a pas d'apprenant universel. Pour chaque algorithme d'apprentissage, il existe une distribution qui amène l'apprenant à émettre une hypotesis avec une grande erreur, avec une probabilité élevée (bien qu'il y ait une hypotesis à faible erreur). La conclusion est …
Un patient est admis à l'hôpital. Leur durée de séjour dépend de deux choses: la gravité de leur blessure et le montant que leur assurance est prête à payer pour les garder à l'hôpital. Certains patients partiront prématurément si leur assurance décide de ne plus payer leur séjour. Supposons ce …
Fermé . Cette question est basée sur l'opinion . Il n'accepte pas actuellement les réponses. Vous souhaitez améliorer cette question? Mettez à jour la question afin d'y répondre avec des faits et des citations en modifiant ce message . Fermé l'année dernière . En parcourant le domaine de recherche du …
J'étudie actuellement la visualisation de données de grande dimension à l'aide de t-SNE. J'ai quelques données avec des variables binaires et continues mixtes et les données semblent regrouper les données binaires beaucoup trop facilement. Bien sûr, cela est prévu pour les données échelonnées (entre 0 et 1): la distance euclidienne …
Le processus de Dirichlet et le processus gaussien sont souvent appelés «distributions sur fonctions» ou «distributions sur distributions». Dans ce cas, puis-je parler de manière significative de la densité d'une fonction sous un GP? Autrement dit, le processus gaussien ou le processus de Dirichlet ont-ils une notion de densité de …
Existe-t-il une justification du nombre d'observations par grappe dans un modèle à effet aléatoire? J'ai un échantillon de 1 500 avec 700 grappes modélisées comme un effet aléatoire échangeable. J'ai la possibilité de fusionner des clusters afin d'en construire moins, mais des clusters plus grands. Je me demande comment puis-je …
Supposons que je m'intéresse à un modèle de régression linéaire, pour , car je voudrais voir si une interaction entre les deux covariables a un effet sur Y.Yi=β0+β1x1+β2x2+β3x1x2Yi=β0+β1x1+β2x2+β3x1x2Y_i = \beta_0 + \beta_1x_1 + \beta_2x_2 + \beta_3x_1x_2 Dans les notes de cours d'un professeur (avec qui je n'ai pas de contact), …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.