Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
J'ai une question qui m'occupe depuis un moment. Le test d'entropie est souvent utilisé pour identifier les données chiffrées. L'entropie atteint son maximum lorsque les octets des données analysées sont distribués uniformément. Le test d'entropie identifie les données chiffrées, car ces données ont une distribution uniforme, comme les données compressées, …
J'essaie d'effectuer une analyse de croissance de classe latente (LCGA) et / ou des modèles de mélange de croissance (GMM) dans R. Les données que j'utilise sont un nombre croissant de fourchettes de référentiels git (variable discrète, non catégorique), comme vous pouvez voir dans cet ensemble de données . J'ai …
Comment puis-je calculer la sensibilité et la spécificité (ou des mesures analogues) d'un test de diagnostic continu pour prédire un résultat continu (par exemple, la pression artérielle) sans dichotomiser le résultat? Des idées? Il semble que les chercheurs l'ont fait en utilisant la modélisation à effets mixtes (voir le lien …
J'ai des questions sur la façon d'analyser les données classées. Les données ressemblent à ceci: 4 groupes de personnes vivant avec le VIH et 16 autres groupes de personnes vivant dans le même village ont été invités à classer 12 défis pour les personnes vivant avec le VIH selon leur …
J'ai quelques données dans lesquelles il y a 5 variables explicatives catégoriques ( concern, breath, weath, sleep, act) et 1 variable de réponse continue ( tto). De plus, chaque variable explicative catégorielle est divisée en 5 niveaux qui montrent à quel point une personne en est convaincue. les niveaux 1 …
Je ne suis pas un assistant en mathématiques, alors veuillez garder votre réponse assez simple. Je dois terminer un examen de dépistage des statistiques pour un cours de méthodes plus tard dans la journée, et je suis accroché à un sujet qui a été soulevé lors du test de pratique. …
J'utilise actuellement R pour prédire une série chronologique avec ces instructions: X <- ts(datas, frequency=24) X.arima <- Arima(X, order=c(2,1,0), seasonal=c(1,1,1)) pred <- predict(X.arima, n.ahead=24) plot.ts(pred$pred) Comme vous pouvez le voir, j'ai des données toutes les heures, et j'ai choisi la période saisonnière de 24 (un jour). Je voudrais améliorer mes …
Les données sont constituées de spectres optiques (intensité lumineuse en fonction de la fréquence) enregistrés à différents moments. Les points ont été acquis sur une grille régulière en x (temps), y (fréquence). Afin d'analyser l'évolution du temps à des fréquences spécifiques (une montée rapide, suivie d'une décroissance exponentielle), je voudrais …
Les méthodes d'apprentissage à noyaux multiples visent à construire un modèle de noyau où le noyau est une combinaison linéaire de noyaux à base fixe. L'apprentissage du noyau consiste alors à apprendre les coefficients de pondération pour chaque noyau de base, plutôt que d'optimiser les paramètres du noyau d'un seul …
Le problème du monde réel Un de mes clients s'apprête à envoyer un publipostage à sa liste d'utilisateurs abonnés, et ce défi statistique s'est posé. Leur équipe marketing dispose de 3 brochures différentes et souhaite savoir quelle brochure obtient le taux de réponse le plus élevé. Ils aimeraient également savoir …
Je travaille sur un petit projet, qui est actuellement au stade de développement précoce. Ce que j'essaie de comprendre, c'est comment générer de la musique aléatoire, en particulier des notes. En faisant des recherches sur Google, je n'ai réussi qu'à trouver un générateur de notes de rançon et beaucoup de …
Tout en suivant un cours de statistique pour les étudiants en médecine, j'ai rencontré un problème lié aux taux d'incidence. Le contexte du problème est un chapitre sur la distribution de Poisson. Dans le problème, 2300 fumeurs sont suivis sur une période d'un an au cours de laquelle 24 d'entre …
Quelqu'un a-t-il un bref exemple pédagogique sur la façon d'utiliser les réseaux de neurones ( nnetdans R par exemple) à des fins de prédiction? Voici un exemple, en R, d'une série chronologique T <- seq(0,20,length=200) Y <- 1 + 3*cos(4*T+2) +.2*T^2 + rnorm(200) plot(T,Y,type="l") Ce n'est qu'un exemple, mais ce …
J'ai fait des recherches sur le package de souris et je n'ai pas encore découvert de moyen d'utiliser les multiples imputations pour créer un modèle Cox, puis valider ce modèle avec la fonction du package rmsvalidate() . Voici un exemple de code de ce que j'ai jusqu'à présent, en utilisant …
À titre de suivi de la suggestion du modèle pour une régression de Cox avec des covariables dépendantes du temps, voici le tracé de Kaplan Meier qui tient compte de la nature dépendante du temps des grossesses. En d'autres termes, l'ensemble de données est maintenant décomposé en un long ensemble …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.