Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
J'ai un ensemble de données avec 26 fonctionnalités et 31000 lignes. C'est l'ensemble de données de 38 sujets. C'est pour un système biométrique. Je veux donc pouvoir identifier les sujets. Afin d'avoir un ensemble de tests, je sais que je dois supprimer certaines valeurs. Alors, que vaut-il mieux faire et …
J'essaie de comprendre pourquoi la somme de deux (ou plus) variables aléatoires lognormales se rapproche d'une distribution lognormale lorsque vous augmentez le nombre d'observations. J'ai regardé en ligne et je n'ai trouvé aucun résultat à ce sujet. De toute évidence, si et sont des variables lognormales indépendantes, alors par les …
Ma question est inspirée du générateur exponentiel de nombres aléatoires intégré de R , la fonction rexp(). Lorsque vous essayez de générer des nombres aléatoires distribués de façon exponentielle, de nombreux manuels recommandent la méthode de transformation inverse, comme indiqué dans cette page Wikipedia . Je suis conscient qu'il existe …
Le package R mclustutilise BIC comme critère de sélection de modèle de cluster. D'après ma compréhension, un modèle avec le BIC le plus bas devrait être sélectionné par rapport aux autres modèles (si vous ne vous souciez que du BIC). Cependant, lorsque les valeurs BIC sont toutes négatives, la Mclustfonction …
Existe-t-il une preuve que le CLT n'utilise pas de fonctions caractéristiques, une méthode plus simple? Peut-être les méthodes de Tikhomirov ou de Stein? Quelque chose de autonome que vous pouvez expliquer à un étudiant universitaire (première année de mathématiques ou de physique) et qui prend moins d'une page?
J'ai une répartition des salaires et je veux comparer la différence de moyenne pour les hommes et les femmes. Je sais qu'il y a le test T étudiant pour comparer deux moyennes mais après avoir suggéré l'ANOVA, j'ai reçu des critiques disant que l'ANOVA est pour comparer plus de deux …
Je mène des recherches pour examiner les différences de densité et de richesse en espèces de poissons lorsque j'utilise deux méthodes de recensement visuel sous-marin différentes. Mes données étaient à l'origine des données de comptage, mais elles sont généralement modifiées en densité de poisson, mais j'ai toujours décidé d'utiliser un …
Supposons que j'ai un classificateur (il pourrait s'agir de n'importe quel classificateur standard comme l'arbre de décision, la forêt aléatoire, la régression logistique, etc.) pour la détection de fraude en utilisant le code ci-dessous library(randomForest) rfFit = randomForest(Y ~ ., data = myData, ntree = 400) # A very basic …
Notre prof ne se lance pas dans les mathématiques ou même la représentation géométrique de la régression linéaire multiple et cela m'a légèrement confus. D'une part, il est toujours appelé régression linéaire multiple , même dans des dimensions plus élevées. D'un autre côté, si nous avons par exemple et que …
Quelle est la bonne façon de spécifier un modèle de différence de différence avec des données de panneau de niveau individuel? Voici la configuration: Supposons que j'ai des données de panel au niveau individuel intégrées dans les villes pendant plusieurs années et le traitement varie au niveau de la ville-année. …
J'ai une demi-heure de données sur la demande, qui est une série chronologique multi-saisonnière. J'ai utilisé tbatsdans le forecastpackage en R, et obtenu des résultats comme celui-ci: TBATS(1, {5,4}, 0.838, {<48,6>, <336,6>, <17520,5>}) Cela signifie-t-il que la série ne doit pas nécessairement utiliser la transformation de Box-Cox et que le …
Je me demandais s'il y avait des techniques d'apprentissage automatique (non supervisées) pour modéliser des données longitudinales? J'ai toujours utilisé des modèles d'effets mixtes (principalement non linéaires) mais je me demandais s'il y avait d'autres façons de le faire (en utilisant l'apprentissage automatique). Par apprentissage automatique, je veux dire forêt …
Je recherche un modèle entre les cours de l'énergie et la météo. J'ai le prix du MWatt acheté entre les pays d'Europe, et beaucoup de valeurs sur la météo (fichiers Grib). Chaque heure sur une période de 5 ans (2011-2015). Prix / jour C'est par jour pendant un an. J'ai …
J'ai déjà suivi un cours de ML, mais maintenant que je travaille avec des projets liés au ML dans mon travail, j'ai beaucoup de mal à l'appliquer. Je suis sûr que les trucs que je fais ont déjà fait l'objet de recherches / traités, mais je ne trouve pas de …
Récemment, nous avons vu l'émergence du réseau neuronal résiduel, dans lequel, chaque couche se compose d'un module de calcul et d'une connexion de raccourci qui préserve l'entrée de la couche telle que la sortie de la ième couche présente: Le réseau permet d'extraire les caractéristiques résiduelles et permet une profondeur …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.