Statistiques et Big Data

Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données

1
Régression des moindres carrés partiels dans R: pourquoi le PLS sur des données standardisées n'est-il pas équivalent à maximiser la corrélation?
Je suis très nouveau dans les moindres carrés partiels (PLS) et j'essaie de comprendre la sortie de la fonction R plsr()dans le plspackage. Simulons les données et exécutons le PLS: library(pls) n <- 50 x1 <- rnorm(n); xx1 <- scale(x1) x2 <- rnorm(n); xx2 <- scale(x2) y <- x1 + …

2
Test statistique pour une valeur nettement plus éloignée de la moyenne de la population: s'agit-il d'un test Z ou d'un test T?
Quelle est l'importance d'une valeur par rapport à une liste de valeurs? Dans la plupart des cas, les tests statistiques consistent à comparer un ensemble d'échantillons à une population. Dans mon cas, l'échantillon est constitué d'une valeur et nous le comparons à la population. Je suis un dilettante dans les …



1
Étapes pour comprendre une distribution postérieure alors qu'elle pourrait être assez simple pour avoir une forme analytique?
Cela a également été demandé à Computational Science. J'essaie de calculer une estimation bayésienne de certains coefficients pour une autorégression, avec 11 échantillons de données: Ouije= μ + α ⋅Ouii - 1+ ϵjeOuije=μ+α⋅Ouije-1+ϵje Y_{i} = \mu + \alpha\cdot{}Y_{i-1} + \epsilon_{i} oùϵjeϵje\epsilon_{i} est gaussien avec moyenne 0 et varianceσ2eσe2\sigma_{e}^{2} La distribution …


2
Une ingénierie des fonctionnalités indépendante du domaine qui conserve une signification sémantique?
L'ingénierie des fonctionnalités est souvent un élément important de l'apprentissage automatique (elle a été largement utilisée pour remporter la Coupe KDD en 2010 ). Cependant, je trouve que la plupart des techniques d'ingénierie des fonctionnalités détruire toute signification intuitive des caractéristiques sous-jacentes ou sont très spécifiques à un domaine particulier …




2
Ajustement de la valeur de p pour l'analyse séquentielle adaptative (pour le test du chi carré)?
Je souhaite savoir quelle littérature statistique est pertinente pour le problème suivant, et peut-être même une idée sur la façon de le résoudre. Imaginez le problème suivant: Nous avons 4 traitements possibles pour certaines maladies. Afin de vérifier quel traitement est le meilleur, nous effectuons un essai spécial. Dans l'essai, …



1
Nom de l'erreur moyenne absolue analogue au score de Brier?
La question d'hier Déterminer l'exactitude du modèle qui estime la probabilité d'un événement m'a rendu curieux au sujet de la notation des probabilités. Le score de Brier est une mesure d'erreur quadratique moyenne. Est-ce que l'analogue signifie une mesure absolue des performances d'erreur absolue avoir un nom aussi?1N∑i=1N(predictioni−referencei)21N∑i=1N(predictioni−referencei)2\frac{1}{N}\sum\limits _{i=1}^{N}(prediction_i - …


En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.