Statistiques et Big Data

Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données

4
Quelles sont les différences entre les termes «analyse des séries chronologiques» et «analyse des données longitudinales»
Lorsque nous parlons de données longitudinales, nous pouvons faire référence aux données collectées au fil du temps auprès du même sujet / unité d'étude à plusieurs reprises, il existe donc des corrélations pour les observations au sein du même sujet, c'est-à-dire la similitude intra-sujet. Lorsque nous parlons de données de …

2
Comment exécuter une analyse de régression logistique ordinale dans R avec des valeurs numériques / catégorielles?
Données de base : j'ai environ 1 000 personnes marquées par des évaluations: «1», [bon] «2», [moyen] ou «3» [mauvais] - ce sont les valeurs que j'essaie de prédire pour les personnes à l'avenir . En plus de cela, j'ai quelques informations démographiques: sexe (catégorique: H / F), âge (numérique: …

3
Pourquoi avons-nous besoin d'encodeurs automatiques?
Récemment, j'ai étudié les encodeurs automatiques. Si j'ai bien compris, un autoencodeur est un réseau neuronal où la couche d'entrée est identique à la couche de sortie. Ainsi, le réseau neuronal essaie de prédire la sortie en utilisant l'entrée comme standard d'or. Quelle est l'utilité de ce modèle? Quels sont …



4
Quelle est la relation entre
Je me demandais s'il y avait une relation entre R2R2R^2 et un test F. Habituellement , R2=∑(Y^t−Y¯)2/T−1∑(Yt−Y¯)2/T−1R2=∑(Y^t−Y¯)2/T−1∑(Yt−Y¯)2/T−1R^2=\frac {\sum (\hat Y_t - \bar Y)^2 / T-1} {\sum( Y_t - \bar Y)^2 / T-1} et il mesure la force de la relation linéaire dans la régression. Un test F prouve simplement une …

1
Attente conditionnelle du R au carré
Considérez le modèle linéaire simple: yy=X′ββ+ϵyy=X′ββ+ϵ\pmb{y}=X'\pmb{\beta}+\epsilon où et , et contient une colonne des constantes.ϵi∼i.i.d.N(0,σ2)ϵi∼i.i.d.N(0,σ2)\epsilon_i\sim\mathrm{i.i.d.}\;\mathcal{N}(0,\sigma^2)X∈Rn×pX∈Rn×pX\in\mathbb{R}^{n\times p}p≥2p≥2p\geq2XXX Ma question est, étant donné , et , existe-t-il une formule pour une borne supérieure non triviale sur *? (en supposant que le modèle a été estimé par OLS).E(X′X)E(X′X)\mathrm{E}(X'X)ββ\betaσσ\sigmaE(R2)E(R2)\mathrm{E}(R^2) * J'ai supposé, en écrivant …




3
Ajustement de la distribution t dans R: paramètre d'échelle
Comment ajuster les paramètres d'une distribution t, c'est-à-dire les paramètres correspondant à la «moyenne» et à «l'écart-type» d'une distribution normale. Je suppose qu'ils sont appelés «moyenne» et «échelle / degrés de liberté» pour une distribution t? Le code suivant entraîne souvent des erreurs «échec de l'optimisation». library(MASS) fitdistr(x, "t") Dois-je …



5
Pourquoi mon R au carré est-il si bas alors que mes statistiques t sont si grandes?
J'ai effectué une régression avec 4 variables, et toutes sont très statistiquement significatives, avec des valeurs T ≈7,9,26≈7,9,26\approx 7,9,26 et 313131 (je dis ≈≈\approx car il ne semble pas pertinent d'inclure les décimales) qui sont très élevées et clairement significatives. Mais alors le R2R2R^2 est seulement .2284. Suis-je mal interprété …


En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.