Statistiques et Big Data

Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données

2
Séries temporelles et détection d'anomalies
Je voudrais configurer un algorithme pour détecter une anomalie dans les séries temporelles, et je prévois d'utiliser le clustering pour cela. Pourquoi devrais-je utiliser une matrice de distance pour le clustering et non les données brutes des séries temporelles ?, Pour la détection de l'anomalie, j'utiliserai un clustering basé sur …

2
Combiner des classificateurs en lançant une pièce
J'étudie un cours d'apprentissage automatique et les diapositives de la conférence contiennent des informations que je trouve en contradiction avec le livre recommandé. Le problème est le suivant: il existe trois classificateurs: classificateur A offrant de meilleures performances dans la plage inférieure des seuils, classificateur B offrant de meilleures performances …






1
Notation des estimateurs (tilde vs chapeau)
1. Y a-t-il une convention de dénomination concernant le chapeau et le symbole tilde dans les statistiques? J'ai trouvé que décrit un estimateur pour ( Wikipedia ) Mais j'ai aussi trouvé que décrit un estimateur pour ( Wolfram ). Y a-t-il une différence de sens? Sur le Web, j'ai trouvé …
15 notation 

1
Comment obtenir un R au carré pour un ajustement Loess?
Comment calculer la statistique R au carré ( ) dans R pour et / ou la sortie de fonction? Par exemple pour ces données:r2r2r^2loesspredict cars.lo <- loess(dist ~ speed, cars) cars.lp <- predict(cars.lo, data.frame(speed = seq(5, 30, 1)), se = TRUE) cars.lpa deux tableaux fitpour le modèle et se.fitpour l'erreur …
15 r  r-squared  loess 

3
Comment développer un bloc de données dans R
Verrouillé . Cette question et ses réponses sont verrouillées car la question est hors sujet mais a une signification historique. Il n'accepte pas actuellement de nouvelles réponses ou interactions. Je rencontre un problème lors de l'analyse avec R. J'ai une trame de données comme celle-ci: Name | Group | Count …
15 r 

2
Comment choisir entre les différentes formules
Je pense aux formules ajustées au R proposées par: Ezekiel (1930), qui je crois est celui actuellement utilisé dans SPSS. R2adjusted=1−(N−1)(N−p−1)(1−R2)Runeréjusteré2=1-(N-1)(N-p-1)(1-R2)R^2_{\rm adjusted} = 1 - \frac{(N-1)}{(N-p-1)} (1-R^2) Olkin et Pratt (1958) R2unbiased=1−(N−3)(1−R2)(N−p−1)−2(N−3)(1−R2)2(N−p−1)(N−p+1)Runbiased2=1−(N−3)(1−R2)(N−p−1)−2(N−3)(1−R2)2(N−p−1)(N−p+1)R^2_{\rm unbiased} = 1 - \frac{(N-3)(1-R^2)}{(N-p-1)} - \frac{2(N-3)(1-R^2)^2}{(N-p-1)(N-p+1)} Dans quelles circonstances (le cas échéant) devrais-je préférer «ajusté» à «impartial» …

5
Puis-je ignorer les coefficients des niveaux de facteurs non significatifs dans un modèle linéaire?
Après avoir demandé des éclaircissements sur les coefficients du modèle linéaire ici, j'ai une question de suivi concernant les coefficients de niveaux de facteur non significatifs (valeur p élevée). Exemple: si mon modèle linéaire comprend un facteur à 10 niveaux et que seulement 3 de ces niveaux ont des valeurs …


3
Comment évaluer l'écart type?
J'ai recueilli les réponses de 85 personnes sur leur capacité à entreprendre certaines tâches. Les réponses sont sur une échelle de Likert à cinq points: 5 = Très bien, 4 = Bon, 3 = Moyen, 2 = Mauvais, 1 = Très pauvre, Le score moyen est de 2,8 et l'écart-type …


En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.