Statistiques et Big Data

Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données

2
Comment utilisez-vous le lissage exponentiel simple dans R?
Je suis débutant en R, pourriez-vous expliquer comment utiliser ses dans le package de prévision de la prévision R ? Je voudrais choisir le nombre de périodes initiales et la constante de lissage. d <- c(3,4,41,10,9,86,56,20,18,36,24,59,82,51,31,29,13,7,26,19,20,103,141,145,24,99,40,51,72,58,94,78,11,15,17,53,44,34,12,15,32,14,15,26,75,110,56,43,19,17,33,26,40,42,18,24,69,18,18,25,86,106,104,35,43,12,4,20,16,8) J'ai 70 périodes, je voudrais utiliser 40 périodes pour l'initiale et 30 pour la …





2
Apprendre des données relationnelles
Paramètres De nombreux algorithmes fonctionnent sur une seule relation ou table, tandis que de nombreuses bases de données réelles stockent des informations dans plusieurs tables (Domingos, 2003). Question Quels types d'algorithmes apprennent bien à partir de plusieurs tables (relationnelles). En particulier, je m'intéresse aux algorithmes applicables aux tâches de régression …

3
Signe retournant lors de l'ajout d'une variable de régression et avec une ampleur beaucoup plus grande
Configuration de base: modèle de régression: où C est le vecteur des variables de contrôle.y= constante + β1X1+ β2X2+ β3X3+ β4X4+ α C+ ϵy=constant+β1x1+β2x2+β3x3+β4x4+αC+ϵy = \text{constant} +\beta_1x_1+\beta_2x_2+\beta_3x_3+\beta_4x_4+\alpha C+\epsilon Je suis intéressé par et m'attends à ce que et soient négatifs. Cependant, il existe un problème de multicolinéarité dans le modèle, …

1
Un parallèle entre LSA et pLSA
Dans l'article original de pLSA, l'auteur, Thomas Hoffman, établit un parallèle entre les structures de données pLSA et LSA dont je voudrais discuter avec vous. Contexte: S'inspirant de la recherche d'informations, nous supposons que nous avons une collection de documents et un vocabulaire de termesNNND={d1,d2,....,dN}D={d1,d2,....,dN}D = \lbrace d_1, d_2, ...., …

4
Box Cox se transforme pour la régression
J'essaie d'adapter un modèle linéaire sur certaines données avec un seul prédicteur (disons (x, y)). Les données sont telles que pour les petites valeurs de x, les valeurs y donnent un ajustement serré à une ligne droite, mais à mesure que les valeurs x augmentent, les valeurs y deviennent plus …





4
Comment tracer 20 ans de données quotidiennes en séries chronologiques
J'ai le jeu de données suivant: https://dl.dropbox.com/u/22681355/ORACLE.csv et je voudrais tracer les changements quotidiens dans «Ouvrir» par «Date», j'ai donc fait ce qui suit: oracle <- read.csv(file="http://dl.dropbox.com/u/22681355/ORACLE.csv", header=TRUE) plot(oracle$Date, oracle$Open, type="l") et j'obtiens ce qui suit: Maintenant, ce n'est évidemment pas le plus beau tracé jamais, alors je me demande …

2
Distributions sur des sous-ensembles de
Je me demande s'il y a toutes sortes de distributions standard sur des sous - ensembles d'entiers {1,2,...,J}{1,2,...,J}\{1, 2, ..., J\} . De manière équivalente, nous pourrions exprimer cela comme une distribution sur un vecteur de longueur JJJ de résultats binaires, par exemple si J=5J=5J = 5 alors {1,3,5}{1,3,5}\{1, 3, …

En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.