Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
Lors du développement d'un logiciel de séries chronologiques à usage général, est-ce une bonne idée de le rendre invariant à l'échelle? Comment ferait-on cela? J'ai pris une série chronologique d'environ 40 points, puis multipliée par des facteurs allant de 10E-9 à 10E3, puis j'ai parcouru les fonctions ARIMA de Forecast …
Selon l'aide de Microsoft Excel: VAR utilise la formule suivante: où x est la MOYENNE moyenne de l'échantillon (nombre1, nombre2,…) et n est la taille de l'échantillon. Ne devrait-il pas être n, plutôt que n - 1, dans le dénominateur?
Fermé. Cette question est hors sujet . Il n'accepte pas actuellement de réponses. Voulez-vous améliorer cette question? Mettez à jour la question afin qu'elle soit sur le sujet pour la validation croisée. Fermé il y a 4 ans . J'ai un ensemble de données avec une structure semblable à un …
J'ai été horrifié de découvrir récemment que Matlab renvoie pour la variance d' échantillon d'une entrée scalaire:000 >> var(randn(1),0) %the '0' here tells var to give sample variance ans = 0 >> var(randn(1),1) %the '1' here tells var to give population variance ans = 0 D'une certaine manière, la variance …
Bonjour chers collègues Je veux générer n scores aléatoires (avec une étiquette de classe) comme s'ils avaient été produits par un modèle de classification binaire. En détail, les propriétés suivantes sont requises: chaque score est compris entre 0 et 1 chaque score est associé à une étiquette binaire avec des …
J'ai un fichier assez volumineux de 100 millions de lignes et 30 colonnes environ, sur lequel j'aimerais exécuter plusieurs régressions. J'ai un code spécialisé pour exécuter les régressions sur l'ensemble du fichier, mais ce que je voudrais faire est de tirer des échantillons aléatoires du fichier et de les exécuter …
Je suis un débutant dans les statistiques, donc si je fais des hypothèses erronées ici, dites-le moi. Il y a une population N. (Par exemple, Npeut être 1 000 000.) Certaines personnes sont des rousses. Je prends un échantillon nde personnes (disons 10) et je trouve que jce sont des …
J'ai regardé certains des packages de la vue de tâche High perf traitant des calculs GPU, et étant donné que la plupart des GPU semblent être d'un ordre de grandeur plus forts pour effectuer des calculs arithmétiques en simple précision que ceux DP , je me demandais: Pourquoi aucun des …
J'ai un ensemble de données où je dois faire une régression linéaire. Malheureusement, il existe un problème d'hétéroscédasticité. J'ai relancé l'analyse en utilisant une régression robuste avec l'estimateur HC3 pour la variance et j'ai également effectué un bootstrap avec la fonction bootcov dans Hmisc pour R. Les résultats sont assez …
Je voulais savoir quels types d'utilisations différentes de la théorie des processus stochastiques en EE & CS existent. Par exemple, je trouve ces types d'utilisations intéressants: utilisant un signal stochastique comme porteuse qui est modulée par le signal d'information pour la communication utilisant l'analyse de processus stochastique pour améliorer les …
J'ai vu quelques requêtes sur le clustering dans les séries temporelles et spécifiquement sur le clustering, mais je ne pense pas qu'elles répondent à ma question. Contexte: Je souhaite regrouper les gènes dans une expérience de cours de temps dans la levure. Il y a quatre points de temps disent: …
J'ai une dizaine de groupes (d'entreprises). Chaque groupe est connecté avec l'autre groupe. Les données dont je dispose représentent la force de la connexion. Imaginez que c'est le nombre de fois qu'un membre du groupe A a envoyé un e-mail au groupe B. La force d'une connexion peut être 0. …
Ceci fait suite à cette question. J'essaie actuellement d'implémenter le C-Index afin de trouver un nombre presque optimal de clusters à partir d'une hiérarchie de clusters. Je le fais en calculant le C-Index pour chaque étape du clustering hiérarchique (agglomératif). Le problème est que l'indice C est minimal (0 pour …
Quel est le meilleur package pour faire une analyse de survie et des tracés dans R? J'ai essayé quelques tutoriels mais je n'ai pas trouvé de réponse définitive. TIA
Je souhaite adapter un modèle de type analyse factorielle sur les rendements des actifs ou d'autres modèles de variables latentes similaires. Quels sont les bons articles à lire sur ce sujet? Je m'intéresse particulièrement à la façon de gérer le fait qu'un modèle d'analyse factorielle est identique sous un changement …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.