Statistiques et Big Data

Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données


4
Comment gérer les lacunes / NaN dans les données de séries chronologiques lors de l'utilisation de Matlab pour l'autocorrélation et les réseaux de neurones?
J'ai une série chronologique de mesures (séries de hauteurs unidimensionnelles). Au cours de la période d'observation, le processus de mesure s'est interrompu pendant quelques instants. Ainsi, les données résultantes sont un vecteur avec NaN où il y avait des lacunes dans les données. L'utilisation de MATLAB me pose un problème …


3
Prise de corrélation avant ou après transformation logarithmique des variables
Existe-t-il un principe général permettant de calculer la corrélation de Pearson pour deux variables aléatoires X et Y avant de prendre leur transformation logarithmique ou après? Existe-t-il une procédure de test qui est plus appropriée? Ils donnent des valeurs similaires mais différentes, car la transformation logarithmique est non linéaire. Cela …

4
Ordre le plus efficace pour apprendre LaTeX, Sweave, Beamer? [fermé]
Fermé. Cette question est hors sujet . Il n'accepte pas actuellement les réponses. Vous souhaitez améliorer cette question? Mettez à jour la question afin qu'elle soit sur le sujet pour la validation croisée. Fermé il y a 3 ans . Je suis très intéressé à apprendre à créer des rapports …
9 r 

1
Création d'un modèle de Markov à entropie maximale à partir d'un classificateur d'entropie maximale à entrées multiples existant
Je suis intrigué par le concept d'un modèle de Markov à entropie maximale (MEMM) et je songe à l'utiliser pour un marqueur de partie de la parole (POS). En ce moment, j'utilise un classificateur conventionnel d'entropie maximale (ME) pour baliser chaque mot individuel. Cela utilise un certain nombre de fonctionnalités, …

7
Recherche de données artificielles 2D pour démontrer les propriétés des algorithmes de clustering
Je recherche des ensembles de données de points de données bidimensionnels (chaque point de données est un vecteur de deux valeurs (x, y)) suivant différentes distributions et formes. Un code pour générer de telles données serait également utile. Je veux les utiliser pour tracer / visualiser le fonctionnement de certains …

4
Test de différence significative dans les ratios de variables aléatoires normalement distribuées
Lié à l' analyse des ratios de variables et comment paramétrer le ratio de deux variables normalement distribuées, ou l'inverse d'une? . Supposons que je dispose d'un certain nombre d'échantillons provenant de quatre distributions aléatoires continues différentes, que nous pouvons tous supposer être à peu près normales. Dans mon cas, …

1
Filtre à particules dans R - exemple de code trivial
Je cherche un exemple de code simple sur la façon d'exécuter un filtre à particules dans R. Le package pomp semble prendre en charge le bit mathématique de l'espace d'état, mais les exemples sont un peu difficiles à suivre par programme pour un développeur OO simple comme moi, en particulier …
9 r 



1
Quelle est la différence entre GLM et GEE?
Quelle est la différence entre un modèle GLM (régression logistique) avec une variable de réponse binaire qui inclut le sujet et le temps comme covariables et le modèle GEE analogue qui prend en compte la corrélation entre les mesures à plusieurs moments? Mon GLM ressemble à: Y(binary) ~ A + …


2
Erreur lors de l'exécution de glmnet en multinomial [fermé]
Fermé. Cette question est hors sujet . Il n'accepte pas actuellement les réponses. Vous souhaitez améliorer cette question? Mettez à jour la question afin qu'elle soit sur le sujet pour la validation croisée. Fermé il y a 9 mois . Le problème mentionné dans cette question est résolu dans la …
9 r  multinomial  glmnet 


En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.