Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
J'ai développé un système de preuve de concept pour la reconnaissance sonore en utilisant des modèles mfcc et markov cachés. Cela donne des résultats prometteurs lorsque je teste le système sur des sons connus. Bien que le système, lorsqu'un son inconnu est entré retourne le résultat avec la correspondance la …
J'ai un ensemble de données sur les cas incidents par saison d'une maladie rare. Par exemple, disons qu'il y a eu 180 cas au printemps, 90 en été, 45 en automne et 210 en hiver. Je me demande s'il est approprié de joindre des erreurs standard à ces chiffres. Les …
J'utilise libsvm et j'ai remarqué que chaque fois que j'appelle svmtrain (), je crée un nouveau modèle et qu'il ne semble pas y avoir d'option pour mettre des données dans un modèle existant. Est-ce possible de faire cependant? Suis-je tout simplement pas voir cet aspect dans libsvm?
Il s'agit clairement d'une question de définition ou de convention, et presque sans importance pratique. Si est réglé sur sa valeur traditionnelle de 0,05, une valeur de p de 0,0500000000000 ... est-elle considérée comme statistiquement significative ou non? La règle pour définir la signification statistique est-elle généralement considérée comme p …
J'analyse des données sur 300 000 élèves dans 175 écoles avec un modèle logistique linéaire à effets mixtes (interceptions aléatoires). Chaque élève se produit exactement une fois et les données s'étalent sur 6 ans. Comment répartir la variance entre les niveaux de l'école et des élèves, d'une manière similaire au …
Si vous ajustez un modèle linéaire ou un modèle mixte, il existe différents types de codages disponibles pour transformer une varibale catégorielle ou nominale en un certain nombre de variables pour lesquelles les paramètres sont estimés, tels que le conditionnement fictif (la valeur par défaut R) et le codage des …
Inspiré par cette question , je me demande si des travaux ont été effectués sur des modèles de sujet pour de grandes collections de textes extrêmement courts. Mon intuition est que Twitter devrait être une inspiration naturelle pour de tels modèles. Cependant, à partir d'une expérimentation limitée, il semble que …
J'utilise spotfire (S ++) pour l'analyse statistique dans mon projet et je dois exécuter une régression logistique multinomiale pour un grand ensemble de données. Je sais que le meilleur algorithme aurait été mlogit, mais malheureusement ce n'est pas disponible en s ++. Cependant, j'ai la possibilité d'utiliser l'algorithme glm pour …
Je veux exécuter une régression logistique binaire pour modéliser la présence ou l'absence de conflit (variable dépendante) à partir d'un ensemble de variables indépendantes sur une période de 10 ans (1997-2006), chaque année ayant 107 observations. Mes indépendants sont: dégradation des terres (catégorielle pour 2 types de dégradation); augmentation de …
Je suis un étudiant diplômé en informatique. J'ai fait une analyse factorielle exploratoire pour un projet de recherche. Mes collègues (qui dirigent le projet) utilisent SPSS, alors que je préfère utiliser R. Cela n'a pas d'importance jusqu'à ce que nous découvrions une divergence majeure entre les deux progiciels statistiques. Nous …
Un système de recommandation mesurerait la corrélation entre les évaluations de différents utilisateurs et produirait des recommandations pour un utilisateur donné sur les éléments qui pourraient l'intéresser. Cependant, les goûts changent avec le temps, de sorte que les anciennes notes peuvent ne pas refléter les préférences actuelles et vice versa. …
Quelles sont certaines approches pour classer les données avec un nombre variable de fonctionnalités? Par exemple, considérons un problème où chaque point de données est un vecteur de points x et y, et nous n'avons pas le même nombre de points pour chaque instance. Pouvons-nous traiter chaque paire de points …
La semaine prochaine, nous avons un stagiaire d'une école locale dans la maison. Le concept derrière son court stage est de se faire une idée du fonctionnement du monde réel et de la gestion de certains emplois, de l'aspect du travail quotidien, etc. Maintenant, je me demandais ce que l'on …
Cette question découle de celle posée ici à propos d'une fonction de génération de moments liés (MGF). Supposons que XXX est une variable aléatoire bornée à moyenne nulle prenant des valeurs dans [−σ,σ][−σ,σ][-\sigma, \sigma] et que G(t)=E[etX]G(t)=E[etX]G(t) = E[e^{tX}] soit son MGF. D'un lié utilisé dans une preuve de l' …
De nombreux algorithmes d'apprentissage automatique, par exemple les réseaux de neurones, s'attendent à traiter les nombres. Ainsi, lorsque vous avez des données catégorielles, vous devez les convertir. Par catégorique, je veux dire, par exemple: Marques automobiles: Audi, BMW, Chevrolet ... ID utilisateur: 1, 25, 26, 28 ... Même si les …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.