Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
Pourriez-vous me donner quelques précisions sur l'exploration de données et les algorithmes d'intelligence artificielle? Pour quelle base mathématique ils ont utilisé? Pourriez-vous me donner un point de départ, en mathématiques, pour comprendre ces types d'algorithmes?
J'essaie de décomposer une matrice de covariance basée sur un ensemble de données clairsemé / gappy. Je remarque que la somme de lambda (variance expliquée), telle que calculée avec svd, est amplifiée avec des données de plus en plus pertinentes. Sans lacunes, svdet eigenobtenez les mêmes résultats. Cela ne semble …
J'utilise le package randomForest dans R et j'utilise les données d'iris, la forêt aléatoire générée est une classification mais lorsque j'utilise un ensemble de données avec environ 700 entités (les entités sont chaque pixel dans une image de 28 x 28 pixels) et la colonne d'étiquette est nommée label, le …
Considérez-vous le HBM vs EB comme deux alternatives dans lesquelles les hyperparamètres sont "dans le jeu" d'être échantillonnés / estimés / etc.? Il y a clairement un lien entre ces deux. Considérez-vous HBM plus "pleinement bayésien" qu'EB? Y a-t-il un endroit où je peux voir quelles sont les différences entre …
Est-il possible d'obtenir une corrélation positive entre un régresseur et une réponse ( +0,43) et, par la suite, d'obtenir un coefficient négatif dans le modèle de régression ajusté pour ce régresseur? Je ne parle pas de changements dans le signe du régresseur parmi certains modèles. Le signe du coefficient reste …
C'est probablement une question très fondamentale, mais je ne semble pas être en mesure d'y trouver une réponse solide. J'espère ici, je peux. Je lis actuellement des articles en préparation de ma propre thèse de maîtrise. Actuellement, je lis un article qui étudie la relation entre les tweets et les …
J'ai exécuté un SVM sur un ensemble de données donné et j'ai fait l'observation suivante: Si je modifie le nombre de fonctionnalités pour la construction du classificateur, le nombre de vecteurs de support résultants sera également modifié. Je voudrais savoir comment expliquer ce genre de scénario.
Les bayésiens soutiennent-ils que leur approche généralise l'approche fréquentiste, parce que l'on peut utiliser des priors non informatifs et donc, récupérer une structure de modèle fréquentiste typique? Quelqu'un peut-il me référer à un endroit où je pourrai lire cet argument, s'il est effectivement utilisé? EDIT: Cette question n'est peut-être pas …
Supposons que j'ai une matrice de recommandations de style Netflix et que je souhaite créer un modèle qui prédit les futures classifications de films potentielles pour un utilisateur donné. En utilisant l'approche de Simon Funk, on utiliserait la descente de gradient stochastique pour minimiser la norme Frobenius entre la matrice …
Existe-t-il un bon compte rendu publié, avec des détails mathématiques, des différentes approches qui ont été adoptées pour le problème de Behrens – Fisher?
Pour un récent concours Kaggle, j'ai (manuellement) défini 10 fonctionnalités supplémentaires pour mon ensemble d'entraînement, qui seraient ensuite utilisées pour former un classificateur de forêts aléatoires. J'ai décidé d'exécuter PCA sur l'ensemble de données avec les nouvelles fonctionnalités, pour voir comment elles se comparaient les unes aux autres. J'ai trouvé …
Les chercheurs utilisent souvent deux mesures qui ont des éléments très similaires et affirment qu'ils mesurent des choses différentes (par exemple, "je m'inquiète toujours quand je suis près des voitures"; "j'ai peur des voitures"). Appelons les mesures hypothétiques la mesure de la peur des voitures et de l'anxiété à l'échelle …
Je suis en train de développer empiriquement un questionnaire et j'utiliserai des nombres arbitraires dans cet exemple pour illustrer. Pour le contexte, je développe un questionnaire psychologique visant à évaluer les schémas de pensée couramment identifiés chez les personnes souffrant de troubles anxieux. Un article pourrait ressembler à "J'ai besoin …
Fermé . Cette question a besoin de détails ou de clarté . Il n'accepte pas actuellement les réponses. Voulez-vous améliorer cette question? Ajoutez des détails et clarifiez le problème en modifiant ce message . Fermé il y a 5 ans . J'ai travaillé avec des données de temps de cycle …
Quelle est la relation entre l'analyse discriminante linéaire et la règle de Bayes? Je comprends que la LDA est utilisée dans la classification en essayant de minimiser le rapport entre la variance intra-groupe et entre la variance entre groupes, mais je ne sais pas comment la règle de Bayes l'utilise.
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.