Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
Dans le premier chapitre de l'ouvrage Algebraic Geometry and Statistical Learning Theory qui parle de la convergence des estimations dans différents espaces fonctionnels, il mentionne que l'estimation bayésienne correspond à la topologie de la distribution de Schwartz, tandis que l'estimation du maximum de vraisemblance correspond à la topologie sup-normale (à …
Des recommandations pour le choix d'une bibliothèque d'optimisation contrainte adaptée à ma fonction d'optimisation? Je minimise ai) une fonction non linéaire avec des contraintes d'égalité et d'inégalité linéaires, et ii) dispose du gradient et de la toile de jute de la fonction. Si cela aide, la fonction que je minimise …
J'essaie de reproduire un algorithme de prédiction existant, transmis par un chercheur à la retraite. La première étape consiste à ajuster certaines données observées à une distribution de Weibull, pour obtenir une forme et une échelle qui seront utilisées pour prédire les valeurs futures. J'utilise R pour ce faire. Voici …
J'ai rencontré ces deux termes qui sont utilisés de manière interchangeable dans de nombreux contextes. Fondamentalement, un modérateur (M) est un facteur qui influe sur la relation entre X et Y. L'analyse de modération se fait généralement à l'aide d'un modèle de régression. Par exemple, le sexe (M) peut affecter …
Dans l'analyse des données de panel, j'ai utilisé des modèles à plusieurs niveaux avec des effets aléatoires / mixtes pour traiter les problèmes d'auto-corrélation (c.-à-d., Les observations sont regroupées au sein des individus au fil du temps) avec d'autres paramètres ajoutés pour s'adapter à certaines spécifications de temps et de …
Dans un article de recherche sur l'analyse de sensibilité d'un modèle d'équation différentielle ordinaire d'un système dynamique, l'auteur a fourni la distribution d'un paramètre de modèle en tant que distribution normale (moyenne = 1e-4, std = 3e-5) tronquée à la plage [0,5e -4 1,5e-4]. Il utilise ensuite des échantillons de …
Tout d'abord, je voudrais décrire quelques dispositions courantes que les livres d'exploration de données utilisent pour expliquer comment traiter les ensembles de données non équilibrés . Habituellement, la section principale est intitulée Ensembles de données non équilibrés et couvre ces deux sous-sections: Techniques de classification et d'échantillonnage sensibles aux coûts. …
Lors de la dichotomisation des variables, quelles informations sont perdues dans le processus? Comment une dichotomisation aide-t-elle dans les analyses?
C'est une question naïve de quelqu'un qui commence à apprendre le machine learning. Je lis ces jours-ci le livre "Machine Learning: An algorithmic perspective" de Marsland. Je le trouve utile comme livre d'introduction, mais maintenant je voudrais entrer dans les algorithmes avancés, ceux qui donnent actuellement les meilleurs résultats. Je …
Tout d' abord, je suppose que pas tous les membres actifs de ce site intéressant sont les statisticiens que leur travail. Sinon, la question posée comme suit n'a aucun sens! Je les respecte bien sûr, mais j'ai besoin d'une explication un peu plus pratique que conceptuelle. Je commence par un …
Je suis novice dans les statistiques et R et j'ai un problème avec l'utilisation de la fonction Levene (je voudrais vérifier l'égalité de variance de deux échantillons). La documentation indique que je devrais exécuter: levene.test (y, groupe) Mais je n'ai aucune idée de ce que je devrais mettre en tant …
Très simplement: y a-t-il des différences dans les approches bayésienne et fréquentiste de l'analyse des données exploratoires? Je ne connais aucun biais inhérent aux méthodes de l'EDA car un histogramme est un histogramme, un nuage de points est un nuage de points, etc., et je n'ai pas trouvé d'exemples de …
J'ai quelques doutes quant à la compréhension intuitive des SVM. Supposons que nous ayons formé un modèle SVM pour la classification en utilisant un outil standard comme SVMLight ou LibSVM. Lorsque nous utilisons ce modèle pour la prédiction sur les données de test, le modèle génère un fichier ayant des …
Est-il approprié de faire une régression logistique où les variables dépendantes et indépendantes sont binaires? par exemple, la variable dépendante est 0 et 1 et les prédicteurs sont des variables codées par contraste -1 et 1?
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.