Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
J'utilise plm()pour estimer les modèles à effets fixes du formulaire y ~ x + time + time:fixed_trait où fixed_traitest une variable qui varie selon les individus mais qui est constante au sein des individus. Le point d'interaction timeavec fixed_traitest de permettre à l'effet de fixed_traitvarier dans le temps. (Je travaille …
J'ai besoin de prévoir les 4 variables suivantes pour la 29e unité de temps. J'ai environ 2 ans de données historiques, où 1 et 14 et 27 sont tous la même période (ou période de l'année). Au final, je fais une décomposition de style Oaxaca-Blinder sur , w d , …
C'est quelque chose que je vois comme une sorte de méthode ad hoc et cela me semble très louche, mais peut-être que je manque quelque chose. J'ai vu cela en régression multiple, mais restons simples: yi=β0+β1xi+εiyi=β0+β1xi+εi y_{i} = \beta_{0} + \beta_{1} x_{i} + \varepsilon_{i} Maintenant, prenez les résidus du modèle …
Plus une question générale. J'utilise un SVM rbf pour la modélisation prédictive. Je pense que mon programme actuel a vraiment besoin d'être accéléré. J'utilise scikit learn avec une recherche de grille grossière à fine + validation croisée. Chaque exécution de SVM prend environ une minute, mais avec toutes les itérations, …
J'ai rencontré quelques moyens de base pour mesurer la complexité des réseaux de neurones: Naïf et informel: comptez le nombre de neurones, de neurones cachés, de couches ou de couches cachées Dimension VC (Eduardo D. Sontag [1998] "Dimension VC des réseaux de neurones" [ pdf ].) Une mesure de la …
Bonjour gourous statistiques et assistants de programmation R, Je m'intéresse à la modélisation des captures d'animaux en fonction des conditions environnementales et du jour de l'année. Dans le cadre d'une autre étude, j'ai dénombré des captures sur environ 160 jours sur trois ans. Chaque jour, j'ai la température, les précipitations, …
Je sais que le pdf d'une loi de puissance est p(x)=α−1xmin(xxmin)−αp(x)=α−1xmin(xxmin)−α p(x) = \frac{\alpha-1}{x_{\text{min}}} \left(\frac{x}{x_{\text{min}}} \right)^{-\alpha} Mais qu'est-ce que cela signifie intuitivement si, par exemple, les cours des actions suivent une distribution de loi de puissance? Cela signifie-t-il que les pertes peuvent être très élevées mais peu fréquentes?
Je cherche différentes façons d'expliquer à mes élèves (dans un cours de statistique élémentaire) ce qu'est un test bilatéral et comment sa valeur P est calculée. Comment expliquez-vous à vos élèves le test bilatéral ou unilatéral?
Existe-t-il une "règle" pour déterminer la taille d'échantillon minimale requise pour qu'un test t soit valide? Par exemple, une comparaison doit être effectuée entre les moyennes de 2 populations. Il y a 7 points de données d'une population et seulement 2 points de données de l'autre. Malheureusement, l'expérience est très …
Fermé. Cette question est hors sujet . Il n'accepte pas actuellement de réponses. Vous souhaitez améliorer cette question? Mettez à jour la question afin qu'elle soit sur le sujet pour la validation croisée. Fermé il y a 6 ans . Je recherche un grand (> 1000) corpus de texte à …
Supposons que nous ayons deux points (la figure suivante: cercles noirs) et que nous voulons trouver une valeur pour un troisième point entre eux (croix). Nous allons en effet l'estimer sur la base de nos résultats expérimentaux, les points noirs. Le cas le plus simple consiste à tracer une ligne, …
Existe-t-il de bons livres qui expliquent des concepts importants de la théorie des probabilités comme les fonctions de distribution de probabilité et les fonctions de distribution cumulative? S'il vous plaît, évitez de vous référer à des livres comme "Statistiques mathématiques et analyse des données" de John Rice qui commencent par …
J'ai essayé de coder un algorithme pour suggérer des paris dans des jeux 1X2 (pondérés). Fondamentalement, chaque match a un ensemble de matchs (équipes à domicile vs équipes à l'extérieur): 1: victoires à domicile X: dessiner 2: victoires à l'extérieur Pour chaque correspondance et symbole ( 1, Xet 2), j'attribuerai …
J'ai essayé plusieurs fois de "faire cavalier seul" - mais avec un succès limité. Je suis un utilisateur occasionnel de SPSS et j'ai une certaine expérience SAS. J'apprécierais un pointeur ou deux de quelqu'un qui a des antécédents similaires et utilise maintenant R.
J'ai un ensemble de données, je veux créer des clusters sur ces données en fonction d'une seule variable (il n'y a pas de valeurs manquantes). Je veux créer 3 clusters basés sur cette variable. Quel algorithme de clustering utiliser, k-means, EM, DBSCAN etc.? Ma question principale est, dans quelles circonstances …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.