Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
Je recherche un package R général, propre et rapide (c'est-à-dire en utilisant des routines C ++) pour simuler des chemins à partir d'une diffusion non linéaire non homogène comme (1) en utilisant le schéma Euler-Maruyama, le schéma Milstein (ou tout autre). Celui-ci est destiné à être intégré dans un code …
En lisant comment approximer la distribution de la moyenne de l'échantillon, je suis tombé sur la méthode de bootstrap non paramétrique. Apparemment, on peut approximer la distribution de X¯n−μX¯n−μ\bar{X}_n-\mu par la distribution de , où désigne la moyenne de l'échantillon de l'échantillon bootstrap.X¯∗n−X¯nX¯n∗−X¯n\bar{X}_n^*-\bar{X}_nX¯∗nX¯n∗\bar{X}_n^* Ma question est alors: ai-je besoin du …
L'une des motivations du filet élastique était la limitation suivante de LASSO: Dans le cas p>np>np > n , le lasso sélectionne au plus n variables avant de saturer, en raison de la nature du problème d'optimisation convexe. Cela semble être une caractéristique limitante pour une méthode de sélection de …
Un de mes amis vend modèles de mélangeurs. Certains mélangeurs sont très simples et bon marché, d'autres sont très sophistiqués et plus chers. Ses données se composent, pour chaque mois, des prix de chaque blender (qui sont fixés par lui), et du nombre d'unités vendues pour chaque modèle. Pour établir …
Je veux prédire la hauteur des arbres dans une certaine zone en utilisant certaines variables obtenues par télédétection. Comme la biomasse approximative, etc. Je veux d'abord utiliser une régression linéaire (je sais que ce n'est pas la meilleure idée mais c'est une étape incontournable pour mon projet). Je voulais savoir …
Pour trouver une association entre le soutien des pairs (variable indépendante) et la satisfaction au travail (variable dépendante), je souhaite appliquer le test du chi carré. Le soutien par les pairs est divisé en quatre catégories selon l'étendue du soutien: 1 = très peu, 2 = dans une certaine mesure, …
Le bootstrap fonctionne bien pour accéder à l'incertitude de l'estimation moyenne, mais je me souviens avoir lu quelque part que le bootstrap ne fait pas du bon travail pour évaluer l'incertitude des estimations quantiles (en particulier la médiane). Je ne me souviens pas où j'ai lu cela, et je n'ai …
Pour les variables aléatoires et une matrice semi-définie positive A : existe-t-il une expression simplifiée pour la valeur attendue, E [ T r ( X T A X ) ] et la variance, V a r [ T r ( X T A X ) ] ? Veuillez noter que …
J'ai des données temporelles de fréquences d'activité. Je veux identifier des grappes dans les données qui indiquent des périodes de temps distinctes avec des niveaux d'activité similaires. Idéalement, je veux identifier les clusters sans spécifier le nombre de clusters a priori. Quelles sont les techniques de clustering appropriées? Si ma …
Donc, cette question est quelque peu impliquée, mais j'ai soigneusement essayé de la rendre aussi simple que possible. Objectif: Bref, il y a une dérivation de la néguentropie qui n'implique pas de cumulants d'ordre supérieur, et j'essaie de comprendre comment elle a été dérivée. Contexte: (je comprends tout cela) J'étudie …
J'ai beaucoup de données et je veux faire quelque chose qui semble très simple. Dans ce grand ensemble de données, je m'intéresse à la façon dont un élément spécifique s'agglutine. Disons que mes données sont un ensemble ordonné comme celui-ci: {A, C, B, D, A, Z, T, C ...}. Disons …
J'ai les pourcentages de classement des étudiants dans 38 examens comme variable dépendante dans mon étude. Un pourcentage de classement est calculé par (rang / nombre d'élèves dans un examen). Cette variable dépendante a une distribution presque uniforme et je veux estimer les effets de certaines variables sur la variable …
Le "Machine Learning For Hackers" d'O'Reilly dit que chaque composant principal représente un pourcentage de la variance. J'ai cité la partie pertinente de la page ci-dessous (chapitre 8, p.207). S'adressant à un autre expert, ils ont convenu qu'il s'agissait du pourcentage. Cependant, les 24 composants totalisent 133,2095%. Comment est-ce possible? …
Je comprends théoriquement (en quelque sorte) comment ils fonctionneraient, mais je ne sais pas comment faire pour utiliser une méthode d'ensemble (comme le vote, les mélanges pondérés, etc.). Quelles sont les bonnes ressources pour mettre en œuvre des méthodes d'ensemble? Existe-t-il des ressources particulières concernant l'implémentation en Python? ÉDITER: Pour …
Les graphiques ci-dessous sont des diagrammes de dispersion résiduels d'un test de régression pour lesquels les hypothèses de "normalité", "homoscédasticité" et "indépendance" ont déjà été vérifiées à coup sûr! Pour tester l' hypothèse de «linéarité» , bien que, en regardant les graphiques, on puisse deviner que la relation est curviligne, …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.