Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
Lors de l'utilisation du bootstrap pour l'évaluation de modèles, j'ai toujours pensé que les échantillons hors sac étaient directement utilisés comme ensemble de test. Cependant, cela ne semble pas être le cas pour l' approche obsolète de scikit-learnBootstrap , qui semble construire l'ensemble de test à partir d'un dessin avec …
Disons que j'ai une variable catégorielle qui peut prendre les valeurs A, B, C et D. Comment puis-je générer 10 000 points de données aléatoires et contrôler la fréquence de chacun? Par exemple: A = 10% B = 20% C = 65% D = 5% Des idées comment je peux …
J'essaie de comprendre comment fonctionnent les fonctions d'influence. Quelqu'un pourrait-il expliquer dans le contexte d'une simple régression OLS yje= α + β⋅ xje+ εjeyje=α+β⋅Xje+εje\begin{equation} y_i = \alpha + \beta \cdot x_i + \varepsilon_i \end{equation} où je veux la fonction d'influence pour .ββ\beta
J'étudie ce tutoriel sur les encodeurs automatiques variationnels de Carl Doersch . Dans la deuxième page, il indique: L'un des frameworks les plus populaires est le Variational Autoencoder [1, 3], le sujet de ce tutoriel. Les hypothèses de ce modèle sont faibles et la formation est rapide par rétropropagation. Les …
J'ai deux ensembles de données (données source et cible) qui suivent la distribution différente. J'utilise MMD - qui est une distribution de distance non paramétrique - pour calculer la distribution marginale entre les données source et cible. données source, Xs données cibles, Xt matrice d'adaptation A * Données projetées, Zs …
J'essaie de comprendre l'application de haut niveau des RNN à l'étiquetage des séquences via (entre autres) l'article de Graves de 2005 sur la classification des phonèmes. Pour résumer le problème: nous avons un grand ensemble de formation composé de fichiers audio (d'entrée) de phrases simples et (de sortie) d'heures de …
Les graphiques acycliques dirigés (DAG) sont des représentations visuelles efficaces d'hypothèses causales qualitatives dans les modèles statistiques, mais peuvent-ils être utilisés pour présenter une équation variable d'instrument régulière (ou d'autres équations)? Si c'est le cas, comment? Sinon, pourquoi?
Fermé. Cette question est hors sujet . Il n'accepte pas actuellement les réponses. Voulez-vous améliorer cette question? Mettez à jour la question afin qu'elle soit sur le sujet pour la validation croisée. Fermé il y a 4 ans . J'ai des rapports de température horaires et quotidiens pour de nombreuses …
Dans l'un des exercices de mon cours, nous utilisons un ensemble de données médicales Kaggle . L'exercice dit: nous voulons modéliser la distribution des charges individuelles et nous voulons aussi vraiment pouvoir saisir notre incertitude sur cette distribution afin de mieux saisir la plage de valeurs que nous pourrions voir. …
J'entreprends un projet d'analyse de données qui consiste à enquêter sur les temps d'utilisation du site Web au cours de l'année. Ce que je voudrais faire, c'est comparer la "cohérence" des modèles d'utilisation, par exemple, leur proximité avec un modèle qui implique de l'utiliser une heure par semaine, ou un …
Comment appelez-vous une moyenne statistique calculée à partir des extrêmes supérieurs et inférieurs dans un ensemble de données donné? Par exemple, si vous avez un ensemble: { -2, 0 , 8, 9, 1, 50, -2, 6} L'extrémité supérieure de cet ensemble est 50et l'extrême inférieur l'est -2. Ainsi, la moyenne …
Habituellement, une distribution de probabilité sur des variables discrètes est décrite à l'aide d'une fonction de masse de probabilité (PMF): Lorsque nous travaillons avec des variables aléatoires continues, nous décrivons les distributions de probabilité en utilisant une fonction de densité de probabilité (PDF) plutôt qu'une fonction de masse de probabilité. …
Lorsque j'ai lu comment configurer vos données, une chose que j'ai souvent rencontrée est que la transformation de certaines données continues en données catégoriques n'est pas une bonne idée, car vous pourriez très bien tirer une mauvaise conclusion si les seuils sont mal déterminés. Cependant, j'ai actuellement des données (valeurs …
Il arrive souvent qu'un intervalle de confiance avec une couverture de 95% soit très similaire à un intervalle crédible qui contient 95% de la densité postérieure. Cela se produit lorsque le prieur est uniforme ou presque uniforme dans ce dernier cas. Ainsi, un intervalle de confiance peut souvent être utilisé …
J'ai un ensemble de données comprenant la demande de plusieurs produits (1200 produits) pour 25 périodes et j'ai besoin de prédire la demande de chaque produit pour la période suivante. Au début, je voulais utiliser ARIMA et former un modèle pour chaque produit, mais en raison du nombre de produits …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.