Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
J'ai des problèmes pour comprendre le modèle skip-gram de l'algorithme Word2Vec. Dans un sac de mots continu, il est facile de voir comment les mots de contexte peuvent "s'adapter" dans le réseau neuronal, car vous les basez en moyenne après avoir multiplié chacune des représentations de codage à chaud avec …
En ce qui concerne les arbres de décision, la valeur prédite peut-elle se situer en dehors de la plage des données de formation? Par exemple, si la plage de l'ensemble de données d'apprentissage de la variable cible est 0-100, lorsque je génère mon modèle et l'applique à autre chose, mes …
J'essaie de faire un détecteur d'objets qui se produisent très rarement (en images), en prévoyant d'utiliser un classificateur binaire CNN appliqué dans une fenêtre coulissante / redimensionnée. J'ai construit des ensembles d'entraînement et de test positifs / négatifs équilibrés 1: 1 (est-ce une bonne chose à faire dans un tel …
Le fond de mon étude : Dans un échantillonnage de Gibbs où nous échantillonnons (la variable d'intérêt) et partir de et respectivement, où et sont des vecteurs aléatoires à dimensions. Nous savons que le processus est généralement divisé en deux étapes:XXXYYYP(X|Y)P(X|Y)P(X|Y)P(Y|X)P(Y|X)P(Y|X)XXXYYYkkk Période de rodage, où nous jetons tous les échantillons. …
J'ai besoin d'un algorithme pour faire une recherche binaire lorsque le test à chaque étape peut donner le mauvais résultat. Contexte: Je dois placer les élèves sur le niveau de difficulté le plus approprié parmi 12. L'approche actuelle est la force brute et pose 60 questions à choix multiples à …
C'est-à-dire que faire une analyse séquentielle (vous ne savez pas à l'avance exactement combien de données vous allez collecter) avec des méthodes fréquentistes nécessite un soin particulier; vous ne pouvez pas simplement collecter des données jusqu'à ce que la valeur p soit suffisamment petite ou qu'un intervalle de confiance soit …
Donc, nous avions Secret Santa au travail. Nous sommes 8 personnes. Nous avons chacun tour à tour et tiré un petit morceau de papier d'un bol avec un nom dessus. La seule règle: si vous tirez votre nom, vous devez remettre le morceau de papier dans le bol et réessayer. …
L'hyperplan optimal dans SVM est défini comme: w⋅x+b=0,w⋅x+b=0,\mathbf w \cdot \mathbf x+b=0, où représente le seuil. Si nous avons un mappage qui mappe l'espace d'entrée à un espace , nous pouvons définir SVM dans l'espace , où l'hiperplane optimal sera:bbbϕϕ\mathbf \phiZZZZZZ w⋅ϕ(x)+b=0.w⋅ϕ(x)+b=0.\mathbf w \cdot \mathbf \phi(\mathbf x)+b=0. Cependant, nous pouvons …
J'ai une application protégée par un code PIN à quatre chiffres et l'utilisateur a obtenu cinq tentatives de connexion avant le verrouillage du compte. Maintenant, un de mes clients veut "renforcer" la sécurité et plaider pour une autre solution: PIN à six chiffres AUCUN "même chiffre côte à côte": par …
Je lisais nonchalamment un article (en économie) qui avait l'approximation suivante pour :log(E(X))log(E(X))\log(E(X)) ,log(E(X))≈E(log(X))+0.5var(log(X))log(E(X))≈E(log(X))+0.5var(log(X))\log(E(X)) \approx E(\log(X))+0.5 \mathrm{var}(\log(X)) ce que l'auteur dit est exact si X est log-normal (ce que je sais). Ce que je ne sais pas, c'est comment dériver cette approximation. J'ai essayé de calculer une approximation de Taylor …
Question: à quoi ressemble une distribution binomiale bivariée dans un espace tridimensionnel? Ci-dessous se trouve la fonction spécifique que je voudrais visualiser pour différentes valeurs des paramètres; à savoir, nnn , et . p 2p1p1p_{1}p2p2p_{2} f(x1,x2)=n!x1!x2!px11px22,x1+x2=n,p1+p2=1.f(x1,x2)=n!x1!x2!p1x1p2x2,x1+x2=n,p1+p2=1.f(x_{1},x_{2}) = \frac{n!}{x_{1}!x_{2}!}p_{1}^{x_{1}}p_{2}^{x_{2}}, \qquad x_{1}+x_{2}=n, \quad p_{1}+p_{2}=1. Notez qu'il existe deux contraintes; et . De …
J'ai toujours lu le terme interaction dans le contexte de la régression. Devrions-nous également considérer les interactions avec différents modèles, par exemple knn ou svm? S'il y a , ou même plus de fonctionnalités et disons observations quelle est la manière habituelle de trouver des interactions utiles? Essayez toutes les …
Voici un extrait de l' introduction de Bolstad aux statistiques bayésiennes . Pour tous les experts, cela pourrait être trivial, mais je ne comprends pas comment l'auteur conclut que nous n'avons pas à faire d'intégration pour calculer la probabilité postérieure d'une certaine valeur de . Je comprends la deuxième expression …
Il semble qu'il y ait quelque chose dans notre compréhension humaine qui crée des difficultés à saisir intuitivement l'idée de variance. Dans un sens étroit, la réponse est immédiate: la quadrature nous rejette de notre compréhension réflexive. Mais, est-ce seulement la variance qui pose problème, ou est-ce l'idée de propagation …
J'essaie de construire une preuve d'un problème sur lequel je travaille et l'une des hypothèses que je fais est que l'ensemble des points à partir desquels je suis échantillonné est dense sur tout l'espace. En pratique, j'utilise l'échantillonnage d'hypercube latin pour obtenir mes points sur tout l'espace d'échantillonnage. Ce que …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.