Statistiques et Big Data

Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données

2
Pourquoi la famille exponentielle n'inclut-elle pas toutes les distributions?
Je lis le livre: Bishop, Reconnaissance des formes et apprentissage automatique (2006) qui définit la famille exponentielle comme des distributions de la forme (Eq. 2.194): p(x|η)=h(x)g(η)exp{ηTu(x)}p(x|η)=h(x)g(η)exp⁡{ηTu(x)}p(\mathbf x|\boldsymbol \eta) = h(\mathbf x) g(\boldsymbol \eta) \exp \{\boldsymbol \eta^\mathrm T \mathbf u(\mathbf x)\} Mais je ne vois aucune restriction placée sur ou \ …



2
Les échantillons d'apprentissage prélevés au hasard pour les mini-réseaux de neurones d'apprentissage doivent-ils être prélevés sans remplacement?
Nous définissons une époque comme ayant parcouru l'intégralité de tous les échantillons d'apprentissage disponibles, et la taille du mini-lot comme le nombre d'échantillons sur lesquels nous faisons la moyenne pour trouver les mises à jour des poids / biais nécessaires pour descendre le gradient. Ma question est de savoir si …




2
Avantages de l'optimisation des essaims de particules par rapport à l'optimisation bayésienne pour le réglage des hyperparamètres?
Il existe d'importantes recherches contemporaines sur l'optimisation bayésienne (1) pour le réglage des hyperparamètres ML. La motivation principale ici est qu'un nombre minimal de points de données est nécessaire pour faire des choix éclairés sur les points qui valent la peine d'être essayés (les appels de fonction objectifs sont coûteux, …


1
Les données doivent-elles être centrées + mises à l'échelle avant d'appliquer t-SNE?
Certaines fonctionnalités de mes données ont de grandes valeurs, tandis que d'autres fonctionnalités ont des valeurs beaucoup plus petites. Est-il nécessaire de centrer + l'échelle des données avant d'appliquer t-SNE pour éviter un biais vers les valeurs plus grandes? J'utilise l'implémentation sklearn.manifold.TSNE de Python avec la métrique de distance euclidienne …


2
Qu'est-ce qu'un graphique variable ajouté (graphique de régression partielle) explique dans une régression multiple?
J'ai un modèle de jeu de données Movies et j'ai utilisé la régression: model <- lm(imdbVotes ~ imdbRating + tomatoRating + tomatoUserReviews+ I(genre1 ** 3.0) +I(genre2 ** 2.0)+I(genre3 ** 1.0), data = movies) library(ggplot2) res <- qplot(fitted(model), resid(model)) res+geom_hline(yintercept=0) Ce qui a donné la sortie: Maintenant, j'ai essayé de travailler …


2
REML ou ML pour comparer deux modèles d'effets mixtes avec des effets fixes différents, mais avec le même effet aléatoire?
Contexte: Remarque: mon ensemble de données et mon code r sont inclus sous le texte Je souhaite utiliser AIC pour comparer deux modèles d'effets mixtes générés à l'aide du package lme4 dans R. Chaque modèle a un effet fixe et un effet aléatoire. L'effet fixe diffère selon les modèles, mais …

5
Le carré
Il semble que je me sois trompé en essayant de comprendre si une valeur carré a également une valeur .rrrppp Si je comprends bien, en corrélation linéaire avec un ensemble de points de données rrr peut avoir une valeur allant de −1−1-1 à 111 et cette valeur, quelle qu'elle soit, …

En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.