Statistiques et Big Data

Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données




2
Pourquoi est-il mal d'arrêter un test A / B avant que la taille d'échantillon optimale soit atteinte?
Je suis en charge de présenter les résultats des tests A / B (exécutés sur les variantes du site) dans mon entreprise. Nous exécutons le test pendant un mois, puis vérifions les valeurs de p à intervalles réguliers jusqu'à ce que nous atteignions la signification (ou abandonnons si la signification …

2
Quelle est la différence entre une variable aléatoire et un échantillon aléatoire?
Ces deux expressions m'ont beaucoup dérouté lorsque j'apprenais les statistiques. Il me semble que ce sont des choses totalement différentes. Un échantillon aléatoire consiste à prélever au hasard un échantillon dans une population, tandis qu'une variable aléatoire est comme une fonction qui mappe l'ensemble de tous les résultats possibles d'une …

1
En général, est-il plus difficile de faire de l'inférence que de faire des prédictions?
Ma question vient du fait suivant. J'ai lu des articles, des blogs, des conférences ainsi que des livres sur l'apprentissage automatique. Mon impression est que les praticiens de l'apprentissage automatique semblent être indifférents à beaucoup de choses qui intéressent les statisticiens et l'économétrie. En particulier, les praticiens de l'apprentissage automatique …



4
Pourquoi l'appariement des scores de propension fonctionne-t-il pour l'inférence causale?
L'appariement par score de propension est utilisé pour faire des inférences causales dans les études observationnelles (voir l'article de Rosenbaum / Rubin ). Quelle est l'intuition simple derrière pourquoi cela fonctionne? En d'autres termes, pourquoi si nous nous assurons que la probabilité de participer au traitement est égale pour les …




4
Comment vérifier l'hypothèse de linéarité au logit pour les variables indépendantes continues dans l'analyse de régression logistique?
Je suis confondu avec l'hypothèse de linéarité au logit pour les variables prédictives continues dans l'analyse de régression logistique. Avons-nous besoin de vérifier la relation linéaire lors du dépistage des prédicteurs potentiels en utilisant une analyse de régression logistique univariable? Dans mon cas, j'utilise l'analyse de régression logistique multiple pour …


1
Comment fonctionne la rétropropagation dans un réseau neuronal siamois?
J'étudie l'architecture du réseau neuronal siamois introduit par Yann LeCun et ses collègues en 1994 pour la reconnaissance des signatures ( "Vérification de signature utilisant un réseau neuronal siamois à retardement" .pdf , NIPS 1994) J'ai compris l'idée générale de cette architecture, mais je ne comprends vraiment pas comment fonctionne …

En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.