Q & A pour les personnes intéressées par les statistiques, l'apprentissage automatique, l'analyse de données, l'exploration de données et la visualisation de données
En phylogénétique, les arbres phylogénétiques sont souvent construits à l'aide d'une analyse MLE ou bayésienne. Souvent, un a priori plat est utilisé dans l'estimation bayésienne. Si je comprends bien, une estimation bayésienne est une estimation de vraisemblance qui intègre un a priori. Ma question est, si vous utilisez un appartement …
J'ai un ensemble de données avec tous les appels passés à un service d'urgence et les temps de réponse du service d'ambulance. Ils ont admis qu'il y avait des erreurs avec les temps de réponse car il y a des cas où ils n'ont pas commencé à enregistrer (donc la …
Un récent sujet brûlant de discussion concerne une revue interdisant l'utilisation de "procédures de test statistique d'hypothèse nulle (NHSTP)" dans les articles soumis à la revue. Je vois ce terme utilisé par certains écrivains, mais je ne comprends pas quelle distinction ils essaient de faire. Un NHSTP est-il quelque chose …
J'ai un ensemble de données tridimensionnelles et j'essaie d'utiliser l'analyse des facteurs aberrants locaux pour identifier les valeurs les plus uniques ou étranges. Comment décide-t-on de la valeur k à utiliser dans l'analyse LOF? Je comprends ce que détermine la valeur k, et je ne suis donc pas surpris de …
Je recherche un package pour m'aider à résoudre certains problèmes d'optimisation quadratique et je vois qu'il existe au moins une demi-douzaine de packages différents. Selon cette page: QP (programmation quadratique, 90C20): cplexAPI , kernlab , limSolve , LowRankQP , quadprog , Rcplex , Rmosek Certains d'entre eux (Rmosek et cplexAPI) …
Mon objectif est d'analyser les journaux du réseau (par exemple, Apache, syslog, audit de sécurité Active Directory, etc.) à l'aide de la détection de cluster / anomalie à des fins de détection d'intrusion. Dans les journaux, j'ai beaucoup de champs de texte comme l'adresse IP, le nom d'utilisateur, le nom …
Je n'ai jamais suivi de cours de statistique officiel, mais en raison de mes recherches, je tombe constamment sur des articles qui appliquent plusieurs concepts statistiques. Souvent, je vais voir une description d'un processus de Monte Carlo appliqué à une situation donnée, et pour ce que je peux rassembler 9 …
J'essaie d'aider un étudiant d'un collègue. L'élève a observé et compté le comportement des oiseaux (nombre d'appels) dans une configuration expérimentale. Le nombre d'appels attribuables à un oiseau observé spécifique au cours de chaque expérience n'a pas pu être déterminé, mais il était possible de compter le nombre d'oiseaux ayant …
Supposons variables aléatoires indépendantes pour lesquelles les quantiles à un niveau spécifique sont connus par estimation à partir des données: , ..., . Définissons maintenant la variable aléatoire comme la somme . Existe-t-il un moyen de calculer la valeur du quantile de la somme au niveau , c'est-à-dire q_z dans …
Ma compréhension est que même la régression ne donne pas de causalité. Il ne peut donner qu'une association entre la variable y et les variables x et éventuellement une direction. Ai-je raison? J'ai souvent trouvé des expressions similaires à "x prédit y" même dans la plupart des manuels de cours …
J'ai quelques valeurs aberrantes dans mes données et je voulais les exclure pour voir si cela change les résultats. À votre avis, quel est le nombre maximal de valeurs aberrantes auquel on devrait se limiter? Merci!
Donc, disons que vous lancez une pièce 10 fois et appelez cela 1 "événement". Si vous exécutez 1 000 000 de ces "événements", quelle est la proportion d'événements dont la tête se situe entre 0,4 et 0,6? La probabilité binomiale suggérerait que cela soit d'environ 0,65, mais mon code Mathematica …
Dans l'Analyse de survie, vous supposez que le temps de survie d'un rv est distribué de façon exponentielle. Considérant maintenant que j'ai "résultats" de de iid rv . Seule une partie de ces résultats est en fait "pleinement réalisée", c'est-à-dire que les observations restantes sont toujours "vivantes".x 1 , …
J'ai le jeu de données simple suivant avec deux variables continues; c'est à dire: d = data.frame(x=runif(100,0,100),y = runif(100,0,100)) plot(d$x,d$y) abline(lm(y~x,d), col="red") cor(d$x,d$y) # = 0.2135273 J'ai besoin de réorganiser les données de manière à ce que la corrélation entre les variables soit ~ 0,6. Je dois garder les moyennes …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.