Questions marquées «r»

Utilisez cette balise pour toute question * sur le sujet * qui (a) implique «R» en tant que partie critique de la question ou réponse attendue, et (b) n'est pas * seulement * sur la façon d'utiliser «R».

1
Comment calculer les scores de confiance en régression (avec forêts aléatoires / XGBoost) pour chaque prédiction dans R?
Existe-t-il un moyen d'obtenir un score de confiance (on peut également l'appeler valeur de confiance ou probabilité) pour chaque valeur prédite lors de l'utilisation d'algorithmes comme Random Forests ou Extreme Gradient Boosting (XGBoost)? Supposons que ce score de confiance varie de 0 à 1 et montre à quel point je …




3
Les valeurs d'échelle dans une analyse discriminante linéaire (LDA) peuvent-elles être utilisées pour tracer des variables explicatives sur les discriminants linéaires?
En utilisant un biplot de valeurs obtenues par l'analyse des composantes principales, il est possible d'explorer les variables explicatives qui composent chaque composante principale. Est-ce également possible avec l'analyse discriminante linéaire? Les exemples fournis utilisent les données suivantes: "Les données de l'iris d'Edgar Anderson" ( http://en.wikipedia.org/wiki/Iris_flower_data_set ). Voici les données …

2
Comment modéliser les effets d'un mois à l'autre dans les données de séries chronologiques quotidiennes?
J'ai deux séries chronologiques de données quotidiennes. L'un est sign-upset l'autre terminationsdes abonnements. J'aimerais prédire ce dernier en utilisant les informations contenues dans les deux variables. En regardant le graphique de ces séries, il est évident que les terminaisons sont corrélées aux multiples des inscriptions des mois précédents. Autrement dit, …


1
Test de Fisher en R
Supposons que nous ayons l'ensemble de données suivant: Men Women Dieting 10 30 Non-dieting 5 60 Si je lance le test exact de Fisher dans R, qu'est-ce que cela alternative = greaterimplique (ou moins)? Par exemple: mat = matrix(c(10,5,30,60), 2,2) fisher.test(mat, alternative="greater") Je reçois le p-value = 0.01588et odds ratio …

3
Comment calculer la différence de deux pentes?
Existe-t-il une méthode pour comprendre si deux lignes sont (plus ou moins) parallèles? J'ai deux lignes générées à partir de régressions linéaires et je voudrais comprendre si elles sont parallèles. En d'autres termes, je voudrais obtenir les différentes pentes de ces deux lignes. Existe-t-il une fonction R pour calculer cela? …

1
Test d'effets simultanés et décalés dans des modèles mixtes longitudinaux avec des covariables variant dans le temps
On m'a récemment dit qu'il n'était pas possible d'incorporer des covariables variant dans le temps dans des modèles mixtes longitudinaux sans introduire un décalage dans le temps pour ces covariables. Pouvez-vous confirmer / nier cela? Avez-vous des références sur cette situation? Je propose une situation simple à clarifier. Supposons que …

4
Que faire des explications dans les séries chronologiques?
Ayant travaillé principalement avec des données transversales jusqu'à présent et très récemment parcouru, parcourant un tas de publications introductives sur les séries chronologiques, je me demande quel rôle jouent les variables explicatives dans l'analyse des séries chronologiques. Je voudrais expliquer une tendance plutôt que la décroissance. La plupart de ce …



1
Nombre de composants principaux lors du prétraitement à l'aide de PCA dans le package caret dans R
J'utilise le caretpackage Rpour la formation des classificateurs SVM binaires. Pour réduire les fonctionnalités, je prétraitement avec PCA en utilisant la fonction intégrée preProc=c("pca")lors de l'appel train(). Voici mes questions: Comment le curseur sélectionne-t-il les principaux composants? Existe-t-il un nombre fixe de composants principaux sélectionnés? Les principales composantes sont-elles sélectionnées …

2
Régression multiple avec prédicteurs catégoriques et numériques
Je suis relativement nouveau dans R et j'essaie d'adapter un modèle à des données qui se composent d'une colonne catégorielle et d'une colonne numérique (entière). La variable dépendante est un nombre continu. Les données ont le format suivant: predCateg, predIntNum, ResponseVar Les données ressemblent à ceci: ranking, age_in_years, wealth_indicator category_A, …

En utilisant notre site, vous reconnaissez avoir lu et compris notre politique liée aux cookies et notre politique de confidentialité.
Licensed under cc by-sa 3.0 with attribution required.