Je commence avec des données d'entrée comme celle-ci
df1 = pandas.DataFrame( {
"Name" : ["Alice", "Bob", "Mallory", "Mallory", "Bob" , "Mallory"] ,
"City" : ["Seattle", "Seattle", "Portland", "Seattle", "Seattle", "Portland"] } )
Qui, une fois imprimé, apparaît comme ceci:
City Name
0 Seattle Alice
1 Seattle Bob
2 Portland Mallory
3 Seattle Mallory
4 Seattle Bob
5 Portland Mallory
Le regroupement est assez simple:
g1 = df1.groupby( [ "Name", "City"] ).count()
et l'impression donne un GroupBy
objet:
City Name
Name City
Alice Seattle 1 1
Bob Seattle 2 2
Mallory Portland 2 2
Seattle 1 1
Mais ce que je veux finalement, c'est un autre objet DataFrame qui contient toutes les lignes de l'objet GroupBy. En d'autres termes, je veux obtenir le résultat suivant:
City Name
Name City
Alice Seattle 1 1
Bob Seattle 2 2
Mallory Portland 2 2
Mallory Seattle 1 1
Je ne vois pas comment accomplir cela dans la documentation des pandas. Tout indice serait le bienvenu.
Empty DataFrame
Columns: []
Index: [(Alice, Seattle), (Bob, Seattle), (Mallory, Portland), (Mallory, Seattle)]