Pyspark code to group the data by name and item calculate the total weight for duplicate items
22:46 19 Aug 2026

data = [ ("alice", "carrot", 1), ("bob", "banana", 3), ("alice", "tomato", 4), ("bob", "carrot", 2), ("charlie", "banana", 5), ("bob", "apple", 1), ("alice", "tomato", 2), ("charlie", "carrot", 3) ]

alice [{tomato, 6}, {carrot, 1}] 7 charlie [{carrot, 3}, {banana, 5}] 8 bob [{banana, 3}, {carrot, 2}, {apple, 1}] 6

best-practices pyspark