Pyspark code to group the data by name and item calculate the total weight for duplicate items
data = [
("alice", "carrot", 1),
("bob", "banana", 3),
("alice", "tomato", 4),
("bob", "carrot", 2),
("charlie", "banana", 5),
("bob", "apple", 1),
("alice", "tomato", 2),
("charlie", "carrot", 3)
]
alice [{tomato, 6}, {carrot, 1}] 7
charlie [{carrot, 3}, {banana, 5}] 8
bob [{banana, 3}, {carrot, 2}, {apple, 1}] 6