Код: Выделить всё
df = spark.createDataFrame(
[('D1', 'ROBBERY', '2024-02-01', 2),
('D1', 'ROBBERY', '2024-02-01', 2),
('D1', 'DRUGS', '2024-03-05', 3),
('D1', 'FRAUD', '2024-03-05', 3),
('D1', 'AUTO THEFT', '2024-01-09',1),
('D1', 'AUTO THEFT', '2024-01-03', 1),
('D2', 'MURDER', '2024-05-04', 5),
('D2', 'MURDER', '2024-06-01', 6),
('D2', 'RAPE', '2024-07-02', 7)],
['district', 'crime_type', 'date', 'month'])
Результатом должен стать новый фрейм данных с тремя столбцами: District, top_3_crime_types, median_crimes_monthly:
район
top_3_crime_types
median_crimes_monthly
D1
ограбление, угон авто, наркотики
2
< tr>
D2
УБИЙСТВО, ИЗНАСИЛОВАНИЕ
1
Подробнее здесь: https://stackoverflow.com/questions/790 ... n-as-comma