У меня есть фрейм данных pyspark, я изменил его на pandas, чтобы использовать matplotlib. На гистограмме все столбцы имеют одинаковую высоту, хотя значения y разные.
Поскольку данных мало, я поместил значения x и y в список и использовал matplotlib для построения графика. Оно показало ожидаемый результат. Я не уверен, связана ли ошибка с типом данных в кадре данных pandas (float64)
pandas_df.dtypes
display(pandas_df )
customer_id=pandas_df['customer_id']
price=pandas_df['sum(price)']
plt.bar(customer_id,sum(price))
plt.show()
y=[4260.0,4440.0,2400.0,1200.0,2040.0]
x=['A','B','C','D','E']
print(type(y[0]))
plt.bar(x,y)
plt.show()
Подробнее здесь: https://stackoverflow.com/questions/789 ... -dataframe