Код: Выделить всё
df.write.parquet("path/myfile.parquet", mode = "overwrite", compression="gzip")
Когда я пытаюсь прочитать это в пандах, я получаю следующие ошибки, в зависимости от того, какой парсер я использую:
Код: Выделить всё
import pandas as pd
df = pd.read_parquet("path/myfile.parquet", engine="pyarrow")
Файл "pyarrow\ error.pxi», строка 83 в pyarrow.lib.check_status
ArrowIOError: Неверный файл паркета. Поврежденный нижний колонтитул.
fastparquet:
Файл «C:\Program Files\Anaconda3\lib\site-packages\fastparquet\util.py», строка 38, в default_open
return open(f, mode)
PermissionError: [Errno 13] Разрешение отклонено: 'path/myfile.parquet'
Я использую следующие версии:
- Spark 2.4.0
- Pandas 0.23.4
pyarrow 0.10.0 - fastparquet 0.2.1
Было бы уже полезно, если бы кто-нибудь смог воспроизвести эту ошибку.
Подробнее здесь: https://stackoverflow.com/questions/542 ... in-pyspark