Geopandas read_file сбивает меня с толку при использовании с параметром «sql»Python

Программы на Python
Anonymous
Geopandas read_file сбивает меня с толку при использовании с параметром «sql»

Сообщение Anonymous »

У меня есть демонстрационная функция, это базовая функция, которая может помочь обрабатывать очень большие наборы данных и обрабатывать их без необходимости загружать весь этот набор данных в память за раз

Код: Выделить всё

def generator(gpkg_file, chunk_size, offset, layer_name):
while True:
query = f"""
SELECT *
FROM {layer_name}
LIMIT {chunk_size} OFFSET {offset}
"""
gdf = gpd.read_file(gpkg_file, sql=query)
if gdf.empty:
break
yield gdf
offset += chunk_size
Когда я использую эту функцию в среде блокнота Jupyter, я получаю ожидаемый результат, который представляет собой фрейм данных с соответствующими ограничениями, смещением и данными с разбивкой на страницы. Но когда я использую то же самое в плоском файле Python он загружает весь файл gpkg без нумерации страниц. Я в тупике и отчаянно нуждаюсь в помощи.
Нажмите здесь, чтобы найти изображение.
Это когда используется в среде блокнота Jupyter, и это то, что мне нужно.
Но при таком использовании в файле Python он просто загружает все 175 строк (присутствуют в файле demo.gpkg) каждую итерацию, и поскольку df не достигает конечного предложения, это продолжается вечно

Подробнее здесь: https://stackoverflow.com/questions/788 ... -parameter

Вернуться в «Python»