Панды читают XML-файл с назначенным типом данныхPython

Программы на Python
Anonymous
Панды читают XML-файл с назначенным типом данных

Сообщение Anonymous »

Мой код:

Код: Выделить всё

df = pd.read_xml(
path_or_buffer=PATH,
xpath="//Data",
compression="gzip"
)
Я использую функцию Pandas read_xml() для чтения данных формата xml.gz. Я использую версию Pandas 1.3.2. Когда я попытался прочитать данные, Pandas прочитал их неправильно.
Данные выглядят так, как показано ниже. И colA, и colB должны быть строкой.
1-й файл данных:

Код: Выделить всё

abc
168E3


def

2-й файл данных:

Код: Выделить всё

ghi
23456


jkl

Когда я использую функцию read_xml(), это выглядит следующим образом:
1-й кадр данных:

Код: Выделить всё

colA: abc, def
colB: 168000.0, None
2-й кадр данных:

Код: Выделить всё

colA: ghi, jkl
colB: 23456.0, None
Я хочу прочитать данные в строковом формате, но в pandas 1.3.2 нет аргумента dtype. Я хочу знать:
  • Как я могу прочитать данные определенного типа данных?
  • Когда данные отсутствуют в столбце Pandas назначит этому столбцу тип float. Как этого избежать или есть ли какая-либо настройка для настройки типа данных столбца с отсутствующим значением при чтении данных?
Обратите внимание, что я могу только эту версию Pandas и не могу ее обновить.

Подробнее здесь: https://stackoverflow.com/questions/787 ... -data-type

Вернуться в «Python»