Кадр данных
Я хотел бы создать два новых столбца из частей строк в столбце «Идентификатор образца». Я не очень хорошо разбираюсь в регулярных выражениях и изо всех сил пытаюсь получить правильные выражения.
- Я хотел бы извлечь имя идентификатора образца B/TP -1. Это имя будет различаться в зависимости от фрейма данных (B/TP-1, B/TP-2 и т. д.).
- Я хотел бы извлеките глубину 0,5 из идентификатора образца. Эти глубины могут различаться в зависимости от кадра данных (0,5, 2,5, 5, 10, 15 и т. д.).
Код: Выделить всё
pattern = r'B/TP-6-(\d+\d+)
SAMPDATA_w['Sample ID2'] = SAMPDATA_w['Sample ID'].apply(lambda x: re.search(pattern, x) .group(1) if re.search(pattern, x) else None)
Мне также не удалось извлечь только идентификатор образца.
Подробнее здесь: https://stackoverflow.com/questions/789 ... -in-pandas