Код: Выделить всё
0 46X ⌀ 376_ 000 THRU
1 SLOT ⌀250 X .750 LG ↧.03
2 -2X .250-20-UNC-2B ↧.75
3 ⌀ 755+.002
4 SLOT ⌀. 375 X 1.98 LG THRU
5 2X SLOT⌀ 256 _ 000
6 ↧ 1.00
7 50X ⌀ 265 THRU
8 SLOT ⌀250 X .750 LG ↧.03
9 SLOT ⌀ 505 +.002 WIDE X 3.86 LG THRU
10 42.±12
11 4X ⌀ 265 THRU
12 2X dĩa 06 THRU -
13 MARKED " A"
14 THRU
15 -. 000
16 +.004 X
17 * X.356 LG
18 CHAMFER .05 X 45°
19 MARKED "B"
20 5 -. 000 Y
21 40.512
22 NOTES: UNLESS OTHERWISE SPECIFIED:
23 4X R.378 THRU
24 2. FINISHED PART FREE OF MANUFACTURING RESIDUE...
25 3. CHEMICAL CLEAN PER SOLYNDRA CLEANING SPEC. ...
26 4\ DIE STAMP OR SCRIBE SOLYNDRA PART NUMBER, R...
27 5 BAG AND TAG WITH SOLYNDRA''S PART NUMBER AND...
28 2X FULL R.
29 THRU
30 (2.823)
31 100 SHT XXXXX-1200
32 755+.003
33 (.197)
34 1.175
35 6. PACKAGE FOR SHIPPING AND STORAGE USING PROT...
36 10X .375-16 UNC-2B THRU MARKED "C"
37 2.350
38 2.850
39 ACO
40 COD B
41 4.75 2.750
42 CO A
43 OC
44 OC B
45 300
46 10X .250-20 UNC-2B THRU
47 SIDE VIEW
48 10X 4.375
49 2X 4.250
50 8X 4.000
51 COADA
52 DACA
53 ACD
54 3X 2.823
55 23X 2.750
1.Игнорировать любые цифры, стоящие перед буквой «X».
Пример: в тексте «46X ⌀ 376_ 000 THRU» игнорируйте цифру 46, поскольку она стоит перед «X».
2. Игнорируйте любые цифры, следующие за символами «+». ' или '-'.
Пример: в тексте «⌀ 755+.002» следует извлечь только число 755, поскольку цифры после «+» игнорируются.
Аналогично, в тексте «-2X .250-20-UNC-2B» игнорируйте число 20, поскольку оно идет после «-».
Моя цель — извлечь только допустимые числа. из каждой текстовой записи на основе этих правил и сохранять результат в новом столбце в DataFrame.
Я пытался сделать:
Код: Выделить всё
df['integers'] = df['text'].str.findall(r'(?
Подробнее здесь: [url]https://stackoverflow.com/questions/78992948/how-to-extract-specific-numbers-with-the-given-conditions-in-pandas[/url]