Например, у меня есть DataFrame Polars:
>>> df = pl.DataFrame({'A': ['a', 'b', 'c', 'd'], 'B': ['app', 'nop', 'cap', 'tab']})
>>> df
shape: (4, 2)
┌─────┬─────┐
│ A ┆ B │
│ --- ┆ --- │
│ str ┆ str │
╞═════╪═════╡
│ a ┆ app │
│ b ┆ nop │
│ c ┆ cap │
│ d ┆ tab │
└─────┴─────┘
Я пытаюсь получить третий столбец C, который имеет значение True, если строки в столбце B начинаются со строк в столбце A code> той же строки, в противном случае — False. Итак, в приведенном выше случае я ожидаю:
┌─────┬─────┬───────┐
│ A ┆ B ┆ C │
│ --- ┆ --- ┆ --- │
│ str ┆ str ┆ bool │
╞═════╪═════╪═══════╡
│ a ┆ app ┆ true │
│ b ┆ nop ┆ false │
│ c ┆ cap ┆ true │
│ d ┆ tab ┆ false │
└─────┴─────┴───────┘
Мне известна функция df['B'].str.starts_with(), но передача столбца дала:
< pre class="lang-py Prettyprint-override">>>> df['B'].str.starts_with(pl.col('A'))
... # Some stuff here.
TypeError: argument 'sub': 'Expr' object cannot be converted to 'PyString'
Как это сделать? В пандах вы должны сделать следующее:
df.apply(lambda d: d['B'].startswith(d['A']), axis=1)
Подробнее здесь: https://stackoverflow.com/questions/751 ... her-column