【发布时间】:2021-12-25 02:24:40
【问题描述】:
我正在尝试使用 pandera 库(我对此很陌生)进行 pandas 数据框验证。 我想要做的是忽略根据架构无效的行。 我该怎么做?
例如: pandera 架构如下所示:
import pandera as pa
import pandas as pd
schema: pa.DataFrameSchema = pa.DataFrameSchema(columns={
'Col1': pa.Column(str),
'Col2': pa.Column(float, checks=pa.Check(lambda x: (0 <= x <= 1)), nullable=True),
})
df: pd.DataFrame = pd.DataFrame({
"Col1": ["1", "2", "3", nan],
"Col2": [0.3, 0.4, 5, 0.2],
})
我想要做的是,当我对 df 应用验证时,我会得到一个结果:
Col1 Col2
0 1 0.3
1 2 0.4
删除了其他有错误的行。
【问题讨论】:
-
我为这个问题创建并添加了 pandera 标签,所以@Prashant,请批准this suggested edit 将新标签应用于您的问题。
标签: python pandas data-science pandera