【问题标题】:regexp_extract function - Spark scala getting errorregexp_extract 函数 - Spark scala 出现错误
【发布时间】:2020-11-01 01:20:13
【问题描述】:

这里是示例记录

SYSTEM, paid18.26 toward test
sys, paid $861.82 toward your
L, paid $1119.00toward your

我需要提取支付和支付之间的数据。我已经写了如下声明,但我没有得到输出

withColumn("message_comment_txt_amount",regexp_extract(col("message_comment_txt"),"(?i)paid\\s+(.*?)\\s+(?i)toward",1))

我没有得到想要的

预期输出

18.26 
861.82 
1119.00

请告诉我确切的错误在哪里。

【问题讨论】:

    标签: scala apache-spark


    【解决方案1】:

    假设金额总是介于字符串“paid”和“toward”之间

     val amount = df.withColumn(
          "amount",
          regexp_extract(col("message_comment_txt"), "^paid(.*)toward.*", 1)
        )
    

    上面的 sn-p 向 dataset/df 添加了一个新的列数量。它不会检查/替换 $ 符号。如果在所有情况下都能正常工作,则可以在下一步中替换它。

    【讨论】:

      猜你喜欢
      • 2020-02-04
      • 1970-01-01
      • 2014-11-17
      • 2019-01-24
      • 1970-01-01
      • 1970-01-01
      • 2019-11-30
      • 2015-09-13
      • 1970-01-01
      相关资源
      最近更新 更多