代码之家  ›  专栏  ›  技术社区  ›  Sachith Muhandiram

如何使用正则表达式忽略特定字符和新行

  •  0
  • Sachith Muhandiram  · 技术社区  · 6 年前

    我正在尝试使用ApacheNIFI验证csv文件。

    我的CSV文件有一些缺陷。

    id,name,address
    1,sachith,{"Lane":"ABC.RTG.EED","No":"12"}
    2,nalaka,{"Lane":"DEF",
    "No":"23"}
    3,muha,{"Lane":"GRF.FFF","No":"%$&%*^%"}
    

    在第二排,它被分成两行,第三排有一些特殊的字符。

    \{("\w+":"\w+",)*[^%&*@]*\} ,但这并不是捕获行拆分错误和新行。

    我也用过 \{("\w+":"\w+",)*[^%&*@]*\}$ ,但它甚至没有得到正确的答案。

    0 回复  |  直到 6 年前
        1
  •  1
  •   Eraklon    6 年前

    这是您可能正在寻找的: ^[0-9]+,[a-z]+,\{("\w+":"[\w\.]+","\w+":"[a-zA-Z0-9]+")\}$