• 如何用火车头采集当前页面url网址


    今天遇到一个问题,就是想发布文章的时候发布原文的网址,不知道采集怎么做,通过搜索和学习,终于搞定了这个问题。

    首先创建一个标签:网址,勾选后面的“从网址中采集”。

    选择下面的“正则提取”,点击通配符“(?<content>?)”,这样在窗口中就显示为(?<content>[\s\S]*?)

    我们再在它前加一个与字符串开始的地方匹配的符号^,又在它后面加一个与字符串结束的地方匹配的符号$,这样就变成了^(?<content>[\s\S]*?)$。

    如图所示:



    Content  代表内容
    ?  表示匹配0次或者1次
    \s  匹配所有空白字符
    \S  匹配所有非空白字符
    *  修饰匹配次数为 0 次或任意次
  • 2021年01月05日 20时40分来自 日新微博
  • 评论 0
  • 手机玩微博

    手机版 手机端
    Powered by 日新微博 © 2018 - 2020 日新网