如何用火车头采集当前页面url网址
https://www.78moban.com/article/5161.html
首先创建一个标签为本文网址,勾选后面的“从网址中采集”。
选择下面的“正则提取”,点击通配符“(??)”,这样在窗口中就显示为(?[\s\S]*?) 我们再在它前加一个与字符串开始的地方匹配的符号^,又在它后面加一个与字符串结束的地方匹配的符号KaTeX parse error: Undefined control sequence: \s at position 21: …成了^(?<content>[\̲s̲\S]*?)。
如图:
Content 代表内容
? 表示匹配0次或者1次
\s 匹配所有空白字符
\S 匹配所有非空白字符
* 修饰匹配次数为 0 次或任意次