提取html xml,分析XML以使用htmlparser2提取特定标记的文本

我正在尝试node-htmlparser2,一开始就被卡住了。我有数千个这样的XML文件:

â¦

â¦

â¦

â¦

我想要里面的一切

作为单个字符串。我下面的代码有效,但在我看来这不是正确的方法

let isFoo = false;

let txt = '';

const p = new htmlparser.Parser({

onopentag: function(name, attribs){

if (name === 'foo') {

isFoo = true;

}

},

ontext: function(text){

if (isFoo) {

txt += text;

}

},

onclosetag: function(tagname){

if (tagname === 'foo') {

isFoo = false;

return txt;

}

}

}, {decodeEntities: true, xmlMode: true});

let data = [];

for (let file in files) {

let record = {

filename: file,

filetext: p.write(file)

}

data.push(record);

p.end();

}

有没有更好的方法可以在没有这种愚蠢的情况下使用htmlparser2?

isFoo

旗帜?

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值