html文档包括那两个部分,如何找出两个HTML文档中不同的部分并能够定位出来？...

最新推荐文章于 2023-01-03 15:47:48 发布

weixin_39539588

最新推荐文章于 2023-01-03 15:47:48 发布

阅读量163

点赞数

文章标签： html文档包括那两个部分

标题说的可能有点抽象，举个例子说明下。

网页A(部分)：

pageA

XXXXX

2013-11-21

网页B(部分)：

pageB

XXXXX

2013-11-20

网页C(部分)：

pageC

YYYYY

2013-11-19

人工对比下可以发现网页A与B对比的话，.title和.lastupdate这两个span里的值不一样。我需要实现的就是能够通过代码识别出这两个位置，并且能够根据这个位置在网页C中提取出pageC和2013-11-19

p.s. 本问题不指定某个特殊语言，主要是探讨下思路。回答最好不要过于依赖某个语言自己独有的包或者类库。

再p.s. 我自己打算最终用node.js或者php实现。如果回答是别的语言的话我会自己“翻译”的，不用担心~

基于回答补充以下内容：

1.不同的定义仅局限在内容的不同，保证被比较的两者整个网页大体的结构是稳定一致的。

2.网页内可能会存在不规则的标签，包括但不限于未闭合的标签(如漏写一个)、自己定义一个标签类别()

weixin_39539588

关注

0
点赞
踩
0

收藏

觉得还不错? 一键收藏
0
评论
html文档包括那两个部分,如何找出两个HTML文档中不同的部分并能够定位出来？...

标题说的可能有点抽象，举个例子说明下。网页A(部分)：pageAXXXXX2013-11-21网页B(部分)：pageBXXXXX2013-11-20网页C(部分)：pageCYYYYY2013-11-19人工对比下可以发现网页A与B对比的话，.title和.lastupdate这两个span里的值不一样。我需要实现的就是能够通过代码识别出这两个位置，并且能够根据这个位置在网页C中提取出pageC...
复制链接

扫一扫

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。