go实现并发爬虫

最新推荐文章于 2024-06-28 14:55:13 发布

tianlongtc

最新推荐文章于 2024-06-28 14:55:13 发布

阅读量1k

点赞数

分类专栏： go

本文链接：https://blog.csdn.net/tianlongtc/article/details/80143489

版权

package main

import (
   "os"
   "fmt"
   "log"
   "net/http"
   "golang.org/x/net/html"
)

func Extract(url string) ([]string, error) {
   resp, err := http.Get(url)
   if err != nil {
      return nil, err
   }
   if resp.StatusCode != http.StatusOK {
      resp.Body.Close()
      return nil, fmt.Errorf("getting %s: %s", url, resp.Status)
   }
   doc, err := html.Parse(resp.Body)
   resp.Body.Close()
   if err != nil {
      return nil, fmt.Errorf("parsing %s as HTML: %v", url, err)
   }
   var links []string
   visitNode := func(n *html.Node) {
      if n.Type == html.ElementNode && n.Data == "a" {
         for _, a := range n.Attr {
            if a.Key != "href" {
               continue
            }

最低0.47元/天解锁文章

确定要放弃本次机会？

福利倒计时

: :

立减 ¥

普通VIP年卡可用

立即使用

tianlongtc

关注关注

0
点赞
踩
0

收藏

觉得还不错? 一键收藏
0
评论
go实现并发爬虫

package mainimport ( "os" "fmt" "log" "net/http" "golang.org/x/net/html")func Extract(url string) ([]string, error) { resp, err := http.Get(url) if err != nil { return ...
复制链接

扫一扫