php 图片网站,php抓取网站图片的程序

此程序实现了网页源代码捕获,图片链接获取、分析、并将同样的图片链接合并功能,实现了图片抓取功能。利用php强大的网络内容处理函数将指定的网站上的所有图片抓取下来,保存在当前目录下,以下为代码:

/*完成网页内容捕获功能*/

function get_img_url($site_name){

$site_fd = fopen($site_name, "r");

$site_content = "";

while (!feof($site_fd)) {

$site_content .= fread($site_fd, 1024);

}

/*利用正则表达式得到图片链接*/

$reg_tag = '//';

$ret = preg_match_all($reg_tag, $site_content, $match_result);

fclose($site_fd);

return $match_result[1];

}

/* 对图片链接进行修正 */

function revise_site($site_list, $base_site){

foreach($site_list as $site_item) {

if (preg_match('/^http/', $site_item)) {

$return_list[] = $site_item;

}else{

$return_list[] = $base_site."/".$site_item;

}

}

return $return_list;

}

/*得到图片名字,并将其保存在指定位置*/

function get_pic_file($pic_url_array, $pos){

$reg_tag = '/.*\/(.*?)$/';

$count = 0;

foreach($pic_url_array as $pic_item){

$ret = preg_match_all($reg_tag,$pic_item,$t_pic_name);

$pic_name = $pos.$t_pic_name[1][0];

$pic_url = $pic_item;

print("Downloading ".$pic_url." ");

$img_read_fd = fopen($pic_url,"r");

$img_write_fd = fopen($pic_name,"w");

$img_content = "";

while(!feof($img_read_fd)){

$img_content .= fread($img_read_fd,1024);

}

fwrite($img_write_fd,$img_content);

fclose($img_read_fd);

fclose($img_write_fd);

print("[OK] ");

}

return 0;

}

function main(){

/* 待抓取图片的网页地址 */

$site_name = "http://image.cn.yahoo.com";

$img_url = get_img_url($site_name);

$img_url_revised = revise_site($img_url, $site_name);

$img_url_unique = array_unique($img_url_revised); //unique array

get_pic_file($img_url_unique,"./");

}

main();

?>

此程序还有待完善的地方是,如果图片在网站服务器上不同目录下但文件名是相同的,此时图片有可能是不一样的,但在最后保存时,后面得到的图片会将前面已经保存的图片覆盖掉,如在http://example.com/网站上有图片链接http://example.com/pic/test1.jpg和http://example.com/pic/new/test1.jpg那么在下载时这两张图片只有一张保存,另一张就被覆盖掉,修正的方法是在每次保存前先检索当前目录下是否已有此文件名,有的话对将要保存的图片重新命名即可。

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
PhotoFun-图趣是一款由淘码岛出品的自适应多语言图片网站系统。PhotoFun-图趣最大的特点就是轻量级,整个系统的源码文件所占空间不到2MB(含演示数据的版本除外),所以“超轻”由此得名。 不过,麻雀虽小,五脏俱全,PhotoFun-图趣除了具有图片管理的功能之外,还有用户管理、社交点评、在线消息等功能,特别适合小型摄影师团体或个人搭建作品展览网站;当然,PhotoFun-图趣简单大气的风格也适合一些企业搭建产品展示网站。对了,PhotoFun-图趣还完美适配移动端。 总之,PhotoFun-图趣的特色是短小精干,就像一件可以随身携带的小工具一样,就看你如何使用它了。 PhotoFun-图趣目前支持简体中文、英语、西班牙语、俄语四种语言,前端一键轻松切换显示语言。 系统需求: PHP和MySQL PHP:5.3+ MySQL:5.0+ WEB环境及服务 Linux+Apache+MySQL+PHP Apache需要 "rewrite_module"的支持 安装: 将下载的压缩包解压; 将photofun.sql文件导入数据库; 如果使用主域名或带www的域名安装的话(比如sudujun.com和www.sudujun.com),请修改UPLOAD目录下的.htaccess文件的对应部分,使得不带www的sudujun.com转向www.sudujun.com,保证访问地址唯一性;如果使用子域名或本地安装的话(比如pf.taomadao.com或localhost),则不需这一步; 如果安装在子目录,请修改UPLOAD目录下的.htaccess文件,将“RewriteBase /”中的“/”修改为“/yourfolder”,“yourfolder”即子目录名,如果是安装在一级目录请忽略这一步; 修改UPLOAD/system目录下的config.php文件的21-35行,具体内容请参照文件中的注释; 将UPLOAD目录中(注意不包含UPLOAD目录本身)的所有文件夹及文件上传至服务器; 修改data目录的权限为0777; 完成以上步骤即已安装成功,现在请在浏览器地址栏输入你网站的访问地址: 管理员用户名:useradmin 密码:123456 登录进去后别忘了修改管理员的密码。 帮助: 安装过程中遇到任何问题,请访问PhotoFun交流论坛寻求帮助。 互动: 对PhotoFun有任何建议、想法、评论或发现了bug,请加入PhotoFun交流论坛畅所欲言。 分享精神: 如果您喜欢PhotoFun,请将它介绍给自己的朋友,或者帮助他人安装一个PhotoFun,又或者写一篇赞扬我们的文章。
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值