php抓取并保存网站图片的实现代码

 更新时间:2015年10月28日 14:30:45   投稿:lijiao  
这篇文章主要介绍了php抓取并保存网站图片的实现代码,网页源代码捕获,图片链接获取、分析、并将同样的图片链接合并功能。功能很全面,需要的朋友可以参考下

此程序实现了网页源代码捕获,图片链接获取、分析、并将同样的图片链接合并功能,实现了图片抓取功能。利用php强大的网络内容处理函数将指定的网站上的所有图片抓取下来,保存在当前目录下,以下为代码:

<?php 
/*完成网页内容捕获功能*/ 
function get_img_url($site_name){ 
 $site_fd = fopen($site_name, "r"); 
 $site_content = ""; 
 while (!feof($site_fd)) { 
  $site_content .= fread($site_fd, 1024); 
 } 
 /*利用正则表达式得到图片链接*/ 
 $reg_tag = '/<img.*?\"([^\"]*(jpg|bmp|jpeg|gif)).*?>/'; 
 $ret = preg_match_all($reg_tag, $site_content, $match_result); 
 fclose($site_fd); 
 return $match_result[1]; 
} 
 
/* 对图片链接进行修正 */ 
function revise_site($site_list, $base_site){ 
 foreach($site_list as $site_item) { 
  if (preg_match('/^http/', $site_item)) { 
   $return_list[] = $site_item; 
  }else{ 
   $return_list[] = $base_site."/".$site_item; 
 } 
 } 
 return $return_list; 
} 
 
/*得到图片名字,并将其保存在指定位置*/ 
function get_pic_file($pic_url_array, $pos){ 
 $reg_tag = '/.*\/(.*?)$/'; 
 $count = 0; 
 foreach($pic_url_array as $pic_item){ 
  $ret = preg_match_all($reg_tag,$pic_item,$t_pic_name); 
  $pic_name = $pos.$t_pic_name[1][0]; 
  $pic_url = $pic_item; 
 print("Downloading ".$pic_url." "); 
  $img_read_fd = fopen($pic_url,"r"); 
  $img_write_fd = fopen($pic_name,"w"); 
  $img_content = ""; 
  while(!feof($img_read_fd)){ 
   $img_content .= fread($img_read_fd,1024); 
   
  } 
  fwrite($img_write_fd,$img_content); 
  fclose($img_read_fd); 
  fclose($img_write_fd); 
  print("[OK] "); 
 } 
 return 0; 
} 
 
function main(){ 
/* 待抓取图片的网页地址 */ 
 $site_name = "https://www.jb51.net/sheying/391528.html"; 
 $img_url = get_img_url($site_name); 
 $img_url_revised = revise_site($img_url, $site_name); 
 $img_url_unique = array_unique($img_url_revised); //unique array 
 get_pic_file($img_url_unique,"./"); 
} 
 
main(); 
?> 

此程序还有待完善的地方是,如果图片在网站服务器上不同目录下但文件名是相同的,此时图片有可能是不一样的,但在最后保存时,后面得到的图片会将前面已经保存的图片覆盖掉,解决方法是在每次保存前先检索当前目录下是否已有此文件名,有的话对将要保存的图片重新命名即可。

以上就是为大家分享的php抓取并保存网站图片的方法,以及在实践过程中修正程序不完善的地方,希望这篇文章对大家的学习有所帮助。

相关文章

  • ThinkPHP与PHPExcel冲突解决方法

    ThinkPHP与PHPExcel冲突解决方法

    最近一个项目需要批量导入Excel数据,要用到PHP读取Excel中的内容然后导入到数据库。
    2011-08-08
  • PHP浮点数的一个常见问题

    PHP浮点数的一个常见问题

    本文主要给大家详细介绍了下php的浮点数,以及在应用中关于浮点数的一个小问题,有需要的小伙伴可以参考下
    2016-03-03
  • php文件上传类完整实例

    php文件上传类完整实例

    这篇文章主要介绍了php文件上传类,结合完整实例形式分析了php上传文件的类型判断、大小计算机限制等技巧,需要的朋友可以参考下
    2016-05-05
  • PHP面向对象概念

    PHP面向对象概念

    要详细了解PHP OO最好看PHP手册。大家都知道的部分就不说了,这里只记下容易忘记的部分
    2011-11-11
  • PHP中new static()与new self()的区别异同分析

    PHP中new static()与new self()的区别异同分析

    这篇文章主要介绍了PHP中new static()与new self()的区别异同分析,是很实用的技巧,需要的朋友可以参考下
    2014-08-08
  • PHP+Tidy-完美的XHTML纠错+过滤

    PHP+Tidy-完美的XHTML纠错+过滤

    PHP+Tidy-完美的XHTML纠错+过滤...
    2007-04-04
  • PHP内核介绍及扩展开发指南—基础知识

    PHP内核介绍及扩展开发指南—基础知识

    本章简要介绍一些Zend引擎的内部机制,这些知识和Extensions密切相关,同时也可以帮助我们写出更加高效的PHP代码。
    2011-09-09
  • php版微信js-sdk支付接口类用法示例

    php版微信js-sdk支付接口类用法示例

    这篇文章主要介绍了php版微信js-sdk支付接口类用法,结合实例形式分析了php版微信js-sdk支付接口类的定义与相关使用技巧,需要的朋友可以参考下
    2016-10-10
  • PHP积分兑换接口实例

    PHP积分兑换接口实例

    这篇文章主要介绍了PHP积分兑换接口,实例分析了积分兑换接口的逻辑处理与数据库操作技巧,需要的朋友可以参考下
    2015-02-02
  • 详解PHP用mb_string处理windows中文字符

    详解PHP用mb_string处理windows中文字符

    如果想批处理以前下载的一堆文件,把文件里的关键内容用正则匹配出来,集中处理。操作文件时遇到一个问题,就是windows操作系统中的编码问题。本文将带着大家详细探讨此问题。
    2021-05-05

最新评论