0

0

如何使用php采集抓取css图片代码详解

伊谢尔伦

伊谢尔伦

发布时间:2017-07-17 15:22:08

|

1793人浏览过

|

来源于php中文网

原创

一. 抓取 css 中的图片: 
> 1. 首先做好准备工作: 
> 第一步,先把 css 原本的路径存到 $url 变量里,然后把 css 的内容保存在 abc.css 中。 
> 因为考虑到经常碰到多个 css 文件的状况,所以小邪没有直接填一个 css 路径。 
> 而是把几个 css 文件的内容合并到一起,全部塞到 abc.css 文件里面即可,嘎嘎嘎。 

$data = file_get_contents('abc.css'); 

> 接着读取 css 文件的内容到 $data 变量中,然后用正则式把域名给取出来。 
> 因为这里考虑到很多图片文件用到了相对根路径,比方说 /img/1.gif 和 img/1.gif。 
> 然后 css 原地址在 http://www.jb51.net/css/ 那么上面的两个文件位置是不同的。 

> 第一个文件在 /upload/201109/20110926143903807.gif,因为它的路径用到了相对根路径。 
> 而第二个在 /upload/201109/20110926143903169.gif,它的路径只是普通的相对路径。 

2. 把图片存储文件夹建好: 
> 小邪这里用了 is_dir 来确定文件夹是否存在,存在的话,就不用再建立第二遍了。 
> 呵呵,顺便说下,is_file 函数可以确定此文件是否为正常文件,也可以确定是否存在。 
> 但 file_exists() 优越一点,因为某次看到有人在 Webmasterworld.com 上面讨论过。 

if (!is_dir('img')) { mkdir('img'); } 

> 3. 用正则式把图片相对地址取出来: 

$regex = '/url\(\'{0,1}\"{0,1}(.*?)\'{0,1}\"{0,1}\)/'; 
//这里用正则式匹配出图片地址,要考虑三种情况,即 url(1.gif) url('1.gif') url("1.gif")。 
//这三种写法都是可以使用的,所以咱们就用上面的正则把里面的 1.gif 取出来。 
//\'{0,1} 表示单引号可能出现1次或0次,\" 则表示双引号可能出现1次或0次。 
//中间必须使用懒惰匹配,不然取出来的就是 1.gif" 而不是 1.gif 鸟,O(∩_∩)P。 
preg_match_all($regex,$data,$result); 

> 4. 处理这些图片: 

> 首先使用一个循环,把上面是用正则提取出来的第一分支内容数组给处理一下。 
> 额,这里的第一分支表示正则式里面的第一个括号来着,呵呵,以此类推。 

foreach ($result[1] as $val) { } 

> 然后是用正则式判定,因为还要考虑到这样 /upload/201109/20110926143903807.gif。 
> 这样是使用了完整的路径了,而不是想其他的一样是 /img/1.gif 或者 img/1.gif。 
> 所以单独判断一下,然后接着判断这两个,看看是 /img/1.gif 还是 img/1.gif。 

ob_start : 打开输出缓冲 
This function will turn output buffering on. While output buffering is active no output is sent from the script (other than headers), instead the output is stored in an internal buffer. (输出是在内部缓冲储存) 
// 
readfile : 读入一个文件并写入到输出缓冲 
返回从文件中读入的字节数。如果出错返回 FALSE 并且除非是以 @readfile() 形式调用,否则会显示错误信息。 
// 

ob_get_contents : Return the contents of the output buffer(返回输出缓冲的内容) 
This will return the contents of the output buffer without clearing it or FALSE, if output buffering isn't active. (如果输出缓冲没有活动(打开),则返回 FALSE) 
// 
ob_end_clean() : Clean (erase) the output buffer and turn off output buffering(清除输出缓冲) 。

STORYD
STORYD

帮你写出让领导满意的精美文稿

下载

相关文章

PHP速学教程(入门到精通)
PHP速学教程(入门到精通)

PHP怎么学习?PHP怎么入门?PHP在哪学?PHP怎么学才快?不用担心,这里为大家提供了PHP速学教程(入门到精通),有需要的小伙伴保存下载就能学习啦!

下载

相关标签:

本站声明:本文内容由网友自发贡献,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系admin@php.cn

相关专题

更多
php源码安装教程大全
php源码安装教程大全

本专题整合了php源码安装教程,阅读专题下面的文章了解更多详细内容。

7

2025.12.31

php网站源码教程大全
php网站源码教程大全

本专题整合了php网站源码相关教程,阅读专题下面的文章了解更多详细内容。

4

2025.12.31

视频文件格式
视频文件格式

本专题整合了视频文件格式相关内容,阅读专题下面的文章了解更多详细内容。

7

2025.12.31

不受国内限制的浏览器大全
不受国内限制的浏览器大全

想找真正自由、无限制的上网体验?本合集精选2025年最开放、隐私强、访问无阻的浏览器App,涵盖Tor、Brave、Via、X浏览器、Mullvad等高自由度工具。支持自定义搜索引擎、广告拦截、隐身模式及全球网站无障碍访问,部分更具备防追踪、去谷歌化、双内核切换等高级功能。无论日常浏览、隐私保护还是突破地域限制,总有一款适合你!

7

2025.12.31

出现404解决方法大全
出现404解决方法大全

本专题整合了404错误解决方法大全,阅读专题下面的文章了解更多详细内容。

42

2025.12.31

html5怎么播放视频
html5怎么播放视频

想让网页流畅播放视频?本合集详解HTML5视频播放核心方法!涵盖<video>标签基础用法、多格式兼容(MP4/WebM/OGV)、自定义播放控件、响应式适配及常见浏览器兼容问题解决方案。无需插件,纯前端实现高清视频嵌入,助你快速打造现代化网页视频体验。

4

2025.12.31

关闭win10系统自动更新教程大全
关闭win10系统自动更新教程大全

本专题整合了关闭win10系统自动更新教程大全,阅读专题下面的文章了解更多详细内容。

3

2025.12.31

阻止电脑自动安装软件教程
阻止电脑自动安装软件教程

本专题整合了阻止电脑自动安装软件教程,阅读专题下面的文章了解更多详细教程。

3

2025.12.31

html5怎么使用
html5怎么使用

想快速上手HTML5开发?本合集为你整理最实用的HTML5使用指南!涵盖HTML5基础语法、主流框架(如Bootstrap、Vue、React)集成方法,以及无需安装、直接在线编辑运行的平台推荐(如CodePen、JSFiddle)。无论你是新手还是进阶开发者,都能轻松掌握HTML5网页制作、响应式布局与交互功能开发,零配置开启高效前端编程之旅!

2

2025.12.31

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
PHP课程
PHP课程

共137课时 | 8.1万人学习

JavaScript ES5基础线上课程教学
JavaScript ES5基础线上课程教学

共6课时 | 6.9万人学习

PHP新手语法线上课程教学
PHP新手语法线上课程教学

共13课时 | 0.8万人学习

关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号