IT数码 购物 网址 头条 软件 日历 阅读 图书馆
TxT小说阅读器
↓语音阅读,小说下载,古典文学↓
图片批量下载器
↓批量下载图片,美女图库↓
图片自动播放器
↓图片自动播放器↓
一键清除垃圾
↓轻轻一点,清除系统垃圾↓
开发: C++知识库 Java知识库 JavaScript Python PHP知识库 人工智能 区块链 大数据 移动开发 嵌入式 开发工具 数据结构与算法 开发测试 游戏开发 网络协议 系统运维
教程: HTML教程 CSS教程 JavaScript教程 Go语言教程 JQuery教程 VUE教程 VUE3教程 Bootstrap教程 SQL数据库教程 C语言教程 C++教程 Java教程 Python教程 Python3教程 C#教程
数码: 电脑 笔记本 显卡 显示器 固态硬盘 硬盘 耳机 手机 iphone vivo oppo 小米 华为 单反 装机 图拉丁
 
   -> PHP知识库 -> swoole 使用 http 客户端 多协程下载图片 -> 正文阅读

[PHP知识库]swoole 使用 http 客户端 多协程下载图片

草稿片:

<?php
/**
 * Created by PhpStorm.
 * User: yangpeng
 * Date: 2021/7/22
 * Time: 16:11
 */
namespace app;

define('PUBLIC_DIR',__DIR__.'/public');
define('IMG_DIR',__DIR__.'/public/image');

use Swoole\Coroutine;
use function Swoole\Coroutine\run;
use Swoole\Coroutine\Channel;
class ReadCsv {
	public function readExcel($fileName){
		$file = fopen(PUBLIC_DIR.'/'.$fileName,'r');
		$goods_list = [];
		$downloadChan = new Channel(10000);
		while ($data = fgetcsv($file)) { //每次读取CSV里面的一行内容
			//print_r($data); //此为一个数组,要获得每一个数据,访问数组下标即可
			if($data[0] != 'product_id'){
				$array = explode('http:',$data[1]);
				foreach($array as $key=> $val){
					$str = trim($val);
					if(!empty($str) && !in_array($str,$goods_list)){
						$temp = explode('max-w',$str);
						$path = pathinfo($str);
						$goods_list[$key][] = 'https:'.$temp[0].'62x62.'.$path['extension'];
						$goods_list[$key][] = 'https:'.$temp[0].'max-440.'.$path['extension'];
						$goods_list[$key][] = 'https:'.($str);
						
					}
				}
			}
		}
		fclose($file);
		foreach($goods_list as $key => $imgArray){
			foreach($imgArray as $v){
				$path = parse_url($v);
				if(isset($path['path'])){
					if(!file_exists(IMG_DIR.$path['path'])){
						$url = $v;
//						$path = IMG_DIR.$path['path'];
						// 解析html标签中的需要的连接地址 并进行投递
						go(function () use ($downloadChan, $url) {
							$downloadChan->push($url);
						});
					}
				}
			}
		}
		
		$this->downloadImg($downloadChan);
	}
	
	public function downloadImg($downloadChan){
		for ($i=1;$i<=50;$i++){
			go(function () use($downloadChan){
				while($downloadChan->length()>0){
					$imageUrl = $downloadChan->pop();
					$path = parse_url($imageUrl);
					if(isset($path['path'])){
						if(!file_exists(IMG_DIR.$path['path'])){
							$savePath = IMG_DIR.$path['path'];
							
							$url = parse_url($imageUrl);
							$domain = $url['host'];
							//download image
							$cli = new \Swoole\Coroutine\Http\Client($domain, 443, true);
							//长连接
							$cli->set(['timeout' => -1]);
							//header信息
							$head = [
								'host'=>$domain,
								'accept-encoding'=>'gzip, deflate',
								'accept-language'=>'zh-CN,zh;q=0.9,en;q=0.8,en-GB;q=0.7,en-US;q=0.6',
								'accept'=>'text/html,application/xhtml+xml,application/xml;q=0.9,image/webp,image/apng,*/*;q=0.8,application/signed-exchange;v=b3;q=0.9',
								'user-agent'=>'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/79.0.3945.88 Safari/537.36 Edg/79.0.309.54',
							];
							//设置header头部
							$cli->setHeaders($head);
							$cli->get($imageUrl);
							if($cli->statusCode == 200){
								$dir = pathinfo($savePath)['dirname'];
								if(!file_exists($dir)){
									mkdir($dir, 0777, true);
								}
								//下载图片
								$cli->download($imageUrl, $savePath,0);
								echo sprintf("[%s] 下载完毕".PHP_EOL,$imageUrl);
							}
						}
					}
				}
				
				
				
			});
		}
		
		


	}
}

修改版:

<?php
/**
 * Created by PhpStorm.
 * User: yangpeng
 * Date: 2021/7/22
 * Time: 16:11
 */
namespace app;

define('PUBLIC_DIR',__DIR__.'/public');
define('IMG_DIR',__DIR__.'/public/image');

use Swoole\Coroutine;
use function Swoole\Coroutine\run;
use Swoole\Coroutine\Channel;
class ReadCsvNew {
	public function readExcel($fileName){
		$s = microtime(true);
		run(function() use($fileName){
			$file = fopen(PUBLIC_DIR.'/'.$fileName,'r');
			$goods_list = [];
			$downloadChan = new Channel(10000);
			while ($data = fgetcsv($file)) { //每次读取CSV里面的一行内容
				//print_r($data); //此为一个数组,要获得每一个数据,访问数组下标即可
				if($data[0] != 'product_id'){
					$array = explode('http:',$data[1]);
					foreach($array as $key=> $val){
						$str = trim($val);
						if(!empty($str) && !in_array($str,$goods_list)){
							$temp = explode('max-w',$str);
							$path = pathinfo($str);
							$small = 'https:'.$temp[0].'62x62.'.$path['extension'];
							$medium = 'https:'.$temp[0].'max-440.'.$path['extension'];
							$big = 'https:'.($str);
							go(function () use ($downloadChan, $small) {
								$downloadChan->push($small);
							});
							go(function () use ($downloadChan, $medium) {
								$downloadChan->push($medium);
							});
							go(function () use ($downloadChan, $big) {
								$downloadChan->push($big);
							});
						}
					}
					
				}
			}
			fclose($file);
			$this->downloadImg($downloadChan);
		});
		
		echo 'use ' . (microtime(true) - $s) . ' s';
	}
	
	public function downloadImg($downloadChan){
		for ($i=1;$i<=100;$i++){
			go(function () use($downloadChan){
				while($downloadChan->length()>0){
					$imageUrl = $downloadChan->pop();
					$path = parse_url($imageUrl);
					if(isset($path['path'])){
						if(!file_exists(IMG_DIR.$path['path'])){
							$savePath = IMG_DIR.$path['path'];
							
							$url = parse_url($imageUrl);
							$domain = $url['host'];
							//download image
							$cli = new \Swoole\Coroutine\Http\Client($domain, 443, true);
							//长连接
							$cli->set(['timeout' => -1]);
							//header信息
							$head = [
								'host'=>$domain,
								'accept-encoding'=>'gzip, deflate',
								'accept-language'=>'zh-CN,zh;q=0.9,en;q=0.8,en-GB;q=0.7,en-US;q=0.6',
								'accept'=>'text/html,application/xhtml+xml,application/xml;q=0.9,image/webp,image/apng,*/*;q=0.8,application/signed-exchange;v=b3;q=0.9',
								'user-agent'=>'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/79.0.3945.88 Safari/537.36 Edg/79.0.309.54',
							];
							//设置header头部
							$cli->setHeaders($head);
							$cli->get($imageUrl);
							if($cli->statusCode == 200){
								$dir = pathinfo($savePath)['dirname'];
								if(!file_exists($dir)){
									mkdir($dir, 0777, true);
								}
								//下载图片
								$cli->download($imageUrl, $savePath,0);
								echo sprintf("[%s] 下载完毕".PHP_EOL,$imageUrl);
							}
							$cli->close();
						}
					}
				}
			});
		}
	}
}

  PHP知识库 最新文章
Laravel 下实现 Google 2fa 验证
UUCTF WP
DASCTF10月 web
XAMPP任意命令执行提升权限漏洞(CVE-2020-
[GYCTF2020]Easyphp
iwebsec靶场 代码执行关卡通关笔记
多个线程同步执行,多个线程依次执行,多个
php 没事记录下常用方法 (TP5.1)
php之jwt
2021-09-18
上一篇文章      下一篇文章      查看所有文章
加:2021-07-24 11:13:11  更:2021-07-24 11:14:01 
 
开发: C++知识库 Java知识库 JavaScript Python PHP知识库 人工智能 区块链 大数据 移动开发 嵌入式 开发工具 数据结构与算法 开发测试 游戏开发 网络协议 系统运维
教程: HTML教程 CSS教程 JavaScript教程 Go语言教程 JQuery教程 VUE教程 VUE3教程 Bootstrap教程 SQL数据库教程 C语言教程 C++教程 Java教程 Python教程 Python3教程 C#教程
数码: 电脑 笔记本 显卡 显示器 固态硬盘 硬盘 耳机 手机 iphone vivo oppo 小米 华为 单反 装机 图拉丁

360图书馆 购物 三丰科技 阅读网 日历 万年历 2024年5日历 -2024/5/4 19:53:14-

图片自动播放器
↓图片自动播放器↓
TxT小说阅读器
↓语音阅读,小说下载,古典文学↓
一键清除垃圾
↓轻轻一点,清除系统垃圾↓
图片批量下载器
↓批量下载图片,美女图库↓
  网站联系: qq:121756557 email:121756557@qq.com  IT数码