关于php多线程的记录

  最近需要对3W台服务器进行下发脚本,如果一个一个执行,时间大约在2个小时,特别的慢,于是修改程序,采用php的多线程去分发,大概在10分钟左右完成,下面记录下这次的经验和理解:

  我所理解的php的多线程实现的方式有两种,下面是官方的介绍:

  1、官方的介绍:(转载自张宴的博客)

  到php5.3以上的版本,php才算是真正的支持多线程,使用的是pthreads的扩展,php在处理多个循环的任务的时候,能够大大的缩短程序的执行时间。

  大多数网站的性能瓶颈,不在php的服务器上,而是在mysql服务器上。因为可以通过横向的增加服务器或者是cpu的核数来应对。如果用Mysql数据库,一条联合查询可能处理玩很复杂的业务逻辑,但是遇到大并发量的查询,服务器可能就会瘫痪。因此我们可以使用NoSQL数据库代替mysql服务器,一条很复杂的sql语句,可能需要好几条NOSQL语句来完成,但是遇到大量的并发的情况下,速度确实非常明显的。然后再加上php的多线程的使用,通过十个php的线程查询NOSQL,然后汇总返回结果输出,速度是非常之快的。

1   PHP扩展下载:https://github.com/krakjoe/pthreads
2   PHP手册文档:http://php.net/manual/zh/book.pthreads.php

  1、扩展的编译安装(Linux),编辑参数 --enable-maintainer-zts 是必选项:

 1 cd /Data/tgz/php-5.5.1
 2 ./configure --prefix=/Data/apps/php --with-config-file-path=/Data/apps/php/etc --with-mysql=/Data/apps/mysql --with-mysqli=/Data/apps/mysql/bin/mysql_config --with-iconv-dir --with-freetype-dir=/Data/apps/libs --with-jpeg-dir=/Data/apps/libs --with-png-dir=/Data/apps/libs --with-zlib --with-libxml-dir=/usr --enable-xml --disable-rpath --enable-bcmath --enable-shmop --enable-sysvsem --enable-inline-optimization --with-curl --enable-mbregex --enable-fpm --enable-mbstring --with-mcrypt=/Data/apps/libs --with-gd --enable-gd-native-ttf --with-openssl --with-mhash --enable-pcntl --enable-sockets --with-xmlrpc --enable-zip --enable-soap --enable-opcache --with-pdo-mysql --enable-maintainer-zts
 3 make clean
 4 make
 5 make install
 6
 7 unzip pthreads-master.zip
 8 cd pthreads-master
 9 /Data/apps/php/bin/phpize
10 ./configure --with-php-config=/Data/apps/php/bin/php-config
11 make
12 make installvi /Data/apps/php/etc/php.iniextension = "pthreads.so"

  2、给出一段PHP多线程、与For循环,抓取百度搜索页面的PHP代码示例:

 1 <?php
 2   class test_thread_run extends Thread
 3   {
 4       public $url;
 5       public $data;
 6
 7       public function __construct($url)
 8       {
 9           $this->url = $url;
10       }
11
12       public function run()
13       {
14           if(($url = $this->url))
15           {
16               $this->data = model_http_curl_get($url);
17           }
18       }
19   }
20
21   function model_thread_result_get($urls_array)
22   {
23       foreach ($urls_array as $key => $value)
24       {
25           $thread_array[$key] = new test_thread_run($value["url"]);
26           $thread_array[$key]->start();
27       }
28
29       foreach ($thread_array as $thread_array_key => $thread_array_value)
30       {
31           while($thread_array[$thread_array_key]->isRunning())
32           {
33               usleep(10);
34           }
35           if($thread_array[$thread_array_key]->join())
36           {
37               $variable_data[$thread_array_key] = $thread_array[$thread_array_key]->data;
38           }
39       }
40       return $variable_data;
41   }
42
43   function model_http_curl_get($url,$userAgent="")
44   {
45       $userAgent = $userAgent ? $userAgent : ‘Mozilla/4.0 (compatible; MSIE 7.0; Windows NT 5.2)‘;
46       $curl = curl_init();
47       curl_setopt($curl, CURLOPT_URL, $url);
48       curl_setopt($curl, CURLOPT_RETURNTRANSFER, 1);
49       curl_setopt($curl, CURLOPT_TIMEOUT, 5);
50       curl_setopt($curl, CURLOPT_USERAGENT, $userAgent);
51       $result = curl_exec($curl);
52       curl_close($curl);
53       return $result;
54   }
55
56   for ($i=0; $i < 100; $i++)
57   {
58       $urls_array[] = array("name" => "baidu", "url" => "http://www.baidu.com/s?wd=".mt_rand(10000,20000));
59   }
60
61   $t = microtime(true);
62   $result = model_thread_result_get($urls_array);
63   $e = microtime(true);
64   echo "多线程:".($e-$t)."\n";
65
66   $t = microtime(true);
67   foreach ($urls_array as $key => $value)
68   {
69       $result_new[$key] = model_http_curl_get($value["url"]);
70   }
71   $e = microtime(true);
72   echo "For循环:".($e-$t)."\n";
73 ?>

  上述是官方给的一个php多线程的一个扩展,由于需要重新编译,因此自己没有进行试验,但其实本质都是在linux中开启多个线程来进行处理。

2、下面说下我自己搞得伪造的php的多线程的实例:

下面是一段测试的代码:

for.php

 1 <?php
 2 $start = microtime(true);
 3 for($i=0;$i<5000;$i++){
 4     $cmd = "php ./test.php &"; -----// 主要是这个,使用php执行,将程序放到后台执行,不等待返回结果,再次继续循环,类似于异步的方式,生成多个php的线程。
 5     $fp = popen($cmd,"r");
 6 }
 7 fclose($fp);
 8 $end = microtime(true);
 9
10 echo $end-$start;
11
12
13 ?>

test.php(简单的显示phpinfo的信息):

1 <?php
2     phpinfo();
3 ?>
采用多线程的执行的时间:32.89448595047
采用普通的执行的时间:85.191102027893

执行循环的次数越大,这种时间差就很明显。

ps:我们可以写一个python或者shell的脚本,来实时的检测php的进程数的变化:

1 #!/usr/bin/env/ python
2 import os
3 from time import sleep
4
5 while 1:
6     os.system("ps -aux|grep php|wc -l");
7     sleep(1);
8
9 上面是一个简单的统计php进程数的一个脚本,在shell界面执行的时候,可以将输出定位到一个文件中。
时间: 2024-11-06 09:46:09

关于php多线程的记录的相关文章

Java多线程——异常记录

Java多线程——异常记录 摘要:本文主要介绍了Java多线程中遇到的奇怪的异常. 部分内容来自以下博客: https://blog.csdn.net/historyasamirror/article/details/6709693 java.lang.IllegalMonitorStateException 在测试多线程通信的代码时,出现了这个异常. 代码如下: 1 public class Demo { 2 public static void main(String[] args) { 3

python多线程学习记录

1.多线程的创建 import threading t = t.theading.Thread(target, args--) t.SetDeamon(True)//设置为守护进程 t.start(),启动线程 t.join(),阻塞当前线程,即使得在当前线程结束时,不会退出.会等到子线程结束之后才退出. 如果不加join语句,主线程不会等到子线程结束才结束,但却不会立即杀死该线程. 但是如果添加了SetDaemon(True),如果不加join,则会在主线程结束后马上杀死子线程. 如果join

【多线程学习记录一(1)】创建java多线程

1)java多线程的创建方式有三种: 1.继承Thread类 2.实现Runnable接口 3.实现Callable接口 第一种: 1 //继承Thread类 2 class ExtendsThread extends Thread{ 3 public void run(){ 4 //do your stuff 5 } 6 } 7 ExtendsThread e = new ExtendsThread(); 8 e.start(); 第二种: 1 //实现Runnable接口 2 class I

【多线程学习记录一(2)】继承Thread类和实现Runnable接口、Callable接口的区别

1)Runnable和Callable同是接口 * Callable的任务执行后可返回值,而Runnable的任务是不能返回值(是void);call方法可以抛出异常,run方法不可以 * 运行Callable任务可以拿到一个Future对象,表示异步计算的结果.它提供了检查计算是否完成的方法,以等待计算的完成,并检索计算的结果.通过Future对象可以了解任务执行情况,可取消任务的执行,还可获取执行结果. * 加入线程池运行,Runnable使用ExecutorService的execute方

GCD 多线程 ---的记录 iOS

先写一个GCD static UserInfoVoModel *userInfoShare = nil; +(instancetype)shareUserInfoVoModel { static dispatch_once_t onceToken; dispatch_once(&onceToken, ^{ userInfoShare = [[UserInfoVoModel alloc] init]; }); return userInfoShare; }

C# 面向切面编程--监控日志记录方案

背景:现在公司整体在做监控平台,要求把各个部分的细节都记录下来,在前台页面上有所显示,所以现在需要做的就是一个监控日志的记录工作,今天讲的就是渲染监控日志的例子. 现状:当前的渲染程序没有为监控日志记录预留代码接入口,因此要新增加监控日志势必要增加新的代码.但是如果只是单单在已有逻辑中新增日志记录的代码似乎不太合理:因为记录日志的代码很多都是一样的,直接插入代码有很多重复代码:原有代码已经上线并且运行良好,新增代码会破坏原有封装,甚至增加出错的可能:再者从设计的角度来说,记录日志不属于任何一个功

Rsyslog日志收集服务并结合Loganalyzer工具展示

一.日志概述 1.rsyslog简介 syslog是日志收集存储系统,负责记录遵守此服务的内核.程序的日志信息.一般记录为:"日期时间,主机,进程:事件".syslog不仅可以记录本地的系统日志,也可以通过tcp, udp协议记录远程主机的程序日志信息. syslog:系统日志,是一种服务,有两个进程 syslogd:记录应用程序相关的日志 klogd:记录内核相关的日志 rsyslog:是syslog的升级版,使用多线程并发记录本地或远程日志,支持存储日志信息在MySQL,PGSQL

java后台面试题整理(包含)

1.Arrays.sort实现原理和Collection实现原理 Collection.sort()底层会调用Arrays.sort(),Arrays.sort()底层实现是TimeSort,TimeSort的算法就是先找到已经排好序数据的子序列,然后对剩余部分数据进行排序,然后在合并起来. 2.foreach和while的区别(编译之后) while会读一行输入,把它存入某个变量并执行循环体,然后再找其他行的输入,适用于不确定循环次数的情况:foreach是增强for循环,它是逐条读取,在循环

ios学习记录 day41 UI17 多线程

CPU(工厂) 进程(车间) 线程(工人) 一个进程代表一个应用程序 CPU总是运行一个进程,其它进程处于非运行状态.一个进程可以包含多个线程.线程与线程之间可以共享进程的内存区域. 打开一个应用程序,系统会给我们创建一个线程,称为主线程 管理主界面的UI与内部循环机制(与界面相关的东西必须放在主线程中!!!) 压力比较大且会造成线程阻塞(界面卡),因此我们通过创建子线程来对主线程进行分压. 什么时候用多线程 1.网络请求(同步的) 2.文件读写(少) 3.大数据计算(冒泡) 4.数据库sele