PHP 使用 CURL 同步抓取多个网页
程序员文章站
2024-01-04 14:06:58
...
一般CURL 抓网页的方法, 是一页一页抓, 假设要抓 4页, 所费时间各别是 5,10,7,5 秒, 那全部总合所花的时间就是 5 + 10 + 7 + 5 = 27 秒。若能同时间去抓取多个网页, 所花费的时间 5,10,7,5 秒, 全部总合所花的时间是 10 秒。(花费最多时间的秒数)
于JavaScript 可使用 AJAX 的 async(YAHOO.util.Connect.asyncRequest)来达成, 于 PHP 可以用 CURL 来达成此 Multi-Threading 的效果。
程序(async.php)
以下为引用的内容:
|
使用
以下为引用的内容: $urls = array('http://example1.com', 'http://example2.com'); print_r(async_get_url($urls)); // [0] => example1, [1] => example2 ?> |
测试
sleep.php # 看时间延长取得的效果
以下为引用的内容: sleep(intval($_GET['time'])); echo intval($_GET['time']); ?> |
以下为引用的内容: $url_array = array( 'http://example.com/sleep.php?time=5', 'http://example.com/sleep.php?time=10', 'http://example.com/sleep.php?time=7', 'http://example.com/sleep.php?time=5', ); print_r(async_get_url($url_array)); // 总花费时间会是 10 秒, 并印出 [0] => 5, [1] => 10, [2] => 7, [3] => 5 ?> |
推荐阅读
-
使用curl抓取一个网页出现瓶颈解决办法
-
PHP中使用file_get_contents抓取网页中文乱码问题解决方法
-
php使用curl判断网页404(不存在)的方法 原创,curl404
-
php中我使用curl抓取页面,本地调试都可以,可是放到服务器上就出现400badrequest
-
php使用curl和正则表达式抓取网页数据示例_PHP教程
-
PHP 使用 CURL 同步抓取多个网页_PHP
-
linux - php的curl_multi是否是真正的多线程抓取网页数据?
-
php使用curl抓取qq空间的访客信息示例
-
php使用curl检测网页是否被百度收录的示例分享
-
php使用curl和正则表达式抓取网页数据示例