欢迎您访问程序员文章站本站旨在为大家提供分享程序员计算机编程知识!
您现在的位置是: 首页  >  后端开发

怎么用PHP抓取网站HTML

程序员文章站 2024-02-04 11:01:22
...
连接地址

http://detail.tmall.com/item.htm?spm=a230r.1.0.0.MlI5e4&id=40364502055&ad_id=&am_id=&cm_id=140105335569ed55e27b&pm_id=&abbucket=12



抓取上面连接的 HTML 用file_get_contents() 测试没成功 怎么回事啊?


回复讨论(解决方案)

file_get_contents() 成功了呀

你可以采用楼上的写法 也可以采用curl来获取,最重要的是要看你啥需求。

查一下php手册中的curl

多测试几次filegetcontents,实在不行就curl
一般就是伪造useragent和referer,也许再带个cookie

可以抓取到的 还可以根据对应的字符闭合段去进行抓取


其中curl_setopt($ch, CURLOPT_FOLLOWLOCATION,true);设置比较重要,可以用来跟随天猫的重定向页面。

非常感谢你啊