首页

51问答网 > 如何用php 编写网络爬虫?

如何用php 编写网络爬虫?

2025-03-23 06:36:25

推荐回答（3个）

回答1：

pcntl_fork或者swoole_process实现多进程并发。按照每个网页抓取耗时500ms，开200个进程，可以实现每秒400个页面的抓取。
curl实现页面抓取，设置cookie可以实现模拟登录
simple_html_dom 实现页面的解析和DOM处理
如果想要模拟浏览器，可以使用casperJS。用swoole扩展封装一个服务接口给PHP层调用

　　在这里有一套爬虫系统就是基于上述技术方案实现的，每天会抓取几千万个页面。

回答2：

爬虫是python的专利啊，用PHP会有很多的坑!

回答3：

找个curl教程学习一下

相关问答

最新问答

哑光的免漆板灰色做柜子好看吗？

呼和浩特到张家界自驾游

2015二层400平方米幼儿园消防喷淋管道口径标准

怎么谈恋爱

请问2020年2月25日唐山市机动车限号吗？

北京建工土木工程有限公司怎么样？

我和老公结婚后彩礼钱一直我妈妈拿着现在又要说把彩礼钱放到我妈妈的卡里

轴承后置代号HC代表什么？

我家的通用SUV汽车的车险马上要到期了，我想重新投保，请问一般买哪四种车险

湖北襄阳到贵州道真距离有多远