当前位置: 首页 > news >正文

服装公司网站模版阿里云做电影网站

服装公司网站模版,阿里云做电影网站,网站建设哪家好 需要多少钱,wordpress 4.7.9漏洞晚上休息,想弄两部好看的电影看看, 找了半天没找到想看的, 想到之前有个人爬知乎的用户数据,突发奇想, 没事把BT天堂的电影信息爬下来,下次阔以直接查数据库。 只能说闲的蛋疼,哈哈&#xf…

晚上休息,想弄两部好看的电影看看,

找了半天没找到想看的睡觉

想到之前有个人爬知乎的用户数据,突发奇想大笑

没事把BT天堂的电影信息爬下来,下次阔以直接查数据库。安静闭嘴

只能说闲的蛋疼得意,哈哈,还能码下代码  ^_^


1.抓取网站html源码

<span style="font-size:24px;">$url = "www.bttiantang.cc";
$html = shell_exec("curl $url");</span>

2.获取总页数,电影总数(正则匹配)

<span style="font-size:24px;">preg_match("/<span class=\"pageinfo\">.*?<\/span>/", $html, $pageCount);
preg_match_all("/\d{1,10000}/",$pageCount[0],$pageCount);</span>


3.抓取电影信息(正则匹配信息)

<span style="font-size:24px;">preg_match("/\d{4}\/\d{2}\/\d{2}/" , $pageInfo[0][$i], $updateTime);preg_match("/<font color=\"#FF6600\">(.*?)<i>/" , $pageInfo[0][$i], $movieName);preg_match("/<strong>(\d{1})<\/strong>/" , $pageInfo[0][$i], $movieScore_int);preg_match("/<em class=\"fm\">(\d{1})<\/em>/" , $pageInfo[0][$i], $movieScore_decimal);preg_match("/href=\"(.*?)\"/" , $pageInfo[0][$i], $movieUrl);preg_match("/<p class=\"des\">(.*?)<\/p>/" , $pageInfo[0][$i], $actor);</span>

4.插入数据库,大功告成


总体来说,php抓取的速度还是蛮快的,4min不到,采集2w多条信息。

start:01:22:54

end:01:26:11






附数据库截图:




附源码:

<?php$url = "www.bttiantang.cc";
$html = shell_exec("curl $url");preg_match("/<span class=\"pageinfo\">.*?<\/span>/", $html, $pageCount);
preg_match_all("/\d{1,10000}/",$pageCount[0],$pageCount);$pageSize = intval($pageCount[0][0]);
$movieCount = $pageCount[0][1];$conn = mysql_connect('***','***','');
mysql_select_db('***',$conn);
mysql_query('set names utf8',$conn);for($j=1;$j<=$pageSize;$j++){$movieHtml = shell_exec("curl $url?PageNo=$j");preg_match_all("/<div class=\"item cl\">.*?<\/div>/s", $movieHtml, $pageInfo);for($i=0;$i<count($pageInfo[0]);$i++){preg_match("/\d{4}\/\d{2}\/\d{2}/" , $pageInfo[0][$i], $updateTime);/******clear ad*****/if(empty($updateTime))continue;/*******************/$updateTime = str_replace('/','-',$updateTime[0]);preg_match("/<font color=\"#FF6600\">(.*?)<i>/" , $pageInfo[0][$i], $movieName);/*****same conditions*****/if(empty($movieName))preg_match("/<b>(.*?)<i>/" , $pageInfo[0][$i], $movieName);if(empty($movieName))preg_match("/<b>(.*?)<\/b>/" , $pageInfo[0][$i], $movieName);/************************/$movieName = $movieName[1];preg_match("/<strong>(\d{1})<\/strong>/" , $pageInfo[0][$i], $movieScore_int);$movieScore_int = $movieScore_int[1];preg_match("/<em class=\"fm\">(\d{1})<\/em>/" , $pageInfo[0][$i], $movieScore_decimal);$movieScore_decimal = $movieScore_decimal[1];$movieScore = floatval($movieScore_int.'.'.$movieScore_decimal);preg_match("/href=\"(.*?)\"/" , $pageInfo[0][$i], $movieUrl);$movieUrl = $movieUrl[1];preg_match("/<p class=\"des\">(.*?)<\/p>/" , $pageInfo[0][$i], $actor);$movieActor = str_replace("<em>",'',str_replace("</em>",'',$actor[1]));mysql_unbuffered_query("insert into movie (name,actor,url,update_ts,score) values ('$movieName','$movieActor','$movieUrl',<span style="white-space:pre">	</span>'$updateTime','$movieScore')");}}?>


本电影信息属于从BT天堂抓取,并未涉及机密信息,因此本人不承担任何法律责任!

若有相关电影信息涉及您的版权或知识产权或其他利益,请告知,确认后会尽快删除。



http://www.yayakq.cn/news/496728/

相关文章:

  • 网站建设公司 石景山wordpress当前文章标题
  • 济南济南网站建设公司网页设计制作网站代码html
  • emlog 转wordpress网络规划与优化技术学什么
  • 芜湖企业网站制作建设领域行政处罚查询网站
  • 软件跟网站开发电子商务商城网站建设
  • 华为服务器seo 新老网站替换 域名不变
  • 新手引导做的差的网站企业号登录wordpress
  • 如何加强校园网站建设竞价推广托管公司价格
  • 余姚网站制作公司中核五公司是国企还是央企
  • 建设购物网站流程图学生网站建设的心得
  • 烟台做网站排名wordpress为什么被墙
  • 邯郸建设局网站资质申报商务酒店设计网站建设
  • 网站建设和利用情况网站怎么做 流程
  • 下列属于网页制作平台的是百度seo排名优化如何
  • 网站推广有用吗?公司简介模板免费文字
  • py可以做网站吗建设网站怎么备案
  • 个人博客网站建设预算网站搭建教程视频
  • 在福州做搬家网站多少钱网站正在建设中页面
  • 长沙企业做网站哪家好深圳平湖网站开发
  • 网银汇款企业做网站用途写什么网站建设 国鸿
  • 网站备案需要准备哪些资料饿了么网站做生鲜吗
  • vps网站如何设置缓存现在推广引流什么平台比较火
  • 广州做网页深圳网站建设seo推广优化
  • 网站手机版怎么做北京南站到故宫最佳路线
  • 住房建设城乡网站网站建设与设计毕业shej
  • 仪器仪表行业网站建设惠州外包网站建设
  • 做网站怎么添加点击事件汕头网站建设方案推广
  • 二级域名网站如何申请wordpress tag=
  • 代做毕业设计网站保定网站建设多少钱
  • 轻淘客网站模板知乎推广优化