网站建设 >

查看其它板块

laravel中如何使用simple_html_dom爬取显示整本小说

小编给大家分享一下laravel中如何使用simple_html_dom爬取显示整本小说，相信大部分人都还不怎么了解，因此分享这篇文章给大家参考一下，希望大家阅读完这篇文章后大有收获，下面让我们一起去了解一下吧！

创新互联公司是一家以网络技术公司，为中小企业提供网站维护、网站设计制作、成都网站制作、网站备案、服务器租用、域名与空间、软件开发、小程序定制开发等企业互联网相关业务，是一家有着丰富的互联网运营推广经验的科技公司，有着多年的网站建站经验，致力于帮助中小企业在互联网让打出自已的品牌和口碑，让企业在互联网上打开一个面向全国乃至全球的业务窗口：建站服务热线：028-86922220

一、在laravel引入第三方类

1.在项目根目录下app目录中新建一个文件夹命名为Lib(自定义名称)

2.如果引入第三方库多的话可以在Lib下再新建几个目录分类,由于只引入了一个类，这里没有新建文件夹。（根据引入类的多少自己定义）

将simple_html_dom.php复制到Lib下

3.找到项目根目录下的composer.json文件，将第三方类的路劲写入autoload下的classmap中，这样才能自动加载

"autoload": {
"classmap": [
"database/seeds",
"database/factories",
"app/Lib/simple_html_dom.php"
]
},

4.在cmd控制台中切换到项目根目录，执行命令:

composer dumpautoload

5.在控制器中use这个类即可

use simple_html_dom;

$html = new simple_html_dom(); 使用

二、创建路由

Route::get('/novel_list','index\Spnovel@index');

三、创建控制器Spnovel.php

load($list_html);
		$list = $html->find('#list dd a');
		foreach ($list as $k=>$v) {
			$arr1=$arr2=[];
			$p1 = '/(.*?)<\/a>/i';
			$p2 = '/.*?<\/a>/i';
			preg_match($p1,$v->outertext,$arr1);
			preg_match($p2,$v->outertext,$arr2);
			$content[$k][0]=$arr1[1];
			$content[$k][1]=$arr2[1];
		}
		array_splice($content,0,12); 
		return $content;
	}
}
class mySpClass{
	// 向服务器发送最简单的get请求
	public static function getCurl($url,$header=null){
		// 1.初始化
		$ch = curl_init($url);   //请求的地址
		// 2.设置选项
		curl_setopt($ch,CURLOPT_RETURNTRANSFER,1);//获取的信息以字符串返回,而不是直接输出(必须) 
		curl_setopt($ch,CURLOPT_TIMEOUT,10);//超时时间（必须）
		curl_setopt($ch, CURLOPT_HEADER,0);// 	启用时会将头文件的信息作为数据流输出。 
		//参数为1表示输出信息头,为0表示不输出
		curl_setopt($ch,CURLOPT_SSL_VERIFYPEER,false); //不验证证书
		curl_setopt($ch,CURLOPT_SSL_VERIFYHOST,false); //不验证证书
		if(!empty($header)){
			curl_setopt($ch,CURLOPT_HTTPHEADER,$header);//设置头信息
		}else{
			$_head = [
			'User-Agent:Mozilla/5.0 (Windows NT 10.0; Win64; x64; rv:70.0) Gecko/20100101 Firefox/70.0'
			]; 
			curl_setopt($ch,CURLOPT_HTTPHEADER,$_head);
		}
		// 3.执行
		$res = curl_exec($ch);
		// 4.关闭
		curl_close($ch);
		return $res;
	}
}

以上代码的解释：首先要对laravel框架了解，对php类要有所了解

访问了以上路由，运行的是Spnovel.php控制器中的index方法，$url是某一本小说的章节列表的地址，将其作为参数运行自定义类mySpClass中的getcurl方法，返回这个页面的html文档字符串。运行此类中的getList方法，参数是需要解析的html字符串。将这个方法私有化，使用simple_html_dom解析，配置正则提取出每章的url地址和章节名称。并返回这个数组，通过return view('index.spnovel.index',$data);将打开index/spnovel/index.blade.php，请看index.blade.php

四、创建视图index.blade.php




	爬取的小说列表
	
	body{padding:0px;margin:0px;}
	#lists{width:100%;padding:30px 50px;box-sizing:border-box;}
	ul{margin:0;padding: 0;overflow:hidden;}
	ul li{list-style:none;display:inline-block;float:left;width:25%;color:#444;}
	ul li:hover{color:#777;cursor: pointer;}
	img {z-index:-1;width:100%;height:100%;position:fixed;}
	


	
	
		
			@foreach($List as $item)
			
			{{$item[0]}}
			
			@endforeach

以上代码的解释:css就简单的写到这里，img是作为背景图片的。ul里面循环li，{{$item[1]}}是获得的地址参数，{{$item[0]}}是获得的章节名称。看一下数组和最后的效果。

laravel中如何使用simple_html_dom爬取显示整本小说

五、运行

laravel中如何使用simple_html_dom爬取显示整本小说

接下来就是每一章节的内容了

先看路由：

Route::get('/novel_con/{a}/{b}/{c}','index\Spnovel@get_nContent');

这与每一章的url参数相对应，比如某一章的参数为：novel_con/85/85445/27248645.html

写get_nContent方法：

public function get_nContent(Request $req){
		$url1 = $req->a.'/'.$req->b.'/'.$req->c;
		$url = "https://www.7kzw.com/".$url1;
		$res = mySpClass::getCurl($url);//获得
		// 开始解析
		$data['artic']= self::getContent($res);
		$next = (int)$req->c;
		$next = $next+1;
		$data['artic']['next']="/novel_con/".$req->a.'/'.$req->b.'/'.$next.'.html';
		return view('index.spnovel.ncontent',$data);
	}
private static function getContent($get_html){
		$html = new simple_html_dom();
		@$html->load($get_html);
		$h2 = $html->find('.bookname h2');
		foreach ($h2 as $k=>$v) {
			$artic['title'] = $v->innertext;
		}
		// 查找小说的具体内容
		$divs = $html->find('#content');
		foreach ($divs as $k=>$v) {
			$content = $v->innertext;
		}
		// 正则替换去除多余部分
		$pattern = "/(.*?<\/p>)|(.*?<\/div>)/";
		$artic['content'] = preg_replace($pattern,'',$content);
		return $artic;
	}

解释：$req->a，$req->b，$req->c，分别是三个参数，然后将其合并为一个完整的请求某一章的地址，然后还是通过mySpClass::getCurl获得某一章的html字符串。然后使用本类中的getContent解析这个页面，先看解析方法，和上篇文章一章解析出章节的标题和内容，写到数组中，并且去掉了多余的文字广告部分。$next则是存放的下一章的地址，用于在章节详情页面跳转。

视图ncontent.blade.php




	{{$artic['title']}}
	
	h3{text-align:center;padding-top:30px;}
	div{margin:20px 50px;font-size:20px;}
	img {z-index:-1;width:100%;height:100%;position:fixed;}
	.next {position:fixed;right:10px;bottom:20px;background:coral;border-radius:3px;padding:4px;}
	.next:hover{color:#fff;}
	


	
	{{$artic['title']}}
	下一章
	
		{!!$artic['content']!!}

解释：因为只有当前一篇所以不需要循环，{{$artic['title']}}就是标题，也可以写到title中。{!!$artic['content']!!}的写法就是不需要转义文章的内容，否则就会有很多其他字符了，如
等。下一章的按钮的地址直接就用传递过来的即可，position:fixed固定定位按钮，随时可以下一章。

运行：

laravel中如何使用simple_html_dom爬取显示整本小说

以上是“laravel中如何使用simple_html_dom爬取显示整本小说”这篇文章的所有内容，感谢各位的阅读！相信大家都有了一定的了解，希望分享的内容对大家有所帮助，如果还想学习更多知识，欢迎关注创新互联行业资讯频道！

文章名称：laravel中如何使用simple_html_dom爬取显示整本小说
文章起源：http://www.cdkjz.cn/article/gegoci.html

返回首页了解更多建站资讯

多年建站经验

多一份参考，总有益处

联系快上网，免费获得专属《策划方案》及报价

咨询相关问题或预约面谈，可以通过以下方式与我们联系

大客户专线成都：13518219792 座机：028-86922220

在线咨询提交需求

友情链接交换友情链接

成都餐饮门店招牌设计青年旅行社阿坝网站设计红光高低压开关厂书籍刊物设计成都网站改版小谭建站 shouzuofang.com 成都企业文化墙网站优化公司

成都网站建设公司地址：成都市青羊区太升南路288号锦天国际A座10层建设咨询028-86922220

专家团队为您提供成都网站建设,成都网站设计,成都品牌网站设计,成都营销型网站制作等服务,成都建网站就找快上网！ | 成都网站建设哪家好？ | 网站建设地图

网站建设

网站推广

案例

方案

电商网站开发

微信小程序

我们

联系

精准传达 • 有效沟通

查看其它板块

laravel中如何使用simple_html_dom爬取显示整本小说

{{$artic['title']}}

多一份参考，总有益处

联系快上网，免费获得专属《策划方案》及报价

大客户专线成都：13518219792 座机：028-86922220

友情链接交换友情链接

网络推广

Network promotion

网站方案

Solution

电商网站开发

E-commerce & System

我们

About Us

联系

Contact Us

精准传达 • 有效沟通

查看其它板块

laravel中如何使用simple_html_dom爬取显示整本小说

{{$artic['title']}}

相关资讯

串口转usb1.0映射给kvm虚拟机

JavaScript中如何检查数组是否包含指定值

linux下查看防火墙是否开启的方法

使用spring怎么实现动态切换

spring通过FactoryBean配置Bean的方法

如何使用golang自带net/http接收文件

DataLakeAnalytics函数如何解析IP地址对应的国家城市地址

C#逐行读取excel所有内容

多一份参考，总有益处

联系快上网，免费获得专属《策划方案》及报价

大客户专线 成都：13518219792 座机：028-86922220

友情链接 交换友情链接

大客户专线成都：13518219792 座机：028-86922220

友情链接交换友情链接