> 백엔드 개발 > PHP 튜토리얼 > javascript - 求大神破解印象笔记chrome插件“悦读”的识别算法

javascript - 求大神破解印象笔记chrome插件“悦读”的识别算法

WBOY
풀어 주다: 2016-06-06 20:44:30
원래의
1264명이 탐색했습니다.

最近因为要做一个采集网页主体内容的软件,所以找了好久,最后觉得“悦读”的效果最理想。
有装了“悦读”的同学可以在C:\Users\Administrator\AppData\Local\Google\Chrome\User Data\Default\Extensions\iooicodkiihhpojmmeghjclgihfjdjhjchrome
找到源码,因本人学业不精,目前还无法看懂代码如何调用,求大神指点,急用,万分感谢。

回复内容:

最近因为要做一个采集网页主体内容的软件,所以找了好久,最后觉得“悦读”的效果最理想。
有装了“悦读”的同学可以在C:\Users\Administrator\AppData\Local\Google\Chrome\User Data\Default\Extensions\iooicodkiihhpojmmeghjclgihfjdjhjchrome
找到源码,因本人学业不精,目前还无法看懂代码如何调用,求大神指点,急用,万分感谢。

我觉得其实就是html的解析,这块你看看各种爬虫是怎么写的就行了

早期的印象的文本提取用的是这个库https://github.com/hatena/extract-content-javascript/,不过印象笔记收编了Readability的作者后,貌似换了文本提取引擎。

관련 라벨:
원천:php.cn
본 웹사이트의 성명
본 글의 내용은 네티즌들의 자발적인 기여로 작성되었으며, 저작권은 원저작자에게 있습니다. 본 사이트는 이에 상응하는 법적 책임을 지지 않습니다. 표절이나 침해가 의심되는 콘텐츠를 발견한 경우 admin@php.cn으로 문의하세요.
인기 튜토리얼
더>
최신 다운로드
더>
웹 효과
웹사이트 소스 코드
웹사이트 자료
프론트엔드 템플릿