GeneralNewsExtractor(新闻网页正文通用抽取器)
v0.2.6官方版- 软件大小:15KB
- 更新日期:2021/4/26
- 软件语言:简体
- 软件类别:网页辅助
- 软件授权:免费软件
- 软件官网:https://github.com/kingname/GeneralNewsE
- 适用平台:WinAll
软件介绍精品推荐相关视频人气软件相关文章评论0下载地址
GeneralNewsExtractor新闻网页正文通用抽取器是一个基于《基于文本及符号密度的网页正文提取方法》论文用Python实现的正文抽取器,可以用来提取HTML中正文的内容、作者、标题。
相关软件软件大小版本说明下载地址
- IDM ToolBox(访问管理工具) v2020官方版7.9Mv2020官方版查看
GeneralNewsExtractor(新闻网页正文通用抽取器)是一个基于《基于文本及符号密度的网页正文提取方法》论文用Python实现的正文抽取器,可以用来提取 HTML 中正文的内容、作者、标题。
开发介绍
项目起源
开发这个项目,源自于我在知网发现了一篇关于自动化抽取新闻类网站正文的算法论文——《基于文本及符号密度的网页正文提取方法》)
这篇论文中描述的算法看起来简洁清晰,并且符合逻辑。但由于论文中只讲了算法原理,并没有具体的语言实现,所以我使用 Python 根据论文实现了这个抽取器。并分别使用今日头条、网易新闻、游民星空、观察者网、凤凰网、腾讯新闻、ReadHub、新浪新闻做了测试,发现提取效果非常出色,几乎能够达到100%的准确率。
项目现状
在论文中描述的正文提取基础上,我增加了标题、发布时间和文章作者的自动化探测与提取功能。
目前这个项目是一个非常非常早期的 Demo,发布出来是希望能够尽快得到大家的使用反馈,从而能够更好地有针对性地进行开发。
本项目取名为抽取器,而不是爬虫,是为了规避不必要的风险,因此,本项目的输入是 HTML,输出是一个字典。请自行使用恰当的方法获取目标网站的 HTML。
本项目现在不会,将来也不会提供主动请求网站 HTML 的功能。
精品推荐
其他版本下载
相关视频
-
没有数据
人气软件
易媒助手13.8M
/简体5866游戏商城上号器76M
/简体后羿采集器47.6M
/简体巅峰爱抢购39.4M
/简体心蓝12306订票助手171KB
/简体搜狗推广管家35.4M
/简体postman windows64位153.4M
/英文Chrome清理工具12.7M
/简体12306订票助手.NET版9.8M
/简体京东抢购助手13.8M
/简体
厂商其他下载
- 电脑版安卓版IOS版Mac版
-
快车(FlashGet)7.4M
/简体VeryCD 电驴(easyMule)4.1M
/简体Opera浏览器81.8M
/简体光影魔术手19.1M
/简体360安全浏览器7.044.6M
/简体格式工厂103.0M
/多国语言[中文]365桌面日历9.6M
/简体福昕PDF阅读器(Foxit Reader)88.4M
/简体快播(QvodPlayer)12.2M
/简体快玩游戏盒31.7M
/简体
优志愿57.2M
/简体全民枪战2.01.40G
/简体北京公交103.2M
/简体泰拉瑞亚245.9M
/简体迷你世界587M
/简体江苏高考16.0M
/简体小米枪战1.31G
/简体腾讯疯狂贪吃蛇48.3M
/简体腾讯街头篮球544.2M
/简体深海大作战手机版30.9M
/简体
跑跑卡丁车40.7M
/简体高考志愿君app63.9M
/简体传奇战域手游491M
/简体像素车超改iphone版370.4M
/简体代号英雄iphone版371.2M
/简体人vs导弹游戏iphone版224.5M
/简体北京公交16.5M
/简体熊猫看书iPad版32.9M
/简体影音先锋iPad版0KB
/简体WPS iPad版228M
/简体
Betterzip Mac23.9M
/简体IINA Mac版77M
/英文多宝游戏盒Mac版90.2M
/简体eZip Mac版15.7M
/简体ios5.1固件802M
/简体Adobe Photoshop CS6 Mac版1.05G
/简体英雄联盟Mac版66.2M
/英文magican for mac12.1M
/简体虾歌Mac版9M
/简体欧朋浏览器for mac173.2M
/简体
相关文章
- 小米11ultra值得入手吗 小米11ultra和小米11pro有什么区别
- ipad pro2021支持5g网吗 ipad pro2021支持二代apple pencil二代笔
- iPhone13配置如何 iPhone13会有什么版本 iPhone13价格预测
- iPhone13系列屏幕有什么变化 iPhone13正面板曝光图
- iphone13 pro max预计上市时间 iphone13 pro max什么时候发售
- iphone13pro max参数配置 iphone13pro max多大尺寸
- iphone13有几种机型 iphone13与iphone12相比会有哪些改进
- iPhone13会卖多少钱 iPhone13发布后iPhone12会降价吗
- iphone称重快捷指令怎么用 苹果iphone称重快捷指令设置方法
- iphone12紫色残影怎么解决 苹果12紫色残影问题解决办法 iphone12
查看所有评论>>网友评论共0条
热门关键词
精彩评论