html2article-golang 基于文本密度的 html2article 实现 html2article-golang

agolangf2017-07-23 05:00:03 • 3087 次点击    
这是一个分享于 2017-07-23 05:00:03 的项目,其中的信息可能已经有所发展或是发生改变。

avg 3.2ms per article, accuracy >= 98% (对比其他开源实现,可能是目前最快的html2article实现,我们测试的数据集约3kw来自于微信公众号,各大类中文科技媒体历史文章,目前能达到98%以上准确率)

参考examples from_url.go

参考论文

Java实现

基于文本密度的html2article实现[golang] Read More

Latest commit to the master branch on 4-5-2019
Download as zip
授权协议:
其他
开发语言:
Google Go 查看源码»
操作系统:
跨平台
3087 次点击  
加入收藏 微博
1 回复  |  直到
polaris
polaris · #1 · 8年之前

? 准备试用下

添加一条新回复 (您需要 登录 后才能回复 没有账号 ?)
  • 请尽量让自己的回复能够对别人有帮助
  • 支持 Markdown 格式, **粗体**、~~删除线~~、`单行代码`
  • 支持 @ 本站用户;支持表情(输入 : 提示),见 Emoji cheat sheet
  • 图片支持拖拽、截图粘贴等方式上传