高等教育领域数字化综合服务平台
云上高博会服务平台 高校科技成果转化对接服务平台 大学生创新创业服务平台 登录 | 注册
|
搜索
搜 索
  • 综合
  • 项目
  • 产品
日期筛选: 一周内 一月内 一年内 不限
一种基于结构和内容二级过滤的 Web 数据相似性检测方法
本发明公开了一种基于结构和内容二级过滤的 Web 数据相似性检测方法,在传统的通用相似性检测 方法的基础上,发掘出 Web 数据结构和内容分布的特点,对检测的文档集进行两级过滤;两级过滤中的 第一级过滤是结构相似性过滤,对每个Web文档建模为Tag树结构,从而剔除在结构上不相似的文档集, 并对剩余的文档进行关键内容抽取,将其表示成元组向量的形式,将关键信息连接起来生成字符串集; 两级过滤中的第二级过滤则对第一级过滤后生成的字符串集进行 Trie
武汉大学 2021-04-14
首页 上一页 1 2 3 4
热搜推荐:
1
云上高博会企业会员招募
2
63届高博会于5月23日在长春举办
3
征集科技创新成果
中国高等教育学会版权所有
北京市海淀区学院路35号世宁大厦二层 京ICP备20026207号-1