期刊文献+
共找到1篇文章
< 1 >
每页显示 20 50 100
中心网页中主题网页链接的自动抽取 被引量:4
1
作者 夏天 《山东大学学报(理学版)》 CAS CSCD 北大核心 2012年第5期25-31,共7页
基于扩展标记树,提出了一种从中心网页中自动抽取主题网页链接的方法。首先构建链接有序表,利用链接前缀树发现主题网页链接拒绝规则,实现对网页链接类型的预判定;其次,通过分组分割和相似分组重新合并,把页面中的链接归入到不同分组之... 基于扩展标记树,提出了一种从中心网页中自动抽取主题网页链接的方法。首先构建链接有序表,利用链接前缀树发现主题网页链接拒绝规则,实现对网页链接类型的预判定;其次,通过分组分割和相似分组重新合并,把页面中的链接归入到不同分组之中,进而识别分组的类型和核心区域所在的分组,最终把链接归入三类链接集合之中。实验结果表明该方法无需训练即可实现中心网页中主题网页链接的高精度抽取。 展开更多
关键词 链接抽取 扩展标记 链接前缀
原文传递
上一页 1 下一页 到第
使用帮助 返回顶部