期刊文献+
共找到14篇文章
< 1 >
每页显示 20 50 100
嵌入式HTML文档解析器的设计与实现 认领 引用 被引量:4
1
作者 李庆诚 彭洁 +1 位作者 宫晓利 刘嘉欣 《计算机工程》 CAS 北大核心 2009年第9期258-260,共3页
针对HTML文档在手持移动阅读设备上的阅读有效性问题,设计实现一种面向嵌入式应用的、平台无关的HTML文档解析器,对其关键技术进行阐述和分析。提出一种屏幕适配探测机制,实现对当前屏幕阅读无效内容的过滤。实验结果表明,该解析器降低... 针对HTML文档在手持移动阅读设备上的阅读有效性问题,设计实现一种面向嵌入式应用的、平台无关的HTML文档解析器,对其关键技术进行阐述和分析。提出一种屏幕适配探测机制,实现对当前屏幕阅读无效内容的过滤。实验结果表明,该解析器降低了对嵌入式系统处理能力与内存配置的要求,能满足手持阅读设备的需要。 展开更多
关键词 嵌入式 HTML文档 解析器 屏幕适配探测 手持阅读设备
暂未订购 下载PDF
HTML到XML转换研究 认领 引用 被引量:2
2
作者 钱程 阳小兰 《计算机与现代化》 2011年第8期39-41,共3页
网络上的许多信息都是由HTML编写的,但HTML语言本身具有不足,使得其不能处理网络上的许多需求,而XML可以弥补很多HTML的不足,因此网络应用的传统数据和XML标记数据的转换变得日趋重要。本文对从HTML到XML的转换技术进行研究,并用Java语... 网络上的许多信息都是由HTML编写的,但HTML语言本身具有不足,使得其不能处理网络上的许多需求,而XML可以弥补很多HTML的不足,因此网络应用的传统数据和XML标记数据的转换变得日趋重要。本文对从HTML到XML的转换技术进行研究,并用Java语言实现该转换系统。 展开更多
关键词 HTML XML 解析器 信息抽取 JAXB
暂未订购 下载PDF
基于HTML解析器的Web信息提取技术 认领 引用 被引量:1
3
作者 王琳琳 《郑州轻工业学院学报(自然科学版)》 2008年第6期100-102,106,共3页
提出一种使用开源的HTML解析器包和正则表达式来提取W eb网页信息的方法.该方法能够解析HTML文件的组成结构,并从中提取主体文本以供处理.实验表明,该方法的抽取准确率可达到95%以上,具有简单、准确的特点.
关键词 Web信息提取 正则表达式 HTML解析器 主题信息
暂未订购 下载PDF
一种嵌入式浏览器中的HTML解析器的设计 认领 引用 被引量:2
4
作者 唐云 《湖南科技学院学报》 2008年第8期92-94,103,共3页
本文主要介绍了一种HTML解析器的设计,以及其在数字电视机顶盒中的实现;另外还简述了CSS层叠样式表技术在嵌入式浏览器中的实现。
关键词 HTML 嵌入式浏览器 解析器 CSS
暂未订购 下载PDF
一种提高中文搜索引擎检索质量的HTML解折方法 认领 引用
5
作者 刘中华 刘先红 王红艺 《西安邮电学院学报》 2007年第5期76-78,共3页
简要分析了目前的搜索引擎,随后提出了一种搜索引擎模型,最后介绍了HTML的解析方法,给出了一种快速解析HTML的方法。
关键词 标准搜索 目录搜索 HTML解析
暂未订购 下载PDF
基于Swing的HTML解析器的实现与应用 认领 引用
6
作者 宋宇 《科技资讯》 2024年第14期43-45,49,共3页
HTML页面解析是一切工作的基础。首先,通过分析HTML解析器感兴趣的标签与超链接的分类,在Java的Swing包的基础上实现了一个HTML解析器,用来提取HTML文档的超链接和锚文本;其次,把HTML解析器应用到多媒体信息检索系统的搜索器Spider的开... HTML页面解析是一切工作的基础。首先,通过分析HTML解析器感兴趣的标签与超链接的分类,在Java的Swing包的基础上实现了一个HTML解析器,用来提取HTML文档的超链接和锚文本;其次,把HTML解析器应用到多媒体信息检索系统的搜索器Spider的开发中,通过设定若干个种子网站,选择合适的搜索算法,从中筛选出包含音频、视频和Flash动画的Web页面,并将其存放在数据库中。 展开更多
关键词 解析器 HTML Swing 超文本链接 链接文本
暂未订购 下载PDF
基于Android的校园通应用程序的设计与实现 认领 引用 被引量:3
7
作者 黄震 吴程龙 《现代计算机》 2014年第21期62-67,共6页
目前Android手机的普及率在高校里已经相当高,所以研究设计一款基于Android手机的校园服务应用对于广大高校生来说具有深远的现实意义。实现一个基于Android的校园通应用程序,主要功能包括有学院概况、校园通讯、新生专题、校图书馆、... 目前Android手机的普及率在高校里已经相当高,所以研究设计一款基于Android手机的校园服务应用对于广大高校生来说具有深远的现实意义。实现一个基于Android的校园通应用程序,主要功能包括有学院概况、校园通讯、新生专题、校图书馆、成绩课表、课室查询、校园信息、在线问吧、出行指南等模块,基本上满足学生所需要的校园服务,可以在一定程度上提高学生的学习和生活效率。 展开更多
关键词 Android 校园助手 校园应用 HTML解析器
暂未订购 下载PDF
Web逆向工程中交互设计模式的抽取方法改进 认领 引用 被引量:2
8
作者 刘继红 吴军华 《计算机工程与设计》 北大核心 2010年第5期932-935,共4页
为了提高Web交互设计模式抽取的准确性,增加现有方法对中文站点的分析能力,提出了一种基于HTML词法分析的改进方法。利用设计的HTML词法分析器将Web页面表示成语法树,抽取Web交互设计模式的特征,并对特征的词条内容进行语义扩展,细化了... 为了提高Web交互设计模式抽取的准确性,增加现有方法对中文站点的分析能力,提出了一种基于HTML词法分析的改进方法。利用设计的HTML词法分析器将Web页面表示成语法树,抽取Web交互设计模式的特征,并对特征的词条内容进行语义扩展,细化了特征抽取的粒度。实验结果表明,改进的方法在召回率和准确率等方面明显优于现有的方法,并在中文站点交互模式抽取方面取得了很好的效果。 展开更多
关键词 Web逆向工程 Web理解 交互设计模式 HTML分析器 特征抽取
暂未订购 下载PDF
网络化制造资源垂直搜索引擎的研究与应用 认领 引用 被引量:6
9
作者 张建 程锦 《计算机应用》 北大核心 2007年第5期1116-1118,共3页
着重研究了网络化制造资源垂直搜索系统的主题爬虫和中文分词技术。通过在主题爬虫中增加评价网页模块,优先爬行与主题相似度高的网页中的链接,提高了爬虫的工作效率。在对中文分词词典进行分层存储的基础上,通过一种改进的简洁的中文... 着重研究了网络化制造资源垂直搜索系统的主题爬虫和中文分词技术。通过在主题爬虫中增加评价网页模块,优先爬行与主题相似度高的网页中的链接,提高了爬虫的工作效率。在对中文分词词典进行分层存储的基础上,通过一种改进的简洁的中文分词词典匹配算法,有效地改善了分词的速度与精度,并缩减了索引库,增强了用户的响应。 展开更多
关键词 网络化制造 制造资源 垂直搜索引擎 页面解析
暂未订购 下载PDF
基于Heritrix和Jsoup的信息抽取系统的设计与实现 认领 引用 被引量:2
10
作者 刘全志 于治楼 《山东师范大学学报(自然科学版)》 2015年第2期16-19,共4页
应用开源的Heritrix和Jsoup设计了一个通用性强的网络商品信息抽取系统,实现了Web信息的抽取、存储.系统由三个分别独立的功能模块组成,即采集网页模块、抽取信息模块、数据存储模块,并对抽取算法在真实数据页面上进行了验证.实验结果... 应用开源的Heritrix和Jsoup设计了一个通用性强的网络商品信息抽取系统,实现了Web信息的抽取、存储.系统由三个分别独立的功能模块组成,即采集网页模块、抽取信息模块、数据存储模块,并对抽取算法在真实数据页面上进行了验证.实验结果表明系统具有良好的召回率和准确率,抽取效果良好. 展开更多
关键词 Web信息抽取 HTML解析器 Jsoup 网络爬虫 Heritirx
暂未订购 下载PDF
一种抽取新闻网页结构化数据的方法 认领 引用 被引量:1
11
作者 陈爽 李先国 +1 位作者 陈福 李素 《燕山大学学报》 CAS 2007年第6期485-488,共4页
根据统计结果,从阅读角度对网页页面空间的构成进行了噪声与信息实体的划分与判断,改进了传统的DOM模型,增加了层次与样式等属性作为噪声判断的依据,逐级降噪,并利用新闻的标题、时间等外显特性,提出并实现了一种结合正向直接抽取与反... 根据统计结果,从阅读角度对网页页面空间的构成进行了噪声与信息实体的划分与判断,改进了传统的DOM模型,增加了层次与样式等属性作为噪声判断的依据,逐级降噪,并利用新闻的标题、时间等外显特性,提出并实现了一种结合正向直接抽取与反向过滤降噪抽取新闻网页得到结构化数据的方法,并使用这种方法进行了大范围的效果验证。验证结果表明:这种方法信息抽取准确率高,对中英文新闻网页都有良好的适用性。 展开更多
关键词 信息抽取 HTML解析 DOM 标签补偿 噪声标记
暂未订购 下载PDF
基于网络爬虫机制的文献资源可用性监测技术 认领 引用
12
作者 闵磊 《科技资讯》 2020年第27期5-7,共3页
在信息化的时代背景下,对电子文献资源库的可用性进行监测,是科研及教学的一项重要保障。该文对基于网络爬虫机制的文献资源监测技术进行了研究,重点探讨了技术选型、HTML文档抓取以及DOM树解析等内容,并对文献资源特征和系统架构展开... 在信息化的时代背景下,对电子文献资源库的可用性进行监测,是科研及教学的一项重要保障。该文对基于网络爬虫机制的文献资源监测技术进行了研究,重点探讨了技术选型、HTML文档抓取以及DOM树解析等内容,并对文献资源特征和系统架构展开了分析。该技术以Web服务器访问端口为数据输入源,因而具有较强的平台无关性,能适应网络多样化的特点。 展开更多
关键词 网络爬虫 电子资源 可用性监测 HTML解析
暂未订购 下载PDF
基于LINUX的嵌入式浏览器的设计与实现 认领 引用
13
作者 林楠 李翠霞 《微计算机信息》 2009年第17期36-37,26,共2页
嵌入式浏览器可以广泛应用于各种信息电器和便携式网络终端中,在工业控制领域也有着非常广阔的应用前景。本文提出了一种基于LINUX的嵌入式浏览器,介绍了实现方法和主要功能特点。该浏览器基于现有的嵌入式GUI,利用系统的HTEP函数库实... 嵌入式浏览器可以广泛应用于各种信息电器和便携式网络终端中,在工业控制领域也有着非常广阔的应用前景。本文提出了一种基于LINUX的嵌入式浏览器,介绍了实现方法和主要功能特点。该浏览器基于现有的嵌入式GUI,利用系统的HTEP函数库实现网络访问,根据文档类型定义和层叠式样式表规范,解析HTML文件和排版显示。此系统在MiniGUI下已成功实现。 展开更多
关键词 嵌入式浏览器 超文本传输协议 HTML解析器
暂未订购 下载PDF
在基于J2EE架构的网站中集成HTTP代理的设计与实现 认领 引用 被引量:4
14
作者 史承毅 《计算机应用》 CSCD 北大核心 2011年第A1期27-29,共3页
提出了一种在服务器上存在基于J2EE网站的情况下,将HTTP代理服务集成于网站的方案。相对于传统的HTTP代理服务,用该设计方法实现的HTTP代理,无需在浏览器客户端进行设置且不另外多开端口,提高了用户体验,同时降低了服务器安全风险。
关键词 HTTP代理 集成 HTML解析 J2EE 网络管理
暂未订购 下载PDF
上一页 1 下一页 到第
在线咨询 使用帮助 返回顶部 意见反馈