期刊文献+
共找到98篇文章
< 1 2 5 >
每页显示 20 50 100
基于组态解析的变电站继电保护设备验收模型设计 认领 引用
1
作者 聂江龙 景明明 +2 位作者 李伟 曹有财 李原昊 《机械与电子》 2026年第8期110-116,共7页
针对变电站继电保护装置在投运前验收过程中跨节点引用关系复杂且难以形成可审计证据链的问题,提出一种基于组态解析的继电保护设备验收模型。该模型以SCL/XML组态为输入,通过块级增量式文档对象模型保留统一资源定位符路径,并引入字段... 针对变电站继电保护装置在投运前验收过程中跨节点引用关系复杂且难以形成可审计证据链的问题,提出一种基于组态解析的继电保护设备验收模型。该模型以SCL/XML组态为输入,通过块级增量式文档对象模型保留统一资源定位符路径,并引入字段标准化算子以消解命名、格式与单位差异;进一步构建面向设备对象、通信对象、信号对象和行为对象的多维索引体系,将订阅侧外部引用等跨节点引用解析为统一的引用向量表征,并通过硬约束一致性与软距离歧义消解完成闭合判定,从而生成可追溯的缺陷定位证据。仿真结果表明,所提方法在总体缺陷识别任务中F1达0.952,且误报率与漏报率仅0.044,平均定位深度为10.9层。在1×106的节点规模条件下,端到端耗时为50.7 s,峰值内存为8.9 GB,验证了该方法在保证高判别性能和证据可复核性的同时,兼具良好的可扩展性与工程部署可行性。 展开更多
关键词 组态解析 继电保护 自动验收 增量式文档对象模型 多维索引
暂未订购 下载PDF
面向信息网模型的语义数据库优化 认领 引用
2
作者 周瑞平 刘梦赤 +1 位作者 唐诗琪 谢仕斌 《计算机与数字工程》 2025年第9期2509-2515,2565,共7页
大数据背景下,以互联网为信息交换媒介的各行业产生的数据总量呈现爆发式增长,对Web语义数据的存储查询技术出了新的挑战。为满足非结构化语义数据的大规模存储需求,课题组设计实现了基于BerkelyDB存储引擎的分布式信息网模型语义数据... 大数据背景下,以互联网为信息交换媒介的各行业产生的数据总量呈现爆发式增长,对Web语义数据的存储查询技术出了新的挑战。为满足非结构化语义数据的大规模存储需求,课题组设计实现了基于BerkelyDB存储引擎的分布式信息网模型语义数据存储系统,解决了关系型数据库无法存储海量非结构化语义数据的问题,但系统仍存在存储和访问的效率瓶颈问题。因此为提升面向信息网模型的语义数据库整体读写性能,沿用信息网模型对语义数据进行组织与建模,设计语义对象模式到BSON文档模式的映射算法,提出了一种基于MongoDB分布式集群架构的大规模语义数据存储设计方案。系统读写性能的对比实验结果表明,在1.2 GB的语义数据规模下,插入平均耗时降低19.8%以及复杂查询平均耗时降低59.3%。 展开更多
关键词 语义数据 信息网模型 对象-文档映射算法 MongoDB集群 分片策略
暂未订购 下载PDF
SVG和Ajax技术在电网分析与辅助决策支持系统中的应用 认领 引用 被引量:18
3
作者 郭挺 谢敏 +1 位作者 刘明波 林辉 《电力系统保护与控制》 EI CSCD 北大核心 2012年第4期83-89,共7页
电网分析与辅助决策系统的各个子系统与实时数据平台之间需要进行复杂而频繁的数据交互。基于oracle的实时数据平台中的数据存储位置和组织形式复杂且不具有直观性。良好的图形界面将大大提高电网分析与辅助决策系统的易用性和用户友好... 电网分析与辅助决策系统的各个子系统与实时数据平台之间需要进行复杂而频繁的数据交互。基于oracle的实时数据平台中的数据存储位置和组织形式复杂且不具有直观性。良好的图形界面将大大提高电网分析与辅助决策系统的易用性和用户友好性。在简要介绍电力图形系统研究现状的基础上,探讨了电力系统中广泛应用的可缩放矢量图形(Scalable Vector Graphics,SVG)技术;通过基于文档对象模型(Document Object Model,DOM)的脚本编程实现了SVG图形与用户的良好交互;通过建立Ajax(Asynchronous JavaScript and XML)引擎,实现了电气模型图形信息与实时数据的关联动态刷新。该方案在电网分析与辅助决策支持系统的应用中取得了良好的效果。 展开更多
关键词 电网分析与辅助决策系统 图形系统 SVG DOM Ajax
暂未订购 下载PDF
基于自动生成模板的Web信息抽取技术 认领 引用 被引量:13
4
作者 张彦超 刘云 +1 位作者 李勇 沈波 《北京交通大学学报》 CAS 北大核心 2009年第5期40-45,共6页
在网络舆情分析中,人们迫切需要自动化的工具在海量信息中抽取所需要的信息,以供进一步分析利用.针对此问题,提出了基于自动生成模板的Web信息抽取方法,可以消除网页噪声,快速有效地抽取所需的网页信息.该方法通过解析器将Web文档解析... 在网络舆情分析中,人们迫切需要自动化的工具在海量信息中抽取所需要的信息,以供进一步分析利用.针对此问题,提出了基于自动生成模板的Web信息抽取方法,可以消除网页噪声,快速有效地抽取所需的网页信息.该方法通过解析器将Web文档解析成文档对象模型,根据用户需求建立抽取规则,采用自动生成模板机制,并依据模板的抽取规则对网页信息进行抽取.实验证明,该抽取方法具有较高的召回率和准确率. 展开更多
关键词 信息抽取 模板 文档对象模型 XPath 网络舆情
暂未订购 下载PDF
基于XML的表单设计器构件的设计与实现 认领 引用 被引量:19
5
作者 王瑞霞 隋宏伟 刘弘 《计算机应用研究》 北大核心 2007年第7期183-185,共3页
针对Web应用系统中用户对表单的需求不断变化的普遍现象,设计了基于XML的表单设计器构件,实现了Web应用系统中用户对表单的动态管理。
关键词 可扩展标记语言 表单 构件 文档对象模型
暂未订购 下载PDF
基于文档对象模型与行块分布算法的网页信息抽取 认领 引用 被引量:10
6
作者 高庆宁 吴鹏 张晶晶 《情报理论与实践》 CSSCI 北大核心 2016年第4期133-137,共5页
[目的]网页所表达的主要信息通常隐藏在大量无关的结构和内容中,使用户不能迅速获取主题内容,限制了网页资源的可用性,使用信息抽取技术解决了这一问题。[方法]基于文档对象模型(DOM)的信息抽取技术能够简单准确地从网页中提取所需内容... [目的]网页所表达的主要信息通常隐藏在大量无关的结构和内容中,使用户不能迅速获取主题内容,限制了网页资源的可用性,使用信息抽取技术解决了这一问题。[方法]基于文档对象模型(DOM)的信息抽取技术能够简单准确地从网页中提取所需内容,但依靠网页本身结构;基于行块分布算法的技术摆脱网页结构的限制,克服限定数据源的缺点,但需要人工干预,文章结合DOM技术和行块分布算法以及正则表达式,实现网页信息采集与信息抽取。[结论]能够自动准确提取网页信息。[局限]对英文以及结构复杂的网页抽取效果不是很理想,抽取内容仅限于文字。 展开更多
关键词 文档对象模型 算法 网页 信息抽取
暂未订购 下载PDF
基于链式结构XML文档的生成方法 认领 引用 被引量:5
7
作者 陈再良 徐德智 +1 位作者 陈学工 沈海澜 《计算机工程》 EI CAS 北大核心 2006年第20期59-61,共3页
提出了一种基于链式结构的XML文档生成方法,设计了一个利用Java中的streamtokenizer类实现HTML文档解析的算法,将解析得到的元素内容及文本内容生成的结点插入到相应的位置上,同步生成DOM解析树,对DOM解析树进行遍历,将遍历得到的信息... 提出了一种基于链式结构的XML文档生成方法,设计了一个利用Java中的streamtokenizer类实现HTML文档解析的算法,将解析得到的元素内容及文本内容生成的结点插入到相应的位置上,同步生成DOM解析树,对DOM解析树进行遍历,将遍历得到的信息以二叉链表的形式存储,采用改进的先根遍历算法对该二叉链表遍历,提取相应的信息构建DTD,完成整个转换生成的过程。 展开更多
关键词 HTML XML DOM 解析
暂未订购 下载PDF
矿山遥感监测解译记录表自动生成方法研究与实现 认领 引用 被引量:5
8
作者 刁明光 刘芳 +2 位作者 谭专条 薛涛 王彦佐 《国土资源遥感》 CSCD 北大核心 2018年第4期212-217,共6页
矿山遥感监测过程中,技术人员会利用Arc Map软件提取矿山开采区遥感监测成果数据中的相关信息制作解译记录表,以实现对矿山开采状况的遥感监测。手工制作解译记录表存在制作成本高、专业性强、工作量大、制表格式不一致、数据准确性低... 矿山遥感监测过程中,技术人员会利用Arc Map软件提取矿山开采区遥感监测成果数据中的相关信息制作解译记录表,以实现对矿山开采状况的遥感监测。手工制作解译记录表存在制作成本高、专业性强、工作量大、制表格式不一致、数据准确性低等问题。本研究提出基于AE(Arc GIS Engine)进行插件式设计的矿山解译记录表自动生成方法,自动提取矿山开采区域遥感监测成果数据的属性信息和空间信息,结合文档对象模型(document object model,DOM)自动编辑文档,完成解译记录表的自动生成工作。 展开更多
关键词 AE 矿山监测 文档对象模型 解译记录表 遥感影像
暂未订购 下载PDF
一种改进的基于本体的Web信息抽取 认领 引用 被引量:7
9
作者 柳佳刚 陈山 黄樱 《计算机工程》 CAS 北大核心 2010年第4期39-41,44,共3页
以Web页面信息项本体定义为基础,对单个样本页面信息项路径进行启发式学习,对所有样本页面集中信息块路径进行归纳学习,识别结构相似的信息块子树位置,以准确划定信息抽取区域,降低页面噪声。将经过噪声处理的样本页面自动解析成页面的... 以Web页面信息项本体定义为基础,对单个样本页面信息项路径进行启发式学习,对所有样本页面集中信息块路径进行归纳学习,识别结构相似的信息块子树位置,以准确划定信息抽取区域,降低页面噪声。将经过噪声处理的样本页面自动解析成页面的结构本体。比较Web页面信息项本体和页面的结构本体,通过归纳学习算法生成抽取规则,提高Web信息的抽准率。 展开更多
关键词 信息抽取 本体 归纳学习 文档对象模型
暂未订购 下载PDF
一种Deep Web查询结果的实体抽取方法 认领 引用 被引量:4
10
作者 赵海霞 李道申 +1 位作者 刘勇 赵嘉诚 《计算机工程与应用》 CSCD 2012年第36期160-163,共4页
Deep Web中蕴含着丰富的高质量的信息,通过Deep Web集成查询接口可以获取到包含这些信息的结果页面,因此,Deep Web查询结果页面的数据抽取成为Deep Web数据集成的关键。提出了将索引方法和编辑相似度相结合的方法,来完成Deep Web查询结... Deep Web中蕴含着丰富的高质量的信息,通过Deep Web集成查询接口可以获取到包含这些信息的结果页面,因此,Deep Web查询结果页面的数据抽取成为Deep Web数据集成的关键。提出了将索引方法和编辑相似度相结合的方法,来完成Deep Web查询结果页面的数据抽取工作。大量实验结果表明:该方法是可行的,并且能够提高Deep Web数据实体抽取的准确性和召回率。 展开更多
关键词 深度网 数据抽取 文件对象模型(DOM)树 索引 相似度
暂未订购 下载PDF
可缩放矢量图形技术在电力系统故障诊断软件包中的应用 认领 引用 被引量:7
11
作者 董泰福 文福拴 廖志伟 《华北电力大学学报(自然科学版)》 CAS 北大核心 2007年第4期38-42,共5页
图形是电力系统在线故障诊断软件的重要组成部分。设计良好的图形可以增强电力系统故障诊断软件包的易用性和互操作性。在分析现代电力系统高级应用软件图形功能发展方向的基础上,介绍了具有广泛应用前景的可缩放矢量图形(SVG)技术和文... 图形是电力系统在线故障诊断软件的重要组成部分。设计良好的图形可以增强电力系统故障诊断软件包的易用性和互操作性。在分析现代电力系统高级应用软件图形功能发展方向的基础上,介绍了具有广泛应用前景的可缩放矢量图形(SVG)技术和文档对象模型(DOM)技术,探讨了SVG和DOM技术在电力系统软件图形化中的具体应用,并在所开发的电力系统故障诊断软件包中进行了实现,取得了很好的效果。 展开更多
关键词 可缩放矢量图形 文档对象模型 电力系统故障诊断系统 互操作
暂未订购 下载PDF
XML与Web数据集成及技术实现 认领 引用 被引量:15
12
作者 周彦晖 邹显春 张为群 《西南师范大学学报(自然科学版)》 北大核心 2001年第3期255-259,共5页
由于HTML缺乏规范的数据表达能力 ,基于Web的数据集成往往很困难 .要使存在于Web上的数量巨大的数据易于共享、处理 ,利用XML (eXtensibleMarkupLanguage)技术可以很好地实现 .现有的XML技术包括XML解析器、文档对象模型、XSL等都可以... 由于HTML缺乏规范的数据表达能力 ,基于Web的数据集成往往很困难 .要使存在于Web上的数量巨大的数据易于共享、处理 ,利用XML (eXtensibleMarkupLanguage)技术可以很好地实现 .现有的XML技术包括XML解析器、文档对象模型、XSL等都可以很好地应用到各种平台下的Web应用程序中 。 展开更多
关键词 数据集成 可扩展标注语言 万维网 文档对象模型
暂未订购 下载PDF
GML数据的Web可视化设计与实现 认领 引用 被引量:6
13
作者 张爱国 邬群勇 王钦敏 《测绘科学》 北大核心 2007年第1期140-141,共2页
GML是GIS领域的通用交流语言,然而目前的浏览器并不支持GML,因此GML的Web可视化仍是GML应用需要解决的问题。为此,本论文提出了一种基于组件的可视化策略。该策略采用文档对象模型(DOM)进行GML模式文件和实例文件解析,按地理要素对GML... GML是GIS领域的通用交流语言,然而目前的浏览器并不支持GML,因此GML的Web可视化仍是GML应用需要解决的问题。为此,本论文提出了一种基于组件的可视化策略。该策略采用文档对象模型(DOM)进行GML模式文件和实例文件解析,按地理要素对GML进行数据分流/分层,然后分层可视化的办法,实现了GML数据的Web可视化。实践验证,该方法是切实可行的,且对于GML数据量较大时尤为有效。 展开更多
关键词 地理标记语言 组件 Web可视化 文档对象模型
暂未订购 下载PDF
基于DOM状态转换检测XSS漏洞 认领 引用 被引量:2
14
作者 王丹 刘立家 +2 位作者 林九川 赵文兵 杜晓林 《北京工业大学学报》 CAS CSCD 北大核心 2018年第9期1208-1216,共9页
为提升跨站脚本(cross site scripting,XSS)漏洞检测中对隐藏注入点的扫描覆盖率,有效判定是否存在XSS漏洞攻击,提出构建Web应用文档对象模型(document object model,DOM)状态转换图搜索XSS漏洞注入点的方法.该方法以DOM状态为节点,以... 为提升跨站脚本(cross site scripting,XSS)漏洞检测中对隐藏注入点的扫描覆盖率,有效判定是否存在XSS漏洞攻击,提出构建Web应用文档对象模型(document object model,DOM)状态转换图搜索XSS漏洞注入点的方法.该方法以DOM状态为节点,以浏览器事件为边对Web应用建模,结合页面分析和代理技术来识别漏洞注入点,提高XSS漏洞注入点判定准确率.首先分析页面中带参数的统一资源定位符(uniform resource locator,URL)和Form表单,并尝试触发页面元素的浏览器事件来检测其是否含有数据请求,以判定Web页面是否有疑似漏洞注入点;进一步利用探子向量进行测试,并根据探子向量的输出位置,对注入点进行分类并保存.之后,基于变异操作和过滤逃逸技术对XSS过滤逃避欺骗备忘单进行转换来设计攻击向量,对已发现的漏洞注入点进行测试,并设计多种方法对不同响应结果进行分析.最后,通过实验对比,验证了其有效性. 展开更多
关键词 跨站脚本(XSS)漏洞 文档对象模型(DOM) 状态转换图 爬虫 Selenium
暂未订购 下载PDF
An Efficient Mechanism for Product Data Extraction from E-Commerce Websites 认领 引用
15
作者 Malik Javed Akhtar Zahur Ahmad +3 位作者 Rashid Amin Sultan H.Almotiri Mohammed A.Al Ghamdi Hamza Aldabbas 《Computers, Materials & Continua》 SCIE EI 2020年第12期2639-2663,共25页
A large amount of data is present on the web which can be used for useful purposes like a product recommendation,price comparison and demand forecasting for a particular product.Websites are designed for human underst... A large amount of data is present on the web which can be used for useful purposes like a product recommendation,price comparison and demand forecasting for a particular product.Websites are designed for human understanding and not for machines.Therefore,to make data machine-readable,it requires techniques to grab data from web pages.Researchers have addressed the problem using two approaches,i.e.,knowledge engineering and machine learning.State of the art knowledge engineering approaches use the structure of documents,visual cues,clustering of attributes of data records and text processing techniques to identify data records on a web page.Machine learning approaches use annotated pages to learn rules.These rules are used to extract data from unseen web pages.The structure of web documents is continuously evolving.Therefore,new techniques are needed to handle the emerging requirements of web data extraction.In this paper,we have presented a novel,simple and efficient technique to extract data from web pages using visual styles and structure of documents.The proposed technique detects Rich Data Region(RDR)using query and correlative words of the query.RDR is then divided into data records using style similarity.Noisy elements are removed using a Common Tag Sequence(CTS)and formatting entropy.The system is implemented using JAVA and runs on the dataset of real-world working websites.The effectiveness of results is evaluated using precision,recall,and F-measure and compared with five existing systems.A comparison of the proposed technique to existing systems has shown encouraging results. 展开更多
关键词 Document object model rich data region common tag sequence web data extraction deep web mining
暂未订购 下载PDF
基于结构相似网页聚类的正文提取算法研究 认领 引用 被引量:2
16
作者 王海涌 冯兆旭 +1 位作者 杨海波 张津栋 《计算机工程与应用》 CSCD 北大核心 2018年第11期122-127,139,共6页
针对当前互联网网页越来越多样化、复杂化的特点,提出一种基于结构相似网页聚类的网页正文提取算法,首先,根据组成网页前端模板各"块"对模板的贡献赋以不同的权重,其次计算两个网页中对应块的相似度,将各块的相似度与权重乘... 针对当前互联网网页越来越多样化、复杂化的特点,提出一种基于结构相似网页聚类的网页正文提取算法,首先,根据组成网页前端模板各"块"对模板的贡献赋以不同的权重,其次计算两个网页中对应块的相似度,将各块的相似度与权重乘积的总和作为两个网页的相似度。该算法充分考虑结构差别较大的网页对网页正文提取的影响,通过计算网页间相似度将网页聚类,使得同一簇中的网页正文提取结果更加准确。实验结果表明,该方法具有更高的准确率,各项评价指标均有所提高。 展开更多
关键词 正文提取 相似性 文档对象模型(DOM)树 层次聚类
暂未订购 下载PDF
“档案语义描述语言”标准化建设论纲 认领 引用 被引量:7
17
作者 赵生辉 胡莹 何亚兰 《山西档案》 2022年第3期47-57,共11页
面向档案数据化实践的现实需求,参考元语言和语义框架理论,提出“档案语义描述语言”的学术概念,探讨其理论实质、设计理念和技术原理,构建其标准体系框架并就其建设实践提出若干策略建议。“档案语义描述语言”是经过人工设计的,专门... 面向档案数据化实践的现实需求,参考元语言和语义框架理论,提出“档案语义描述语言”的学术概念,探讨其理论实质、设计理念和技术原理,构建其标准体系框架并就其建设实践提出若干策略建议。“档案语义描述语言”是经过人工设计的,专门用来以结构化形式描述档案语义信息并承担逻辑中介功能的工具性元语言符号系统,可以为档案内容信息的结构化数据描述提供系统性、整体性解决方案。“档案语义描述语言”致力于实现档案文本语义信息的逆向解码,遵循事件驱动、逻辑降维、实体消歧、语义压缩等设计理念,参照文档对象模型DOM进行XML数据建模,将档案文本的语义信息表示为树形语义框架。档案语义描述语言由基础标准、技术标准和管理标准构成,国家档案管理部门和标准化工作部门应当提前进行战略布局,通过制定建设规划,加强基础理论研究、启动试点项目、引入众包机制、推进人机协同、建立开放式进化机制等方式推进其体系建设。 展开更多
关键词 档案数据化 档案语义描述语言 文档对象模型 语义框架 唯一标识符
暂未订购 下载PDF
城市GML文档三维特征的快速获取与可视化 认领 引用 被引量:2
18
作者 赵伶俐 朱建军 +1 位作者 刘帅 马力 《计算机工程与应用》 北大核心 2009年第26期226-229,共4页
随着网络技术的发展,对城市三维数据的需求愈益增加,然而众多的城市三维数据缺乏统一的模型,使数据不能有效地进行共享与交互。开放式地理信息系统协会(Open GIS Consortium,OGC)提出了地理标记语言(Geography Markup Language,GML),城... 随着网络技术的发展,对城市三维数据的需求愈益增加,然而众多的城市三维数据缺乏统一的模型,使数据不能有效地进行共享与交互。开放式地理信息系统协会(Open GIS Consortium,OGC)提出了地理标记语言(Geography Markup Language,GML),城市GML规范定义了城市空间信息模型的标准,有利于三维数据在网络上进行传输、共享。通过分析城市GML文件的结构,提出一种适合一般城市GML文件的数据结构集合,使得在采用DOM接口解析文件后,能够快速获取城市GML文件的3D信息。实验部分使用Java3D编程显示快速获取的3D信息,证明了提出的数据结构集合的有效性。 展开更多
关键词 城市地理标记语言GML 开放式地理信息系统协会 3D特征 可视化
暂未订购 下载PDF
基于Web的定向医药信息采集系统设计与实现 认领 引用 被引量:2
19
作者 邹元平 邢珂 +4 位作者 林宇 修春 梁进权 宓穗卿 王宁生 《医学信息学杂志》 CAS 2012年第5期23-27,共5页
为解决不同Web网络的定向信息采集问题,开发具有网页分析和自动信息采集功能的定向医药信息采集系统(MICS),具体介绍技术原理与开发过程,实践证明该系统能应用于海量医药信息的自动采集工作,满足大型数据库的建库要求。
关键词 医药信息采集 文档对象模型 网页分析 定向采集
暂未订购 下载PDF
XML数据更新算法研究 认领 引用 被引量:5
20
作者 鲍培明 吉根林 《计算机工程》 CAS 北大核心 2008年第4期101-103,共3页
为了实现对XML文档的数据更新,提出一组实用算法。该算法利用简单应用编程接口扩展标记语言(SAX)解析和文件对象模型(DOM)解析,使其优势互补。应用SAX解析器将大XML文档编码成线性数据结构存储,该线性数据结构与原XML文档具有同构特性,... 为了实现对XML文档的数据更新,提出一组实用算法。该算法利用简单应用编程接口扩展标记语言(SAX)解析和文件对象模型(DOM)解析,使其优势互补。应用SAX解析器将大XML文档编码成线性数据结构存储,该线性数据结构与原XML文档具有同构特性,因此,线性结构存储的数据可以无损还原为原XML文档。线性数据结构支持Xpath查询,在查询得到的局部数据上应用DOM方法进行数据更新。更新后的数据再转换为XML文档。该组算法对大XML文档的数据更新实用且有效,而且对大XML文档的其他数据处理也有一定的实用价值。 展开更多
关键词 扩展标记语言 数据更新 SAX解析 DOM解析
暂未订购 下载PDF
上一页 1 2 5 下一页 到第
在线咨询 使用帮助 返回顶部 意见反馈