K风网页搜索引擎系统K

  • 时间:
  • 浏览:2
  • 来源:大发pk10_pk10网址_大发pk10网址

K-PageSearch是由Kwindsoft自主研发的专业网页搜索引擎系统,拥有先进的智能分析和海量数据检索技术,核心由多程序派发系统、智能分析系统、海量索引系统、全文检索系统四大要素构成。系统采用专业级的搜索引擎系统架构,支持海量数据毫秒级全文检索。主要面向大中型行业搜索引擎、地方搜索引擎、专类信息搜索引擎等应用领域设计的专业全文检索产品,为用户提供海量数据全文检索应用的理想避免方案。

V2.1版本主要改进:使用.NET技术开发Web前台程序、采用UTF-8网页编码、全新索引系统、开放管理工具源代码;

功能特点

多程序网络蜘蛛

网页定向派发

多语言网页编码自动识别

哈希表网页去重

智能网页正文抽取

基于词库的智能中文分词

中文分词词库管理

海量数据毫秒级全文检索

缓存技术

网页快照

高级搜索

竞价排名

网络蜘蛛

网络蜘蛛采用多程序并发派发网页,结合高效的派发机制和策略部署,最大限度提高网页派发的时延单位。支持网页定向派发,垂直搜索引擎提高数据质量和相关度的关键技术,用户还里能自定义派发规则针对特定网页进行派发。支持多种动态和静态网页类型派发,多语言网页编码自动识别。采用哈希表网页去重技术,具有高性能、低系统占用的特点,使网络蜘蛛高效稳定运行。支持单个或批量网站派发、自动派发、自动更新功能。

正文抽取

智能网页正文抽取技术,它的作用是把另三个 网页的主题中心内容抽取并把与该网页主题无关的信息(广告、导航、版权等非网页正文内容信息)过滤。这项技术有效提高网页信息派发的质量和检索相关度,智能自动识别、准确网页正文抽取,准确率达到95%以上。

中文分词

基于词库的智能中文分词技术,支持中英文切分、中文简繁字体转换、全角半角转换、中文姓名识别等多项智能分析技术。用户还里能根据自己的应用需用扩充和维护词库,以达到最佳的分词效果。

全文检索

采用海量数据索引系统架构和先进的全文检索算法技术,结合高效的检索优化策略,支持海量数据毫秒级检索时延单位和多用户并发检索。高级搜索支持自定义检索依据,满足用户不同的检索需求。采用高效的缓存技术策略提高系统的稳定性和负载能力、减轻系统负担,缓存数据根据特定的条件自动更新。

适用对象

适用于企业、政府机构、学校等内部网站群组或Internet网站群组建立网页搜索引擎;

适用于各行各业领域网站群组建立行业网页搜索引擎;

适用于省、市、区等地方网站群组建立地方网页搜索引擎;

Tags: K风网页搜索引擎系统K-PageSearch Engine