`

IBM OmniFind Enterprise Starter Edition

阅读更多

IBM OmniFind Enterprise Starter Edition

http://www-142.ibm.com/software/dre/ecatalog/detail.wss?locale=zh_CN&synkey=I450133S45837Y30

 

 

JAVA开源搜索引擎

http://open-open.com/32.htm

 

Lucene的学习

http://zhuhaifeng.iteye.com/blog/425650

 Egothor 

Egothor是一个用Java编写的开源而高效的全文本搜索引擎。借助Java的跨平台特性,Egothor能应用于任何环境的应用,既可配置为单独的搜索引擎,又能用于你的应用作为全文检索之用。

更多Egothor信息

 Nutch 

Nutch 是一个开源Java 实现的搜索引擎。它提供了我们运行自己的搜索引擎所需的全部工具。包括全文搜索和Web爬虫。

更多Nutch信息

 Lucene 

Apache Lucene是一个基于Java全文搜索引擎,利用它可以轻易地为Java软件加入全文搜寻功能。Lucene的最主要工作是替文件的每一个字作索引,索 引让搜寻的效率比传统的逐字比较大大提高,Lucen提供一组解读,过滤,分析文件,编排和使用索引的API,它的强大之处除了高效和简单外,是最重要的 是使使用者可以随时应自已需要自订其功能。

更多Lucene信息

 Oxyus 

是一个纯java写的web搜索引擎。

更多Oxyus信息

 BDDBot 

BDDBot是一个简单的易于理解和使用的搜索引擎。它目前在一个文本文件(urls.txt)列出的URL中爬行,将结果保存在一个数据库中。它也支持一个简单的Web服务器,这个服务器接受来自浏览器的查询并返回响应结果。它可以方便地集成到你的Web站点中。

更多BDDBot信息

 Zilverline 

Zilverline 是一个搜索引擎,它通过web方式搜索本地硬盘或intranet上的内容。Zilverline可以从PDF, Word, Excel, Powerpoint, RTF, txt, java, CHM,zip, rar等文档中抓取它们的内容来建立摘要和索引。从本地硬盘或intranet中查找到的结果可重新再进行检索。Zilverline支持多种语言其中包 括中文。

更多Zilverline信息

 XQEngine 

XQEngine 用于XML文档的全文本搜索引擎.利用XQuery做为它的前端查询语言.它能够让你查询XML文档集合通过使用关键字的逻辑组合.有点类似于 Google与其它搜索引擎搜索HTML文档一样.XQEngine只是一个用Java开发的很紧凑的可嵌入的组件.

更多XQEngine信息

 MG4J 

MG4J可以让你为大量的文档集合构建一个被压缩的全文本索引,通过使内插编码(interpolative coding)技术.

更多MG4J信息

 JXTA Search 

JXTA Search是一个分布式的搜索系统.设计用在点对点的网络与网站上.

更多JXTA Search信息

 YaCy 

YaCy基于p2p的分布式Web搜索引擎.同时也是一个Http缓存代理服务器.这个项目是构建基于p2p Web索引网络的一个新方法.它可以搜索你自己的或全局的索引,也可以Crawl自己的网页或启动分布式Crawling等.

更多YaCy信息

 Red-Piranha 

Red- Piranha是一个开源搜索系统,它能够真正"学习"你所要查找的是什么.Red-Piranha可作为你桌面系统(Windows,Linux与 Mac)的个人搜索引擎,或企业内部网搜索引擎,或为你的网站提供搜索功能,或作为一个P2P搜索引擎,或与wiki结合作为一个知识/文档管理解决方 案,或搜索你要的RSS聚合信息,或搜索你公司的系统(包括SAP,Oracle或其它任何Database/Data source),或用于管理PDF,Word和其它文档,或作为一个提供搜索信息的WebService或为你的应用程序 (Web,Swing,SWT,Flash,Mozilla-XUL,PHP, Perl或c#/.Net)提供搜索后台等等.

更多Red-Piranha信息

 LIUS 

LIUS是一个基于Jakarta Lucene项目的索引框架。LIUS为Lucene添加了对许多文件格式的进行索引功能如:
Ms Word,Ms Excel,Ms PowerPoint,RTF,PDF,XML,HTML,TXT,Open Office序列和JavaBeans。针对JavaBeans的索引特别有用当我们要对数据库进行索引或刚好用户使用持久层ORM技术 如:Hibernate,JDO,Torque,TopLink进行开发时。

更多LIUS信息

 Aperture 

Aperture这个Java框架能够从各种各样的资料系统(如:文件系统、Web站点、IMAP和Outlook邮箱)或存在这些系统中的文件(如:文档、图片)爬取和搜索其中的全文本内容与元数据。它当前支持的文件格式如下:
  • Plain text
  • HTML, XHTML
  • XML
  • PDF (Portable Document Format)
  • RTF (Rich Text Format)
  • Microsoft Office: Word, Excel, Powerpoint, Visio, Publisher
  • Microsoft Works
  • OpenOffice 1.x: Writer, Calc, Impress, Draw
  • StarOffice 6.x - 7.x+: Writer, Calc, Impress, Draw
  • OpenDocument (OpenOffice 2.x, StarOffice 8.x)
  • Corel WordPerfect, Quattro, Presentations
  • Emails (.eml files)
  • 更多Aperture信息

     Apache Solr 

    Solr 是一个高性能,采用Java5开发,基于Lucene的全文搜索服务器。文档通过Http利用XML加到一个搜索集合中。查询该集合也是通过http收到 一个XML/JSON响应来实现。它的主要特性包括:高效、灵活的缓存功能,垂直搜索功能,高亮显示搜索结果,通过索引复制来提高可用性,提供一套强大 Data Schema来定义字段,类型和设置文本分析,提供基于Web的管理界面等。

    更多Apache Solr信息

     Lucene中文分词“庖丁解牛” Paoding Analysis 

    Paoding's Knives中文分词具有极高效率和高扩展性。引入隐喻,采用完全的面向对象设计,构思先进。高效率:在PIII 1G内存个人机器上,1秒可准确分词100万汉字。采用基于不限制个数的词典文件对文章进行有效切分,使能够将对词汇分类定义。能够对未知的词汇进行合理 解析。

    更多Lucene中文分词“庖丁解牛” Paoding Analysis信息

     Carrot2 

    Carrot2 是一个开源搜索结果分类引擎。它能够自动把搜索结果组织成一些专题分类。Carrot2提供的一个架构能够从各种搜索引擎(YahooAPI、 GoogleAPI、MSN Search API、eTools Meta Search、Alexa Web Search、PubMed、OpenSearch、Lucene index、SOLR)获取搜索结果。

    更多Carrot2信息

     Regain 

    Regain 是一个基于Jakarta Lucene封装的搜索引擎。它能够索引和查询多种格式的文件(当前支持的格式包括:HTML、XML、Excel、Powerpoint、Word、 PDF和RTF)。此外它还提供一个标签库以便易于将搜索结果展示在JSP页面中。

    更多Regain信息

     Hounder 

    Hounder是一个完善的搜索系统,Hounder只会检索那些出现在互联网上的文档,并通过一个简单的网页来展示搜索结果。能够完美与其它项目相结合。它在各方面的设计都是规模级的包括:索引网页的数量,检索速度,查询并发数。它已经成功应用在多个大型搜索系统中。

    更多Hounder信息

     中文分词器 IKAnalyzer 

    IKAnalyzer 是一个开源的,基于java语言开发的轻量级的中文分词工具包。从2006年12月推出1.0版开始,IKAnalyzer已经推出了3个大版本。最初, 它是以开源项目Luence为应用主体的,结合词典分词和文法分析算法的中文分词组件。新版本的IKAnalyzer3.0则发展为面向Java的公用分 词组件,独立于Lucene项目,同时提供了对Lucene的默认优化实现。
    IKAnalyzer3.0特性:
  • 采用了特有的“正向迭代最细粒度切分算法“,具有50万字/秒的高速处理能力。
  • 采用了多子处理器分析模式,支持:英文字母(IP地址、Email、URL)、数字(日期,常用中文数量词,罗马数字,科学计数法),中文词汇(姓名、地名处理)等分词处理。
  • 优化的词典存储,更小的内存占用。支持用户词典扩展定义
  • 针对Lucene全文检索优化的查询分析器IKQueryParser(作者吐血推荐);采用歧义分析算法优化查询关键字的搜索排列组合,能极大的提高Lucene检索的命中率。
    IKAnalyzer.jpg
  • 更多中文分词器 IKAnalyzer信息

     

    开源中文分词系统:HTTPCWS在线演示

    http://blog.s135.com/demo/httpcws/

    开源PHP中文分词扩展:PHPCWS在线演示

    http://blog.s135.com/demo/phpcws/

     

    世界各国google网址

    http://subin.org.cn/blog/post/297.html

    荷兰 www.google.nl

    英国 www.google.co.uk

    日本 www.google.co.jp

    韩国 www.google.co.kr

    意大利 www.google.it

    加拿大 www.google.ca

    新西兰 www.google.co.nz  
    新加坡 www.google.com.sg

    俄罗斯 www.google.com.ru
    中国台湾 www.google.com.tw
    中国香港 www.google.com.hk  

    、、、

     

    google apps

     

    >>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>

    google sms

    http://www.google.cn/rebang/msg

    google tips

    http://www.google.cn/help/tips/

    google dictionary

    http://download.iciba.com/pwl/powerwordlite.2801.0.exe

    http://www.google.cn/rebang/product/dictionary/dictionary.html

    google destop

    http://desktop.google.com/zh/

    http://dl.google.com/dl/desktop/R/zh_CN/GoogleDesktopSetup.exe

    http://127.0.0.1:4664/status&s=iWK3Rg3lnDWPtca0STyPCOOmpNI

    google gmail

    http://www.google.com/mobile/products/mail.html#p=blackberry

    mr+etang-10577610435266355075-Bt8s6dcw@prod.writely.com

    gmail_conf :

    帐户类型: POP3

    接收邮件服务器: pop.gmail.com 。ssl_port:995

    发送邮件服务器:smtp.gmail.com 。ssl_port:587

    IMAP(即 Internet Message Access Protocol,互联网邮件访问协议)

    接收邮件服务器 (IMAP): imap.gmail.com 。ssl_port:993

    发送邮件服务器 (SMTP):smtp.gmail.com 。ssl_port:465

    google docs

    http://docs.google.com

    google picasa
    http://picasaweb.google.com/mr.etang

    http://dl.google.com/picasa/picasa3-setup.exe

    http://dl.google.com/linux/deb/pool/non-free/p/picasa/picasa_2.7.3736-15_i386.deb

    google chrome
    http://dl.google.com/chrome/install/172.8/chrome_installer.exe (1.0.154.64)
    http://www.google.com/chrome/eula.html
    http://70.duote.com.cn/chrome_installer.zip
    http://www.google.com/chrome/intl/zh-CN/linux.html?hl=zh-CN
    google pinyin
    http://tools.google.com/pinyin
    http://www.google.com/ime/pinyin/
    http://71.duote.com.cn/sogou_pinyin_36_4371.exe
    http://dl.google.com/pinyin/GooglePinyinInstaller.exe
    google earth
    http://70.duote.com.cn/googleearthwin.exe
    http://earth.google.com/intl/en/download-earth.html
    google toolbar (自带单词翻译功能)
    http://dl.google.com/firefox/google-toolbar-linux.xpi
    http://www.google.com/tools/firefox/toolbar/FT2/intl/zh-CN/


    google.com

    地址栏输入:*** site:lindows.iteye.com

    site:lindows.iteye.com

    soso.com

    地址栏输入:*** site:170475387.qzone.qq.com


    end
    分享到:
    评论

    相关推荐

      omnifind搜索Note的详细配置

      omnifind 搜索Note 的详细配置

      Omnifind搜索Lotus Connection的配置

      Omnifind搜索Lotus Connection的详细配置,亲自成功实现过。

      web_2_0_and_social_networking_for_the_enterprise.pdf

      How IBM Uses OmniFind Enterprise Edition . . . . . .196 Using Tagging to Find Information . . . . . . . . . . . . .198 Conclusion . . . . . . . . . . . . . . . . . . . . . . . . . . . . . .202 Chapter...

      node-v10.17.0-linux-x64.tar.xz

      Node.js,简称Node,是一个开源且跨平台的JavaScript运行时环境,它允许在浏览器外运行JavaScript代码。Node.js于2009年由Ryan Dahl创立,旨在创建高性能的Web服务器和网络应用程序。它基于Google Chrome的V8 JavaScript引擎,可以在Windows、Linux、Unix、Mac OS X等操作系统上运行。 Node.js的特点之一是事件驱动和非阻塞I/O模型,这使得它非常适合处理大量并发连接,从而在构建实时应用程序如在线游戏、聊天应用以及实时通讯服务时表现卓越。此外,Node.js使用了模块化的架构,通过npm(Node package manager,Node包管理器),社区成员可以共享和复用代码,极大地促进了Node.js生态系统的发展和扩张。 Node.js不仅用于服务器端开发。随着技术的发展,它也被用于构建工具链、开发桌面应用程序、物联网设备等。Node.js能够处理文件系统、操作数据库、处理网络请求等,因此,开发者可以用JavaScript编写全栈应用程序,这一点大大提高了开发效率和便捷性。 在实践中,许多大型企业和组织已经采用Node.js作为其Web应用程序的开发平台,如Netflix、PayPal和Walmart等。它们利用Node.js提高了应用性能,简化了开发流程,并且能更快地响应市场需求。

      使用opencv决策树训练mushroom数据集-python源码.zip

      使用opencv决策树训练mushroom数据集-python源码.zip

      基于Faster RCNN的人脸检测识别系统python源码+项目说明+wider-face数据集.zip

      基于Faster RCNN的人脸检测识别系统python源码+项目说明+wider_face数据集.zip ### 三,使用说明 1. 锚框的大小为[128、256、512],比率为[1:1、1:2、2:1]。 2. tensorflow的版本是'1.9.0',keras的版本是'2.1.5',除了使用tensorflow2.0之后版本,其他版本都可以尝试。不支持python2.x。 3. 使用的是tensorflow backend,theano可以自行修改。 4. wider face的Label文件格式与VOC2012的label不同,而我使用的Faster RCNN需要VOC2012的格式,所以需要将label文件转换一下格式。具体可以查看 [https://blog.csdn.net/qq_37431083/article/details/102742322](https://blog.csdn.net/qq_37431083/article/details/102742322) 5. 在训练过程中可能会出现`"ValueError: 'a' cannot be empty

      1985-2022年广东省企业专利明细数据-专利名称专利类型专利摘要专利授权专利分类号等

      1985-2022年广东省企业专利明细数据-专利名称专利类型专利摘要专利授权专利 分类号等 1、数据说明: 在知识经济时代,技术创新是实现经济内生增长的关键动力, 科技优势成为经济竞争优势的根本源泉。新一轮科技革命和产业变革加速,全球创新速度加 快,我国正在经历发展方式转变、经济结构优化、新旧动能转换的攻关期,创新日益成为破 解发展难题的关键。专利作为技术与知识的载体,其申请数量是创新研究中衡量创新最常用 的指标之一,中国成为创新领先国家也同样体现在专利申请量上。改革开放 40 年来, 我们的知识产权事业取得了举世瞩目的巨大成功,但也面临着“大而不强”的问题。引导专 利从追求数量向提高质量转变,这是国家近几年的政策扶持重点,也是未来专利申请审查的 一个风向标,针对海量专利数据的价值识别与预测,逐渐成为当前的研究热点。 本数据提 供了1985-2022年广东省的企业专利明细数据,可用于各类专利相关研究。 2、 数据来源: 数据来源为国家知识产权局,利用知识产权局的高级检索,选择地区、年份、 专利类型,对全国31省的各类专利进行统计并将检索结果整理为面板数据,包括发明公开 、发明授权、实用

      Kaggle竞赛 稻田病害分类-python源码.zip

      Kaggle竞赛 稻田病害分类-python源码.zip

      基于paddle+mediapipe注意力机制的表情识别python源码+数据集+模型+项目说明.zip

      文件目录解释 # 1. Models 用来存放的模型,可以是已有的Paddle格式的模型 # 2. Pages - assets 用到的图片资源 - assets.qrc 使用PySide生成的样式文件 - assets_rc.py GUI界面的样式文件,此目录和根目录都有,我忘记是调用的哪一个了,所以都保留了。 # 3. Utils - AttResNet.py 网络代码 - DatasetProcess.py 数据集处理代码 - FaceDetection.py 人脸检测代码 - Predict.py 模型预测代码 - VisualTrain.py 模型训练代码 - CSV文件 用来保存数据集和创建的信息 # 4. Dataset 存放数据集的目录 注意事项 * # 配置好环境,安装使用PySide的工具,不会安装见如下以PyCharm为例的说明 1. 依次点击 File:arrow_right:Settings:arrow_right:Tools:arrow_right:External Tools:arrow_right::heavy_plus_sign:添加PySide工具,

      机械设计小线圈生产打蜡机sw20非常好的设计图纸100%好用.zip

      机械设计小线圈生产打蜡机sw20非常好的设计图纸100%好用.zip

      手机和讯财金网触屏版自适应手机wap财金网站模板.zip

      触屏版自适应手机wap软件网站模板 触屏版自适应手机wap软件网站模板

      基于普中51开发板的超声波测距+蜂鸣器报警 (附开发板原理图)

      基于普中51开发板的超声波测距+蜂鸣器报警 (附开发板原理图) 基于普中51开发板的超声波测距+蜂鸣器报警 (附开发板原理图)

      机械设计大倾角输送机sw17非常好的设计图纸100%好用.zip

      机械设计大倾角输送机sw17非常好的设计图纸100%好用.zip

      1999-2022年投资者信心指数表、消费者信心指数表、企业景气指数表、企业家信心指数表

      每个压缩包都附有数据表和数据来源 信心指数 1.投资者信心指数表 数据区间:20 08.04-2022.09,月度数据(数据库中该项数据的全部内容) 字段设置:全 选 全部字段: DeclareDate [发布日期] - YYYY-MM-DD SgnMonth [统计月度] - YYYY-MM IndexCode [指数编 码] - Q4001信心指数;Q4002国内经济基本面;Q4003国内经济政策; Q4004国际经济金融环境;Q4005股票估值;Q4006大盘乐观;Q4007大 盘反弹;Q4008大盘抗跌;Q4009买入; Name [指数名称] - 信心指 数;国内经济基本面;国内经济政策;国际经济金融环境;股票估值;大盘乐观;大盘反弹 ;大盘抗跌;买入; Value [当月值] - LastValue [上月值] - Mom [环比增减] - 压缩包所含文件: 数据样例: 2.消费者信心指数表 数据区间:1999.01-2022.09,月度数据(数据库中该项数据的全部内容 ) 字段设置:全选 全部字段: SgnMonth [统计月度] - YYYY-M M Expect

      使用Keras+TensorFlow进行目标检测-python源码.zip

      使用Keras+TensorFlow进行目标检测-python源码.zip

      node-v10.24.0-linux-x64.tar.xz

      Node.js,简称Node,是一个开源且跨平台的JavaScript运行时环境,它允许在浏览器外运行JavaScript代码。Node.js于2009年由Ryan Dahl创立,旨在创建高性能的Web服务器和网络应用程序。它基于Google Chrome的V8 JavaScript引擎,可以在Windows、Linux、Unix、Mac OS X等操作系统上运行。 Node.js的特点之一是事件驱动和非阻塞I/O模型,这使得它非常适合处理大量并发连接,从而在构建实时应用程序如在线游戏、聊天应用以及实时通讯服务时表现卓越。此外,Node.js使用了模块化的架构,通过npm(Node package manager,Node包管理器),社区成员可以共享和复用代码,极大地促进了Node.js生态系统的发展和扩张。 Node.js不仅用于服务器端开发。随着技术的发展,它也被用于构建工具链、开发桌面应用程序、物联网设备等。Node.js能够处理文件系统、操作数据库、处理网络请求等,因此,开发者可以用JavaScript编写全栈应用程序,这一点大大提高了开发效率和便捷性。 在实践中,许多大型企业和组织已经采用Node.js作为其Web应用程序的开发平台,如Netflix、PayPal和Walmart等。它们利用Node.js提高了应用性能,简化了开发流程,并且能更快地响应市场需求。

      深圳曙光医院触屏自适应html5手机医院网站模板下载 .zip

      触屏版自适应手机wap软件网站模板 触屏版自适应手机wap软件网站模板

      手机wap网站 仿腾讯新闻.zip

      触屏版自适应手机wap软件网站模板 触屏版自适应手机wap软件网站模板

      仿想去网触屏版html5手机wap网站模板购物网站模板.zip

      触屏版自适应手机wap软件网站模板 触屏版自适应手机wap软件网站模板

      lda代码-checkpoint-checkpoint.ipynb

      lda代码-checkpoint-checkpoint.ipynb

    Global site tag (gtag.js) - Google Analytics