设为首页 收藏本站
查看: 1916|回复: 0

[经验分享] IBM OmniFind Enterprise Starter Edition

[复制链接]

尚未签到

发表于 2017-5-25 08:47:41 | 显示全部楼层 |阅读模式

  IBM OmniFind Enterprise Starter Edition
http://www-142.ibm.com/software/dre/ecatalog/detail.wss?locale=zh_CN&synkey=I450133S45837Y30
  JAVA开源搜索引擎
  http://open-open.com/32.htm
Lucene的学习
http://zhuhaifeng.iteye.com/blog/425650
DSC0000.gif  Egothor 
DSC0001.gif

Egothor是一个用Java编写的开源而高效的全文本搜索引擎。借助Java的跨平台特性,Egothor能应用于任何环境的应用,既可配置为单独的搜索引擎,又能用于你的应用作为全文检索之用。  更多Egothor信息

 Nutch 


Nutch 是一个开源Java 实现的搜索引擎。它提供了我们运行自己的搜索引擎所需的全部工具。包括全文搜索和Web爬虫。  更多Nutch信息

 Lucene 


ApacheLucene是一个基于Java全文搜索引擎,利用它可以轻易地为Java软件加入全文搜寻功能。Lucene的最主要工作是替文件的每一个字作索引,索引让搜寻的效率比传统的逐字比较大大提高,Lucen提供一组解读,过滤,分析文件,编排和使用索引的API,它的强大之处除了高效和简单外,是最重要的是使使用者可以随时应自已需要自订其功能。  更多Lucene信息

 Oxyus 


是一个纯java写的web搜索引擎。  更多Oxyus信息

 BDDBot 


BDDBot是一个简单的易于理解和使用的搜索引擎。它目前在一个文本文件(urls.txt)列出的URL中爬行,将结果保存在一个数据库中。它也支持一个简单的Web服务器,这个服务器接受来自浏览器的查询并返回响应结果。它可以方便地集成到你的Web站点中。  更多BDDBot信息

 Zilverline 


Zilverline是一个搜索引擎,它通过web方式搜索本地硬盘或intranet上的内容。Zilverline可以从PDF, Word, Excel,Powerpoint, RTF, txt, java, CHM,zip,rar等文档中抓取它们的内容来建立摘要和索引。从本地硬盘或intranet中查找到的结果可重新再进行检索。Zilverline支持多种语言其中包括中文。  更多Zilverline信息

 XQEngine 


XQEngine用于XML文档的全文本搜索引擎.利用XQuery做为它的前端查询语言.它能够让你查询XML文档集合通过使用关键字的逻辑组合.有点类似于Google与其它搜索引擎搜索HTML文档一样.XQEngine只是一个用Java开发的很紧凑的可嵌入的组件.  更多XQEngine信息

 MG4J 


MG4J可以让你为大量的文档集合构建一个被压缩的全文本索引,通过使内插编码(interpolative coding)技术.  更多MG4J信息

 JXTA Search 


JXTA Search是一个分布式的搜索系统.设计用在点对点的网络与网站上.  更多JXTA Search信息

 YaCy 


YaCy基于p2p的分布式Web搜索引擎.同时也是一个Http缓存代理服务器.这个项目是构建基于p2p Web索引网络的一个新方法.它可以搜索你自己的或全局的索引,也可以Crawl自己的网页或启动分布式Crawling等.
  更多YaCy信息

 Red-Piranha 


Red-Piranha是一个开源搜索系统,它能够真正"学习"你所要查找的是什么.Red-Piranha可作为你桌面系统(Windows,Linux与Mac)的个人搜索引擎,或企业内部网搜索引擎,或为你的网站提供搜索功能,或作为一个P2P搜索引擎,或与wiki结合作为一个知识/文档管理解决方案,或搜索你要的RSS聚合信息,或搜索你公司的系统(包括SAP,Oracle或其它任何Database/Datasource),或用于管理PDF,Word和其它文档,或作为一个提供搜索信息的WebService或为你的应用程序(Web,Swing,SWT,Flash,Mozilla-XUL,PHP, Perl或c#/.Net)提供搜索后台等等.  更多Red-Piranha信息

 LIUS 


LIUS是一个基于Jakarta Lucene项目的索引框架。LIUS为Lucene添加了对许多文件格式的进行索引功能如:
MsWord,Ms Excel,Ms PowerPoint,RTF,PDF,XML,HTML,TXT,OpenOffice序列和JavaBeans。针对JavaBeans的索引特别有用当我们要对数据库进行索引或刚好用户使用持久层ORM技术如:Hibernate,JDO,Torque,TopLink进行开发时。  更多LIUS信息

 Aperture 


Aperture这个Java框架能够从各种各样的资料系统(如:文件系统、Web站点、IMAP和Outlook邮箱)或存在这些系统中的文件(如:文档、图片)爬取和搜索其中的全文本内容与元数据。它当前支持的文件格式如下:
Plain text
HTML, XHTML
XML
PDF (Portable Document Format)
RTF (Rich Text Format)
Microsoft Office: Word, Excel, Powerpoint, Visio, Publisher
Microsoft Works
OpenOffice 1.x: Writer, Calc, Impress, Draw
StarOffice 6.x - 7.x+: Writer, Calc, Impress, Draw
OpenDocument (OpenOffice 2.x, StarOffice 8.x)
Corel WordPerfect, Quattro, Presentations
Emails (.eml files)
  更多Aperture信息

 Apache Solr 


Solr是一个高性能,采用Java5开发,基于Lucene的全文搜索服务器。文档通过Http利用XML加到一个搜索集合中。查询该集合也是通过http收到一个XML/JSON响应来实现。它的主要特性包括:高效、灵活的缓存功能,垂直搜索功能,高亮显示搜索结果,通过索引复制来提高可用性,提供一套强大Data Schema来定义字段,类型和设置文本分析,提供基于Web的管理界面等。  更多Apache Solr信息

 Lucene中文分词“庖丁解牛” Paoding Analysis 


Paoding'sKnives中文分词具有极高效率和高扩展性。引入隐喻,采用完全的面向对象设计,构思先进。高效率:在PIII1G内存个人机器上,1秒可准确分词100万汉字。采用基于不限制个数的词典文件对文章进行有效切分,使能够将对词汇分类定义。能够对未知的词汇进行合理解析。  更多Lucene中文分词“庖丁解牛” Paoding Analysis信息

 Carrot2 


Carrot2是一个开源搜索结果分类引擎。它能够自动把搜索结果组织成一些专题分类。Carrot2提供的一个架构能够从各种搜索引擎(YahooAPI、GoogleAPI、MSN Search API、eTools Meta Search、Alexa WebSearch、PubMed、OpenSearch、Lucene index、SOLR)获取搜索结果。
DSC0002.jpg   更多Carrot2信息

 Regain 


Regain是一个基于JakartaLucene封装的搜索引擎。它能够索引和查询多种格式的文件(当前支持的格式包括:HTML、XML、Excel、Powerpoint、Word、PDF和RTF)。此外它还提供一个标签库以便易于将搜索结果展示在JSP页面中。
DSC0003.jpg   更多Regain信息

 Hounder 


Hounder是一个完善的搜索系统,Hounder只会检索那些出现在互联网上的文档,并通过一个简单的网页来展示搜索结果。能够完美与其它项目相结合。它在各方面的设计都是规模级的包括:索引网页的数量,检索速度,查询并发数。它已经成功应用在多个大型搜索系统中。
DSC0004.jpg   更多Hounder信息

 中文分词器 IKAnalyzer 


IKAnalyzer是一个开源的,基于java语言开发的轻量级的中文分词工具包。从2006年12月推出1.0版开始,IKAnalyzer已经推出了3个大版本。最初,它是以开源项目Luence为应用主体的,结合词典分词和文法分析算法的中文分词组件。新版本的IKAnalyzer3.0则发展为面向Java的公用分词组件,独立于Lucene项目,同时提供了对Lucene的默认优化实现。
IKAnalyzer3.0特性:采用了特有的“正向迭代最细粒度切分算法“,具有50万字/秒的高速处理能力。
采用了多子处理器分析模式,支持:英文字母(IP地址、Email、URL)、数字(日期,常用中文数量词,罗马数字,科学计数法),中文词汇(姓名、地名处理)等分词处理。
优化的词典存储,更小的内存占用。支持用户词典扩展定义
针对Lucene全文检索优化的查询分析器IKQueryParser(作者吐血推荐);采用歧义分析算法优化查询关键字的搜索排列组合,能极大的提高Lucene检索的命中率。
DSC0005.jpg   更多中文分词器 IKAnalyzer信息

 
开源中文分词系统:HTTPCWS在线演示
http://blog.s135.com/demo/httpcws/
开源PHP中文分词扩展:PHPCWS在线演示
http://blog.s135.com/demo/phpcws/
 
世界各国google网址
http://subin.org.cn/blog/post/297.html
  荷兰www.google.nl
  英国 www.google.co.uk
  日本 www.google.co.jp
  韩国 www.google.co.kr
  意大利 www.google.it
  加拿大www.google.ca
   新西兰 www.google.co.nz 
新加坡 www.google.com.sg
  俄罗斯www.google.com.ru
中国台湾 www.google.com.tw
中国香港 www.google.com.hk 

、、、
  google apps
  >>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>
  google sms
http://www.google.cn/rebang/msg
google tips
http://www.google.cn/help/tips/
google dictionary
http://download.iciba.com/pwl/powerwordlite.2801.0.exe
http://www.google.cn/rebang/product/dictionary/dictionary.html
google destop
http://desktop.google.com/zh/
http://dl.google.com/dl/desktop/R/zh_CN/GoogleDesktopSetup.exe
http://127.0.0.1:4664/status&s=iWK3Rg3lnDWPtca0STyPCOOmpNI
google gmail
http://www.google.com/mobile/products/mail.html#p=blackberry
mr+etang-10577610435266355075-Bt8s6dcw@prod.writely.com
gmail_conf:
  帐户类型: POP3
  接收邮件服务器: pop.gmail.com 。ssl_port:995
  发送邮件服务器:smtp.gmail.com 。ssl_port:587
  或
  IMAP(即 Internet Message Access Protocol,互联网邮件访问协议)
接收邮件服务器 (IMAP): imap.gmail.com 。ssl_port:993
发送邮件服务器 (SMTP):smtp.gmail.com 。ssl_port:465
google docs
http://docs.google.com

google picasa
http://picasaweb.google.com/mr.etang
http://dl.google.com/picasa/picasa3-setup.exe
http://dl.google.com/linux/deb/pool/non-free/p/picasa/picasa_2.7.3736-15_i386.deb
google chrome
http://dl.google.com/chrome/install/172.8/chrome_installer.exe (1.0.154.64)

http://www.google.com/chrome/eula.html
http://70.duote.com.cn/chrome_installer.zip

http://www.google.com/chrome/intl/zh-CN/linux.html?hl=zh-CN
google pinyin
http://tools.google.com/pinyin
http://www.google.com/ime/pinyin/


http://71.duote.com.cn/sogou_pinyin_36_4371.exe

http://dl.google.com/pinyin/GooglePinyinInstaller.exe
google earth
http://duote.com/soft/3603.html
http://70.duote.com.cn/googleearthwin.exe

http://earth.google.com/intl/en/download-earth.html
google toolbar (自带单词翻译功能)

http://dl.google.com/firefox/google-toolbar-linux.xpi
http://www.google.com/tools/firefox/toolbar/FT2/intl/zh-CN/



  google.com
  地址栏输入:*** site:lindows.iteye.com
  site:lindows.iteye.com
soso.com

地址栏输入:*** site:170475387.qzone.qq.com




end

运维网声明 1、欢迎大家加入本站运维交流群:群②:261659950 群⑤:202807635 群⑦870801961 群⑧679858003
2、本站所有主题由该帖子作者发表,该帖子作者与运维网享有帖子相关版权
3、所有作品的著作权均归原作者享有,请您和我们一样尊重他人的著作权等合法权益。如果您对作品感到满意,请购买正版
4、禁止制作、复制、发布和传播具有反动、淫秽、色情、暴力、凶杀等内容的信息,一经发现立即删除。若您因此触犯法律,一切后果自负,我们对此不承担任何责任
5、所有资源均系网友上传或者通过网络收集,我们仅提供一个展示、介绍、观摩学习的平台,我们不对其内容的准确性、可靠性、正当性、安全性、合法性等负责,亦不承担任何法律责任
6、所有作品仅供您个人学习、研究或欣赏,不得用于商业或者其他用途,否则,一切后果均由您自己承担,我们对此不承担任何法律责任
7、如涉及侵犯版权等问题,请您及时通知我们,我们将立即采取措施予以解决
8、联系人Email:admin@iyunv.com 网址:www.yunweiku.com

所有资源均系网友上传或者通过网络收集,我们仅提供一个展示、介绍、观摩学习的平台,我们不对其承担任何法律责任,如涉及侵犯版权等问题,请您及时通知我们,我们将立即处理,联系人Email:kefu@iyunv.com,QQ:1061981298 本贴地址:https://www.yunweiku.com/thread-380699-1-1.html 上篇帖子: ibm x3650 安装centos6 下篇帖子: 也谈IBM并购Sun
您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

扫码加入运维网微信交流群X

扫码加入运维网微信交流群

扫描二维码加入运维网微信交流群,最新一手资源尽在官方微信交流群!快快加入我们吧...

扫描微信二维码查看详情

客服E-mail:kefu@iyunv.com 客服QQ:1061981298


QQ群⑦:运维网交流群⑦ QQ群⑧:运维网交流群⑧ k8s群:运维网kubernetes交流群


提醒:禁止发布任何违反国家法律、法规的言论与图片等内容;本站内容均来自个人观点与网络等信息,非本站认同之观点.


本站大部分资源是网友从网上搜集分享而来,其版权均归原作者及其网站所有,我们尊重他人的合法权益,如有内容侵犯您的合法权益,请及时与我们联系进行核实删除!



合作伙伴: 青云cloud

快速回复 返回顶部 返回列表