您现在的位置是：首页 > 后端

当前栏目

基于ASP.NET的lucene.net全文搜索实现步骤

Net 搜索 ASP 实现基于步骤全文 Lucene

2023-06-13 09:14:45 时间

在做项目的时候，需求添加全文搜索，选择了lucene.net方向，调研了一下，基本实现了需求，现在将它分享给大家。理解不深请多多包涵。

在完成需求的时候，查看的大量的资料，本文不介绍详细的lucene.net工程建立，只介绍如何对文档进行全文搜索。对于如何建立lucene.net的工程请大家访问

使用lucene.net搜索分为两个部分，首先是创建索引，创建文本内容的索引，其次是根据创建的索引进行搜索。那么如何对文档进行索引呢，主要是对文档的内容进行索引，关键是提取出文档的内容，按照常规实现，由简到难，提取txt格式的文本相对比较简单，如果实现了提取txt文本，接下来就容易多了，万丈高楼平地起，这就是地基。

1.首先创建ASP.NET页面。

这是一个极其简单的页面，创建页面之后，双击各个按钮生成相应的点击事件，在相应的点击事件中实现程序设计。

2.实现索引部分。

前面已经说到了，索引主要是根据文本内容建立索引，所以要提取文本内容。创建提取txt格式文档文本内容的函数。

复制代码代码如下:

//提取txt文件
publicstaticstringFileReaderAll(FileInfofileName)
{
//读取文本内容，并且默认编码格式，防止出现乱码
StreamReaderreader=newStreamReader(fileName.FullName,System.Text.Encoding.Default);
stringline="";
stringtemp="";
//循环读取文本内容
while((line=reader.ReadLine())!=null)
{
temp+=line;
}
reader.Close();
//返回字符串，用于lucene.net生成索引
returntemp;
}

文本内容已经提取出来了，接下来要根据提取的内容建立索引
复制代码代码如下:

protectedvoidButton2_Click(objectsender,EventArgse)
{
//判断存放文本的文件夹是否存在
if(!System.IO.Directory.Exists(filesDirectory))
{
Response.Write("<script>alert("指定的目录不存在");</script>");
return;
}
//读取文件夹内容
DirectoryInfodirInfo=newDirectoryInfo(filesDirectory);
FileInfo[]files=dirInfo.GetFiles("*.*");
//文件夹判空
if(files.Count()==0)
{
Response.Write("<script>alert("Files目录下没有文件");</script>");
return;
}
//判断存放索引的文件夹是否存在，不存在创建
if(!System.IO.Directory.Exists(indexDirectory))
{
System.IO.Directory.CreateDirectory(indexDirectory);
}
//创建索引
IndexWriterwriter=newIndexWriter(FSDirectory.Open(newDirectoryInfo(indexDirectory)),
analyzer,true,IndexWriter.MaxFieldLength.LIMITED);

for(inti=0;i<files.Count();i++)
{
stringstr="";
FileInfofileInfo=files[i];
//判断文件格式，为以后其他文件格式做准备
if(fileInfo.FullName.EndsWith(".txt")||fileInfo.FullName.EndsWith(".xml"))
{
//获取文本
str=FileReaderAll(fileInfo);
}
Lucene.Net.Documents.Documentdoc=newLucene.Net.Documents.Document();
doc.Add(newLucene.Net.Documents.Field("FileName",fileInfo.Name,Lucene.Net.Documents.Field.Store.YES,Lucene.Net.Documents.Field.Index.ANALYZED));
//根据文本生成索引
doc.Add(newLucene.Net.Documents.Field("Content",str,Lucene.Net.Documents.Field.Store.YES,Lucene.Net.Documents.Field.Index.ANALYZED));
doc.Add(newLucene.Net.Documents.Field("Path",fileInfo.FullName,Lucene.Net.Documents.Field.Store.YES,Lucene.Net.Documents.Field.Index.NO));
//添加生成的索引
writer.AddDocument(doc);
writer.Optimize();
}
writer.Dispose();
Response.Write("<script>alert("索引创建成功");</script>");
}

3.索引创建完了，接下来就是搜索，搜索只要按照固定的格式书写不会出现错误。
复制代码代码如下:
protectedvoidButton1_Click(objectsender,EventArgse)
{
//获取关键字
stringkeyword=TextBox1.Text.Trim();
intnum=10;
//关键字判空
if(string.IsNullOrEmpty(keyword))
{
Response.Write("<script>alert("请输入要查找的关键字");</script>");
return;
}

IndexReaderreader=null;
IndexSearchersearcher=null;
try
{
reader=IndexReader.Open(FSDirectory.Open(newDirectoryInfo(indexDirectory)),true);
searcher=newIndexSearcher(reader);
//创建查询
PerFieldAnalyzerWrapperwrapper=newPerFieldAnalyzerWrapper(analyzer);
wrapper.AddAnalyzer("FileName",analyzer);
wrapper.AddAnalyzer("Path",analyzer);
wrapper.AddAnalyzer("Content",analyzer);
string[]fields={"FileName","Path","Content"};

QueryParserparser=newMultiFieldQueryParser(Lucene.Net.Util.Version.LUCENE_30,fields,wrapper);
//根据关键字查询
Queryquery=parser.Parse(keyword);

TopScoreDocCollectorcollector=TopScoreDocCollector.Create(num,true);

searcher.Search(query,collector);
//这里会根据权重排名查询顺序
varhits=collector.TopDocs().ScoreDocs;

intnumTotalHits=collector.TotalHits;

//以后就可以对获取到的collector数据进行操作
for(inti=0;i<hits.Count();i++)
{
varhit=hits[i];
Lucene.Net.Documents.Documentdoc=searcher.Doc(hit.Doc);
Lucene.Net.Documents.FieldfileNameField=doc.GetField("FileName");
Lucene.Net.Documents.FieldpathField=doc.GetField("Path");
Lucene.Net.Documents.FieldcontentField=doc.GetField("Content");
//在页面循环输出表格
strTable.Append("<tr>");
strTable.Append("<td>"+fileNameField.StringValue+"</td>");
strTable.Append("</tr>");
strTable.Append("<tr>");
strTable.Append("<td>"+pathField.StringValue+"</td>");
strTable.Append("</tr>");
strTable.Append("<tr>");
strTable.Append("<td>"+contentField.StringValue.Substring(0,300)+"</td>");
strTable.Append("</tr>");
}
}
finally
{
if(searcher!=null)
searcher.Dispose();

if(reader!=null)
reader.Dispose();
}
}

现在整个lucene.net搜索全文的过程就建立完了，现在可以搜索txt格式的文件，搜索其他格式的文件在以后添加，主要核心思想就是提取各个不同格式文件的文本内容。

显示效果如下：

在以后的博文里继续接受搜索其他格式的文档。

猜你喜欢

神经网络与深度学习
【数据结构运用】单调栈 + 乘法原理运用题
gridpanel动态加载数据的实例代码
漫谈模式之简单工厂和工厂方法模式
service启动MySQL服务： init.d指令调用（init.dmysql）
MySQL索引命名规范及实践（mysql索引命名）
JVM的内部组成详解编程语言
如何简便快速配置Linux下的NFS文件共享（linux配置nfs）
系统构建可靠的Redis集群版队列系统（redis集群版队列）
解决MySQL CPU使用率过高的方法（mysqlcpu过高）
2021最新Java基础篇(后续已更新到另一篇文章)
你还把《水形物语》拿奥斯卡当娱乐看？其实背后深藏了大秘密
java网络编程之Socket编程详解编程语言
Oracle公司英语能力必不可少（oracle公司英语要求）
哔哩哔哩网站源码分析
解决方案大全：Linux 缺页知识详解（linux缺页）
缓存微服务架构下的Redis缓存共享技术（微服务中共享redis）

zl程序教程

当前栏目

基于ASP.NET的lucene.net全文搜索实现步骤

相关文章