Lucene.net实现自定义排序笔记

ROS机器人建模与仿真(一)——从零构建URDF模型并集成Gazebo物理属性 本文详细介绍了如何使用URDF在ROS中构建机器人模型并集成Gazebo物理属性。从基础URDF结构到Xacro宏定义,再到Gazebo仿真配置,逐步指导开发者完成机器人建模与仿真全流程,特别强调了物理属性设置和调试技巧,帮助避免常见错误。 阅读详情

在Lucene.net实现自定义排序,需要实现两个Lucene.Net.Search的两个接口:
public interface SortComparatorSource
{
   ScoreDocComparator NewComparator(IndexReader reader , System.String fieldname) ;
}

public interface ScoreDocComparator
{
   int Compare(ScoreDoc i , ScoreDoc j) ;
   System.IComparable SortValue(ScoreDoc i) ;
   int SortType() ;
}

涉及到的一个类:
public class ScoreDoc
{
   public float score ;
   public int doc ;
   public ScoreDoc(int doc , float score)
   {
      this.doc = doc ;
      this.score = score ;
   }
}

Lucene.net 2.0包含的SortType有:
在Lucene.Net.Search.SortField里定义的:
public class SortField
{
   public const int SCORE = 0 ;  //相关度
   public const int DOC = 1 ;    //文挡号
   public const int AUTO = 2 ;   //自动识别
   public const int STRING = 3 ; //字符型
   public const int INT = 4 ;    //int
   public const int FLOAT = 5 ;  //float
   public const int CUSTOM = 9 ; //自定义
   .....
}

少了DateTime,那就实现DateTime类型的自定义排序来测试下:
Lucene.Net.Search.ScoreDocComparator接口的实现类:
    public class DateDocComparator : Lucene.Net.Search.ScoreDocComparator
    {
        private string fieldname = null;
        private System.IComparable[] cachedValues ;

        public DateDocComparator(System.IComparable[] cachedValues, string fieldname)
        {
            this.cachedValues = cachedValues;
            this.fieldname = string.Intern(fieldname) ;
        }

        public int Compare(ScoreDoc i, ScoreDoc j)
        {
            return this.cachedValues[i.doc].CompareTo(this.cachedValues[j.doc]) ;
        }

        public System.IComparable SortValue(ScoreDoc i)
        {
            return this.cachedValues[i.doc] ;
        }

        public int SortType()
        {
            return Lucene.Net.Search.SortField.CUSTOM ;
        }
    }

Lucene.Net.Search.SortComparatorSource接口的实现类:
    public class DateSortComparatorSource : Lucene.Net.Search.SortComparatorSource
    {
        public ScoreDocComparator NewComparator(Lucene.Net.Index.IndexReader reader, System.String field)
        {
            return new DateDocComparator(GetCustom(reader, field), field);
        }

        protected virtual System.IComparable[] GetCustom(Lucene.Net.Index.IndexReader reader, System.String field)
        {
                System.IComparable[] retArray = new System.IComparable[reader.MaxDoc()];
                Lucene.Net.Index.TermDocs termDocs = reader.TermDocs();
                Lucene.Net.Index.TermEnum termEnum = reader.Terms(new Lucene.Net.Index.Term(field, ""));
                try
                {
                    do
                    {
                        Lucene.Net.Index.Term term = termEnum.Term();
                        if (term == null || term.Field() != field)
                            break;
                        System.IComparable termval = Lucene.Net.Documents.DateTools.StringToDate(term.Text()) ;
                        termDocs.Seek(termEnum);
                        while (termDocs.Next())
                        {
                            retArray[termDocs.Doc()] = termval;
                        }
                    }
                    while (termEnum.Next());
                }
                finally
                {
                    termDocs.Close();
                    termEnum.Close();
                }
                return retArray;
        }
    }

使用:
Sort sort = new Sort(new SortField("datecreated",new DateSortComparatorSource(),true)) ;

 
本文首发于cnblogs:
http://www.cnblogs.com/kwklover/archive/2007/07/28/834819.html

Lucene.NET中文全文检索实战:从分词到相关性排序 全文检索是现代应用搜索能力的基础技术,其核心在于突破SQL LIKE的字符匹配局限,实现语义感知的文本理解。它依赖倒排索引结构、中文分词处理、相关性打分模型(如BM25)等关键技术原理,显著提升查准率与响应速度。在.NET生态中,Lucene.NET作为轻量、嵌入式、高可控的开源方案,特别适合需规避Elasticsearch运维成本或SQL Server全文索引灵活性不足的中小系统。本文聚焦中文场景下的真实落地难点——包括IKAnalyzer适配、字段级权重控制、Query手写构建及NRT索引刷新,覆盖制造 阅读详情

相关推荐

深入实践Lucene.NET 2.3.1:构建高效搜索引擎

分析器在全文检索系统中扮演着至关重要的角色。它的主要职责是将文本数据进行处理,以便于索引机制可以更高效地存储和检索信息。具体来说,分析器会将文本数据分解为一个个的词汇单元,这个过程也被称为“分词”(Tokenization)。分词后,分析器还会执行一些额外的任务,例如:去除停用词(Stop words removal):停用词如“的”,“和”,“是”等在文本中出现频率极高,但通常不含有实际的检索价值。

weixin_32661831的博客 1236

lucene自定义排序实现

lucene自定义排序实现,大家有兴趣关注我的博客http://blog.csdn.net/wuyinggui10000/article/category/3173543

构建基于ASP.NETLucene.NET的搜索引擎

搜索引擎是一种根据用户的需求,从大量数据中通过一定的算法提取所需信息的工具。它们在互联网、企业内部网以及个人数据库中都能发挥巨大作用,满足信息检索的需求。在这一章节中,我们探索了搜索引擎的高级功能和优化方法,从动态搜索体验到索引管理、多语言支持以及搜索建议和拼写纠错技术。这些功能和优化策略对于构建一个高效、智能、用户友好的搜索引擎至关重要。接下来的章节中,我们将继续深入探讨更多技术细节和实现方法,帮助IT专业人士和爱好者进一步提升他们的搜索引擎技术。本文还有配套的精品资源,点击获取。

weixin_42629522的博客 876

[Lucene.Net] 基本用法

本文仅记录一些简单的使用方法,供初学者参考。以下例子采用 Lucene.NET 1.9 版本,可取去 Lucene.Net 下载。1. 基本应用using System;using System.Collections.Generic;using System.Text;using Lucene.Net;using Lucene.Net.Analysis;using Lucene.Net.An

xwchen的专栏 771

Lucene.NET的多关键排序和条件搜索(高级搜索篇)

 1.Lucene排序    Lucene有内置的排序用IndexSearcher.search(query,sort)但是功能并不理想。我们需要自己实现自定义排序。    这样的话得实现两个接口: ScoreDocComparator, SortComparatorSource              用IndexSearcher.search(query,new Sort(new Sort

tongyiyi的专栏 2347

C# Lucene.Net 使用

目录标题一. Lucene.Net概述二 分词(一)内置分词器(二)分词过程(三)中文分词三 索引(一)索引的存储结构(三)创建索引1 基本实现2 权重Boost(四)合并索引(五)删除索引(六)更新索引(七)优化索引四 搜索(一)基本查询(二)常用类型(三)逻辑查询(四)复合查询(五)跨度查询(六)通配符查找(七)排序1 按单列排序2 按多列排序3 自定义排序4 使用查询函数排序5 设置权重(八)过滤五 实践中的问题(一)缓存(二)锁(三)使用内存目录以及多线程查询器提高查询速度(四)总是设置权重 一.

Wu7z_的博客 2567

关于lucene自定义排序 FieldComparatorSource

其实关于FieldComparatorSource的lucene默认实现,应该已经满足我们对结果排序的需求了,比如: [img]http://dl.iteye.com/upload/attachment/550152/6f040161-2ed2-3b9c-9a0c-3bccab11f6b5.jpg[/img] 如果我们希望对搜索结果按照一定的业务规则,人工干预排序,不妨尝试一下继承一下Fiel...

LANDOWS的博客 568

(转)Lucene.net实现自定义排序笔记

本文转载自:http://www.cnblogs.com/kwklover/archive/2007/07/28/834819.html 在Lucene.net实现自定义排序,需要实现两个Lucene.Net.Search的两个接口:public interface SortComparatorSource{ ScoreDocComparator NewComparator(IndexRea...

weixin_33768481的博客 100

基于 .NET 8 + Lucene.Net + 结巴分词实现全文检索与匹配度打分实战指南

本文详细讲解如何利用.NET 8Lucene.Net和结巴分词(Jieba)实现高效的全文检索功能,并支持搜索结果按匹配度排序。内容涵盖环境搭建、索引管理、分词优化、动态更新策略及实战代码示例,助您快速构建高性能中文搜索引擎。.NET 8:微软最新跨平台框架,提供高性能运行时。Apache顶级搜索库的.NET移植版,支持复杂搜索逻辑。结巴分词(Jieba):高效中文分词组件,支持搜索和索引双模式。// 修改词频计算逻辑// 应用自定义评分停用词文件:移除“的”、“了”等无意义词。用户词典。

李赛赛的专栏 4178

Lucene.net实现自定义排序

Lucene.net实现自定义排序,需要实现两个Lucene.Net.Search的两个接口: public interface SortComparatorSource { ScoreDocComparator NewComparator(IndexReader reader , System.String fieldname) ; } public in...

weixin_30415113的博客 112

如何在Lucene.net实现自定义排序

如何在Lucene.net实现自定义排序Lucene.net实现自定义排序,需要实现两个Lucene.Net.Search的两个接口: public interface SortComparatorSource { ScoreDocComparator NewComparator(IndexReader reader ,...

weixin_30241919的博客 114

使用Lucene.Net实现全文检索

目录 一 Lucene.NET概述 二 分词 三 索引 四 搜索 五 实践中的问题   一 Lucene.Net概述   Lucene.Net是一个C#开发的开源全文索引库,其源码包括“核心”与“外围”两部分。外围部分实现辅助功能,而核心部分包括: Lucene.Net.Index 提供索引管理,词组排序Lucene.Net.Search 提

zhou_xuexi的专栏 4447

Lucene.Net全文搜索引擎:架构解析与全流程实战指南

Lucene.Net灵活架构:模块化设计支持深度定制高性能:倒排索引+段机制保障搜索效率可扩展:通过Analyzer和Similarity实现业务适配集成实现分布式搜索结合AI模型实现语义搜索构建实时日志分析系统。

李赛赛的专栏 2088

Lucene.Net]基本用法

本文仅记录一些简单的使用方法,供初学者参考。以下例子采用 Lucene.NET 1.9 版本,可取去 Lucene.Net 下载。1. 基本应用using System;using System.Collections.Generic;using System.Text;using Lucene.Net;using Lucene.Net.Analysis;using Lucene.Net.An

西洋樱草的专栏 2164
上一篇: Lucene.net源码浅读笔记(1) : Lucene.Net.Analysis
下一篇: Lucene.net常见功能实现知识汇总
kwklover
博客等级 码龄23年 36粉丝 48原创
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值