[ZZ]Internet上的图像检索技术

【计算机视觉】图像检索 目录一、图像检索基本概述二、基于Bag of words模型的图像检索(一)Bag of words模型简介1、Bag of words模型2、Bag of words模型在计算机视觉中的应用(二)Bag of features算法1、Bag of features算法基础流程2、补充:K-means算法2.1 K-means算法简介2.2 K-means算法基本步骤三、实验代码及结果 一、图... 阅读详情


随着网上图像信息的急剧膨胀,对这一部分信息的检索给传统的检索理论带来了挑战。由于图像不同于文本,文本本身就可以说明所讲的内容,而图像则需要靠人们各自的理解来说明其蕴义,因此图像检索比起文本的查询和匹配要困难得多。

  目前,网上图像信息的检索技术大致可分为两大部分,一是基于整个网络的图像搜索引擎的检索技术,再就是主要基于图像数据库的各种图像检索系统。二者从不同的角度出发检索图像信息。比较而言,后者的技术更为成熟,前者由于要求反映信息快速、全面、覆盖面广,因而技术相对粗糙些。并且前者越来越倾向于与后者的检索技术相结合。

  一.  图像搜索引擎的检索技术

  近年来随着用户对网上图像搜索要求的不断增长,各种基于web的图像搜索引擎应运而生,它们各自以不同的工作方式为用户提供各种检索途径,使网上图像信息的搜索变得非常简单,尽管还不很完善,却已经可以满足用户的大多数要求。

  1.  工作原理

  WWW图像搜索引擎需要为在web上浏览过的图像建立索引信息,能够进行图像分析和判别,为图像加注释,存储抽取出的索引信息建立索引库,理想的图像搜索引擎还应该能支持基于内容的图像检索[1]。

  图像搜索引擎主要通过以下两种方法识别图像[2]: (1)自动查找图像文件 可以通过两个HTML标签,即IMG SRC和HREF来检测是否存在可显示的图像文件,IMG SRC表示"显示下面的图像文件",导向的是嵌入式图像;而HREF则表示"下面是一个链接",导向的是被链接的图像。搜索引擎通过检查文件扩展名来判断其导向的是否是图像文件。如果文件扩展名是.GIF或.JPG,即是一个可显示的图像。(2)人工干预找出图像并进行分类 由人工对网上的图像及站点进行选择。这种方法可以产生准确的查询体系,但劳动强度太大,限制处理图像的数量。

  2.  图像搜索引擎的检索途径

  目前图像搜索引擎大多支持关键词搜索和分类浏览两种检索方式,部分可提供可视属性检索,但也很有限。主要的检索途径有以下三种:

  (1)  关键词检索

  即基于图像外部信息或人工赋予的关键词进行自由词检索。图像的外部信息包括图像的文件名或目录名、路径名、链路、ALT标签以及图像周围的文本信息。基于这部分信息的检索是目前图像搜索引擎采用最多的方法。在找出图像文件后,图像搜索引擎通过查看文件名或路径名确定文件内容,但这取决于文件名或路径名的描述程度。也可以通过查看图像的标题来匹配检索词,但嵌入式或被链接的图像可能有也可能没有正规标题,即使存在正规标题,可能还是缺少让搜索引擎可识别的一致性标志,如带冒号的"photo"一类的词。但HTML的ALT标签可以起到图像标题的作用,它紧跟在IMG SRC标签后面。也可以查找网站或页面的标题,但这取决于其是否准确描述了该站点的内容,而这几乎是不可能的,所以只是偶尔起作用[2]。

  有些图像搜索引擎采用人工对图像的内容(如物体、背景、构成、颜色等)进行描述并分类,给出标引词,检索时,主要在这些标引词中搜索用户的检索词。这种查询方式比较准确,可以获得较好的查准率。但需人工参与,劳动强度大,因而限制了可处理的图像数量,并且需要一定的规范和标准,效果取决于人工描述的精确度。

  (2)  分类目录浏览方式

  图像搜索引擎将采集到的图像或通过某种自动机制或采用人工进行分类标引,为用户提供按主题浏览的检索方式。适用于检索目标不明确或以一般浏览为目的的用户。如WebSEEK提供了含有16个大类77个小类的极为丰富的类目体系,Yahoo!的Image Surfer的类目体系虽只包括几个流行主题,但对类目的划分比较深入,含有6个大类14个二级类以及更多的三级类,每个类目下的图像从几个到几百个不等。

  (3)  基于图像可视属性的检索

  又称为基于图像内容(content-based)的检索。由图像分析软件自动抽取图像的颜色、形状、纹理等特征,建立特征索引库,用户只需将要查找的图像的大致特征描述出来,就可以找出与之具有相近特征的图像。这是一种基于图像固有属性的机械匹配,特别适用于检索目标明确的查询要求(例如对商标的检索),产生的结果也比较准确。目前这种较成熟的检索技术主要应用于图像数据库的检索,在基于web的图像搜索引擎中应用这种检索技术虽还具有一定的困难,但已有部分图像搜索引擎进行了尝试,如Yahoo、WebSEEK就提供了基于图像的形状或颜色直方图的粗陋的可视检索功能。本文的第二部分将具体讨论这种检索技术在图像检索软件中的应用。

  3.  具代表性的几个图像搜索引擎简介[2]

  (1) .Scour(http://www.scour.com)[3][4]

  Scour成立于1998年,自称是第一个基于web的多媒体搜索引擎。虽严格讲,它并非是一个图像搜索引擎,但可以将检索限制在图像搜索上。

  它的工作原理是在文件名、路径名或ALT标签中搜索检索词。主要使用关键词检索,可以用"+"或"-"来增加或排除关键词,使用尽可能少的关键词会更有效。在高级检索中,可以将检索结果图像限制在GIF、BMP、JPEG等格式中。检索结果显示简图、图像类型(如GIF、BMP)、图像大小、最后被查找的日期、检索词的匹配数量、标引使用的关键词、成功下载的可靠程度等,并同时给出图像文件的URL和源站点的URL。

  主要缺陷是标引深度不足,查准率较低,但查全率较好。

  (2) .WebSEEK (http://disney.ctr.columbia.edu/webseek/)[5]

  WebSEEK是由哥伦比亚大学开发的一种实验性系统。采用代理自动搜索可视信息并对其进行分类,目前已分类的图像有66万多幅,形成了一个极富创新性的图像目录,主题分类是它的主要优点。

  WebSEEK的检索途径有三种,一是使用关键词进行自由全文检索,但不支持短语检索;二是利用不同的类目等级进行主题浏览;三是在检出图像的基础上利用其可视属性进一步检索。

  其检索结果显示为没有文本的简图及图像大小。单击简图可得到原图。每个简图下面提供三个链接,分别是:"col"-根据该图颜色在检出图像列表中搜索相关图像;"web"-在整个WebSEEK目录中根据该图颜色再次检索相近图像;"his"-通过手动调整该图像的颜色直方图进行另一新的检索。

  (3) .Amazing Picture Machine(http://www.ncrtec.org/picture.htm)[6]

  这是由NCRTEC组织开发的一个"真正人工建立的完全的关键词式索引"。 Amazing Picture Machine后面的教师负责选择图像丰富的站点,然后对每幅选定的图像内容进行描述,给出关键词。因此它的最大特点就是人工干预,关键词检索是主要的检索手段。

  Amazing Picture Machine的搜索结果将显示一个简短的标题、有关图像的说明(如彩色或黑白)、文件的大小、文件类型及象素多少等,但不显示简图。单击该标题可得到原图像,但需由该URL回溯才能找出源站点。

  由于人工干预检索过程,它的查准率极好,但这也限制了它的查全率。它的检索范围很有限,只包括web上人工选择的部分站点。

  (4) .Lycos (http://multimedia.lycos.com/)[7][8]

  图像搜索是Lycos 的多媒体检索功能之一,其搜索范围包括整个网络和一个内含80,000幅图像的图库供浏览和检索,并划分为主题目录。

  Lycos对所收录的图像进行了详尽的内容描述(description),并支持短语检索,从而使其查准率大大提高。它根据文件扩展名识别图像,在描述词、文件名、目录名或ALT字段中查询检索词。结果显示的信息极为丰富,包括简图、图像大小、最后检索日期、图像文件名、图像内容描述词、图像所在页面等。点击简图将得到原图及更多的信息,如著作权人和更多的相关图像。比较而言它的检索效果很好,速度也很快。



  二.  基于内容特征的图像检索系统

  从上面对图像搜索引擎的讨论中,我们可以看出,图像搜索引擎所实现的图像检索基本上是与文本搜索引擎类似的基于图像内容描述(description-based)的语义层次的匹配(例如通过关键词或自由词、分类目录)。因为许多情况下,用户习惯于通过概念来提交查询。概念查询的一种实现即是基于文本式的描述,用关键词、关键词逻辑组合或自然语言来表达查询的概念,这就是语义层次的匹配。但由于对图像的理解比文本更容易产生歧义,当语词不足以形象和准确地描述视觉感知时,用户就需要利用其所呈现的视觉特性来查询,例如利用颜色、纹理、形状等特征[9]。因此,就出现了基于图像本身固有属性(content-based)匹配的图像检索技术。

  1  基于内容的图像检索技术 [10]

  (1)  基于颜色特征的检索

  颜色特征是图像最直观而明显的特征,一般采用直方图来描述。颜色直方图是表示图像中颜色分布的一种方法,它的横轴表示颜色等级,纵轴表示在某一个颜色等级上具有该颜色的像素在整幅图像中所占的比例,直方图颜色空间中的每一个刻度表示了颜色空间中的一种颜色。采用直方图计算图像间的相似性比较简单,但它不能反映图像中对象的空间特征。

  (2)  基于纹理特征的检索

  图像可以看成是不同纹理区域的组合,纹理通常定义为图像的某种局部性质,或是对局部区域中像素之间关系的一种度量。纹理特征可用来对图像中的空间信息进行一定程度的定量描述。根据纹理特征进行检索主要考虑粗糙性、方向性和对比性三种特征。

  由于纹理描述比较困难,一般对纹理的检索都采用示例查询(Query By Example)方式。用户给出示例的全部或部分区域特征,从而找到类似图像。

  (3) 基 于形状特征的检索

  采用该特征进行检索时,用户通过勾勒图像的形状或轮廓,从图像库中检出形状类似的图像。基于此特征的检索方法有两种:(1)分割图像经过边缘提取后,得到目标图像的轮廓线,针对这种轮廓线进行的形状特征检索。(2)直接针对图形寻找适当的矢量特征用于检索算法。但处理这种结构化检索更为复杂,需做更多的预处理。

  2  基于内容特征的图像库检索引擎 [11]

  目前已有Virage、Excalibur和IBM公司开发出了基于图像内容相似性特征的图像库检索引擎,并在网上提供了演示站点。

  (1)  VIRAGE ( http://www.virage.com )

  VIRAGE公司的VIR(Visual Information Retrieval)图像引擎提供了四种可视属性检索(颜色、成分、纹理和形状)。每种属性被赋予0到10的权值。通过颜色特性检索是最简单明了的,该软件对选出的基础图像的色调、色彩以及饱合度进行分析,然后在图像库中查找与这些颜色属性最接近的图像。成分(composition)特性指相关颜色区域的近似程度。

  用户可以设定一个或多个属性权值来优化检索。要达到最佳平衡度需要反复试验,但检索过程是相当快的。在结果显示矩阵中可以选择查看3、6、9、12、15或18个简图。通过对四个属性权值的调整,显示出不同的检索结果。简图是根据相似度降序排列。点击简图标题将得到该图像的一些详细说明,包括Virage计算出的相似比。

  (2)  EXCALIBUR ( http://www.excalib.com )

  Visual RetrievalWare只是Excalbur提供的查询程序之一。在它的演示站点中提供了对其检索参数的综合设置的测试。Excalbur提供基于6种图像属性的检索,分别是颜色、形状、纹理、颜色结构、亮度结构和纵横比。颜色属性是对图像的颜色及其所占的比率进行测定,但并不包括对颜色的结构或位置的测定,这一项是由颜色结构属性控制的;形状属性指图像中物体的轮廓或线条的相对方位、弯曲度及对比度;纹理属性是指图像的平滑度或粗糙度,一幅图的表面特性;亮度属性是指构成图像的象素组合的亮度。这是一个非常有力的图像检索工具。

  每一个属性值范围从0到5。例如,主要以形状属性进行检索时,将形状属性的权值设为5,而将其它属性的权值设为0或1。不同的权值设定产生的结果不同。当主要用形状属性检索时,检出的结果可能看起来毫不相干,例如,用一幅意大利地图为示例图像会检出一幅GUCCI的靴子,因为它们的形状的确很相似。应该注意到,图像的形状相似性与该图像中的物体是什么没有关系。

  (3)  QBIC ( http://www.qbic.almaden.ibm.com )[12]

  QBIC(Query By Image Content)是由IBM公司著名的Almaden实验室开发的。它可能是目前应用最广的图像检索系统,如旧金山现代艺术博物馆以及法国文化部等机构。

  虽然QBIC只提供了3 种属性的检索功能:颜色属性、形状属性和纹理属性,但它的检索效率非常高。颜色特性的查询包括颜色百分比查询和颜色分布查询,利用颜色百分比查询,用户可以找到具有相似颜色及比率的图像,而利用颜色分布查询可进一步找到不仅颜色相似且颜色分布也相似的图像。纹理特性是对图像中线条的粗糙性、对比性、方向性三者的综合考虑。形状属性查询包括对象形状查询和轮廓查询。

  QBIC除了上面的基于内容特性的检索,还辅以文本查询手段。例如为旧金山现代艺术博物馆的每幅作品给予标准描述信息:作者、标题、日期,许多作品还有内容的自然描述。


  三. 目前图像检索技术研究的热点问题

  尽管各种图像搜索引擎为快速、大量地查找网上图像信息创造了条件,而基于内容特征的图像库检索技术亦为图像数据的检索从可视角度开辟了一条更为准确直观的途径,但仍存在一些有待研究的热点问题。

  1  两类图像检索技术的结合

  现有的图像搜索引擎主要侧重于对图像内容的语义描述,而图像库检索技术则侧重于图像内容的特征提取,二者虽侧重不同但却互相补充。如果能将二者结合起来取长补短,则网络的图像检索技术必有新的进展。已有的图像搜索引擎在信息的自动加工和标引方面都有待提高,需要开发出计算机自动识别和标引图像的算法和技术,以完善现有的检索功能,并与已有的成熟的图像库检索技术相结合,这是今后应该研究的一个课题。而且,图像库检索技术也应面向网络,利用网络技术进行改造,提供新的WWW访问界面代替原来的应用系统界面。同时将巨大的图像库资源利用网络实现共享。

  2  对基于内容编码技术的研究

  目前,国际上还没有通用的基于内容的编码标准。20世纪90年代初,国际上就开始了对基于内容的图像信息检索方面的研究。从基本的颜色检索,到综合利用多种图像特征进行检索,大量原型系统已经推出,其中,部分已投入到实际应用中以检验其有效性。同时,MPEG-7标准作为基于内容的多媒体编码标准也正在制定当中,即将成为国际标准中的一员。因此,应尽快对MPEG-7标准进行研究,分析其编码的实质,在此基础上进一步研究基于内容检索的系统,使我国基于内容的图像检索尽快走向实际应用阶段[9]。

  3  对用户查询接口的研究  

  这涉及到用户对图像内容的感知表达、交互方式的设计、用户如何形成并提交查询等方面。现代多媒体信息系统的一个重要特征就是信息获取过程的可交互性,人在系统中是主动的。除了提供示例和描绘查询基本接口之外,用户的查询接口应提供丰富的交互能力,使用户在主动的交互过程中表达对图像语义的感知,调整查询参数及其组合,最终获得满意的查询结果。用户的查询接口应该是直观易用的,底层的特征选择对用户是透明的。这里涉及到如何把用户的查询表达转换为可以执行检索的特征矢量,如何从交互过程中获取用户的内容感知,以便选择合适的检索特征等问题[9]。

  随着网上多媒体的广泛应用,对图像的检索需求将会越来越迫切。未来的图像检索技术将是网络技术和基于内容的图像库检索技术的结合。随着多媒体信息处理技术的日益发展和深化,图像信息的加工、处理和检索标准的出台,网上的图像检索技术将会日趋完善,而图像搜索引擎也将成为Internet上的新宠。
0116-图像检索 图像检索 1 传统图像检索 1.1 相似颜色检索 相似颜色检索的过程如下图所示: 1.1.1 颜色特征提取 首先是将一张图像描述成一个特征向量,在颜色直方图里面可以描述成一个256维度的特征向量,也可以使用K-means对图片Lab像素值进行聚类出颜色聚类直方图,从而转换为一个少维的颜色直方图,后者常用。 如果使用的特征向量,维度很大,所以会采用自编码器的机制来进行处理: 那么什么是自编码器呢,自编码器是如何学习的呢? 自编码器:是通过神经网络进行特征提取,提取出针对学习样本的通用特征降维方法。在神经网络 阅读详情

相关推荐

ASP.NET图像的检索技术毕业设计(源代码+论文+开题报告+外文翻译+文献综述+答辩PPT)

页面的信息是通过元数据的形式保存的,典型的元数据包括标题、IP地址、一个该页面的简要的介绍,关键字或者是索引短语、文件的大小和最后的更新的日期。而基于图像内容的检索主要是由图像分析软件自动抽取图像的颜色、形状、纹理等特征,建立特征索引库,其输入为用户要查找的图像的大致特征描述或示例,通过一定相似性匹配规则,输出为与之具有相近特征的图像,按相似程度排列,供用户选择,从而把在传统图像检索技术中一般用户难以完成的图像特征描述、提取与识别等难题,交由系统去解决。进行分类,由人工对网上的图像及站点进行选择。

2301_76992670的博客 278

Internet上的图像检索技术

http://chinaitpower.com/A/2001-05-11/159383.html  随着网上图像信息的急剧膨胀,对这一部分信息的检索给传统的检索理论带来了挑战。由于图像不同于文本,文本本身就可以说明所讲的内容,而图像则需要靠人们各自的理解来说明其蕴义,因此图像检索比起文本的查询和匹配要困难得多。   目前,网上图像信息的检索技术大致可分为两大部分,一是基于整个网络的图像搜索...

weixin_34071713的博客 331

文件上传漏洞攻击与防范方法

文件上传漏洞攻击与防范方法 文件上传漏洞简介: 文件上传漏洞是web安全中经常用到的一种漏洞形式。是对数据与代码分离原则的一种攻击。上传漏洞顾名思义,就是攻击者上传了一个可执行文件如木马,病毒,恶意脚本,WebShell等到服务器执行,并最终获得网站控制权限的高危漏洞。 文件上传漏洞危害: 上传漏洞与SQL注入或 XSS相比 , 其风险更大 , 如果 Web应用程序存在上传漏洞 , 攻击者上传...

m0_38103658的博客 4万+

计算机视觉:图像检索

基于BOW的图像检索

qq_51667621的博客 4478

图像检索技术简述

图像检索技术主要分为两类,一类是基于文本的图像检索(Text Based Image Retrieval),另一类是基于内容的图像检索(Content Based Image Retrieval) TBIR主要是利用文本标注的方式为图像添加关键词,比如物体、场景、尺寸等信息,检索图像时根据关键词检索想要的图像。这种方式实现起来简单,但是非常耗费人工(需要人为给每一张图像标注),对于大型数据库检索不太现实。此外,人工标注存在人为认知误差,对相同图像,人理解不一样,也到导致标注不一致,这使得基于文本的图像

qq_35912099的博客 6399

Office Tool Plus:正版Office干净部署指南

Office部署是Windows新机配置的关键环节,涉及版本选择、架构匹配、语言支持与合规激活等基础技术问题。其核心原理基于微软官方Office Deployment Tool(ODT)的声明式XML配置机制,通过标准化流程确保安装可复现、可审计、无第三方捆绑。技术价值在于规避官网安装器的版本锁定、架构误配和语言缺失等常见风险,提升部署稳定性与安全性。典型应用场景包括企业批量部署、IT运维标准化、隐私敏感型用户自主安装。本文以Office Tool Plus为实践载体,深入解析ODT底层逻辑、XML配置规范

701

新兴的Internet数据库

新兴的Internet数据库发布于:WWW.WFCN.Net  发布日期:2004-11-18  浏览次数:121数据库技术自20世纪60年代诞生以来,为计算机收集、存储、加工和利用数据提供了全面的支持,并起到了十分关键的作用,已经成为当今计算机信息系统的核心技术,是计算机技术和应用发展的基础。围绕着数据结构和模型的演变,传统数据库技术相继经历了网状数据库、层次数据库和现今的关系数据库3个阶段。但

keini的专栏 1433

GPS从入门到放弃(一) --- GPS基础原理

GPS从入门到放弃(一) — GPS基础原理 GPS,全称Global Positioning System,已经广泛应用于我们的日常生活中了,现在的智能手机 里都会自带GPS定位功能。这是一个美国的全球定位系统,虽然我们现在也有北斗了,但毕竟GPS搞的早,所以先从它开始研究起。 整个GPS系统分三大部分: 地面站 卫星 接收机 地面站负责监控。它们通过接收、测量各个卫星信号,计算卫星的运行轨...

tyst08的专栏 2万+

利用VB访问Internet

利用VB访问Internet 当前,有许多构造模块可以帮助用户创建名为超客户端(rich client)的Internet应用, 其中包括Visual Basic(以下简称VB)的ActiveX控件集合。它们可以提供SMTP和POP邮件服务、FTP、Newsgroup和Web访问等功能。另外,利用OLE也可以实现Web访问的自动化。本文向大家介绍这两种方法。 在应用

1413

在Internet Explorer 8中查找与内容相关的图像

Do you want an easy way to find images related to news stories or articles when browsing in Internet Explorer? Then you will definitely want to have a look at the Bing Image Search accelerator. 在Inte...

252

FPGA中参数化SPI接口设计与Verilog实现

SPI(串行外设接口)作为嵌入式系统的核心通信协议,通过全双工、高速率特性在FPGA与Flash、ADC等外设交互中占据重要地位。参数化设计通过抽象时钟极性、数据位宽等可配置维度,采用分层架构实现硬件复用,显著提升开发效率。Verilog实现需重点处理跨时钟域同步和可配置帧结构,结合AXI总线集成与UVM验证方法学,可构建适应工业控制、物联网网关等场景的高可靠SPI解决方案。

ciya3282的博客 698

3大核心优势:Internet Archive Downloader如何优雅解决数字图书馆下载难题

Internet Archive Downloader是一款专业的浏览器扩展工具,专为从Internet Archive和HathiTrust数字图书馆高效下载电子书而设计。这款开源工具通过创新的流式处理技术,让用户能够轻松获取数字资源,彻底告别传统下载方法的低效与繁琐。 ## 🚀 为什么你需要这款数字图书馆下载器? 在数字时代,研究人员、学生和知识爱好者经常面临一个共同挑战:如何在有限的时

gitblog_00891的博客 361

hive sql每个用户的累积访问次数

我们有如下的用户访问数据 userId visitDate visitCount u01 2017/1/21 5 u02 2017/1/23 6 u03 2017/1/22 8 u04 2017/1/20 3 u01 2017/1/23 6 u01 2017/2/21 8 U02 2017/1/23 6 U01 2017/2/22 4 要求使用SQL...

weixin_39150719的博客 2956

Internet Archive下载器使用指南:高效获取数字图书馆资源

Internet Archive下载器是一款功能强大的浏览器扩展,能够帮助用户从Internet Archive和HathiTrust Digital Library等数字图书馆快速下载书籍资源。该工具支持多种输出格式和批量处理功能,让知识获取变得更加便捷高效。 ## 核心功能与优势 ### 多样化输出格式 支持将借阅的书籍转换为多种格式,满足不同使用场景: - 智能PDF生成:创建包含可搜索

gitblog_01109的博客 1067

盘点3本巨巨巨好发的期刊,十投九中,见刊快!检索稳定!

盘点3本巨巨巨好发的期刊,十投九中,见刊快!检索稳定!

leisigoyle的博客 2914

oracle两节点RAC,由于gipc导致某节点crs无法启动问题分析

两节点RAC,其中1 节点集群CRS无法启动。经过分析原因为2节点gipcd进程异常,导致节点之间无法正常通信,重启2节点gipcd.bin后问题得以恢复。 从现象来看,是 ora.crsd...

cuibaye0692的博客 3998

Internet的主要服务

Internet的最大优势就是拥有极其丰富的信息资源,为了使用户能够方便快捷地使用这些资源,它提供了各种各样的服务。简便、高效、廉价的通信手段,利用它用户可以和Internet上的任何一个用户交流信息。电子邮件是Internet提供的最基本的服务项目之一,它为广大用户提供了一种快速、万维网是Internet上一种基于超文本方式的信息查询服务系统,也是目前规模最大的。效的信息查询方法,Gopher将网上的所有信息组成在线的菜单系统。更重要的是它提供了对多媒体信息的支持,这使广大用户可以。

张丰麟的博客 1170

DAVIS前言:事件相机资料调研

Event-Camera 资料集锦 1. 官网资料 假设了你买了事件相机,就可以在以下几个链接了解相关的参数和gui界面安装,如果不喜欢gui界面安装,可以第2节,安装相关的源码驱动。 DVS/DAVIS产品说明 等相关产品的软硬件介绍。 iniVation DV教程文档 给出在不同平台下的dvs-gui界面,可按照其说明进行相应的操作。 另外,Neuromorphic vision com...

Ian的博客 4156

Motoko与Node.js构建高效嵌入向量存储检索系统

嵌入向量是机器学习和AI应用中的核心数据结构,通过深度学习模型将高维数据映射到低维空间,广泛应用于推荐系统和自然语言处理。其技术实现涉及高维浮点数据的存储优化和相似性检索,传统方案面临存储效率与查询性能的平衡难题。本文介绍的Motoko智能合约与Node.js分层架构,结合Internet Computer区块链的去中心化特性与近似最近邻算法,在保证数据安全性的同时显著提升检索效率。该方案特别适用于需要处理海量向量数据的场景,如电商个性化推荐和AIGC内容审核,通过PCA降维和分级缓存等优化手段,实现比传统

weixin_30550081的博客 580

Windows网络编程Internet Gopher了解下

  Gopher:中文译“地鼠”,是迪士尼卡通人物之一(谷佛)。      英文原义:The Internet Gopher Protocol   中文释义:(RFC-1436)网际Gopher协议   该系统是在明尼苏达大学设计,并以该校的运动队“金色地鼠”(俚语:“去找”)来命名。在时间上,比Internet还要早几年。它只支持文本,不支持图像。   Gopher是Internet上...

weixin_30257433的博客 174

C# WinForm 基于DirectShow.dll编写的程序,可边预览边保存视频,音频和图片

基于微软的DirectShow.dll的二次开发1.自动识别连接的摄像头跟麦克风且可以对其进行选择(默认选中第一个)2.可录制wmv和avi两种格式的视频并且都带有音频,avi可以录制的分辨率和帧数进行选择,wmv默认进行了淸晰度优化如不喜欢可去除代码中有相关提示3.可在预览点开之后进行拍照,也可边录制视频边拍照4.添加了视频和音频的压缩功能(酌情使用)这次二次开发发现C#对DirectShow的相关信息太少,这次做完也不敢藏私共享出来,还望大家指正

RAG技术解析:检索增强生成系统构建指南

检索增强生成(RAG)是结合信息检索与大语言模型(LLM)的前沿AI技术,通过动态获取外部知识库内容来增强模型生成能力。其核心技术原理包括稠密向量检索、语义相似度计算和上下文整合,能有效解决LLM的知识更新滞后与事实性错误问题。在工程实践中,RAG系统通常采用Milvus等向量数据库存储文档嵌入,结合GPT-4等大模型实现智能问答。典型应用场景包括技术文档问答、客户支持系统和专业领域知识库,其中关键实现环节涉及文档分块、向量化索引和提示词工程。现代RAG系统通过混合检索(结合BM25与向量检索)和结果重排序

weixin_34416649的博客 335

IDEA的使用指南

IDEA基于java的使用手册,可以最快速的上手,在使用中不断的丰富自己的使用技巧.

如何用浏览器扩展高效获取数字图书馆资源:Internet Archive下载器完全指南

你是否曾在Internet Archive和HathiTrust数字图书馆中遇到心仪的书籍却无法下载?面对珍贵的数字资源只能在线浏览,无法离线保存?这款开源的浏览器扩展工具正是为你量身打造的解决方案。它能够智能地将在线电子书转换为PDF文件,支持批量处理和多种格式输出,让数字图书馆的资源真正成为你的个人收藏。 ## 🎯 数字资源获取的三大痛点 在数字时代,我们面临着这样的困境:**数字图书馆

gitblog_01195的博客 810
上一篇: ctrl-shift-esc
下一篇: 基于像素的视频背景分割 VIBE
lcmssd
博客等级 码龄13年 20粉丝 255原创
评论
成就一亿技术人!
拼手气红包6.0元
还能输入1000个字符
 
 条评论被折叠 查看
添加红包

请填写红包祝福语或标题

个

红包个数最小为10个

元

红包金额最低5元

当前余额3.43元 前往充值 >
需支付:10.00元
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付元
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值