2025上半年,最新 AI实践都在这!20+ 应用案例,任听一场议题就值回票价 了解详情
写点什么

基于 Elasticsearch 创建企业 AI 搜索应用实践 |QCon 北京

  • 2025-03-23
    北京
  • 本文字数:1458 字

    阅读完需:约 5 分钟

基于 Elasticsearch 创建企业 AI 搜索应用实践 |QCon北京

2025 年 4 月 10 - 12 日,QCon 全球软件开发大会将在北京召开,大会以 “智能融合,引领未来” 为主题,将汇聚各领域的技术先行者以及创新实践者,为行业发展拨云见日。


Elastic 中国社区首席布道师刘晓国已确认出席并发表题为《基于 Elasticsearch 创建企业 AI 搜索应用实践》的主题分享。传统的词汇搜索不能满足当今时代的需求,特别是在这个智能的时代。当代企业针对搜索提出语义搜索,也就是根据文字的语义来进行搜索,而不是简单的词汇匹配。另外,我们也需要针对其它的数据类型,比如图片,语音及视频来进行搜索。


Elasticsearch 自 8.0 开始提供向量搜索(密集向量,稀疏向量)。它可以完美地解决文字语义搜索及多媒体数据的搜索。此外,向量搜索也并非完美,特别是针对文字搜索。我们可以使用混合搜索(词汇搜索,向量搜索)进行多路召回并对最终结果进行排名,这种方法可以提高搜索的精度及召回率。在人工智能发展的今天,结合大模型,使用 GenAI 可以让我们得到唯一的搜索答案,而不是传统的搜索引擎提供的多页面的搜索结果。由于企业数据或私有数据在每时每刻都在生成。大模型在缺乏上下文的情况下使用大模型来进行推理,在很多的时候会产生幻觉,因为这些知识不存在于大模型中。结合 Elasticsearch 的向量搜索技术针对企业数据或私有数据进行搜索,把搜索结果作为上下文提供给大模型,从而消除幻觉。这种技术也被称作为 RAG(检索增强生成)。本次演讲将详细介绍 Elasticsearch 的向量搜索技术及如何使用它进行 RAG 的应用开发。


刘晓国是新加坡国立大学硕士,西北工业大学本硕。曾就职于新加坡科技,康柏电脑,通用汽车,爱立信,诺基亚,Linaro 非营利组织 (Linux for ARM),Ubuntu,Vantiq 等企业。从事过嵌入式软件开发,电脑设计,手机软件设计,汽车电子,计算机操作系统,通信,云实时事件处理等行业。他在本次会议的详细演讲内容如下:


演讲提纲

1. 智能时代的搜索需求

  • 对语义搜索的需求,而不是简单的词汇匹配

  • 对多媒体数据的搜索,比如图片,声音及视频

  • 非结构化数据的搜索

  • 向量搜索带来的新的解决方案

2. Elasticsearch 向量搜索

  • 向量搜索原理

  • 向量搜索种类(密集向量,稀疏向量)

  • 混合搜索介绍(多路召回,综合评分)

3. RAG 实现

  • 如何使得大模型变得更聪明

  • RAG 的实现方法

4. Elasticsearch 在向量搜索上的最新进展

  • 硬件加速

  • 并行化

  • 标量量化

  • 搜索效率

  • 重新排名

  • Semantic text 字段

  • 推理 API

  • AI 生态

5. 使用 Elasticsearch 在企业搜索中的案例分享

  • 高级 RAG 案例分享


您认为,这样的技术在实践过程中有哪些痛点?

向量搜索需要大量的内存及计算能力,如果针对超大规模的数据进行向量搜索,存在成本上考虑。有时搜索的结果缺乏可解释性。如何结合传统的词汇搜索来实现更加精准的搜索的结果。如何使用大语言模型/人工智能来提高最终的搜索结果排名。在使用 GenAI 时,如何针对私有或者企业数据来规避幻觉。


演讲亮点

  • 使用 Elasticsearch 来针对企业进行大规模的商用、规避搜索幻觉

  • 结合大模型,使用混合搜索来得到更加精准的搜索结果


听众收益

  • 了解如何运行 Elasticsearch 来进行语义搜索

  • 了解如何结合大模型,针对企业数据进行 GenAI 搜索


除此之外,本次大会还策划了多模态大模型及应用AI 驱动的工程生产力面向 AI 的研发基础设施不被 AI 取代的工程师大模型赋能 AIOps云成本优化Lakehouse 架构演进越挫越勇的大前端等专题,届时将有来自不同行业、不同领域、不同企业的 100+资深专家在 QCon 北京现场带来前沿技术洞察和一线实践经验。


现在报名即可以享受 9 折优惠,单张门票立省 680 元,详情可扫码或联系票务经理 18514549229 咨询。



2025-03-23 09:034311

评论

发布
暂无评论

2025世亚软博会(北京展)正式开启预定

AIOTE智博会

软件展会 软博会 世亚软博会 北京软博会

新业财税资档一体化:存量资产盘活就选用友BIP超级版

用友BIP

软件测试丨标准、高效的管理测试用例和活动

测试人

软件测试

事件管理革命:监控系统中统一日志和指标

Greptime 格睿科技

日志 时序数据库 指标

鸿蒙原生游戏再添力作!《蔚蓝档案》HarmonyOS NEXT版上架华为游戏中心

最新动态

出海正当时,亚马逊云科技深度赋能中国生物医药企业全球化战略

亚马逊云科技 (Amazon Web Services)

ColPali: 基于 PaliGemma-3B 和 ColBERT 策略的视觉检索器

吴脑的键客

人工智能 搜索算法

【教程】第三章:任务数据管理 —— 运筹帷幄,轻松上手

NocoBase

开源 低代码 教程 无代码

如何通过1688平台API接口搭建跨境电商独立站并实现商品采集与下单

代码忍者

API 接口 pinduoduo API

利用京东API接口实现商品详情数据获取与表格化展示

代码忍者

API 接口 pinduoduo API

落子全球,亚马逊云科技让中国企业出海“触手可及”

亚马逊云科技 (Amazon Web Services)

史上最严数据新规落地,出海企业应如何应对这把悬在头上的“达摩克利斯之剑”?

亚马逊云科技 (Amazon Web Services)

央国企“严选”!天翼云夺得IaaS+PaaS市场桂冠!

天翼云开发者社区

云计算 云服务 天翼云

Taro 鸿蒙技术内幕系列(二):如何让 W3C 标准的 CSS跑在鸿蒙上

京东零售技术

taro 鸿蒙 前端

为何选择向日葵IT精英版?打造高效独立的个人远程IT支持方案

科技热闻

极狐GitLab X 某清洁能源高科技企业,助力零碳技术开创更加美好的零碳世界

极狐GitLab

gitlab cicd geo

为什么说ERP系统在国内用不起来?

积木链小链

数字化转型 数字化 ERP

威睿第100万台电驱产品下线,全速迈上新能源驱动发展新台阶

科技热闻

舞台已就位!坐等AI玩家集结!

天翼云开发者社区

云计算 AI 天翼云

数字先锋| 小平台如何展现大智慧?快来一睹“遵”容!

天翼云开发者社区

云计算 云服务

Neo4j×Milvus:手把手教你搭建GraphRAG Agent

Zilliz

neo4j 图数据库 Milvus 向量数据库 GraphRAG Agent

干货来袭 | 博睿数据《2024IT运维最佳实践白皮书》请查收!

博睿数据

分析时序数据:如何从 InfluxQL 迁移到 SQL

Greptime 格睿科技

sql 时序数据库 InfluxQL

Netty 如何自动探测内存泄露的发生

不在线第一只蜗牛

Java 内存泄露 Netty

基于 Elasticsearch 创建企业 AI 搜索应用实践 |QCon北京_AI&大模型_QCon全球软件开发大会_InfoQ精选文章