写点什么

基于 Elasticsearch 创建企业 AI 搜索应用实践 |QCon 北京

  • 2025-03-23
    北京
  • 本文字数:1458 字

    阅读完需:约 5 分钟

基于 Elasticsearch 创建企业 AI 搜索应用实践 |QCon北京

2025 年 4 月 10 - 12 日,QCon 全球软件开发大会将在北京召开,大会以 “智能融合,引领未来” 为主题,将汇聚各领域的技术先行者以及创新实践者,为行业发展拨云见日。


Elastic 中国社区首席布道师刘晓国已确认出席并发表题为《基于 Elasticsearch 创建企业 AI 搜索应用实践》的主题分享。传统的词汇搜索不能满足当今时代的需求,特别是在这个智能的时代。当代企业针对搜索提出语义搜索,也就是根据文字的语义来进行搜索,而不是简单的词汇匹配。另外,我们也需要针对其它的数据类型,比如图片,语音及视频来进行搜索。


Elasticsearch 自 8.0 开始提供向量搜索(密集向量,稀疏向量)。它可以完美地解决文字语义搜索及多媒体数据的搜索。此外,向量搜索也并非完美,特别是针对文字搜索。我们可以使用混合搜索(词汇搜索,向量搜索)进行多路召回并对最终结果进行排名,这种方法可以提高搜索的精度及召回率。在人工智能发展的今天,结合大模型,使用 GenAI 可以让我们得到唯一的搜索答案,而不是传统的搜索引擎提供的多页面的搜索结果。由于企业数据或私有数据在每时每刻都在生成。大模型在缺乏上下文的情况下使用大模型来进行推理,在很多的时候会产生幻觉,因为这些知识不存在于大模型中。结合 Elasticsearch 的向量搜索技术针对企业数据或私有数据进行搜索,把搜索结果作为上下文提供给大模型,从而消除幻觉。这种技术也被称作为 RAG(检索增强生成)。本次演讲将详细介绍 Elasticsearch 的向量搜索技术及如何使用它进行 RAG 的应用开发。


刘晓国是新加坡国立大学硕士,西北工业大学本硕。曾就职于新加坡科技,康柏电脑,通用汽车,爱立信,诺基亚,Linaro 非营利组织 (Linux for ARM),Ubuntu,Vantiq 等企业。从事过嵌入式软件开发,电脑设计,手机软件设计,汽车电子,计算机操作系统,通信,云实时事件处理等行业。他在本次会议的详细演讲内容如下:


演讲提纲

1. 智能时代的搜索需求

  • 对语义搜索的需求,而不是简单的词汇匹配

  • 对多媒体数据的搜索,比如图片,声音及视频

  • 非结构化数据的搜索

  • 向量搜索带来的新的解决方案

2. Elasticsearch 向量搜索

  • 向量搜索原理

  • 向量搜索种类(密集向量,稀疏向量)

  • 混合搜索介绍(多路召回,综合评分)

3. RAG 实现

  • 如何使得大模型变得更聪明

  • RAG 的实现方法

4. Elasticsearch 在向量搜索上的最新进展

  • 硬件加速

  • 并行化

  • 标量量化

  • 搜索效率

  • 重新排名

  • Semantic text 字段

  • 推理 API

  • AI 生态

5. 使用 Elasticsearch 在企业搜索中的案例分享

  • 高级 RAG 案例分享


您认为,这样的技术在实践过程中有哪些痛点?

向量搜索需要大量的内存及计算能力,如果针对超大规模的数据进行向量搜索,存在成本上考虑。有时搜索的结果缺乏可解释性。如何结合传统的词汇搜索来实现更加精准的搜索的结果。如何使用大语言模型/人工智能来提高最终的搜索结果排名。在使用 GenAI 时,如何针对私有或者企业数据来规避幻觉。


演讲亮点

  • 使用 Elasticsearch 来针对企业进行大规模的商用、规避搜索幻觉

  • 结合大模型,使用混合搜索来得到更加精准的搜索结果


听众收益

  • 了解如何运行 Elasticsearch 来进行语义搜索

  • 了解如何结合大模型,针对企业数据进行 GenAI 搜索


除此之外,本次大会还策划了多模态大模型及应用AI 驱动的工程生产力面向 AI 的研发基础设施不被 AI 取代的工程师大模型赋能 AIOps云成本优化Lakehouse 架构演进越挫越勇的大前端等专题,届时将有来自不同行业、不同领域、不同企业的 100+资深专家在 QCon 北京现场带来前沿技术洞察和一线实践经验。


现在报名即可以享受 9 折优惠,单张门票立省 680 元,详情可扫码或联系票务经理 18514549229 咨询。



2025-03-23 09:034580

评论

发布
暂无评论

OSPF路由协议基本知识点大全

单点登录(SSO)

一个大红包

SSO 28天写作 单点登录 3月日更

四、查询

Kylin

读书笔记 数据库开发 分布式数据库mongodb 读书总结 3月日更

在一个操蛋(执行力极差)的团队工作是一种怎样的体验?

冰河

团队管理 程序人生 执行力 问题总结 团队成长

【回溯算法】组合总和升级版 ...

宫水三叶的刷题日记

面试 LeetCode 数据结构和算法

用户画像实践

Jackchang234987

什么是开放艺术?探讨融合区块链技术的新艺术范式

CECBC

2021最新腾讯面经分享:Java面试刷题PDF(17个专题 5000字解析)

比伯

Java 编程 程序员 架构 面试

mysql常用命令

Sakura

进程和nginx

一个大红包

28天写作 3月日更

容器 & 服务:K8s 与 Docker 应用集群 (二)

程序员架构进阶

Docker 持续集成 kubernete 服务化 3月日更

写作对我来说是什么?

lenka

产品经理 写作 3月日更

(28DW-S8-Day14) 数据孤岛

mtfelix

28天写作 数据孤岛

程序员成长第二十篇:刚晋升管理者,有哪些方面要注意?

石云升

程序员 28天写作 职场经验 管理经验 3月日更

表达的时代

ES_her0

28天写作 3月日更

需要对未知保持敬畏「Day 14」

道伟

搜狐三面:说说你是怎么解决MySQL死锁问题的!

Java架构师迁哥

融云CEO韩迎:飞信十年珍贵历练,做To B别有取巧的心思

融云 RongCloud

IM RTC 飞信

VMware Workstation

梅花鹿鹿

虚拟机

2021最新分享面试跳槽宝典:互联网大厂Java高级工程师核心面试498题(附解析)

比伯

Java 编程 程序员 架构 面试

翻译:《实用的Python编程》03_06_Design_discussion

codists

Python

LeetCode题解:309. 最佳买卖股票时机含冷冻期,动态规划,JavaScript,详细注释

Lee Chen

算法 大前端 LeetCode

方法论分享之:刻意练习,微小改进

boshi

方法论 经验分享 七日更

麻木得那么快应不应该——韦伯-费希纳定律

Justin

心理学 28天写作 游戏设计

女神节|深情告白季,程序员和他的浪漫

InfoQ写作社区官方

热门活动

JAVA学习心得

张鹤羽

28天写作 3月日更

震撼来袭!2021版全新版Java面试笔记现世,简直把所有Java知识面试题写出来了

Java 架构 面试

Wireshark数据包分析学习笔记Day2

穿过生命散发芬芳

Wireshark 数据包分析 3月日更

《经济学人》2021年3月6日刊精彩文章导读及资源下载

wbliu85

进程调度算法

鲁米

算法

政府区块链招投标市场活跃 “区块链+警务”等多元化领域成​方向

CECBC

基于 Elasticsearch 创建企业 AI 搜索应用实践 |QCon北京_AI&大模型_QCon全球软件开发大会_InfoQ精选文章