写点什么

阿里云企业 AI 搜索大模型关键技术优化实践 |QCon 北京

  • 2025-03-21
    北京
  • 本文字数:1744 字

    阅读完需:约 6 分钟

阿里云企业 AI 搜索大模型关键技术优化实践 |QCon北京

2025 年 4 月 10 - 12 日,QCon 全球软件开发大会将在北京召开,大会以 “智能融合,引领未来” 为主题,将汇聚各领域的技术先行者以及创新实践者,为行业发展拨云见日。


阿里云高级算法工程师姚舰航、徐光伟已确认出席并发表题为《阿里云企业 AI 搜索大模型关键技术优化实践》的主题分享。随着人工智能和深度学习的迅猛发展,大模型(Large Language Model)在自然语言处理、计算机视觉等领域取得了突破性的成果。这些进步促使搜索技术迎来了新的变革。传统搜索主要依赖于关键词匹配和预定义的规则,强调精确的相关性匹配。然而,AI 大模型的引入,使得搜索技术从关键词检索转向了语义理解,从单一模态走向了多模态融合,从确定性检索演变为基于相似度的智能检索。


本次演讲将聚焦于 AI 搜索大模型的关键技术应用,涵盖文本向量化、降维、重排序、NL2Search(自然语言到搜索)、文档解析与切片、问答大模型评测与微调、 Agentic RAG(检索增强生成)及客户专属大模型的最新进展。具体将结合实际业务场景和案例(如智能问答系统、文档搜索、人工智能助手等),深入阐述这些技术如何提升搜索的质量和效率,以及在实践中如何克服各种技术挑战。


姚舰航是浙江大学自动化控制专业硕士,毕业后一直从事搜广推算法研究与应用工作。涉及信息流推荐、商业化广告定向 DMP、OCPX 深度转化模型优化以及云上智能推荐等领域,具备丰富的 C 端和 B 端算法优化和实践经验。目前专注于企业级 AI 搜索方向,负责搜索专属大模型训练以及 Agentic RAG 能力建设。


徐光伟在搜索技术和 NLP 算法方向有十年以上的经验,共有 20 篇以上的顶会论文发表和 50 篇以上的专利,拿到 MS MARCO 和 TREC 2022 文档检索的冠军、NL2SQL 任务 BIRD 榜单的冠军。在 to B 业务方向有八年的经验,搜索云服务业务上推动了行业版算法效果超越竞品,创新地提出轻量化客户定制与多模态检索的产品功能持续迭代,赢得多个标杆客户的认可。


本次大会,两位讲师分享的详细演讲内容如下:


演讲提纲

  • AI 大模型在搜索领域的背景与趋势

  • 文本向量化与降维

  • 搜索结果的重排序模型

  • NL2Search:从自然语言到搜索

  • 基于大模型的语义切片

  • 大模型问答质量评测与微调

  • Agentic RAG 实践

  • 客户专属大模型训练探索

您认为,这样的技术在实践过程中有哪些痛点?

  • 文本向量化与降维:向量化可能导致高维数据难以处理,而降维可能导致信息丢失,影响搜索效果

  • 重排序算法:需要高效的算法以确保实时性,尤其是在大规模数据集上,但计算复杂度可能成为瓶颈

  • NL2Search(自然语言到搜索):构建高质量的自然语言处理模型需要大量标注数据,且模型的准确性对于搜索体验非常关键

  • 基于大模型的语义切片:切片语义完整度直接影响搜索结果的相关性

  • 大模型问答质量评测与微调:大模型问答缺乏全面且高精度的质量评测体系,大模型在 AI 搜索场景中仍存在幻觉、回答不完整、回答冗余等问题

  • Agentic RAG 实践:单轮 RAG 难以解答复杂问题(如多跳问题、聚合问题等)

  • 客户专属大模型训练:由于大模型缺乏客户专有域知识,对客户场景特有问题的理解不足,回答不专业

演讲亮点

  • 实际业务场景结合:通过智能问答系统和文档搜索案例,展示 AI 搜索技术如何在现实中应用,增强观众理解

  • 前沿技术进展:介绍 Agentic RAG 的最新进展,帮助听众了解技术的未来发展趋势

  • 技术问题与解决方案:不仅指出各项技术的实际痛点,还提供了相应的解决策略,使内容更加实用

  • 综合性讨论:涵盖从文本向量化到问答大模型的多个技术层面,提供全方位的知识视角

听众收益

  • 深入了解 AI 搜索大模型的核心技术和应用场景,掌握最新的行业动态和技术趋势

  • 学习如何将大模型技术应用于实际业务中,解决传统搜索难以应对的问题,提升系统的智能化水平

  • 开拓新的思路和方法,了解如何结合传统技术和大数据处理,实现高效的搜索解决方案

  • 了解当前领域的技术挑战,为未来在 AI 搜索领域的研究和实践提供指引


除此之外,本次大会还策划了多模态大模型及应用AI 驱动的工程生产力面向 AI 的研发基础设施不被 AI 取代的工程师大模型赋能 AIOps云成本优化Lakehouse 架构演进越挫越勇的大前端等专题,届时将有来自不同行业、不同领域、不同企业的 100+资深专家在 QCon 北京现场带来前沿技术洞察和一线实践经验。


现在报名即可以享受 9 折优惠,单张门票立省 680 元,详情可扫码或联系票务经理 18514549229 咨询。



2025-03-21 17:045894

评论

发布
暂无评论

2021年阿里高频Java面试题:分布式+中间件

爱好编程进阶

Java 程序员 后端开发

与众不同的企业,都有最棒的知识管理!

小炮

知识管理

2022年开发者时间报告

Geek_rze78a

3 个方法,教你提升程序员的自我价值

爱好编程进阶

Java 程序员 后端开发

网站开发进阶(四十九)由JS报“未结束的字符串常量”引发的思考

No Silver Bullet

作用域 5月月更 解析引擎

java内存模型之双重检查锁定与线程安全的延迟初始化

急需上岸的小谢

5月月更

C语言_数组的查找、替换、排序、拼接

DS小龙哥

5月月更

网站开发进阶(四十五)浅谈XML与HTML的区别

No Silver Bullet

html xml 5月月更

kubernetes下的Nginx加Tomcat三部曲之一:极速体验

程序员欣宸

Java tomcat Kubernetes 5月月更

SAP GUI 一些实用技巧分享

汪子熙

router 客户端 SAP GUI 5月月更

40个W年薪蚂蚁团队Java岗技术4面分享:HashMap+线程池

爱好编程进阶

Java 程序员 后端开发

[Python] 题集 ②

謓泽

5月月更

Flink CDC Meetup · Online,5.21 开讲!

Apache Flink

大数据 flink 编程 流计算 实时计算

【刷题第三天】无重复字符的最长字串

白日梦

5月月更

1024属于程序员的专属浪漫

爱好编程进阶

Java 程序员 后端开发

10个 解放双手的 IDEA 插件,少些冤枉代码

爱好编程进阶

Java 程序员 后端开发

【ICDE 2022】稀疏模型训练框架HybridBackend,单位成本下训练吞吐提升至5倍

阿里云大数据AI技术

深度学习 推荐系统 开源项目

33岁跳槽无路,濒临绝望受贵人指点,拼尽全力阿里offer在兜里

爱好编程进阶

Java 程序员 后端开发

算力免费,还奖钱,OpenI日常激励活动“我为开源打榜狂”来袭

OpenI启智社区

开源 我为开源打榜狂

六大应用场景解决方案重磅发布,华为开发者联盟助力开发者商业成功

最新动态

跨境电商中的秘密

Geek_e369a5

跨境电商 编程解决 跨境电商快速更新产品 多图AI融合 图片背景替换

2020java面试题-chukou-chengzhang

爱好编程进阶

Java 程序员 后端开发

OpenYurt 开源之夏开始申请啦

阿里巴巴云原生

阿里云 云原生 开源之夏

面试突击46:公平锁和非公平锁有什么区别?

王磊

Java 面试 java常见面试题

【校招/社招】面试字节,写了一份硬核简历!

小傅哥

Java 面试 小傅哥 招聘 简历

2个月成功逆袭!最新分享阿里(Java岗

爱好编程进阶

Java 程序员 后端开发

Apriori算法详解

爱好编程进阶

Java 程序员 后端开发

cdn日志文件导入mysql进行分析,核心用到 Python

梦想橡皮擦

5月月更

某小视频App v10.x 手机号加密算法分析

奋飞安全

android 移动安全

11-SpringSecurity:Session共享

爱好编程进阶

Java 程序员 后端开发

7-21 求前缀表达式的值 (25 分)(思路详解)

爱好编程进阶

Java 程序员 后端开发

阿里云企业 AI 搜索大模型关键技术优化实践 |QCon北京_阿里巴巴_QCon全球软件开发大会_InfoQ精选文章