阿里、蚂蚁、晟腾、中科加禾精彩分享 AI 基础设施洞见,现购票可享受 9 折优惠 |AICon 了解详情
写点什么

专访腾讯小知陈松坚:知识表示是 NLP 乃至 AI 发展的瓶颈

  • 2018-12-26
  • 本文字数:2702 字

    阅读完需:约 9 分钟

专访腾讯小知陈松坚:知识表示是NLP乃至AI发展的瓶颈

人工智能领域有这样一句名言:解决了 NLP 的难题,也就解决了 AI 领域 80%的问题。从对话机器人 Eliza 开始,人们就对“会说话的机器”出奇的着迷,随着人工智能技术的进步,越来越多的人投身自然语言处理(NLP)的研究中,为了开发出智能、易用的对话机器人而不懈努力着。


几个月前,AI 前线策划了一篇文章,题为《都说聊天机器人已死,为什么腾讯还要打造自己的智能客服?》,在这篇文章中,我们曾深入讨论过智能客服 / 问答产品和 NLP 技术的技术难点、解决思路、商业化落地的途径和未来发展,在极客邦科技主办的全球人工智能与机器学习技术大会:AICon 2018 上,我们有幸再次专访到腾讯数据平台部高级算法研究员陈松坚,除了对他本人的技术研发之路有了更深的了解,陈松坚也与我们分享了许多有关 NLP 发展瓶颈以及技术趋势的看法。

入坑 NLP,一不小心深耕十年

自然语言处理被称为人工智能皇冠上的明珠,为了它,无数研究人员为之辛勤钻研,陈松坚就是这其中的一员。2009 年,还是研究生的陈松坚选择了 NLP 作为自己的研究方向。为了这个选择,他与自己作了一番斗争。


从当时比较现实的角度看,算法或许更好就业,于是陈松坚选择了机器学习、NLP、计算机视觉、数据挖掘等几个方向作为备选。至于为什么最终选择 NLP,陈松坚说,主要是因为考虑自己当时对搜索引擎比较关注,尤其是智能搜索技术;而从理想的角度想,他说自己从小比较喜欢机器人,一直有个梦想开始建造自己的机器人系统,而 NLP 是其中的不可或缺的部分,于是也就自然地做出选择了。


兜兜转转过了十年,陈松坚也早已成长为一名专业的研发人员,但是手里的工作还是转回到了 NLP 相关的项目上来——即腾讯小知,他开玩笑的说:或许是内心的召唤让自己重回智能对话这个研究领域。

小知是如何炼成的?

对于大部分对话机器人的研究人员来说:人类是如何产生认知并且与外部进行交互是一个永恒的课题,对于陈松坚来说自然是不例外,他认为:深度学习的兴起使得语音和图像识别的错误率大大降低,感知的问题得到了很大程度的解决。但是认知的问题,目前可以说还没有本质上的进步,原因就是那个永恒的课题。



“语言是思维的外化,研究语言的理解和产生,就是想借此推动认知智能的发展。”陈松坚补充道:“当然这需要一个迭代的过程,也需要一个场景去实践和落实这些想法, 于是我们选择了智能客服这个商业场景,去打造企业服务中的智能问答服务,输出价值。”


陈松坚说,智能问答中有很多方面都可以进行深入研究。


比如,基础层可以做深度语义匹配模型核心组件的进一步优化,还有开发问答拒识模型,用于过滤当前问答库无法回答的问题;应用层可以做强化学习在多轮任务机器人的应用,主要用于进行对话策略的在线学习。据了解,目前小知团队已经成功开发了若干个特定任务的 demo,正在准备正式部署到线上使用。


说回陈松坚深度参与的腾讯小知项目。


小知是从去年 7 月开始启动研发的智能客服系统,经历 1 年多的核心功能打造,现已落地多个应用,日均回答百万量级。在之前的采访中,陈松坚曾说:小知目前落地在政务、零售、服务等多个行业,上线时间仅 2 个月,已落地了数套成熟行业解决方案,成长势头很好。


虽然长势喜人,但说起小知的成长历程,陈松坚还是发出了一声感叹:万事起头难。


他解释道,在小知刚起步的时候,团队里对深度匹配模型的经验较少,而又由于业务上线的进度比较紧迫,因此选择双线作战,一边开发基于传统机器学习模型(xgboost)的线上系统,另一边进行深度语义匹配模型的论文复现,调优和工程实践。


考虑到 SaaS 场景下用户能够提供的训练语料非常欠缺,陈松坚和团队因此特地引入了迁移学习的策略来对应解决语料不足的问题。事实证明这些安排和策略都取得不错的效果。


能够带领小知的算法团队,从零开始一步一步地建设这种面向行业的智能问答解决方案,让陈松坚倍感欣慰,一方面需要快速响应业务的需求,快速实现和上线新功能,切实解决客户提出的问题;另一方面又必须紧跟业界和学界最新的技术,并积极寻求实施落地的路径,陈松坚说,从个人角度来说,这是最有成就感的事情。


从业近十年,陈松坚也积累了大量的实践经验,在采访中他也毫不吝啬地将这些经验分享给了有同样困扰地开发者:


他认为对于开发者来说,首先,要尽早搞清楚业务的需求,不同行业的问答解决方案很可能会涉及到不同的技术点,而且不同的业务场景对准确率指标的要求也不一样,这个也会影响算法落地的侧重点。比如小知最早接入的公安行业,知识库就特别复杂,分支条件很多,因此需要大量使用知识图谱来补全 FAQ 机器人的问答死角。


第二,要注意测评数据集的准确构建,尤其是线上环境的测试数据的收集,需要保证线下实验能对齐模型在线上环境的效果。另外就是跟业务关联的评价体系的构建,这样才能朝着正确的方向,稳定地迭代优化。

NLP 如何突破瓶颈?

智能客服是非常综合的 AI 系统,几乎涉及 NLP 领域所有技术点,甚至还包括语音和图像的处理。但人们对技术往往短期期望过高,而长期期望过低。虽然近年来 NLP 应用,尤其是翻译,写作,对话机器人等,在模型增强和知识图谱建设完善的过程中,在特定的场景下,满足了大部分人的使用需求,但是,在陈松坚看了,NLP 仍有一些瓶颈问题需要解决。



他说:AI 领域目前解决的问题,使用的都是模式识别的方法。进一步解释的话,就是通过大量的训练数据去找到数据内里的模式,然后再应用到实际数据的识别上,比如说语音的识别,图像的识别等,对应的是感知智能。


而 NLP 问题往往需要更高级的方法,因为在语言理解中涉及到大量的上下文,而除了一般意义的语言上下文,更重要的是外部知识上下文。这对应的就是认知智能的范畴,即如何帮助机器人构建概念世界,并作用到 NLP 的处理过程中。


陈松坚比喻说:“我认为对知识表示的建模,是目前 NLP 乃至 AI 技术发展的瓶颈,如果是 NLP 是皇冠上的明珠,那知识表示就是其中最大的一颗。”


他解释道,目前的知识都是基于符号表示的,比如知识图谱是利用了图节点来表示概念,关联边来表示概念之间的关系,但总的来说还是一个符号系统,所以的操作还是符号的检索和匹配,而跟当前的深度神经网络模型没办法有机结合。


所以,他本人与研发团队思考的方向也是诸如:是否可以将所有概念和关系都利用深度学习技术向量化,以及如何将规则也使用模型表示等问题。


强化学习在多轮对话中的应用也是陈松坚重点关注的技术趋势,主要是在特定场景下进行对话策略的学习,例如订票订餐任务,商品推荐等。他认为,目前主流的任务机器人都是基于槽位填充的方法,对话策略主要基于事先约定的规则,不够灵活,而强化学习可以通过结合端到端模型来实现对话策略的灵活调整,并且能够实现在线学习,使得多轮对话模型可以持续优化。


公众号推荐:

跳进 AI 的奇妙世界,一起探索未来工作的新风貌!想要深入了解 AI 如何成为产业创新的新引擎?好奇哪些城市正成为 AI 人才的新磁场?《中国生成式 AI 开发者洞察 2024》由 InfoQ 研究中心精心打造,为你深度解锁生成式 AI 领域的最新开发者动态。无论你是资深研发者,还是对生成式 AI 充满好奇的新手,这份报告都是你不可错过的知识宝典。欢迎大家扫码关注「AI前线」公众号,回复「开发者洞察」领取。

2018-12-26 14:431920
用户头像
陈思 InfoQ编辑

发布了 576 篇内容, 共 262.4 次阅读, 收获喜欢 1293 次。

关注

评论 1 条评论

发布
暂无评论
发现更多内容

Wise 的平台工程 KPI 探索之旅

快乐非自愿限量之名

KPI 平台工程 wise

前端如何入门 Go 语言

高端章鱼哥

前端 Go 语言

2023-06-25:redis中什么是缓存穿透?该如何解决?

福大大架构师每日一题

redis 福大大架构师每日一题

实录分享 | Alluxio Operator一体化部署方案

Alluxio

分布式 operator Alluxio 大数据 开源 容器化部署

国外主机引领你的网站征服全球!

一只扑棱蛾子

国外主机

镭速——简单、快速、自动备份数据到云端

镭速

3DCAT实时云渲染助力上海市乡村振兴可视化平台,展现数字乡村的魅力

3DCAT实时渲染

云渲染 数字孪生实时云渲染

个推文案圈人模型助力TT语音智选人群,实现消息推送点击率提升120%

个推

消息推送 移动开发

浅谈全面预算在交通运输与物流行业的应用

用友BIP

全面预算

2023年度解决方案大奖花落用友,人才发展解决方案备受瞩目

用友BIP

数智人力

集团公司该如何构建信息化系统?

优秀

信息化系统

共建智能汽车数据管理方案 | 4.15 IoTDB X EMQ 主题 Meetup 回顾

Apache IoTDB

智能汽车 emq IoTDB

6 种方式读取 Springboot 的配置,老鸟都这么玩(原理+实战)

快乐非自愿限量之名

开发语言 spring-boot

AI+低代码:解密AI赋能,释放创新力量!

快乐非自愿限量之名

AI 低代码

强化学习从基础到进阶-常见问题和面试必知必答[5]::梯度策略、添加基线(baseline)、优势函数、动作分配合适的分数(credit)

汀丶人工智能

人工智能 深度学习 强化学习 6 月 优质更文活动

略施小计,拥有自己的GPT

高端章鱼哥

人工智能 GPT ChatGPT

阿里云EMAS超级App助力Agmo电动车超级应用程序发布

移动研发平台EMAS

阿里云 超级app解决方案

一文了解Java低代码开发平台

互联网工科生

Java 低代码 JNPF java低代码开发平台

SOFAStack 的下一个五年

SOFAStack

开源 SOFA 程序员 java

低代码应用搭建平台,基于低代码快速开发管理系统

互联网工科生

低代码 低代码开发 JNPF

强化学习从基础到进阶-案例与实践[5]:梯度策略、添加基线(baseline)、优势函数、动作分配合适的分数(credit)

汀丶人工智能

人工智能 深度学习 强化学习 6 月 优质更文活动

国企为什么要建设数智底座?

用友BIP

数智底座 Pass平台

智慧垃圾分类处理3D可视化系统

2D3D前端可视化开发

智慧环卫 智慧垃圾处理 智慧垃圾分类 智慧环保

EMQ & 明道云:零代码高效构建工业物联网设备管理平台

EMQ映云科技

IoT 工业物联网 明道云

深入理解并发编程艺术-内存模型篇

Java并发 内存模型 Java内存模型 多线程高并发 高并发编程

谷歌推出“能讲会听”的大语言模型 AudioPaLM,实现语音理解和生成

Zilliz

谷歌 AIGC 大语言模型

数字孪生城市革命!低代码开发平台引爆智慧未来

EquatorCoco

低代码 低代码开发 数字孪生城市

超越极限!80Gbps高速传输,让您的数据瞬间飞速传递

镭速

专访腾讯小知陈松坚:知识表示是NLP乃至AI发展的瓶颈_AI&大模型_陈思_InfoQ精选文章