写点什么

Airbnb:用机器学习打响金融诈骗战

  • 2018-04-03
  • 本文字数:1756 字

    阅读完需:约 6 分钟

看新闻很累?看技术新闻更累?试试下载 InfoQ 手机客户端,每天上下班路上听新闻,有趣还有料!

Airbnb ,一家旅行房屋租赁网站,正在使用机器学习技术来打击金融诈骗。他们用“定向摩擦”打击退款诈骗,与此同时,尽可能将该机制对于正常顾客使用在线预订系统的负面影响降到最低。

诈骗检测对 Airbnb 团队非常关键,因为每晚大约有二百万人在分布于 191 个国家的 Airbnb 房源入住。这意味着他们全球性社区的快速发展很大程度上依赖于信任。他们打击诈骗的方法包括主动措施和被动支持。主动措施通常应用在交易前,并且通常在后台进行:利用机器学习、试验和分析,防止欺诈者在网站上使用偷来的信用卡。

David Press 是 Airbnb 的信任数据科学家,他介绍了 Airbnb 是如何利用机器学习技术来鉴别和阻止诈骗者,同时将对正常顾客的影响降到最低。

退款是他们诈骗检测项目的主要关注点。与所有线上交易相同,Airbnb 也会遇到试图用盗取的信用卡进行交易的诈骗犯。当真正的持卡人发现他们的卡被盗了,并注意到账单上未经授权的消费,信用卡公司会向商家发起退款要求,然后商家(Airbnb)把钱返给消费者。与其他公司不同的是,Airbnb 承担这些退款的全部损失,而且不会让房主承担经济责任。所以为了更好地保护这个社区,并且减少退款损失,Airbnb 致力于对诈骗交易的源头进行打击:阻止盗用信用卡在网站的使用。

有时候交易会被直接拒绝,但在大多数情况下,Airbnb 会给用户机会,看他们是否满足附加验证条件,称为“摩擦”。 ”摩擦“是用来阻止未授权用户的一种方法,但对于正常用户来说是很容易满足的。为了防止信用卡盗用,会触发不同类型的“摩擦”机制来证明用户是信用卡的真正持卡人,包括微授权(在信用卡上放置两个小的授权码,持卡人必须通过登录网上银行进行确认), 3-D 安全(允许信用卡公司通过密码或短信直接验证持卡人),账单证明(需要持卡人上传一份相关信用卡帐单复印件)。

Press 介绍了他们如何使用机器学习模型来触发针对诈骗犯的“摩擦“。他还概述了如何通过最小化三个不同场景的损失函数来选择 ML 模型的阈值:假阳性、假阴性和真阳性。

他们使用机器学习模型来检测诈骗交易,用过去的已证实为良好消费和欺诈消费的例子进行训练,模型的目标是预测订单属于诈骗订单的概率。和其他机器学习模型一样,训练的模型并不是完美的,所以他们也需要处理不同的场景:假阳性、假阴性和真阳性。

  • 假阳性是指正常交易得分超过阈值,被模型分类成金融诈骗。
  • 假阴性是指诈骗情况得分低于模型阈值,被判断为正常交易。
  • 真阳性是指模型正确识别诈骗行为,其得分高于阈值。

Press 还介绍了每一种情况给 Airbnb 带来的损失。如果他们错误地对正常用户使用了“摩擦”(假阳性)机制,他们需要承担一定的损失,因为信用良好的用户可能会选择不配合完成”摩擦“,放弃交易,然后不再使用 Airbnb,造成客户流失。

对于假阴性,总损失是通过将假阴性的事件个数(FN)乘以每个诈骗交易的成本(C)计算出来的:FN*C。Airbnb 要承担与退款相关的所有损失,所以总成本是诈骗犯所诈骗的全部金额,再加上与处理相关的杂项费用,以及信用卡日益增加的拒绝率。

最后,对于真阳性交易(诈骗行为),Airbnb 应用“摩擦”来防止诈骗犯使用 Airbnb。如果“摩擦”机制成功地阻止了诈骗交易,就不会造成损失。

Airbnb 通过利用过去的阳性(诈骗)和阴性(非诈骗)订单来训练模型,优化机器学习模型的阈值。由于诈骗案例十分少见,这是一个不平衡的分类问题,缺乏正向标签。他们用真阳性率和假阳性率来描述模型在不同的阈值下识别诈骗和正常交易的能力,然后利用取决于这些比率的损失函数来评估与每个阈值相关的总成本。

Airbnb 使用他们的实验报告框架(Experiment Reporting Framenwork)运行 A / B 测试,来衡量由于“摩擦”机制使用不当(假阳性)对正常用户造成的影响。他们把得分较低的用户(基本排除诈骗可能)放在对诈骗者采用“摩擦“机制同一个实验阶段。

在博客中,Press 还演示了一个模拟示例,对比了直接拒绝交易和应用“摩擦“机制之间的不同。

查看英文原文 Fighting Financial Fraud with Machine Learning at Airbnb


感谢冬雨对本文的审校。

给InfoQ 中文站投稿或者参与内容翻译工作,请邮件至 editors@cn.infoq.com 。也欢迎大家通过新浪微博( @InfoQ @丁晓昀),微信(微信号: InfoQChina )关注我们。

2018-04-03 19:001907
用户头像

发布了 52 篇内容, 共 31.4 次阅读, 收获喜欢 73 次。

关注

评论

发布
暂无评论
发现更多内容

几类主流的虚拟化技术

穿过生命散发芬芳

虚拟化技术 11月月更

【Python 基础学习】-数据类型

度假的小鱼

11月月更 Python数字类型

高效、安全,华为云会议开启云上办公新天地

IT科技苏辞

云上办公兴起,华为云桌面Workspace更靠谱

IT科技苏辞

统一移动办公门户,满足政企高效安全协作需求

BeeWorks

WorkPlus即时通讯APP,提供智能化、多场景的IM系统解决方案

BeeWorks

第三章热备份路由选择协议(HSRP)

初学者

网络 11月月更

华为云会议AI智能降噪3.0,可抑制200种噪声!

科技之光

明道云Sales Playbook开源版正式发布

明道云

第五章TCP/IP 网络在我们身边

初学者

网络 11月月更

HDC 2022 开发者主题演讲与技术分论坛干货分享(附课件)

HarmonyOS开发者

HarmonyOS

阿里云液冷技术荣获CDCC数据中心科技成果一等奖

云布道师

阿里云 基础设施建设

一发一存一消费,跟着p8大佬深入学习Java中间件技术及其应用开发

钟奕礼

Java 程序员 java面试 java编程

远程触发Jenkins的Pipeline任务

程序员欣宸

jenkins 11月月更 pipiline

有了 Protocol buffer 还是用 JSON

HoneyMoose

一文了解 Go 中的指针和结构体

陈明勇

Go golang 指针 结构体 11月月更

LigaAI X 猴子无限 | AIGC火了,人类又得到了什么?

LigaAI

分布式 大模型训练 研发协作平台 AIGC 大规模离散模型

完全解析大数据的高可用集群部署

好程序员IT教育

大数据

助力教育信创快速发展,统信软件与山东四所高校建立信创应用重点实验室

统信软件

软件 操作系统 教育 信创产业 教育新创

后台管理不可忽视,华为云会议最新支持管理员分权分域

秃头也爱科技

高标准企业级安全性,华为云会议为线上沟通保驾护航

爱科技的水月

Linux 文件与目录管理

芯动大师

创建资源文件 11月月更 Linux系统指令

跬智信息 (Kyligence) 荣获信创“大比武”重要奖项,坚持做大做实国产软件

Kyligence

数据库 数据分析 云平台技术

第四章TCP/IP网络层设备路由器

初学者

网络 11月月更

【Python 基础学习】-字符串

度假的小鱼

11月月更 Python字符串操作

案例 | 九科信息为某大型企业设计社保公积金自动缴存解决方案

九科Ninetech

普惠联接,让人类诗意地栖居在大地上

脑极体

2022-11-25:连续出现的数字。编写一个 SQL 查询,查找所有至少连续出现三次的数字。 答案是输出1,原因是1是唯一连续出现三次的数字。 DROP TABLE IF EXISTS logs;

福大大架构师每日一题

数据库 福大大

超详细图文保姆级教程:App开发新手入门(一)

YonBuilder低代码开发平台

开发者 App 新手入门

【Python 基础学习】-流程控制

度假的小鱼

11月月更 Python流程控制

支持向量机-探索核函数的优势和缺陷

烧灯续昼2002

Python 机器学习 算法 sklearn 11月月更

Airbnb:用机器学习打响金融诈骗战_语言 & 开发_Srini Penchikala_InfoQ精选文章