写点什么

Airbnb:用机器学习打响金融诈骗战

  • 2018-04-03
  • 本文字数:1756 字

    阅读完需:约 6 分钟

看新闻很累?看技术新闻更累?试试下载 InfoQ 手机客户端,每天上下班路上听新闻,有趣还有料!

Airbnb ,一家旅行房屋租赁网站,正在使用机器学习技术来打击金融诈骗。他们用“定向摩擦”打击退款诈骗,与此同时,尽可能将该机制对于正常顾客使用在线预订系统的负面影响降到最低。

诈骗检测对 Airbnb 团队非常关键,因为每晚大约有二百万人在分布于 191 个国家的 Airbnb 房源入住。这意味着他们全球性社区的快速发展很大程度上依赖于信任。他们打击诈骗的方法包括主动措施和被动支持。主动措施通常应用在交易前,并且通常在后台进行:利用机器学习、试验和分析,防止欺诈者在网站上使用偷来的信用卡。

David Press 是 Airbnb 的信任数据科学家,他介绍了 Airbnb 是如何利用机器学习技术来鉴别和阻止诈骗者,同时将对正常顾客的影响降到最低。

退款是他们诈骗检测项目的主要关注点。与所有线上交易相同,Airbnb 也会遇到试图用盗取的信用卡进行交易的诈骗犯。当真正的持卡人发现他们的卡被盗了,并注意到账单上未经授权的消费,信用卡公司会向商家发起退款要求,然后商家(Airbnb)把钱返给消费者。与其他公司不同的是,Airbnb 承担这些退款的全部损失,而且不会让房主承担经济责任。所以为了更好地保护这个社区,并且减少退款损失,Airbnb 致力于对诈骗交易的源头进行打击:阻止盗用信用卡在网站的使用。

有时候交易会被直接拒绝,但在大多数情况下,Airbnb 会给用户机会,看他们是否满足附加验证条件,称为“摩擦”。 ”摩擦“是用来阻止未授权用户的一种方法,但对于正常用户来说是很容易满足的。为了防止信用卡盗用,会触发不同类型的“摩擦”机制来证明用户是信用卡的真正持卡人,包括微授权(在信用卡上放置两个小的授权码,持卡人必须通过登录网上银行进行确认), 3-D 安全(允许信用卡公司通过密码或短信直接验证持卡人),账单证明(需要持卡人上传一份相关信用卡帐单复印件)。

Press 介绍了他们如何使用机器学习模型来触发针对诈骗犯的“摩擦“。他还概述了如何通过最小化三个不同场景的损失函数来选择 ML 模型的阈值:假阳性、假阴性和真阳性。

他们使用机器学习模型来检测诈骗交易,用过去的已证实为良好消费和欺诈消费的例子进行训练,模型的目标是预测订单属于诈骗订单的概率。和其他机器学习模型一样,训练的模型并不是完美的,所以他们也需要处理不同的场景:假阳性、假阴性和真阳性。

  • 假阳性是指正常交易得分超过阈值,被模型分类成金融诈骗。
  • 假阴性是指诈骗情况得分低于模型阈值,被判断为正常交易。
  • 真阳性是指模型正确识别诈骗行为,其得分高于阈值。

Press 还介绍了每一种情况给 Airbnb 带来的损失。如果他们错误地对正常用户使用了“摩擦”(假阳性)机制,他们需要承担一定的损失,因为信用良好的用户可能会选择不配合完成”摩擦“,放弃交易,然后不再使用 Airbnb,造成客户流失。

对于假阴性,总损失是通过将假阴性的事件个数(FN)乘以每个诈骗交易的成本(C)计算出来的:FN*C。Airbnb 要承担与退款相关的所有损失,所以总成本是诈骗犯所诈骗的全部金额,再加上与处理相关的杂项费用,以及信用卡日益增加的拒绝率。

最后,对于真阳性交易(诈骗行为),Airbnb 应用“摩擦”来防止诈骗犯使用 Airbnb。如果“摩擦”机制成功地阻止了诈骗交易,就不会造成损失。

Airbnb 通过利用过去的阳性(诈骗)和阴性(非诈骗)订单来训练模型,优化机器学习模型的阈值。由于诈骗案例十分少见,这是一个不平衡的分类问题,缺乏正向标签。他们用真阳性率和假阳性率来描述模型在不同的阈值下识别诈骗和正常交易的能力,然后利用取决于这些比率的损失函数来评估与每个阈值相关的总成本。

Airbnb 使用他们的实验报告框架(Experiment Reporting Framenwork)运行 A / B 测试,来衡量由于“摩擦”机制使用不当(假阳性)对正常用户造成的影响。他们把得分较低的用户(基本排除诈骗可能)放在对诈骗者采用“摩擦“机制同一个实验阶段。

在博客中,Press 还演示了一个模拟示例,对比了直接拒绝交易和应用“摩擦“机制之间的不同。

查看英文原文 Fighting Financial Fraud with Machine Learning at Airbnb


感谢冬雨对本文的审校。

给InfoQ 中文站投稿或者参与内容翻译工作,请邮件至 editors@cn.infoq.com 。也欢迎大家通过新浪微博( @InfoQ @丁晓昀),微信(微信号: InfoQChina )关注我们。

2018-04-03 19:001999
用户头像

发布了 52 篇内容, 共 32.0 次阅读, 收获喜欢 73 次。

关注

评论

发布
暂无评论
发现更多内容

面部表情识别在社交媒体中的应用

数据堂

TooKit助力开发者上云

华为云开发者联盟

云计算 后端 华为云 华为云开发者联盟 企业号 8 月 PK 榜

文件传输软件常见问题解决办法大全

镭速

文件传输软件

关于低代码解放程序员这件事儿

互联网工科生

低代码 可视化开发 企业级应用程序开发 JNPF

山东布谷网络科技详解直播打赏源码,让功能更灵活

山东布谷网络科技

App 直播源码

2023年-广州国际睡眠家居产品及睡眠展会

秋硕展览

简明易懂的介绍:Selenium是什么?

Liam

编程 测试 自动化测试 web开发 测试工具

推动多云管理平台发展的因素简单分析

行云管家

云计算 云管平台 上云

瓴羊Quick BI跻身Gartner魔力象限挑战者行列

夜雨微澜

软件开发项目文档清单(多套实际案例)

金陵老街

MES系统在机器人行业生产管理种的运用

万界星空科技

人工智能 机器人 MES系统 机器人自动化

袋鼠云数栈 DataOps 数据生产力实践,实现数据流程的自动化和规范化

袋鼠云数栈

DataOps

预设成功

FunTester

2023年广州国际智能窗帘及智能门窗遮阳展会

秋硕展览

智慧生活的下半场,从全屋智能4.0接入未来

这不科技

华为 鸿蒙系统

【智领信创】用友 U8 cloud &亚信科技 AntDB联合产品强势来袭,0元购活动惠及陕、鲁

亚信AntDB数据库

数据库 AntDB AntDB数据库 企业号 8 月 PK 榜

HA3 SQL样本实验:一种混合计算查询的全新样本解决方案

阿里技术

镭速-解析极速文件传输软件

镭速

文件传输软件 传输文件

文心一言 VS 讯飞星火 VS chatgpt (73)-- 算法导论7.1 4题

福大大架构师每日一题

福大大架构师每日一题

基于昇腾,安擎又双叒叕推新品!

科技热闻

企业如何挑选适合自己需求的文件传输软件

镭速

文件传输软件

超好用的数据可视化工具——Grafana

云原生应用市场

监控 数据 Grafana 告警

HarmonyOS系统级推送服务,打造消息通知新体验

HarmonyOS SDK

腾讯云ES:一站式配置,TKE容器日志采集与分析就是这么简单

腾讯云大数据

ES

龙蜥社区系统运维 MeetUp

乘云数字DataBuff

告别传统人肉运维,实现360°可观测!奇点云数据存算引擎DataKun R2.0发布

奇点云

产品发布 奇点云 数据安全引擎 数据存算引擎

如何优雅地处理RabbitMQ中的消息丢失

互联网工科生

RabbitMQ 消息系统 消息不丢失

Airbnb:用机器学习打响金融诈骗战_语言 & 开发_Srini Penchikala_InfoQ精选文章