写点什么

轻松上手 UAI-Train,拍拍贷人脸识别算法优化效率提升 85.7%

  • 2019-11-11
  • 本文字数:1788 字

    阅读完需:约 6 分钟

轻松上手UAI-Train,拍拍贷人脸识别算法优化效率提升85.7%

“UAI-Train 平台可以让我们方便地在短时内使用大量的 GPU 资源,用较低的成本训练海量的数据集,提高算法模型迭代优化的效率。”

— 拍拍贷算法研究员 朱运

UAI-Train 是什么

UAI-Train 是面向 AI 训练任务的大规模分布式计算平台,基于 P40、V100 等 GPU 云主机集群,通过分布式扩展,最高可实现 192TFlops 的单精度计算能力。提供一站式训练任务托管服务,可自动化解决计算节点调度、训练环境准备、数据上传下载以及任务容灾等问题,并支持按需收费、成本可控,无需担心资源浪费。在视频图像识别、自然语言处理、语音处理等领域均已有诸多实践。

拍拍贷接入 UAI-Train 的效果

通过使用分布式 GPU 训练平台,700W 人脸数据的模型训练所需时长可从原先的一周缩短至一天,整体算法优化效率提升 85.7%,相应的迭代频率也提高数倍,为更深层次的模型结构试验提供了可能。同时 UAI-Train 平台备有大量 GPU 资源,拍拍贷的算法工程师可以同时探索多种算法模型结构,极大缩短初期算法结构探索的时间。最重要的是 UAI-Train 平台具备按需收费的特性,拍拍贷人脸识别算法的 GPU 资源成本可由原先的上万元/月,下降至数千元/月,GPU 资源的有效利用率也达到了 100%。



表:UAI-Train 与购买 GPU 资源的特性对比

关于拍拍贷

拍拍贷是一家行业领先的金融科技公司,同时也是一家非常注重技术驱动、强调自主研发的高科技公司。一直以来非常重视 AI 技术的探索和应用,涉及到计算机视觉、语音分析和建模、自然语言处理、复杂网络分析等针对特定非结构化数据的领域,并将迁移学习、主动学习、强化学习、多任务学习、在线学习、非监督半监督等各种机器学习算法应用至多种业务场景。尤其是人脸识别、OCR、不良中介识别和欺诈团伙挖掘、智能对话机器人、社交文本挖掘等项目,在实际的业务实践中取得了不俗的效果,极大地提升了风险反欺诈水平和运营效率。

人脸识别

人脸识别是拍拍贷 AI 技术的一个重要研究方向,它通过算法识别人的脸部特征,从而可以做到实时地从图片或者视频流中检测和追踪特定的人。


目前拍拍贷自研人脸识别算法,在 700W 规模多年龄段、多姿态、多表情、多环境的人脸图片上进行训练。通过尝试不同的网络结构,包含 Inception-v3、优化后的 resnet 等,以及多种损失函数,例如 triplet_loss、sphere、cosine、arc_loss 等来优化人脸识别算法,从而提升 1:1 人脸认证、1:N 人脸搜索、N:N 人脸交叉比对、人脸聚类等场景的识别精度,并将此类技术应用于拍拍贷的风险监控、反欺诈等业务,并发挥了重要作用。



图:人脸识别业务场景

面临的问题

算法人员在优化人脸识别算法的过程中发现使用单台 GPU 机器迭代一次算法需要一周左右的时间,效率过低影响研发进度,但是采购更多的 GPU 机器来探索不同算法会导致资源成本线性增长;此外由于算法调优工作涉及诸多研究内容,例如算法效果分析、新算法调研、开发等,实际的资源使用率不高。

接触 UAI-Train

在一次线下技术交流活动中,拍拍贷技术人员了解到 UCloud 提供一种面向人工智能算法训练的 UAI-Train 平台,并支持 GPU 资源的按需租售服务,同时该平台上还可执行多机多卡的分布式训练任务。


为了提升模型训练的效率,充分高效地利用更多的新数据来进一步提高其准确率,拍拍贷抉择后选择尝试 UAI-Train 平台。UCloud AI 团队在 GitHub 上发布了适配 UAI-Train 平台的 Insightface 开发案例,用于协助拍拍贷的算法工程师很方便地将单机的人脸识别算法转化成支持分布式训练的人脸识别算法,并成功在 UAI-Train 平台上进行算法的快速优化。


Insightface 是 GitHub 上一个基于 MXNet 框架的开源人脸识别项目。UCloud 基于 insightface 开发了一整套能支持分布式训练的人脸识别训练和在线推理的案例代码,并发布在GitHub上,其中包括基于 MXNet 框架的代码及开发案例。拍拍贷的工程师基于该案例,结合自身人脸识别算法的实现和数据,一周时间内就完成了开发和调试,并顺利在 UAI-Train 平台上逐步展开人脸识别算法的训练迭代工作。



图:人脸识别算法接入过程


在多次算法优化迭代尝试后,拍拍贷通过利用高维向量表征人脸,余弦距离表达相似度,最终在开源测试集准确率表现为:lfw 99.8%, cfp_fp 97%, agedb_30 98.2% ,实际业务应用中的准确率高达 99%以上,进一步提升了风险监管、反欺诈等业务的效率。


本文转载自公众号 UCloud 技术(ID:ucloud_tech)。


原文链接:


https://mp.weixin.qq.com/s/I1Ts8R4_vHCTB6kOWNo3yQ


2019-11-11 10:391045

评论

发布
暂无评论
发现更多内容

大数据培训学习包含java技术吗

小谷哥

武汉前端开发培训哪家比较好

小谷哥

StoneDB 源码解读系列|Tianmu 引擎工具类模块源码详解(一)

StoneDB

数据库 开源 HTAP StoneDB 企业号 2 月 PK 榜

VOP消息仓库演进之路|如何设计一个亿级企业消息平台

京东科技开发者

软件架构 平台 VOP 客户调用 消息仓库

新春发版,大展宏“兔”:StoneDB-5.7-V1.0.2 版本正式发布!两分钟快速部署安装您的分析加速器~

StoneDB

开源 数据库· StoneDB 企业号 2 月 PK 榜

产品价值“三省”

QualityFocus

基于Web的6个完美3D图形WebGL库

2D3D前端可视化开发

前端开发 WebGL webgl库 3d图形库 webgl框架

Web、移动端、桌面端自动化测试工具或框架推荐

软件测试 自动化测试 自动化框架

恭喜! SelectDB 五位开发者成为 Apache Doris 新晋 PMC 成员和 Committer!

SelectDB

数据湖 Doris 程序猿 ;开源 企业号 2 月 PK 榜

实践指南|如何在 Jina 中使用 OpenTelemetry 进行应用程序的监控和跟踪

Jina AI

Python 微服务 PyTorch 云技术 OpenTelemetry

使用Python+Opencv从摄像头逐帧读取图片保存在本地

Python 数据读取 摄像头

Linux中Sl命令的使用

Linux 操作系统 命令

敏捷管理到底有没有捷径可走?

Onegun

开源 将本增效 敏捷迭代

「 Java基础-泛型 」一文说清Java泛型中的通配符T、E、K、V、N、?和Object的区别和含义

小刘学编程

Java 源码阅读 Java泛型 构架师

F5 2022财年安全营收10亿美金 服务应用安全做了哪些事?

F5 Inc

移动应用 安全 应用安全

大数据开发培训中心有哪些

小谷哥

保险行业需要一个安全的大数据传输

镭速

JuiceFS 在火山引擎边缘计算的应用实践

火山引擎边缘云

边缘计算 存储 JuiceFS 火山引擎 渲染

小游戏也能脱离微信运行到自己的app中

Onegun

微信小程序 小游戏 小游戏开发 微信小程序-游戏

MQTT发布/订阅模式介绍

EMQ映云科技

物联网 IoT mqtt 客户端 企业号 2 月 PK 榜

业务“兔”飞猛进,只因他们做对了这件事

华为云开发者联盟

数据库 华为云 企业号 2 月 PK 榜 华为云开发者联盟

Python读execl之xlrd库函数详解一:工作簿相关

Python Excel 数据读取

西安java培训班哪家好?

小谷哥

通过案例理解MQTT主题与通配符

EMQ映云科技

物联网 IoT mqtt 企业号 2 月 PK 榜 通配符

API+DevOps:华为云API Arts一体化平台,端到端呵护您的API

API

重磅!GitLab 提出五大预测,洞见 2023 年 DevSecOps 发展趋势

极狐GitLab

DevOps 安全 DevSecOps 安全左移 供应链安全

HummerRisk V0.9.1:操作审计增加百度云、增加主机检测规则等

HummerCloud

云安全 云原生安全

Python读写txt文本(示例说明)

Python 数据读取 txt

前端开发哪家培训机构教的好

小谷哥

嵌入式ARM设计编程(三) 处理器工作模式

timerring

arm

轻松上手UAI-Train,拍拍贷人脸识别算法优化效率提升85.7%_文化 & 方法_UCloud技术_InfoQ精选文章