写点什么

机器学习,像极了一场足球比赛

  • 2021-03-04
  • 本文字数:2047 字

    阅读完需:约 7 分钟

机器学习,像极了一场足球比赛

本文最初发表于 Towards Data Science 博客,经原作者 Renato Boemer 授权,InfoQ 中文站翻译并分享。


如果向没有技术背景的人解释清楚机器学习,可能有些难度。


如果你是一名专业数据科学家,你会经常被问到一个问题 —“你这个工作是干什么的?”如果向没有技术背景的人解释清楚这个问题,可能有些难度。


卡内基梅隆大学著名计算机科学家 Tom Mitchell 教授给机器学习下的定义是


“一种计算机程序,它从经验 E 中学习某些类别的任务 T 和性能指标 P,如果它在任务 T 中的性能(用 P 来衡量) 随着经验 E 而提高。”


坦率地说,在任何非正式对话中,引用这种专业性很强的定义可能很难让对话继续下去。


而作为一个数据科学家,又经常需要向非技术性的受众解释技术术语。因此,每当我发现自己在解释自己的工作时,我就用到了我的哲学老师曾经用到的同样的技巧:足球类比。即便人们不喜欢足球,他们也可以以某种方式把机器学习和足球运动及规则联系在一起。


但愿足球的比喻有助于你理解或向其他人解释机器学习。

球员(数据)


显然,没有球员,就没有足球赛。无论你是在温布利球场进行职业级别的球赛,还是在街上和朋友们一起踢球,这都不重要。没有球员,那些地方只是一个空旷的足球场和街道。


对于机器学习来说,数据就像球员,没有数据,一切都无从下手。不过,并非所有数据集都是相同的,就像球员一样,C 罗和梅西是伟大的球员,他们超越了人们对于一场精彩的足球比赛的期待。但如果让我上场的话,这就不可能了。因此,优秀的球员才会有出色的表现。


类似地,数据科学中也有一句名言:“垃圾进,垃圾出”。无论你的编程技术多么精湛,或者你的数学知识多么渊博,但如果没有有用的数据集,你的机器学习项目很可能会使你的团队失望。

足球经理(数据准备)


一支足球队的成功离不开足球经理。即便拥有挑选顶级球员的豪华条件,英格兰国家足球队自 1966 年以来也再没有赢得过世界杯。足球经理负责决定谁将参加世界杯。同时,他也负责为球员提供指导,指导日常训练。这个过程很花时间,如果不能很好地完成,球队就不能为下届冠军做好准备。


据一份研究报告称,约 80% 的数据科学家会做数据准备和数据清理。数据专业人员必须将他们的数据集转化为机器学习模型可以学习的格式(例如,将数据归一化,处理空白值等)。不论对于数据科学家还是足球专业人士,这些都不是最令人兴奋的事情。

足球战术(机器学习模型)


球队要想夺冠,就必须根据每个对手的情况改变战术。举例来说,如果美国国家足球队面对四届世界冠军德国国家足球队,他们很有可能建立一个强大的防守体系。若美国队对阵冰岛足球队,则可采用强攻策略,采用不同的进攻战术。因此,一支经过良好训练的球队,只要做到战术合理,那么在 90 分钟内,很有可能进球并取得胜利。


机器学习从业者必须根据给定的特定数据集和期望的结果来决定要应用哪种算法或模型。举例来说,机器学习专业人员根据问题来选择预测模型:分类模型是关于预测标签的,而回归模型是关于预测数量的。因此,熟知哪些规则和技术是项目成功的关键。如,K- 最近邻、逻辑回归、朴素贝叶斯分类器和随机森林是一些常用的机器学习模型。

足球设备(硬件和软件)


足球在不同位置需要不同的装备和训练。举例来说,只有门将才能用手触球。因此,他们需要(特殊的)手套和独特的体能训练,而其他人则需要来回奔跑 90 分钟,并尝试用额头进球得分。另外,拥有强大赞助商的团队可以雇佣营养师、医学专家甚至数据科学家来分析表现数据。归根结底,设备和独特的专业人才能够帮助一支球队在世界杯上获得成功。


类似地,要处理一个很小的数据集(1000 行×5 列)来创建一些图形,这些图形可以在标准笔记本电脑上使用 Microsoft Excel 生成,但如果要从多个服务器上提取数据并处理数百万行的数据,就需要特定的编程语言 Python 和具有非凡计算能力的高性能设备。



不同联盟(领域专长)


不管你走到哪儿,可能总会有人在踢足球,可能是孩子 / 成人,男人 / 女人,室内 / 业余,线上 / 户外或业余 / 职业等。这都不重要,总有人在玩。另外,你会遇到技术水平的巨大差异。


足球不会因为不同的技术水平和比赛类型而存在缺陷,这正是足球运动的多样性和包容性。每种技术水平或竞赛类型都可以满足某种特殊的需求。有些人喜欢在户外的草地上踢球,而另一些人则喜欢在网上与朋友一起踢球。这也没关系,这些人专攻某一种类型的足球。


机器学习就像足球一样。不同的专业人员在各自的领域拥有不同的专长和工作,例如,商业和企业领域(金融市场);学术和技术领域(在大学研究开发新算法)。

总结


当你正在成为机器学习专家时,你必然会向来自不同背景的人解释你的工作。这个简单有效的类比可以帮助你让他们更容易理解机器学习。关注受众对足球的普遍印象,并与机器学习建立易于记忆的联系。但愿现在,你有了一个有趣的类比,来比喻和通俗解释那些日常生活中的复杂话题。


作者介绍:


Renato Boemer,企业家,毕业于剑桥大学。爱好数据科学和人工智能。


原文链接:


https://towardsdatascience.com/machine-learning-is-like-football-e3e3ace8ce7a

2021-03-04 10:302213
用户头像
刘燕 InfoQ高级技术编辑

发布了 1123 篇内容, 共 605.3 次阅读, 收获喜欢 1982 次。

关注

评论

发布
暂无评论
发现更多内容

为什么要禁用不安全的HTTP请求方法?从安全整改实践谈起

coolion

nginx 前端 网络安全 HTTP

优秀团队的“双向奔赴”:新晋 Committer 的进化之路

Apache IoTDB

.NET Core 中如何实现缓存的预热?

不在线第一只蜗牛

.net spring 缓存

日志易SPL高效进阶:语法编辑器的妙用

日志易

编辑器 日志易SPL

SelectDB 实时分析性能突出,宝舵成本锐减与性能显著提升的双赢之旅

SelectDB

大数据 数据仓库 数据分析 电商 实时分析

直播预告:慢热的 MCP 终于火了;什么是 MCP,以及智能体通信协议的未来丨RTE Dev Talk

RTE开发者社区

ETL与ELT核心技术解析:如何选择最优数据集成方案

谷云科技RestCloud

数字化转型 ETL ELT 数据集成工具

AI搜索,难分胜负

趣解商业

百度 科技 AI搜索 腾讯元宝

大模型叙事下的百度智能云:比创新更重要的,是创新的扩散

Alter

直播预告 | PaperRaeding:基于深度强化学习的查询优化框架 FOSS

KaiwuDB

直播 数据库、 KaiwuDB

【每日学点HarmonyOS Next知识】swiper样式、日期选择、自定义弹窗键盘、文本组件换行、富文本适配

轻口味

HarmonyOS HarmonyOS NEXT

【每日学点HarmonyOS Next知识】span问题、组件标识属性、属性动画回调、图文混排、相对布局问题

轻口味

HarmonyOS HarmonyOS NEXT

[大厂实践] Pinterest Ray 基础设施实践

俞凡

人工智能 大厂实践

IEC新增滤波器材料透过率标准,三安方案推动全球产业链工艺革新

财见

SvelteKit 最新中文文档教程(1)—— 入门指南

冴羽

vue.js 前端 React Svelte SvelteKit

Easysearch 磁盘水位线注意事项

极限实验室

easysearch

网易伏羲人工智能实验室技术创新再突破!前馈捏脸等3篇论文入选CVPR 2025

网易伏羲

人工智能 论文 网易伏羲

macOS Sequoia 15.3.2 (24D81) Boot ISO 原版可引导镜像下载

sysin

macos

神州数码爱问学Beta版开放测试:本地部署大模型助力AIPC时代到来

编程猫

机器学习,像极了一场足球比赛_文化 & 方法_Renato Boemer_InfoQ精选文章