写点什么

计算资源分配不公引发内斗!LLaMA 核心作者流失大半,Meta AI 联合主管也已离职

  • 2023-09-07
    北京
  • 本文字数:2215 字

    阅读完需:约 7 分钟

大小:1.13M时长:06:35
计算资源分配不公引发内斗!LLaMA核心作者流失大半,Meta AI联合主管也已离职

计算资源上的内斗,导致 Meta AI 研究部门四分五裂。

 

随着 OpenAI 及其他科技巨头在 AI 领域取得突破,Meta 也正忙于发布自己的大语言模型,希望在这一新兴领域占得立足之地。日前,Meta 发布了大模型 LLaMALLaMA 2,作为 OpenAI 和 Anthropic 私有模型的开源替代,LLaMA 和 LLaMA 2 在市场上备受好评。但对大部分参与该项目的科学家和工程师来说,称赞来得太迟了。

 

作为一家由社交媒体巨头转向元宇宙技术研发的大厂,Meta 旗下的 AI 研究实验室 Fundamental AI Research (FAIR) 正面临内部危机。

Meta 公司因争抢计算资源发生内斗

 

据 The Information 近日报道,消息人士表示,Meta 参与 LLaMA 项目的人员大半都已辞职,原因是与公司另一个研究团队在计算资源上的内斗。此外,另一个与 LLaMA 相竞争的模型已被 Meta 放弃。

 

据悉,2022 年,来自美国的一支 FAIR 团队发布了 OPT-175B,这是一套拥有 1750 亿参数的模型。与此同时,常驻巴黎的另一支 FAIR 队伍则着手开发体量较小的 LLaMA 模型,并坚信其效率能够与更大模型相媲美。

 

但与 OPT 团队相比,巴黎团队所能获得的算力资源严重不足。随着运营体系内的分配纠纷不断升级,Meta 内部的紧张局势也是愈演愈烈。

 

2023 年 2 月,随着 FAIR 正式发布 LLaMA,矛盾和压力也终于逼近临界点。

 

此前一周,Meta AI 的联合主管兼巴黎分部负责人 Antoine Bordes 以工作过度和为了配合加州工作时间而筋疲力尽为由选择辞职。他的退出加剧了 Meta 美国和巴黎两支队伍间的分歧,最终闹到了势同水火的地步。为此,Meta 只得放弃了 OPT 模型,并要求双方团队的成员在 LLaMA 2 项目上共同合作。

 

公众对于 Meta 发布的 LLaMA 和 LLaMA 2 均表示赞赏,称它们为 OpenAI 和 Anthropic 的最先进模型提供了免费的开源替代方案。然而,市场上的一片好评并没能平息 FAIR 之内部分研究人员和工程师们的不满,其中不少人已经申请退出 Meta。

有限的计算资源该怎么分?

 

在生成式 AI 的训练过程中,需要使用大量的计算资源,Meta 这类科技巨头虽然比其它公司拥有更多的计算资源,但也是有限制的。

 

在部分员工看来,Meta 内部今日的紧张局面,早在 FAIR 确立开放 AI 研究的使命时就已埋下了祸根。世界各地的 FAIR 实验室争相开发各种项目,从改善磁共振成像到解析自然语言等。而在 ChatGPT 横空出世之后,新的难题更是压在每个 FAIR 人头上:如何在有限的资源下,将现有 AI 功能整合起来?

 

FAIR 部门负责人 Joelle Pineau 在接受 The Information 采访时坦言,Meta 内部的计算资源分配每月都需要由来自企业多个部门的领导班子重新议定

 

她承认,LLaMA 和其他团队在资源的具体分配上表现得“有点关系紧张”。Pineau 还强调,高层领导应当在各竞争项目间分配有限资源时努力权衡,尽量在保证顶尖人才的充分参与之外为各个研究方向提供充足的资源供应,而这显然并非易事。

 

Pineau 称,“我自己的大部分工作时间都花在了挽留和吸引优秀人才上,毕竟没有了这些出色的参与者,我什么都做不了。”

 

当然,爆发计算资源争夺的绝不只有 Meta 一家。随着生成式 AI 开发变得越来越复杂、资源密集度愈盛,不少科技巨头也开始感受到专用芯片不足、可调度资源有限的窘境。这个现实问题令 AI 研究人员的留存工作变得更加复杂。

大厂的 AI 人才痛:招人难,留人更难

 

今年以来,Meta 的 AI 人才流失严重。知情人士称,2 月发表的 LLaMA 论文的 14 名作者中,一半以上已经离开 Meta 司,其中几位加入了 AI 创业公司或其它大公司。这种外流不仅仅是人才上的损失,更是整个 AI 行业在局势持续紧张、资源限制日益加剧的现实之下表现出的自然态势。

 

Meta 内部的结构性变化更是令复杂现实雪上加霜。去年 11 月,Meta 宣布裁减约 13% 的员工,即 11000 个工作岗位,这是其历史上规模最大的一轮裁员。今年 2 月,Meta 成立了一支新团队,专注于为自家应用开发生成式 AI 技术。此举从已经捉襟见肘的研究人员队伍中又抽调走了几名生力军。

 

目前,Meta 公司仍在寻求理想结构、希望保持正常研发。想要保住这份竞争力,团队自身的敏捷运营和团队间的通力协作将至关重要。AI 人才之争在短时间内尚无平息的迹象, 而 Meta 只有想办法成功留存并吸引到研究人员,其作为技术大厂的资源优势才能真正转化为市场领先地位。

 

不只 Meta,谷歌近几年也流失了不少 AI 人才,Transformer 的八位作者甚至全部离开了谷歌。OpenAI 的日子也不好过,据量子比特统计,OpenAI 的 51 位研究人员中,有 16 位人才离开了 OpenAI,离职率高达三分之一;根据 AMiner 的统计,OpenAI 的 ChatGPT R&D 团队已经有 4 人离职。

 

留人难,招人也并不轻松。AI 大模型热潮使得 AI 人才成为各大公司的争抢对象,供需关系紧张。拉勾招聘发布的《2023 第一季度 AIGC 人才供需报告》显示,在 AI 抢人大战中,AIGC 人才岗位需求量在今年 3 月环比增加 42%。

 

美国知名求职网站 Indeed 数据显示,近几个月来,合乎 AI 要求的招聘职位急剧上升,尤其是中高级的 AI 人才供不应求,招聘薪资也不断攀升。另一家知名求职网站 Adzuna 数据也显示,6 月份美国有 760 万个空缺职位,而与 AI 相关的职位空缺已经上升至 169045 个,其中有 3575 个职位特别标注需要有 AIGC 的技能。

 

参考链接:

https://www.theinformation.com/articles/inside-metas-ai-drama-internal-feuds-over-compute-power

https://www.reddit.com/r/LocalLLaMA/comments/16b18tj/inside_metas_ai_drama_internal_feuds_over_compute/

2023-09-07 14:026891

评论

发布
暂无评论
发现更多内容

Data Guardian for Mac(数据加密保护工具)v7.6.9激活版

小玖_苹果Mac软件

Swift Publisher 5 for Mac(专业版面设计工具)v5.7.0直装版

小玖_苹果Mac软件

WebGL开发手术模拟系统的技术难点

北京木奇移动技术有限公司

软件外包公司 webgl开发 手术模拟

PullTube for Mac(在线视频下载器)v1.8.5.52中文激活版

小玖_苹果Mac软件

PowerPhotos for Mac(mac专用图片管理工具)v2.7.2直装版

小玖_苹果Mac软件

行政审批远程勘验管理系统(源码+文档+部署+讲解)

深圳亥时科技

2024 年度时序数据库 IoTDB 论文总结

Apache IoTDB

Topaz Photo AI for Mac(人工智能降噪软件)v3.4.3 激活版

小玖_苹果Mac软件

探析同济医院科研一体化平台建设(三):科研人才分层培养

ModelWhale

人工智能 大数据 医疗

【完全免费】开源零代码平台,敲敲云 v2.0 首版本发布

JEECG低代码

零代码 低代码平台 零代码平台

谜局剧本杀系统(源码+文档+部署+讲解)

深圳亥时科技

AirRadar for Mac(无线wifi搜索工具)v7.4.2激活版

小玖_苹果Mac软件

MacMagic for Mac(系统垃圾清理软件)v1.2.5激活版

小玖_苹果Mac软件

MacPilot for Mac(系统优化软件)v16.2激活版

小玖_苹果Mac软件

必看!人工智能通识课怎么上?解答你最关心这 6 个问题!(3)

ModelWhale

Python 人工智能 大数据

Eon Timer for Mac(好用的时间跟踪定时器)v2.9.15中文激活版

小玖_苹果Mac软件

必看!人工智能通识课怎么上?解答你最关心这 6 个问题!(2)

ModelWhale

人工智能 大数据 教改

转载:GaussDB TPOPS搭建流程

炸鸡配冰淇淋

GaussDB TPOPS

从企业级 RAG 到 AI Assistant,阿里云 Elasticsearch AI 搜索技术实践

阿里云大数据AI技术

elasticsearch 阿里云 Ops rag AI搜索

拼多多根据ID取商品详情原数据API接口的开发、运用与收益

科普小能手

数据挖掘 电商 API 接口 API 测试 拼多多API

商会信息化管理系统(源码+文档+部署+讲解)

深圳亥时科技

天谋科技获授 2024 小米 Vela 全球生态合作伙伴

Apache IoTDB

第81期 | GPTSecurity周报

云起无垠

解密人工智能:如何改变我们的工作与生活

天津汇柏科技有限公司

AI 人工智能

VMware ESXi 8.0U3c macOS Unlocker & OEM BIOS NVMe 驱动特殊定制版 (集成驱动版)

sysin

esxi

MES系统在肉制品加工行业解决方案

万界星空科技

mes 万界星空科技mes 食品MES 食品行业 肉制品加工

WebGL在医学领域的应用

北京木奇移动技术有限公司

医学影像 软件外包公司 webgl开发

触目惊心,部分行业POI减少超百万!2025年选址挖掘分析建议更新至2024年12月31日最新全国所有类别POI,共6721万个

Geek_f9782a

GIS POI数据

Scherlokk for Mac(文件搜索软件)v6.3.4激活版

小玖_苹果Mac软件

VMware ESXi 8.0U3c macOS Unlocker & OEM BIOS Huawei (华为) 定制版

sysin

esxi

必看!人工智能通识课怎么上?解答你最关心这 6 个问题!(1)

ModelWhale

人工智能 大数据 人工智能通识课

计算资源分配不公引发内斗!LLaMA核心作者流失大半,Meta AI联合主管也已离职_生成式 AI_凌敏_InfoQ精选文章