写点什么

大模型智算与开发落地实践:释放 AI 潜力的关键技术与行业应用

  • 2024-12-02
    北京
  • 本文字数:1929 字

    阅读完需:约 6 分钟

大模型智算与开发落地实践:释放AI潜力的关键技术与行业应用

大模型服务已经成为推动各行各业创新的核心力量。为了充分释放大模型的潜力,智算基础设施的建设与大模型的研发成为了关键环节。大模型智算与开发并非仅仅局限于算法的优化与创新,如何构建高效的 AI 基础设施,如何优化训练与推理架构,如何在多个行业中实现大模型的成功落地,这些都是当前技术发展的核心问题。


12 月 13 日~14 日,2024 年度最后一场「AICon全球人工智能开发与应用大会」将在北京盛大开幕!大会特别策划了《大模型智算与开发落地实践》专题,聚焦于大模型服务背后的智算基础设施与基础大模型研发中的前沿技术与实践。

更多精彩议题可以点击链接查看大会日程:https://aicon.infoq.cn/202412/beijing/schedule


本专题的出品人为阿里云智能政企事业部大模型智算负责人 王浩 博士,负责政企 AI 大模型智算产品研发。曾任阿里巴巴达摩院人工智能实验室天猫精灵智能语音助手产品算法负责人。之前曾是 360 搜索首席科学家以及中国科学院教授,成果大多发表在人工智能国际顶级会议和期刊:KDD、NeurIPS、SIGIR、AAAI、IJCAI、WWW、ICDE、ACM MM、ECCV、ICCV、TOIS、TKDE、TPAMI、TIP 等。


精彩分享一

智谱 GLM 技术团队专注于面向通用人工智能(AGI)的基础模型研发,早在 2022 年就训练并开源了媲美 GPT-3 性能的中英双语预训练模型 GLM-130B,后续发布的 ChatGLM 开源模型系列在 Hugging Face 社区上获得了超过一千万的下载量;2024 年 8 月,GLM 团队发布的旗舰模型 GLM-4-Plus 在 9 月的 SuperBench 大模型评测中位列世界前三。


智谱这些模型展现出来的卓越性能离不开海量互联网数据和算力训练。与此同时,大语言模型的兴起给训练基础设施带来全新的挑战,包括对算力、大规模数据处理量、复杂的系统管理等需求。针对自身的特定需求,智谱从零开始构建了一套大模型原生的训练基础设施。针对大规模训练稳定性、多算力集群数据流转、平台易用性等进行了一些优化,大会上,智谱 AI GLM 模型预训练与基础设施负责人曾奥涵将通过《智谱大模型训练基础设施落地实践》演讲,分享智谱在大模型原生基础设施建设中的经验与实践。


精彩分享二

模型量化通过降低权重精度减少计算量与内存占用,加速推理过程并降低能耗,对于提升大模型在资源受限设备上的部署效率至关重要以往 PTQ 量化方法忽略不同层权重对量化精度的敏感性,且在超低比特量化下(2-3 位)精度损失严重。


为了应对这一挑战,阿里巴巴行业大模型智算技术负责人张跃伟,将在本次演讲中分享《大模型超低比特无损量化技术实践》,介绍 AMLQ(Adaptive Mixed precision and Low-rank Quantization error reconstruction)量化方法,探讨大模型在推理实践中的挑战以及如何通过创新的量化技术提升大模型在资源受限设备上的部署效率。


精彩分享三

在资源有限的情况下,如何提高模型训练效率,尤其是数据的质量控制,成为了一个重要的课题。许多轻量化模型如 Phi 系列,通过严谨的质量控制,在较少数据和较低算力(FLOPs)支持下,达到了显著的效果提升。当前开源数据集的趋势集中在增多 Tokens 和更精细化的质量筛选,以获得更小、效果更佳的数据集。此外,去重策略需要根据具体业务需求定制,更高比例的去重未必能带来更优结果,且数据质量这一概念难以仅依赖人类偏好定义。


来自百川智能的算法专家张宇鹏,将在本次演讲中分享《百川智能预训练数据策略的探索与实践》他将详细阐述如何通过优化数据质量控制策略,提升模型在有限资源下的表现;介绍基于模型自我学习能力和人类标注结合的数据筛选策略,解决数据去重和质量控制问题,并分享如何通过知识类别的分类采样和小模型拟合 Scaling Law,降低实验成本并提升数据利用效率。


精彩分享四

随着 ChatGPT 的出现,大模型获得了前所未有的热度,但关于大模型研究主要聚焦在高资源语种上(如英文、中文),对中低资源语种的支持相对较差。如何在中低资源语上进行大模型业务落地,是一个非常有价值且值得探索的问题。


华为翻译中心高级工程师商恒超带来演讲《盘古多语言大模型研究与业务落地探索》,他将介绍华为翻译中心以翻译技术为出发点,提升大模型在低资源语种的表现,并且以阿语和泰语为例,详细介绍模型的适配、翻译技术的应用、以及业务场景的落地等内容。


彩蛋

在本场专题期间,我们还将举行一场圆桌讨论,主题为「Scaling Law 的边界及 AI 芯片领域的新竞争格局」。本次圆桌将探讨以下核心问题:

  • 大模型预训练阶段的 Scaling law 还可持续吗?算力的突破能否带来新的 Scaling law?

  • 形如 OpenAI o1 的推出会对未来算力的格局发生什么变化?

  • 新一代推理芯片(Groq、Celebras)是否会挑战 NVIDIA 的 GPU 地位?


PS,AICon 大会门票即将售罄,若团购可全年最低价入手,还有最后为数不多的优惠名额,有兴趣的朋友真得抓紧了:https://aicon.infoq.cn/202412/beijing/

2024-12-02 18:016415

评论

发布
暂无评论
发现更多内容

深度解析 slab 内存池回收内存以及销毁全流程

bin的技术小屋

Linux 内存管理 Linux Kenel 内存池 slab

TiDB x Flink x Iceberg 实时 ODS 实践

TiDB 社区干货传送门

实践案例 大数据场景实践 实时数仓场景实践 数据中台场景实践 OLAP 场景实践

TiDB 使用国内公有云和私有部署的 S3 存储备份指南

TiDB 社区干货传送门

数据库架构设计 6.x 实践

深入浅出微服务:40个微服务架构实战案例(Dubbo+Springcloud)

Java 微服务 Spring Cloud

C4D 常用 14 款插件

Finovy Cloud

C4D 3D软件

属实不赖!Alibaba开源GitHub星标114K微服务架构全彩进阶手册

Java你猿哥

Java 架构 微服务 微服务架构 ssm

惊喜!华秋DFM软件升级,新功能让你爱不释手

华秋电子

浅析财务共享各阶段面临的挑战

用友BIP

财务共享

用友协办国有资本投资运营公司第八次圆桌会议, 展示数智国资发展新路径

用友BIP

国资国企数智化转型

用友与临港集团签署战略合作协议

用友BIP

国资国企数智化转型

基于openfaas托管脚本的实践

百度Geek说

数据库 百度 企业号 5 月 PK 榜

Github标星78k,Alibaba最新发布的Spring Boot项目实战文档!太强了

Java你猿哥

Java 面试 Spring Boot ssm Spring MVC

软件测试/测试开发丨Web自动化测试中显式等待的高级使用

测试人

程序员 软件测试 自动化测试 测试开发

TiDB x Flink 数据集成实践

TiDB 社区干货传送门

实践案例 大数据场景实践 数据中台场景实践 OLAP 场景实践

面试进阶齐飞!Github一天万赞的阿里Java系统性能优化有多牛?

Java你猿哥

Java JVM ssm Java性能优化

【5.19-5.26】写作社区优秀技术博文一览

InfoQ写作社区官方

热门活动 优质创作周报

如何将千亿文件放进一个文件系统,EuroSys'23 CFS 论文背后的故事

Baidu AICLOUD

文件存储 元数据

数据可视化:相关类可视化图表大全

2D3D前端可视化开发

数据可视化控件 数据可视化工具 可视化数据 可视化图表 数据可视化设计

TiDBv6.5离线部署

TiDB 社区干货传送门

6.x 实践

阿里全新推出:微服务突击手册,把所有操作都写出来了|超清PDF

Java你猿哥

Java spring Spring Cloud ssm Ribbon

Github上星标55.9k的微服务神仙笔记真的太香了

Java 架构 微服务 Spring Cloud 设计模式

官宣!时序数据库 TDengine 与天翼云完成产品兼容性认证

爱倒腾的程序员

涛思数据 时序数据库 ​TDengine

AI 换脸技术:你的照片可能被滥用了!

郑州埃文科技

AI 数据治理

7个工程应用中数据库性能优化经验分享

华为云开发者联盟

数据库 后端 华为云 华为云开发者联盟 企业号 5 月 PK 榜

JVM——解析运行期优化与JIT编译器

Java你猿哥

JVM ssm 虚拟机 编译器 JIT编译器

JVM—解析运行期优化与JIT编译器

Java JVM JIT

如何通过财务共享推进财务精细化管理

用友BIP

财务共享

微服务是不是金科玉律?基于Spring Cloud如何构建分布式系统?

Java 架构 微服务 Spring Cloud

SpringBoot 实现启动项目后立即执行方法的几种方式

Java你猿哥

源码 jdk Spring Boot ssm

跪了!Alibaba内部优质Springboot笔记:两大项目实战+源码解析

Java spring 微服务 Spring Boot 框架

池州控股集团财务共享项目启动啦!

用友BIP

财务共享

大模型智算与开发落地实践:释放AI潜力的关键技术与行业应用_AI&大模型_AICon 全球人工智能开发与应用大会_InfoQ精选文章