代码生成：基于AI大模型的挑战与前景_生成式 AI_Ben Linders

【AICon】探索八个行业创新案例，教你在教育、金融、医疗、法律等领域实践大模型技术！ >>> 了解详情 



 写点什么



1.0x 

大小：777.07K时长：04:25

使用 AI 通用模型来完成代码生成这类非常具体的任务可能会带来问题。人工智能生成的代码就像是陌生人的代码，它们可能并不符合你的代码质量标准。这种情况下，创建专业或专用的模型不失为一条出路。

Luise Freese 和 Iona Varga 在2023 年的 NDC Oslo 大会上探讨了 AI 模型的实践困境和伦理相关问题。

Varga 提到，“人工智能”这个词给人一种智慧的感觉，虽然这个名字实际只是代表了这些模型的构建方式。以节点相连的形式模仿人脑中神经元与突触连接而成的网络，这类模型因此而得名“人工网络”或“人工智能”。

Freese 补充道，抽象来说，计算机是完全依赖于或开或关的晶体管，通过这些开关的组合，我们得以操纵比特。由于晶体管之间没有相互的纠缠，这些开关最终会带来这样的结果：

因此，计算机并不会思考，不过是我们的人工智能算法赋予了它们个性和特征，比如“让我考虑一下”这类礼貌说辞。AI 仅仅是利用统计数据对事物进行预测、分类或组合。

Varga 提到，AI 的问题在与使用极其通用的模型或是基础模型完成非常具体的任务。大语言模型（LLM）的工作原理是先分析问题、创建一两个词语，再根据统计数据预测下一个标记的最佳匹配。此外，LLM 本身是无法对事实进行核查的，因为这类模型的设计目的是生成而非验证。

如果我们试图建立一个能解决所有 AI 问题的 AI 模型，那么我们将会创造出一种自我放大的螺旋式下降，Freese 补充道。若想实现螺旋式上升，那就应该少用基础模型，多用更为具体的模型，后者中有一部分实际就是搭建在基础模型之上的。

AI 或许能生成代码，但这些代码是否能安全地使用，是否能满足我们对质量的标准要求？Varga 认为这些问题只能由真正的人类来回答，这一过程并不容小觑。归根结底，就像是代码的编写一样，调试陌生人的代码远比自己从头到尾参与其中的代码更为困难。

一般模型的理解能力也更为通用，这在代码生成问题上可能会带来问题，正如 Varga 所解释的：

举例来说，React v17 或 v16 这些可能没有直接反应在模型的上下文中，但模型也能了解这些代码库。或许你会发现自己生成的一个函数中会混杂有两个版本的代码。

Varga 认为，多数情况下 AI 都是解决问题的好帮手。但使用 AI 就意味着你要去检查、验证、修改、编辑或重写部分内容，而这一部分可能才是我们低估 AI 工具带来工作量的地方。

InfoQ 针对人工智能所带来的挑战问题采访了 Luise Freese 和 Iona Varga。

InfoQ：什么因素会造成 AI 的失败？

Iona Varga：一般来说，AI 并不是命中注定要失败的。我是医学物理出身的，我也见过很多优秀的 AI 工具，它们能出色地完成波弹性成像的实时剪切，早期阶段的婴儿检测，甚至能检测出肿瘤专家都无法发现的肺癌细小结节。

但由于虚假数据和扭曲事实问题的存在，这些结果并不完全可信。举例来说，川普就职典礼上，实际的到场人数是要少于最初公布的数据。试着问模型就职典礼的公园有多热闹，你大概会得到一个出乎意料的答案。但同样，数据的来源时至今日也有颇具争议的历史背景，它们可能会出于政治剧本或标准等原因而被修改。

InfoQ：伦理道德如何才能帮助我们解决 AI 所带来的问题？

Luise Freese：伦理道德作为工具本身是帮不上太多忙的。伦理只是一种工作的方式，就像是 DevOps 一样。一旦你有了规划，知道该做什么了，“伦理道德”就是你对“完成”的定义。我所用的数据是否覆盖了所有产品使用相关的人或事？通过这些道德的检测，我们的工作方式将会在可访问性、包容性和避免偏见方面得到改善。

原文链接：

The Challenges of Producing Quality Code When Using AI-Based Generalistic Models

公众号推荐：

跳进 AI 的奇妙世界，一起探索未来工作的新风貌！想要深入了解 AI 如何成为产业创新的新引擎？好奇哪些城市正成为 AI 人才的新磁场？《中国生成式 AI 开发者洞察 2024》由 InfoQ 研究中心精心打造，为你深度解锁生成式 AI 领域的最新开发者动态。无论你是资深研发者，还是对生成式 AI 充满好奇的新手，这份报告都是你不可错过的知识宝典。欢迎大家扫码关注「AI前线」公众号，回复「开发者洞察」领取。

发布

暂无评论

创作场景

代码生成：基于 AI 大模型的挑战与前景

公众号推荐：

评论

对htmlMeta的实例详解

ICASSP2021 M2VoC挑战赛报告会：高分队伍及评审分享回顾（附PPT）

网易云音乐：基于分布式图学习PGL的推荐系统优化之路

Kyuubi: 网易数帆开源的企业级数据湖探索平台（架构篇）

云原生时代下，容器安全的“四个挑战”和“两个关键”

面试官：啥？SynchronousQueue是钟点房？

Kubernetes入门——Kubernetes工作原理及使用

Java程序员面试15家公司收到15份offer，月薪35K全靠这Java面试小抄（2021版）开源分享

吉他扒谱该怎么做？分享一款超好用的扒谱工具！

校招开始，你做好【终身成长】的准备了吗？

第七.产品规划与功能规划

私藏干货 | 实现分布式锁的三种方案对比

区块链数字版权管理,区块链赋能知识产权保护

您的客户管理决策是否低于10毫秒？

阿里P9春招特此分享：Java核心开发成长手册（2021版）涵盖所有p5-p8技术栈

Kubernetes入门——深入浅出讲Docker

PHP-Trait解析与使用

NAC公链——Nirvana NA公链白皮书

思维转换 - 更好的认识世界

论如何快速吃透算法？186道高阶算法题+学习资料程序员面试必备

区块链电子证照应用赋能政府服务

PC五年，华为如水

uni-app跨端开发H5、小程序、IOS、Android（一）：太强了，一次性搞定全端开发

微服务的下一步，离不开服务网格

在vscode中go编码发生的问题整理

五个问题，三大策略，手把手教你定制App性能监控方案

人脸识别无间道

Kubectl Plugin 推荐（三）| 插件开发篇

阿里二面：什么是mmap？

Java的“泛型”特性，你以为自己会了？（万字长文）

Timewait是什么

创作场景

代码生成：基于 AI 大模型的挑战与前景

公众号推荐：

评论

更多内容推荐

推荐阅读

电子书

大厂实战PPT下载