2天时间,聊今年最热的 Agent、上下文工程、AI 产品创新等话题。2025 年最后一场~ 了解详情
写点什么

Claude 3 震撼发布,这家云巨头同时宣布已接入该模型,全球开发者均可访问

  • 2024-03-08
    北京
  • 本文字数:2632 字

    阅读完需:约 9 分钟

大小:1.27M时长:07:22
Claude 3震撼发布,这家云巨头同时宣布已接入该模型,全球开发者均可访问

最近几日,Claude 3 的受关注度无人能敌。

 

这家总部位于旧金山的初创公司 Anthropic 发布了一款新的大型语言模型(LLM) Claude 3,据称是迄今为止世界上最强大的大模型,因为它在常规的基准测试中击败了之前的领导者 OpenAI 的 GPT—— 4 和谷歌的 Gemini。

 

Anthropic 官宣的三款 Claude 3 模型——按照智力从高到低的顺序分别命名为 Opus、Sonnet 和 Haiku。三个模型均提供 200k 长度的上下文,并针对不同的用例进行了优化:

 

  • Haiku 的优势在于速度和成本效益,这是一种快速紧凑的模型,具有近乎即时的响应能力。

  • Sonnet 在智能和速度之间实现了理想的平衡,适用于绝大多数工作负载,速度比 Claude 2 和 Claude 2.1 快 2 倍,且智能水平更高。它擅长执行需要快速响应的智能任务,例如知识检索或销售自动化。

  • Opus 是最先进、最强大的大模型,具有深度推理、高级数学和编码能力,在高度复杂的任务上具有顶级性能。它可以非常流畅地导航开放式提示和新颖场景,包括任务自动化、假设生成以及图表、图形和预测的分析。

 

有趣的是,新模型是根据合成数据进行训练的,即由人工智能本身生成的数据,而不是主要由人类作者生成的数据,这应该会消除一些人们对模型崩溃的担忧。


 Anthropic Claude 3 模型的智能与成本图。

 

Anthropic 的研究数据显示,Claude 3 Opus 作为其模型家族中最为智能的成员,已经在推理、数学和编程等领域树立了新标杆,超越了现有的其他模型,包括 OpenAI 的 GPT-4。具体来说,Opus 在人工智能系统的大多数常见评估基准上都优于同行,包括本科水平专家知识(MMLU)、研究生水平专家推理(GPQA)、基础数学(GSM8K)等。 下图是 Claude 3 与 GPT 和 Gemini 的基准测试成绩对比:

 


 资料来源:https ://www.anthropic.com/news/claude-3-family

 

Claude 3 的三类模型均提供了视觉功能,可以理解不同格式的结构化和非结构化数据,不仅是语言,还包括图像、图表、图表等,这使得企业能够构建集成不同多媒体源并解决真正跨领域问题的生成式人工智能应用程序。例如,制药公司可以查询药物研究论文以及蛋白质结构图,以加速发现;媒体组织可以自动生成图像标题或视频脚本。

 

值得一提的是,在 Claude 3 出现之前,幻觉现象是所有大模型的共同之痛,这一痛点在业内都没有特别有效的办法。而 Claude 3 模型通过“宪法 AI(Constitutional AI)”的训练方法原则为该 Claude 聊天机器人提供了明确的“价值观”,这些技术提供了对模型推理过程的透明度,并且提高了准确性。

 

此外,Claude 3 Opus 在困难的开放式问题上比 Claude 2.1 显示出 2 倍的预估准确性增益,降低了错误响应的可能性。随着企业客户依赖 Claude 跨越医疗、金融和法律研究等行业,减少幻觉现象对于安全性和性能至关重要。

 

这样的理念与亚马逊云科技倡导的以负责任的方式推进 AIGC 的发展不谋而合。事实上,早在去年亚马逊云科技就宣布向 Anthropic 投资 40 亿美元。除了通过 Amazon Bedrock 使用 Claude3 之外,用户也可以在 Anthropic 网站上访问 Claude 3。Amazon Bedrock 提供的领先 LLM 厂商的名单并不止 Anthropic 一家,包括 AI21 Labs、Cohere、Meta、Mistral、Stability 等大模型厂商提供的模型以及独占的 Amazon Titan 系列模型。


那么,利用 Amazon Bedrock 托管服务部署 Anthropic Claude 3 大模型的便捷之处?

 

据悉,Amazon Bedrock 已经推出了多项特色服务,包括模型评估功能能够帮助客户识别、比较和选择最适合的模型;知识库功能能够简化生成式 AI 应用构建并利用专有数据提供基于最新内容的定制化响应;模型调优功能支持对更多先进模型进行调优;代理功能可支持生成式 AI 应用在确保安全和隐私保护的情况下执行多步骤业务指令;Guardrails 功能可更好地帮助实现负责任 AI。这些功能为企业利用生成式 AI 提供多种选项,使得企业能够根据其业务和场景的特定需求,使用 Anthropic 的最新模型进行构建。这不仅包括自然语言模型,还包括扩展的多模式人工智能模型,能够跨文本、图像、图表等进行高级推理。

 

亚马逊云科技认为没有一种模型可以满足所有需求。为此,Amazon Bedrock 与全球领先的大模型供应商合作,为用户提供领先大模型选择,并在近日将大模型提供商扩充至 7 家。至此,Amazon Bedrock 的大模型供应商共有 AI21 Labs、Anthropic、Cohere、Meta、Stability AI、Amazon 和 Mistral AI,Mistral AI 的两种高性能模型 Mistral 7B 和 Mixtral 8x7B 也已经在 Amazon Bedrock 正式可用。Mistral 7B 是 Mistral AI 推出的首个基础模型,支持英语文本生成任务并具备自然编码能力。而 Mixtral 8x7B 则采用当下备受关注的 MoE(优质稀疏专家混合)技术,功能比 Mixtral 7B 更强大,可支持英语、法语、德语、西班牙语和意大利语文本生成任务并具备自然编码能力,非常适用于文本摘要、问题解答、文本分类、文本完善和代码补全等使用案例。

 

亚马逊云科技全球产品副总裁 Matt Wood 博士在其最新的博客文章中提到:“基础模型是未来 100 年最重要的软件组件之一。尽管生成式 AI 演示因其撰写博客文章或回答问题的能力而闻名(而且它们确实做得很好),但这些卓越的模型更应被视为能够重新定义我们与数据、信息以及彼此互动方式的推理和集成引擎。单独来看,Claude 3 在这些方面是行业领先的。在 Amazon Bedrock 中,这些模型与其他基础模型结合,获得了新的超能力,加上易于使用你自己的数据来定位响应、添加自主代理和可配置的安全护栏,其效果远大于各部分之和。”

 

Matt Wood 博士特别强调了 Claude3 模型在交互和安全方面的优势:“在交互方面,所有的 Claude 3 模型更容易被‘引导’,并且被设计得更好地支持流行的输出格式,如 JSON。这使得开发人员构建能够与 Claude 3 模型进行交互的应用程序变得更加容易。这些模型也不太可能拒绝回答那些处于模型安全边界边缘的提示,从而开放了更多企业用例,这些用例曾经可能因为模型的限制而被阻止。在安全方面,Claude 3 也保持了 Anthropic 的高安全标准。”

 

可见,此次宣布接入 Claude 3 模型是亚马逊云科技 更广泛战略的一部分,该战略旨在通过投资生成式 AI 堆栈的所有层(基础设施、模型和面向用户的应用程序)来抢占生成式 AI 领域的有利地位。亚马逊云科技表示,全球有超过 10,000 个组织已经在使用 Amazon Bedrock 来探索和部署生成式 AI 应用程序。

 

与此同时,有传言称 OpenAI 很快就会用自己对 Claude 3 的答案 GPT-5 进行反击,具体结果如何,我们可以拭目以待。

 

参考链接:

https://foresightnews.pro/article/detail/32716

https://aws.amazon.com/cn/blogs/machine-learning/unlocking-innovation-aws-and-anthropic-push-the-boundaries-of-generative-ai-together/

 

2024-03-08 10:0610269
用户头像
李冬梅 加V:busulishang4668

发布了 1201 篇内容, 共 824.4 次阅读, 收获喜欢 1312 次。

关注

评论

发布
暂无评论
发现更多内容

有哪些前端面试题是面试官必考的

coder2028

JavaScript 前端

考研失败,加入国企当程序员,真香!

程序员晚枫

程序员 找工作 考研 国企

深入浅出玩转监控宝|网站监控之管理网站监控任务

云智慧AIOps社区

安全 监控宝 云智慧 监控软件 网站监控

nodejs实现jwt

coder2028

JavaScript 前端

基于 docker-compose 部署 SkyWalking包含halo和jenkins案例

忙着长大#

Skywalking

进行软件开发,需要掌握什么知识和技能?

飞算JavaAI开发助手

热点面试题:箭头函数与普通函数的区别?

Immerse

JavaScript 箭头函数 前端面试题 #热点问题 普通函数

2023年了,做SEO还有必要吗?

京东科技开发者

搜索引擎 SEO 搜索算法 SEO优化 企业号 3 月 PK 榜

文心一言的蝴蝶振翅,云计算的飓风狂飙

脑极体

云计算

ChatGPT到底有多贵?| 社区征文

AIWeker

人工智能 openai GPT ChatGPT

采编式AIGC视频生产流程编排实践

百度Geek说

服务编排 AIGC 企业号 3 月 PK 榜 引擎架构

在MWC 2023,华为创新解决方案点亮F5.5G时代的每一处光

脑极体

MWC

微信 + ChatGPT = 自己的智能助手 | 社区征文

IT蜗壳-Tango

ChatGPT

js异步编程的三种模式

hellocoder2029

JavaScript 前端

关于 App Store 苹果商店价格的那些事(历上最全版)

37手游iOS技术运营团队

apple In App Purchase App Store Connect API app store iTunes Store

高校技术导师云集 OpenHarmony技术峰会“高校技术俱乐部分论坛”举办

极客天地

阿里前端二面常见面试题汇总

coder2028

JavaScript 前端

我用ChatGPT写互联网职场黑话!

FN0

openai ChatGPT

SREWorks数智运维平台开源一周年 | 回顾与展望

阿里云大数据AI技术

大数据 开源 运维 企业号 3 月 PK 榜

Zepoch节点持有人数大突破,Nautilus Chain 或有海量空投

西柚子

量化合约系统开发程序技术(源码搭建)合约量化开发逻辑方案

I8O28578624

校招前端二面经典面试题(附答案)

hellocoder2029

JavaScript 前端

js对象和原型、原型链的关系

hellocoder2029

JavaScript 前端

那些高级前端是如何回答面试题的

hellocoder2029

JavaScript 前端

推荐一款好用的数据一致性校验工具

NineData

MySQL 数据一致性 数据校验 IDC SqlServer

‘区块链’3M互助模式系统开发技术(源码搭建)

I8O28578624

云上贵州:基于鲲鹏DevKit快速开发智能运维平台,性能提升75%

极客天地

架构训练营第10期模块8作业

Geek_4db2d5

架构实战营模块二作业

null

三天吃透Redis面试八股文

程序员大彬

redis java

Claude 3震撼发布,这家云巨头同时宣布已接入该模型,全球开发者均可访问_亚马逊云科技_李冬梅_InfoQ精选文章