AI实践哪家强?来 AICon, 解锁技术前沿,探寻产业新机! 了解详情
写点什么

OpenAI 深夜炸场!一口气放出 o1 模型全家桶,月费 200 美元的 Pro 模式被狂怼:Altman 疯狂捞金!

  • 2024-12-06
    北京
  • 本文字数:2695 字

    阅读完需:约 9 分钟

大小:1.30M时长:07:33
OpenAI深夜炸场!一口气放出o1模型全家桶,月费200美元的Pro模式被狂怼:Altman疯狂捞金!

刚刚,OpenAI 震惊圈内的“12 天连续轰炸”正式开启。在首场直播中,OpenAI 宣布了两件事:


第一,o1 完整版现在上线 ChatGPT,即将上线 API,比 o1-Preview 更智能、更快、功能更多(如多模态)。


第二,200 美元 / 月的 ChatGPT Pro 模式下,可以无限制访问 OpenAI 的所有先进模型。

o1 完整版:错误率减少 34%,响应速度快 50%

OpenAI 宣布正在发布其 o1 模型的完整版本(取代 o1-preview),该模型最初于 9 月作为有限预览版发布(代号为“Strawberry”)。新模型将于今日面向 ChatGPT Plus 和 Team 用户推出,而 Enterprise 和 Edu 用户将从下周开始使用该模型。


那么,该完整版模型能力到底怎么样?


据 OpenAI 称,与 o1 和 o1-preview 相比,o1 pro 在数学、科学和编码等具有挑战性的 ML 基准测试中表现更佳,在处理图像和文本(类似于 GPT-4o)时也比 o1-preview 快得多。



OpenAI 比较了 o1-preview、o1 和 o1 pro 模式的性能。


在一个关于罗马皇帝的现场演示问题中,o1 花了 14 秒回答问题,而 o1-preview 花了 33 秒才给出答案。据 OpenAI 称,o1 在“现实世界难题”上减少了 34% 的“重大错误”,而“思考”速度快 50%。据报道,一旦部署完成,将 GPU 转换为新模型,该模型的速度也会变得更快。


o1 不需要 ChatGPT Pro 订阅。从今天下午开始,所有 ChatGPT 付费用户都可以通过 ChatGPT 模型选择器工具访问 o1。OpenAI 表示,它计划在未来几个月内增加对网页浏览、文件上传等功能的支持。


o1 也将很快在 OpenAI 的 API 中推出,并具有包括函数调用(即使用外部工具的能力)和图像分析等新功能。


现在,ChatGPT Pro 的订阅用户将获得比那些没有订阅的用户更好的 o1 版本。OpenAI 表示,这种模式被称为 o1 pro 模式,它“使用更多的计算来为最难的问题提供最佳答案”。


ChatGPT Pro 用户可以通过在模型选择器中选择“o1 pro mode”并直接提问来访问该功能。由于生成答案需要更长时间,ChatGPT 将显示进度条,并在用户切换到另一个对话时发送应用内通知。


o1 pro 版本可能只是增加了模型在给出答案之前所需的“推理”时间。OpenAI 在其 o1-preview 公告中表示,其目标是试验推理时间长达数小时、数天甚至数周的 o1 模型,以进一步提升其推理能力,这很可能是朝着这个方向迈出的一步。


OpenAI 发言人在接受外媒采访时表示:“在外部专家测试人员的评估中,o1 pro 模式能够提供更可靠、更准确、更全面的响应,尤其是在数据科学、编程和案例分析等领域。”“与 o1 和 o1-preview 相比,o1 pro 模式在数学、科学和编码等具有挑战性的机器学习基准测试中表现更好。特别是,我们看到更容易编码的竞赛问题的错误减少了 75%,更能反映日常编程查询。”


o1 完整版本的发布在 Reddit 社区上引发了用户们的热议。


有用户对于 o1 回答问题速度之快表示震惊, 并表示自己其实还没准备好,但或许通用人工智能很快就来了。


也有用户认为,即使推出了很多超级强大的模型,但我们距离通用人工智能还有很长的路要走。


这些强大的大模型无法像人类一样进行广泛而深入的研究和发明,它们的记忆力就像金鱼一样。它们无法像人类一样连续数月或数年无所事事地完成项目,因此无法完成人类在数字世界中所做的许多事情。

o1 不是 AGI,因为它根本不通用。如果 AGI 真的存在,我们所知道的生活绝对会有所不同,几乎从定义上来说都是如此。


200 美元的 Pro 模式被热议:价格上涨了 10 倍


根据 OpenAI 的介绍,其新增的 ChatGPT Pro 模式是一个 200 美元的月度订阅套餐。在该模式下,用无限制访问 OpenAI 的最佳模型和工具,包括 o1 的 mini 及 pro 版本、GPT-4o 和高级语音。


总的来说,ChatGPT Pro 提供了对其最智能模型版本的访问,可以获得思考时间更长的可靠响应。


例如,在外部专家测试人员的评估中,o1 pro 模式可以产生更可靠、更准确、更全面的响应,尤其是在数据科学、编程和判例法分析等领域。与 o1 和 o1-preview 相比,o1 pro 模式在数学、科学和编码等具有挑战性的 ML 基准测试中表现更好。



为了突出 o1 pro 模式提高可靠性的主要优势,OpenAI 使用了更严格的评估设置:只有当模型在四次尝试中有四次尝试(“4/4 可靠性”)中正确回答时,才会被视为可以解决问题,而不仅仅是一次。


目前,Pro 用户可以通过在模型选取器中进行选择并直接提出问题来访问此功能。由于生成答案需要较长的时间,ChatGPT 会显示进度条,并在用户切换到其他对话时发送应用内通知。



在 OpenAI 看来,“ChatGPT Pro 为研究人员、工程师和其他每天使用研究级智能的个人提供了一种加快生产力的方式,让他们站在人工智能进步的最前沿。”未来,他们还将在此计划中添加更强大的计算密集型生产力功能。


但有网友认为,允许无限制的 AVM 、o1 访问以及在 o1 上进行“更深入的思考”,其实只是更长的 CoT 线程。



此外,该模式的价格也引发了许多用户的质疑:“200 美元对于普通人来说太贵了,买不起有用但并非必备的软件”,“AI 通常不应该随着时间的推移而变得更便宜吗?”“这是‘非营利组织’吗?”



毕竟,从 ChatGPT Plus(20 美元 / 月)切换到 ChatGPT Pro(200 美元 / 月)代表价格上涨了 10 倍。也有网友表示,该模式或许适用于企业用户。



不过此前就有外媒报道,OpenAI 正在努力向非营利组织转变。前不久,代表马斯克和其 AI 初创公司 xAI 的律师团队还向联邦法院提交了一项初步禁令,申请禁止 OpenAI 转型为完全营利性企业,并阻止 OpenAI 要求投资者避免为其竞争对手(包括 xAI 和其他公司)提供资金的行为。


有意思的是,OpenAI 特地提到,为了帮助在造福人类的领域取得有意义的进步,他们将向美国领先机构的医学研究人员提供 10 项 ChatGPT Pro 资助,并计划在未来将 Pro 资助扩展到其他地区和研究领域。

One more thing


尽管 OpenAI 一口气放出了这么多模型来“秀肌肉”,但过去几天已经有几款开源模型争夺榜首位置,尤其是国内刚发布的 DeepSeek R1 Lite 和 AIibaba 的 Qwen 2.5 也备受瞩目。X 上的一位用户对泄漏的消息做出了评论,他说:“如果真的会有 200 美元的计划,那么我看不到它的未来,因为我们现在有很多开源工具。”


无论如何,从今天开始,OpenAI 将正式启动了为期 12 天的新功能、新产品和演示“shipmas”期。

据悉,其中包括将发布 OpenAI 期待已久的文本转视频 AI 工具 Sora 和一个新模型的公告。OpenAI 还计划在 ChatGPT 中增加对网页浏览、文件上传等的支持,但这些变化没有时间表。


在 o1 的代码演示中,我们还发现了 GPT-4.5 预览版。



从 OpenAI 官网可以看到,ChatGPT Team 计划将提供“有限预览版 GPT-4.5“(尚不可见)。




参考链接:

https://openai.com/index/openai-o1-system-card/

https://openai.com/index/introducing-chatgpt-pro/


2024-12-06 06:008848
用户头像
李冬梅 加V:busulishang4668

发布了 1115 篇内容, 共 729.2 次阅读, 收获喜欢 1257 次。

关注

评论

发布
暂无评论
发现更多内容

龙蜥开发者说:从技术向往到生态共建的机密计算之路 | 第 30 期

OpenAnolis小助手

开发者 操作系统 龙蜥社区 龙蜥社区开发者说

AI 技术发展简史

不在线第一只蜗牛

人工智能 AI

云上玩转 Qwen3 系列之三:PAI-LangStudio x Hologres构建ChatBI数据分析Agent应用

阿里云大数据AI技术

大数据 数据分析 人工智能、 PAI LangStudio

英特尔携手壳牌打造浸没式液冷认证方案,助力数据中心迈向高效未来

E科讯

高途公布2025年第一季度未经审计业绩及新股票回购计划

财见

0元打造520浪漫神器,用CodeBuddy生成专属爱情故事书

不惑

CodeBuddy

偶遇龙蜥,2025 OceanBase 开发者大会即将在广州举办

OpenAnolis小助手

数据库 AI 操作系统 龙蜥社区 OceanBase 开发者大会

如何医治一条慢SQL?

量贩潮汐·WholesaleTide

sql

Web前端入门:JavaScript 的应用领域

电子尖叫食人鱼

JavaScript 前端 Web

一个让成员认可、管理者省心的程序员数据评估系统,应该是什么样子?

思码逸研发效能

研发效能 绩效管理 效能度量 效能管理 研发效能度量

哈尔滨等保、备案单位如何选择备案地?

黑龙江陆陆信息测评部

深度解析智能体:从概念到应用的全方位洞察

Techinsight

智能体评估

【AI】我没写一行 SQL,就让 AI 查出了销售报表

非晓为骁

人工智能 AI BI MCP

MiniMax 新语音模型登顶 TTS 全球榜单;AI 会议笔记 Granola 融资 6700 万美元,估值 2.5 亿丨日报

声网

Addepar完成2.3亿美元G轮融资

财见

利用 Amazon Bedrock Data Automation(BDA)对视频数据进行自动化处理与检索

亚马逊云科技 (Amazon Web Services)

探秘企业级智能体:脱颖而出的秘诀何在?

Techinsight

AI 智能体

集成学习常用组合策略:让多个模型“合作”得更好

量贩潮汐·WholesaleTide

集成学习

模块化和DID能让UBI惠及所有人吗?

加密眼界

模块化和DID能让UBI惠及所有人吗?

股市老人

第五章:数据治理启动的契机

数据小吏

数据治理

局域网聊天工具,哪款更适合政企的即时通讯需求?

BeeWorks

即时通讯 IM 私有化部署 局域网

产品经理用什么软件做竞品分析?AI生成产品报告攻略奉上!

职场工具箱

AI 产品经理 竞品分析 办公软件 AIGC

模块化和DID能让UBI惠及所有人吗?

石头财经

游戏行业DDoS攻击类型及防御分析

网络安全服务

CDN 服务器 带宽 API接口 DDoS 攻击

技术贴 | 如何基于 KWDB 快速实现工业物联网智能电表系统设计?

KaiwuDB

数据库·

深入剖析低代码:实现24小时产品上线的技术机制与优化策略

JeeLowCode低代码平台

低代码 低代码平台 低代码前端 低代码缺点 低代码,

iVX BI 引擎数据驱动优化全解析

代码制造者

BI

联想,让AI计算发生“钟摆革命”

脑极体

AI

模块化和DID能让UBI惠及所有人吗?

BlockChain先知

AI应用及数据驱动型HR决策呈激增态势

财见

OpenAI深夜炸场!一口气放出o1模型全家桶,月费200美元的Pro模式被狂怼:Altman疯狂捞金!_OpenAI_华卫_InfoQ精选文章