2025云栖大会,开启通往AGI的未来之旅 了解详情
写点什么

OpenAI 深夜炸场!一口气放出 o1 模型全家桶,月费 200 美元的 Pro 模式被狂怼:Altman 疯狂捞金!

  • 2024-12-06
    北京
  • 本文字数:2695 字

    阅读完需:约 9 分钟

大小:1.30M时长:07:33
OpenAI深夜炸场!一口气放出o1模型全家桶,月费200美元的Pro模式被狂怼:Altman疯狂捞金!

刚刚,OpenAI 震惊圈内的“12 天连续轰炸”正式开启。在首场直播中,OpenAI 宣布了两件事:


第一,o1 完整版现在上线 ChatGPT,即将上线 API,比 o1-Preview 更智能、更快、功能更多(如多模态)。


第二,200 美元 / 月的 ChatGPT Pro 模式下,可以无限制访问 OpenAI 的所有先进模型。

o1 完整版:错误率减少 34%,响应速度快 50%

OpenAI 宣布正在发布其 o1 模型的完整版本(取代 o1-preview),该模型最初于 9 月作为有限预览版发布(代号为“Strawberry”)。新模型将于今日面向 ChatGPT Plus 和 Team 用户推出,而 Enterprise 和 Edu 用户将从下周开始使用该模型。


那么,该完整版模型能力到底怎么样?


据 OpenAI 称,与 o1 和 o1-preview 相比,o1 pro 在数学、科学和编码等具有挑战性的 ML 基准测试中表现更佳,在处理图像和文本(类似于 GPT-4o)时也比 o1-preview 快得多。



OpenAI 比较了 o1-preview、o1 和 o1 pro 模式的性能。


在一个关于罗马皇帝的现场演示问题中,o1 花了 14 秒回答问题,而 o1-preview 花了 33 秒才给出答案。据 OpenAI 称,o1 在“现实世界难题”上减少了 34% 的“重大错误”,而“思考”速度快 50%。据报道,一旦部署完成,将 GPU 转换为新模型,该模型的速度也会变得更快。


o1 不需要 ChatGPT Pro 订阅。从今天下午开始,所有 ChatGPT 付费用户都可以通过 ChatGPT 模型选择器工具访问 o1。OpenAI 表示,它计划在未来几个月内增加对网页浏览、文件上传等功能的支持。


o1 也将很快在 OpenAI 的 API 中推出,并具有包括函数调用(即使用外部工具的能力)和图像分析等新功能。


现在,ChatGPT Pro 的订阅用户将获得比那些没有订阅的用户更好的 o1 版本。OpenAI 表示,这种模式被称为 o1 pro 模式,它“使用更多的计算来为最难的问题提供最佳答案”。


ChatGPT Pro 用户可以通过在模型选择器中选择“o1 pro mode”并直接提问来访问该功能。由于生成答案需要更长时间,ChatGPT 将显示进度条,并在用户切换到另一个对话时发送应用内通知。


o1 pro 版本可能只是增加了模型在给出答案之前所需的“推理”时间。OpenAI 在其 o1-preview 公告中表示,其目标是试验推理时间长达数小时、数天甚至数周的 o1 模型,以进一步提升其推理能力,这很可能是朝着这个方向迈出的一步。


OpenAI 发言人在接受外媒采访时表示:“在外部专家测试人员的评估中,o1 pro 模式能够提供更可靠、更准确、更全面的响应,尤其是在数据科学、编程和案例分析等领域。”“与 o1 和 o1-preview 相比,o1 pro 模式在数学、科学和编码等具有挑战性的机器学习基准测试中表现更好。特别是,我们看到更容易编码的竞赛问题的错误减少了 75%,更能反映日常编程查询。”


o1 完整版本的发布在 Reddit 社区上引发了用户们的热议。


有用户对于 o1 回答问题速度之快表示震惊, 并表示自己其实还没准备好,但或许通用人工智能很快就来了。


也有用户认为,即使推出了很多超级强大的模型,但我们距离通用人工智能还有很长的路要走。


这些强大的大模型无法像人类一样进行广泛而深入的研究和发明,它们的记忆力就像金鱼一样。它们无法像人类一样连续数月或数年无所事事地完成项目,因此无法完成人类在数字世界中所做的许多事情。

o1 不是 AGI,因为它根本不通用。如果 AGI 真的存在,我们所知道的生活绝对会有所不同,几乎从定义上来说都是如此。


200 美元的 Pro 模式被热议:价格上涨了 10 倍


根据 OpenAI 的介绍,其新增的 ChatGPT Pro 模式是一个 200 美元的月度订阅套餐。在该模式下,用无限制访问 OpenAI 的最佳模型和工具,包括 o1 的 mini 及 pro 版本、GPT-4o 和高级语音。


总的来说,ChatGPT Pro 提供了对其最智能模型版本的访问,可以获得思考时间更长的可靠响应。


例如,在外部专家测试人员的评估中,o1 pro 模式可以产生更可靠、更准确、更全面的响应,尤其是在数据科学、编程和判例法分析等领域。与 o1 和 o1-preview 相比,o1 pro 模式在数学、科学和编码等具有挑战性的 ML 基准测试中表现更好。



为了突出 o1 pro 模式提高可靠性的主要优势,OpenAI 使用了更严格的评估设置:只有当模型在四次尝试中有四次尝试(“4/4 可靠性”)中正确回答时,才会被视为可以解决问题,而不仅仅是一次。


目前,Pro 用户可以通过在模型选取器中进行选择并直接提出问题来访问此功能。由于生成答案需要较长的时间,ChatGPT 会显示进度条,并在用户切换到其他对话时发送应用内通知。



在 OpenAI 看来,“ChatGPT Pro 为研究人员、工程师和其他每天使用研究级智能的个人提供了一种加快生产力的方式,让他们站在人工智能进步的最前沿。”未来,他们还将在此计划中添加更强大的计算密集型生产力功能。


但有网友认为,允许无限制的 AVM 、o1 访问以及在 o1 上进行“更深入的思考”,其实只是更长的 CoT 线程。



此外,该模式的价格也引发了许多用户的质疑:“200 美元对于普通人来说太贵了,买不起有用但并非必备的软件”,“AI 通常不应该随着时间的推移而变得更便宜吗?”“这是‘非营利组织’吗?”



毕竟,从 ChatGPT Plus(20 美元 / 月)切换到 ChatGPT Pro(200 美元 / 月)代表价格上涨了 10 倍。也有网友表示,该模式或许适用于企业用户。



不过此前就有外媒报道,OpenAI 正在努力向非营利组织转变。前不久,代表马斯克和其 AI 初创公司 xAI 的律师团队还向联邦法院提交了一项初步禁令,申请禁止 OpenAI 转型为完全营利性企业,并阻止 OpenAI 要求投资者避免为其竞争对手(包括 xAI 和其他公司)提供资金的行为。


有意思的是,OpenAI 特地提到,为了帮助在造福人类的领域取得有意义的进步,他们将向美国领先机构的医学研究人员提供 10 项 ChatGPT Pro 资助,并计划在未来将 Pro 资助扩展到其他地区和研究领域。

One more thing


尽管 OpenAI 一口气放出了这么多模型来“秀肌肉”,但过去几天已经有几款开源模型争夺榜首位置,尤其是国内刚发布的 DeepSeek R1 Lite 和 AIibaba 的 Qwen 2.5 也备受瞩目。X 上的一位用户对泄漏的消息做出了评论,他说:“如果真的会有 200 美元的计划,那么我看不到它的未来,因为我们现在有很多开源工具。”


无论如何,从今天开始,OpenAI 将正式启动了为期 12 天的新功能、新产品和演示“shipmas”期。

据悉,其中包括将发布 OpenAI 期待已久的文本转视频 AI 工具 Sora 和一个新模型的公告。OpenAI 还计划在 ChatGPT 中增加对网页浏览、文件上传等的支持,但这些变化没有时间表。


在 o1 的代码演示中,我们还发现了 GPT-4.5 预览版。



从 OpenAI 官网可以看到,ChatGPT Team 计划将提供“有限预览版 GPT-4.5“(尚不可见)。




参考链接:

https://openai.com/index/openai-o1-system-card/

https://openai.com/index/introducing-chatgpt-pro/


2024-12-06 06:008977
用户头像
李冬梅 加V:busulishang4668

发布了 1163 篇内容, 共 781.4 次阅读, 收获喜欢 1289 次。

关注

评论

发布
暂无评论
发现更多内容

给跪了!阿里P7技术专家进阶必备,架构进阶宝典

Java 进阶 架构师

8个不能错过的程序员必备网站,惊艳到我了!!!

引迈信息

前端

爱了!阿里P8纯手码出489页SQL优化手册,附笔记源码

Java 数据库 sql 面试

建木v2.7.0发布

Jianmu

node.js maven 缓存 CI/CD 流水线

字节三面被挂后,狂刷算法,意外斩获阿里offer,定级P6+

Java 数据结构 面试 算法

牛皮!GitHub上标星90.6K的Java面试指南+笔记

Java java面试 Java八股文 Java面试题 Java面试八股文

《2023大型企业财务数智化白皮书》:大型企业财务数智化建设应用架构

用友BIP

财务数智化 智能财务

全员狠人!CG大佬的连环暴击!第二届瑞云3D渲染动画创作大赛入围名单出炉!人气奖投票进行时!

Renderbus瑞云渲染农场

3D渲染动画创作大赛 瑞云3D渲染动画大赛

远程桌面连接软件:Jump Desktop 8 mac激活版

真大的脸盆

Mac 远程办公 Mac 软件 远程连接 远程工具

现货合约一键自动跟单app系统开发搭建(api对接)

开发v-hkkf5566

直面风口,未来不仅是中文版ChatGPT,还有AGI大时代在等着我们

加入高科技仿生人

人工智能 AI 低代码 数智化 AGI

建木缓存—提升构建速度,让你不加班!

Jianmu

maven 缓存 持续集成 CI/CD 流水线

布隆过滤器(Bloom Filters)的原理及代码实现(Java)

Java 布隆过滤器

蚁人与量子停车场

白洞计划

AI 智慧停车场

python进阶:带你学习实时目标跟踪

华为云开发者联盟

Python 人工智能 华为云 华为云开发者联盟 企业号 3 月 PK 榜

想稳中求进?字节大佬的硬核学习神器《图解Java并发编程》看了吗

Java你猿哥

Java 面试 Java并发 ssm 面经

IPQ5018 cooperate QCN6122 / QCN6102 high performance high speed wi-fi connection

Cindy-wallys

ipq5018 QCN6102 QCN6122 IPQ5010

提升面试成功率:深入理解C++11新特性

小万哥

程序员 面试 软件开发 新特性 C++11

腾讯2022年度研发大数据报告:研发人员占比74%,新增研发项目超7000个

科技热闻

3月27日“文心一言云服务”系列产品将发布 已有21家企业签约

极客天地

终于扒完国内算法第一人10年经验总结的数据结构与算法详解文档

程序知音

Java 算法 编程语言 数据结构与算法 后端技术

MQTT协议是什么?MQTT和Kafka的联系与区别

EMQ映云科技

kafka 物联网 IoT mqtt 企业号 3 月 PK 榜

软件测试/测试开发丨RPC接口测试技术-Tcp 协议的接口测试

测试人

软件测试 自动化测试 测试开发

轻松搞定面试拿offer的Java面试宝典(全彩图文版)24个Java技术栈

Java你猿哥

Java 面试 ssm 面经 java技术栈

分析 | NFTScan NFT API 在加密钱包开发中的应用

NFT Research

API NFT

瓴羊Quick BI作为自定义数据门户,在企业的有效管理中发挥巨大作用

流量猫猫头

Java敏捷开发框架 高效搭建数据报表

力软低代码开发平台

看起来很简单的二维码巡检,究竟是怎么实现的?

草料二维码

小程序 二维码 表单 设备巡检

不要再问我 In,Exists 走不走索引了

让国内顶尖程序员社区“牛客网”低头的这份Java面试手册真的强

程序知音

Java 编程语言 java面试 java架构 八股文

OpenAI深夜炸场!一口气放出o1模型全家桶,月费200美元的Pro模式被狂怼:Altman疯狂捞金!_OpenAI_华卫_InfoQ精选文章