诺奖得主 Hassabis 或将一年内离职,DeepMind 独立时代彻底落幕;曝字节拟训练超 5 万亿参数大模型,张一鸣罕见发声:反对蒸馏;DeepSeek 拟上调 API 服务定价,预计涨幅较大;宇树科技超百名员工参与 IPO“盛宴”,一批 90 后千万富豪或将诞生;智元机器人发放年中奖金,离职员工也有份;小红书高薪招募 AI 人才,主导 AI 社交类产品;阿里两个秘密小组与悟空重组,目标并不是 WorkBuddy;苹果中国官网删除 Apple 智能接入阿里千问使用手册;曝大众拟裁掉数百个管理层:求助猎头安排下家被拒,“没这么多岗位”……
行业热点
诺奖得主 Hassabis 或将一年内离职,DeepMind 独立时代彻底落幕
外媒报道,在 Jeff Dean 确定离职创业之际,Demis Hassabis 同步递交离职意向,二人本计划一同离开 Alphabet。
谷歌管理层评估认为,两大 AI 核心人物同步离职将引发资本市场剧烈震荡,仅官宣 Jeff Dean 离职、哈萨比斯调岗的半份人事消息落地后,谷歌股价已下跌 5%。为避免股价雪崩,谷歌紧急挽留哈萨比斯,临时授予其 DeepMind 董事长 + Alphabet 首席科学家双重头衔,暂缓离职节奏,换取组织稳定过渡时间。
Pathfounders 明确预测,缓冲期最长不超过一年,哈萨比斯终将体面离开谷歌;英国《卫报》同步佐证,本次岗位调整并非简单退居二线,而是 DeepMind 独立运营生命周期终结的标志性信号。
本次架构调整落地于 8 月 5 日,原 DeepMind CTO Koray Kavukcuoglu 晋升高级副总裁,全盘接管实验室日常运营、Gemini 模型研发,直接向 Alphabet CEO 皮查伊汇报。自此 DeepMind 不再设置独立 CEO 岗位,组织管辖权全面收归谷歌总部。
此外,首席科学家 Jeff Dean 效力谷歌 27 年后,这位被誉为硅谷“程序员中的程序员”、深度参与 Google 系统架构和 AI 技术建设的传奇工程师,将与长期合作伙伴 Sanjay Ghemawat、Oriol Vinyals 和 Quoc Le 共同创立 Discovery Loop,一家聚焦机器学习、科学和工程前沿研究的公益性公司。Google 将作为创始投资方和云计算合作伙伴继续与他们合作。
据 WIRED 披露,这个创业想法其实只是几周前才浮出水面。为了挽留这支核心团队,Alphabet CEO Sundar Pichai 还曾在多次会面中试图说服他们“别摘工牌”。但最终,几人还是决定离开大公司体系,去换取一家初创公司才有的乐趣、速度和自由。
曝字节拟训练超 5 万亿参数大模型,张一鸣罕见发声:反对蒸馏
8 月 6 日消息,据报道,字节跳动正在讨论训练一个参数规模超 5 万亿的模型,它超过阿里的 Qwen 3.8-Max(2.4 万亿参数)和月之暗面的 K3(2.8 万亿参数),也是目前国内已知参数规模最大的模型。该计划仍处于早期阶段,模型最终不一定会发布。报道称,新模型将由 Seed Foundation 负责人项亮主导,与大语言模型预训练数据负责人沈科合作。为此,Seed 正在重新梳理组织,划分职责,分配资源。
项亮与沈科均是字节跳动人工智能及大模型研发体系内的核心骨干,均出自字节的“搜广推”体系。项亮本科毕业于中国科学技术大学,博士就读于中科院自动化所,2016 年加入字节,曾负责机器学习中台 AML 团队,后调任豆包大模型 Foundation 团队任负责人。沈科 2018 年清华毕业后,加入字节跳动,现主要负责 LLM 预训练数据。针对字节讨论训练超 5 万亿参数模型的原因,报道援引接近 Seed 人士消息称,Seed 团队认为,与其在现有尺寸上继续追赶其他大模型,不如把参数规模一次推到同行的数倍,争取领先位置。
两周前的 Seed 全员会上,字节跳动创始人张一鸣安抚了 Seed 的成员。他认为,训大模型本就是一件很难的事,团队不必过度焦虑。他明确一段时间内可接受模型落后于行业,希望大家以追求智能上限为目标,期待 Seed 模型能力能跻身世界第一梯队。张一鸣认为编程是当前的关键方向,并表态自己反对蒸馏。在其看来,蒸馏能在短期内改善模型表现,但本质上仍是在复制 Claude 已有的能力。沿着这条路走,最多只能不断逼近对方,很难真正实现超越。
DeepSeek 拟上调 API 服务定价,预计涨幅较大
8 月 6 日午间消息,据 DeepSeek 最新公告,公司计划近期整体上调 DeepSeek API 服务定价,预计涨幅较大。公司建议广大用户合理安排使用,具体方案以正式通知为准。据悉,目前 DeepSeek 采用峰谷定价模式,工作日高峰时段(北京时间 9:00–12:00、14:00–18:00)全部价格直接翻倍,凌晨 00:30–08:30、周末及法定节假日执行平峰原价。
此外,8 月 4 日消息,近日,有知乎网友扒出一个名为“程序小王子”的早年微博账号,疑似为 DeepSeek 创始人兼 CEO 梁文锋本人账号。从账号内容来看,博主是个摄影爱好者,早年发布的内容以风景照为主,记录了大量藏区风光。其中一条 2011 年 11 月 7 日发布的微博格外引人关注:“被困无人区一个星期。所幸我出来了。但我的菲亚特没有出来。它永远地留在了那片漫无边际的高山草原。That's the END。”
有趣的是,这条十多年前的微博如今成了网友“打卡圣地”,评论区涌入大量留言不少人专程前来“打卡梁总”。还有网友戏称,“世界线差点被改变,辣鸡菲亚特。”还有网友表示,“有人能去找到这台车吗?可以建一个博物馆了。”“建议把那台菲亚特挖出来,摆 DeepSeek 总部当镇司之宝。”此外,从该账号关注列表来看,其关注了微博证券、小莉帮忙、对冲基金网、量化交易爱好者、马云、浙大俱乐部等,较为符合梁文锋的经历。
多名交易人士透露,大模型公司 DeepSeek 重启第二轮融资,计划募资 500 亿元,投前估值约 5000 亿元,拟 8 月下旬完成签约。该公司今年 4 月开启首轮融资,6 月完成交割,融资金额 500 亿元,估值超 3500 亿元,为中国 AI 大模型史上首轮融资规模最大的公司。多位投资人称,其第二轮融资至少 7 月中旬已开启,7 月底突然暂停,部分候补投资人被告知签约计划暂缓。
宇树科技超百名员工参与 IPO“盛宴”,一批 90 后千万富豪或将诞生
今天(8 月 10 日),“人形机器人第一股”宇树科技(688836)正式开启网上网下申购。宇树即将引爆新一轮“打新热”,股民网上排队许愿求中签。
8 月 6 日,宇树科技发布科创板上市发行公告,发行价 150.80 元/股,发行后总股本 4.045 亿股,上市市值约 609.99 亿元,高于此前市场预估的超 400 亿元。据公告,宇树科技发行市盈率为 219.23 倍,市销率为 35.89 倍,其所属行业静态市盈率为 38.56 倍。
另外,公告还披露,战略配售总量 808.9286 万股,约占本次发行数量的 20.00%。
招股书显示,发行前宇树科技创始人王兴兴直接与间接合计持股比例为 33.3583%。计算下来,王兴兴身家达 203.5 亿元。宇树科技的股东阵容集齐了美团、腾讯、阿里、蚂蚁等互联网大厂,以及红杉中国、经纬创投等机构。此外,DeepSeek、腾讯旗下上海启善投资有限公司等企业入围战略配售名单。还有一类投资者是宇树科技的高管以及核心员工。参与认购宇树科技员工 1 号、2 号资管计划的发行人高级管理人员和核心员工分别为 159 名、12 名。其中,既有研发技术主管,也有销售、生产等主管,认购金额百万元起。

资管计划之外,宇树科技在发行前还设有股权激励平台上海宇翼。上海宇翼持有公司股份 3982.86 万股,持股比例为 10.9414%。近年来,核心技术人员杨知雨、张阳光通过股权激励平台间接持有宇树科技的股份比例分别为 0.49%、0.15%。按照目前的发行初始市值,他们的财富有望跃升至千万元。和王兴兴一样,他们都是 90 后。
王兴兴称,根据双方签订的《战略合作备忘录》,宇树科技和 DeepSeek 双方将在三方面开展重点合作:面向通用人工智能开展合作研发、高性能通用机器人方面深度合作、AI 大模型方面开展深度合作。
王兴兴还透露,宇树科技 2025 年度不含轮式双臂机器人的人形机器人出货量已超 5,500 台。“随着行业技术的不断进步、产品成本的降低以及应用场景的拓展,预计未来几年内人形机器人在工业制造、消费服务、公共服务等多个下游领域的渗透率将逐步提升。”
8 月 8 日下午,王兴兴回应称,深度求索(DeepSeek)将为宇树科技提供包括模型架构方案、智算集群建设等方面的技术支持。宇树科技公告称,深度求索与公司有战略合作关系或长期合作愿景,拥有同行业或产业链上下游重要资源,可增强公司市场竞争力。
智元机器人发放年中奖金,离职员工也有份
智元机器人 2026 年中全员大会宣布,因上半年业绩超额达成,将向全体正式员工发放 1 个月固定月薪的「年中特别绩效奖」,随 7 月薪资发放,离职员工可按 1-6 月在职天数折算发放,目前公司总人数约 1500 人。
自 2023 年 2 月成立以来,智元发展迅速,2026 年 6 月第 15000 台通用具身机器人量产下线,其量产规模逐年攀升,创新产品矩阵涵盖多种类型机器人。业绩上,智元营收增长迅猛,2025 年突破十亿元,是中国最快过十亿元营收的机器人及 AI 公司,2026 年一季度营收目标完成情况良好,按 2025 年及 2026 年第一季度收入计,智元是全球最大的通用 AI 机器人公司。
智元获超 50 家知名机构 10 轮融资,估值超 200 亿元,目前已启动赴港上市流程,若成功将搭建「A + H」双资本平台。行业方面,具身智能发展快速,2025 年及 2026 年一季度融资额和融资数量均大幅增长,工业及特种机器人为融资主导领域。工业具身智能领域竞争焦点正从单一产品性能向系统级综合能力转移,市场竞争或加剧。
小红书高薪招募 AI 人才,主导 AI 社交类产品
8 月 6 日下午消息,据媒体报道,小红书正全面提速 AI 战略,布局 AI 社交产品、AI 社区互动工具等方向,从后台技术应用转向前台自研、产品化与生态化全面竞速。一位知情人士透露,“小红书正在高薪招募 AI 人才,投入系列 AI 产品自研,要找有强烈 AI Native 产品思维的人。”
在招聘平台检索发现,小红书近日正密集招募 AI 应用研发人才。其中,“AI 社交产品经理”岗位职责包括:主导 AI 陪伴产品的设计与打造,探索 AI 在情感连接、兴趣匹配、个性化互动等维度的深度应用,构建有温度的 AI 陪伴体验。值得注意的是,该岗位薪资为 30-60K/16 薪,最高年薪可达 96 万元,足见其加码 AI 社交赛道的决心。
阿里两个秘密小组与悟空重组,目标并不是 WorkBuddy
阿里内部已经把“AI 办公”这一当下市场风口视为公司在 AI 领域的战略方向之一。对“AI 办公”这件事,阿里决策层的定位是:做企业级、面向企业组织的 AI 生产力平台,而非仅面向 C 端的个人 AI 办公工具。
在组织架构上,“AI 办公”的核心组织载体是“千问办公事业部”,为 ATH 事业群下属的一级事业部。这一组织,由陈宇森作为一号位负责的原悟空事业部升级而来。在产品上,千问办公(QwenWork)将是阿里在 AI 办公场景上的核心产品。这一产品,由 QoderWork、悟空、MuleRun(骡子快跑)三个产品“技术三合一”而来,并非某个产品的融合升级,而是基于三个产品的技术沉淀重新做。
据了解,QoderWork、悟空、MuleRun 三个产品今后将不再单独存在,人才也整合进入统一的千问办公这一体系内。
苹果中国官网删除 Apple 智能接入阿里千问使用手册
苹果官网 Mac 简体中文使用手册曾出现一篇《在 Mac 上配合 Apple 智能使用千问》的支持文档,明确 Apple 智能可配合阿里千问模型工作,后该文档被删除,原链接无法访问。
此前信息显示,千问扩展适用于 macOS 26.6 或更高版本,满足位于中国大陆且 Apple 账户地区为中国大陆、Mac 是中国大陆版本、物理位置在中国大陆且未登录 Apple 账户三种情形之一即可开启,用户可通过 macOS「系统设置」中「Apple 智能与 Siri」的「扩展」设置千问,需登录千问账户或用 Apple 登录。
千问扩展支持写作工具,可在备忘录、邮件等应用实现写作、改写等功能,也支持 Siri,可通过其查找信息,如让千问写诗、总结文稿等,Siri 确认后会询问用户是否使用千问完成请求。
曝大众拟裁掉数百个管理层:求助猎头安排下家被拒,“没这么多岗位”
8 月 5 日消息,据外媒近日报道,大众汽车正在裁减数百个管理职位,这是其精简白领员工计划的一部分,此举将大量裁员人员涌入就业市场。
高管猎头公司 IFP 的汽车行业合伙人 Magnus Tessner 表示,梅赛德斯-奔驰和大众汽车等制造商“正在疯狂地裁员”。他说,虽然许多经理的离职都得到了丰厚的离职补偿,但他们仍在寻找新的工作。一位外部猎头表示,大众汽车曾联系他们,希望他们为 400 到 500 名经理人寻找新的职位。“我告诉他们我们做不到…… 我们没有 400 个高管职位需要填补,”这位猎头说道。
报道称,大众汽车已经开始减少德国工厂的工人数量,但该公司还制定了计划,将在行政、产品开发和销售等“间接”业务领域再裁减 5 万个工作岗位。其跑车品牌保时捷也公布了裁员 5,000 人的计划,主要涉及后台岗位。
Anthropic 任命库埃拉尔为首位全球事务官,负责应对 AI 政策
8 月 5 日消息,Anthropic 发布公告,宣布任命马里亚诺·弗洛伦蒂诺·库埃拉尔为公司首任全球事务主管。据外媒报道,库埃拉尔将直接向公司联合创始人兼总裁丹妮拉·阿莫迪汇报工作,工作地点位于 Anthropic 的旧金山总部,领导公司在全球范围内的政策、战略国际参与和政府关系方面的工作。公开资料显示,库埃拉尔是美籍墨西哥裔法学家、公共政策专家,曾任加州最高法院法官(2014–2021)、卡内基国际和平基金会主席(2021.11–2026.06)。
罕见召回退休高管,苹果准 CEO 特努斯开始组建自己的班底
8 月 4 日,据外媒报道,苹果公司候任 CEO 约翰·特努斯正在重新启用一名他在过去负责硬件工程时的得力助手,让其加入他的新管理团队。据知情人士透露,特努斯已聘用劳拉·莱格罗斯,后者曾任苹果硬件工程副总裁,直至 2022 年退休。在特努斯 9 月 1 日正式接任苹果 CEO 后,莱格罗斯将向他汇报工作。
知情人士称,莱格罗斯的新职位是副总裁,负责跨职能协作,与公司各部门沟通配合。在苹果任职期间,莱格罗斯曾负责产品交付、开发进度管理以及工程团队之间的协调工作,以确保各团队目标保持一致。退休前,她是特努斯最信任的副手之一。2018 年,她曾在苹果产品发布会上亮相,介绍新款 MacBook Air。两年后,她又发布了当前的 iPad Air 设计。
员工上班玩手机被指“摸鱼”并开除:法院判决公司赔偿 11 万元
8 月 4 日,央视报道南京一起劳动纠纷案:技术工程师林某因被指上班看手机、离座等“摸鱼”行为被公司开除,林某不服将公司告上法庭。一二审法院均认定公司违法解除,判决赔偿 11 万余元。
林某于 2020 年 8 月入职南京某科技公司任技术工程师,2025 年 1 月结束外派后坐班,公司未分配具体任务,仅要求完成竞品调研和日报告。2025 年 2 月,公司以林某“严重违反员工手册”为由单方解除劳动合同,理由是监控显示其有 14 次违纪行为,包括离座 9 分钟,和同事说话 4 分钟,迟开电脑 8 分钟,看手机,提前 3 分钟离岗。
对于公司给出的解雇理由,林某在法庭上予以了反驳:“我的本职工作就是互联网行业,是离不开手机的职业,我们是做 App 产品的。我们一定要去实时地调研和研究,写一些报告,所以说我日常玩手机的行为,他不能说看我碰手机就说我在‘摸鱼’,这不合理。我每天都有提交我的工作日报,写了我看了哪些竞品报告的总结。”
一审法院认为公司证据不足以证明林某行为与工作无关,属违法解除,判令支付工资及赔偿金共 111976.67 元。公司上诉,二审法院维持原判:公司未安排具体任务,短暂离座和看手机属正常生理与工作需求,未达到“严重违纪”程度。程序上公司未核实、未告知、未沟通,直接开除缺乏正当性。法官强调“人不是机器”,用人单位应基于善意管理,对轻微违纪采用批评教育等柔性手段,体现“过罚相当”。
北京首例破坏 AI 模型刑案落槌:九零后算法工程师“删库”获刑
8 月 4 日,北京市首例破坏人工智能模型刑事案件近日尘埃落定:九零后算法工程师王某因犯破坏计算机信息系统罪,被判处有期徒刑五年十个月,并赔偿公司经济损失 20.4 万余元。
据《检察日报》报道,王某是计算机科班出身,履历上写满互联网大厂经历。2024 年 1 月,他入职北京市东城区某科技公司,在 AI 短剧部门担任算法工程师。2024 年 9 月 3 日下午,王某用旧账号密码登录 A 集群,查找本部门文件夹未果,随后打开 AI 游戏部门的文件夹。那里存放着该公司自主研发的多个文生 3D 和渲染 AI 模型,以及全部训练数据。拉取目录未果后,他输入了一条程序员圈子里被称为“删库跑路”的指令:以最高权限、无需确认、强制删除当前目录下的一切文件和子目录。
王某到案后始终辩称“以为数据没用了才删除”。压垮这一辩解的,是检方从海量手机数据中挖出的聊天记录。记录显示,王某与网上结识的同行高某早有约定:利用公司的数据和算力,帮对方“训模型”“跑数据”。检方据此认定,王某删除公司数据,目的是为自己干私活下载模型腾出空间。
苹果向法院申请临时禁令,阻止 OpenAI 使用、披露其机密信息
8 月 4 日,苹果当地时间周一向美国法院申请初步禁令,要求禁止两名前员工以及 OpenAI 获取、访问、使用或披露涉嫌属于苹果的机密信息。与此同时,苹果正推进其商业机密侵权诉讼。
与此同时,苹果周一还提交了一项加快证据开示程序的动议,要求被告提供与涉嫌访问苹果专有信息和商业机密相关的文件。
苹果还请求法院要求诉讼中涉及的两名前苹果员工刘畅(Chang Liu,音译)和唐坦(Tang Tan,音译)接受庭前证词询问。此外,苹果还要求 OpenAI 员工彭宇婷(Yu-Ting Peng,音译)以及另一位曾任职于苹果、目前供职于 OpenAI、但身份尚未公开的员工接受问询。
刘畅曾担任苹果高级系统电气工程师,唐坦则曾任苹果 iPhone 和 Apple Watch 产品设计副总裁。苹果还要求 OpenAI 以及其商业硬件部门 io Products(同样被列为本案被告)的企业代表接受庭前证词询问。苹果在提交给法院的文件中表示:“如果法院不发布初步禁令,苹果将遭受无法弥补的损害。”
对此,OpenAI 当地时间周一晚间在一篇博客文章中回应称:“苹果申请初步禁令既基于错误信息,也完全没有必要,因为我们既没有,也不希望拥有苹果的任何商业机密。”
1 分钟 25.8 万!AI 短剧虚拟演员商单报价超真人网红
8 月 5 日消息,出道不到两个月,AI 短剧《被裁掉的女孩》女主角方桃子的抖音粉丝已达到 41.2 万,男主角周以衡粉丝也突破 13 万,话题 #两个 AI 演员比内娱待爆艺人都火 #一度登上微博热搜。
粉丝量只是表象,更令行业震动的是方桃子的商业价值。数据显示,其 1-20 秒视频报价 16.8 万元,21-60 秒 20.8 万元,60 秒以上 25.8 万元。这个报价已超过大批真人百万粉丝网红,甚至高于部分千万粉丝网红。目前,方桃子已正式接拍美瞳品牌广告,完成了从剧中人到独立商业 IP 的跨越。一个由算法生成、没有实体的虚拟角色,正在以真人偶像的方式走红、吸粉、变现。
OpenAI 首款 AI 硬件爆料:甜甜圈造型、冰球大小,先进语音交互等
8 月 7 日消息,彭博社的马克·古尔曼爆料称 OpenAI 的首款 AI 硬件为“甜甜圈”造型、冰球(直径约为 7.62 厘米,约 115.8 立方厘米)大小,售价预估在 300 美元到 400 美元(现汇率约合 2,029 元到 2,705 元人民币)之间,由 OpenAI 公司和前苹果设计师乔纳森·伊夫合作开发,有望 2027 年发布。
这款 AI 硬件本质上是“没有显示屏的智能音箱”,面向家庭场景设计,用户可用单手在家中携带它移动。这款硬件配备可移动部件,其中部分部件可自动移动,用于提示设备正在响应或与用户互动。设备还将配备灯光、摄像头系统和其他传感器。交互方式上,该设备的运行机制,类似于手机端的 ChatGPT 语音模式,会使用更先进的模型,以支持更接近人类交流的互动。

此外,OpenAI 宣布 ChatGPT Atlas 于 8 月 9 日正式停止服务,此后既不再推送功能更新,也不再修补安全漏洞,这款产品从 2025 年 10 月 21 日登陆 macOS 算起,满打满算才活了不到十个月。OpenAI 官方表示,ChatGPT Atlas 的所有数据不会自动迁移至新版 ChatGPT。如果用户希望保存过往书签、历史记录,则需要将其导出为 HTML 文件,再导入到 Chrome 等其他浏览器。同时,ChatGPT Atlas 浏览器目前无法导出 Cookies 数据,用户迁移至其他浏览器后需要重新登录。
大模型一周大事
重磅发布
阿里巴巴正式发布新一代基座大模型 Qwen3.8,新一代视频生成模型 Wan3.0
8 月 3 日,阿里巴巴正式发布新一代基座大模型 Qwen3.8,总参数量 2.4 万亿,在编程(Coding)和专业办公(Cowork)方面能力大幅提升。近日放榜的三方榜单 Arena 中,阿里 Qwen 模型仅次于 Anthropic 的 Claude 系列。目前,Qwen3.8 的 API 已上线千问 AI 平台,并接入阿里同步推出的 Agent 产品“千问办公”。Qwen3.8-Max 预计下周开源,同时还将开源 Qwen3.8-27B。
8 月 6 日,阿里云公众号宣布全新一代视频生成模型 Wan3.0 开启公测。Wan3.0 在生成时长、万能创作、全能参考与真实感等维度全面升级,单次可生成 30 秒视频,完整表达创作意图;在文本、图片、音频、视频四种基础模态之外,首次支持 doc、xls、ppt、pdf、md 等文档格式输入,号称将让“万物皆可生视频”。
字节跳动发布 SeedRealtime 音视频全双工大模型
8 月 5 日,字节跳动正式发布原生音视频全双工大模型 SeedRealtime,并宣布该模型已在豆包 App 全量上线。用户将豆包更新至最新版本后,可通过“打电话”功能进入视频通话界面,体验实时音视频 AI 交互。SeedRealtime 采用统一端到端架构,原生融合音频、视频和文本,支持模型在连续多模态信息流中同步完成感知、理解、决策与表达,实现“边看、边听、边说”的实时交互。字节表示,SeedRealtime 实现了三项核心能力,包括音视频联合理解、主动交互能力以及更自然的对话节奏。
腾讯混元 Hy ASR 3.0 preview:让语音识别理解上下文
8 月 4 日,腾讯混元正式发布新一代语音识别模型 Hy ASR 3.0 preview。基于最新一代大语言模型 Hy3 的语言理解能力,Hy ASR 3.0 preview 融合高精度语音识别与深度语义理解能力,在通用识别、上下文感知、多场景鲁棒性以及方言覆盖等核心维度实现全面提升。
MiniMax H3 开源,华为昇腾、AMD 等十六家芯片厂商、开源社区 Day 0 适配
8 月 3 日下午消息,MiniMax H3 模型开源,华为昇腾、摩尔线程、沐曦、海光信息、昆仑芯、天数智芯、壁仞科技、AMD、Intel 及 Hugging Face、魔搭 ModelScope、ComfyUI 等十六家芯片厂商、开发社区和云推理平台均在 H3 开源同日完成了相关适配支持。
MiniMax H3 是一个通用型全模态生成系统,在 Artificial Analysis 榜单中视频编辑能力排名全球第一。它能够统一理解由文本、图像、视频和音频构成的多模态上下文,并可生成最高 2K 分辨率、最长 15 秒、带有原生立体声音频的视频。得益于以任务泛化为导向的系统设计,H3 在预训练阶段便已具备广泛的多模态上下文理解与生成能力,因此能够出色地遵循复杂的多模态指令。
H3 系统由 H3-Context-IR、H3-Base、H3-Regenerate-2K 三个模块组成。开发者可以直接从 Hugging Face 下载 MiniMax H3 模型,H3-Base 目前支持通过 SGLang、vLLM、diffusers 和 ComfyUI 等推理框架和工作流进行部署。
面壁智能开源全球首个 Stencil 优化 AI 系统
8 月 4 日,面壁智能联合 OpenBMB 开源社区正式发布并开源全球首个 Stencil(模板计算)优化“自动研究+自动部署”大闭环 AI 系统 ForgeStencil。实测数据显示,ForgeStencil 在同精度(fp32)下几何平均加速 2.35 倍,混合精度下额外提速 1.95 倍。在真实应用场景中,通用 CAE 求解器 hypre 加速 3.86 倍,电磁仿真 FDTD 加速 2.47 倍,核反应堆中子学计算 minisweep 加速最高达 5.78 倍。
阿里云容器服务 Agent 开启商业化收费
阿里云宣布,容器服务 Agent 将于北京时间 9 月 3 日 10 时增加新的技能中心和 IM 频道等功能并开启商业化收费。本次调整后,相关对话、自主智能运维及定时任务等功能将开始收费。调整过程不会影响存量用户已有设置和历史任务记录。容器服务 Agent 以积分作为计量单位,免费开通,支持按量付费及预付费资源包抵扣。使用容器服务 Agent 的对话、自主智能运维及定时任务等功能时产生的模型资源消耗会折算为积分进行计费。
国内首个辅助生殖诊疗 AI Agent 上线
近日,由锦欣生殖旗下成都锦欣信息科技有限公司自主研发的“IVF 领航员”(IVF Co-pilot)系统,在四川锦欣西囡妇女儿童医院(毕昇院区)启动试点。据了解,这是辅助生殖领域首个面向医生的临床辅助 AI Agent。该系统面向辅助生殖诊疗全流程,当前聚焦 IVF(试管婴儿)促排方案及启动用药的辅助评估。系统将医院临床经验、IVF 专业知识、临床算法与本地大模型融入电子病历工作流,为医生提供可比较、可追溯、可复核的辅助信息和临床决策参考。
企业应用
8 月 6 日,Meta 首席执行官马克・扎克伯格在社交媒体发文表示,目前处于测试版的 Muse Code 能够“在大型代码仓库中完成完整软件工程任务”,涵盖“方案规划、代码编写、结果验证”全流程。用户仅需一条命令即可安装 Muse Code,底层依托 Meta 此前发布的代码大模型 Muse Spark。面对大型项目时,它会自动生成多个 Agent 并行开展工作。
8 月 6 日,据外媒报道,微软向参与 AI 编程项目的开发人员提出了一个新要求:把 OpenAI 旗舰模型作为首选。微软 CoreAI 工程团队执行副总裁杰伊 · 帕里克负责的 CoreAI 团队涵盖 GitHub、Visual Studio 和 Visual Studio Code,他要求员工使用 GitHub Copilot 时默认选择 OpenAI 旗舰模型 GPT-5.6 Sol,并在绝大多数情况下继续使用该模型。
8 月 4 日,影石 Insta360 为旗下产品新增 AI 语音助手功能,并将率先落地于影石 Go Ultra 系列。该 AI 语音助手以影石自研为核心,融合了阿里千问的多模态模型能力。端侧完成声纹识别与意图判断,云端则承担问答、模式切换、翻译等复杂任务,由内部代号“Kira”的语音助手承载。




