硬核干货——《中小企业 AI 实战指南》免费下载! 了解详情
写点什么

用大模型自动做笔记、提取 PPT、整理访谈,阿里云 AI 新产品“通义听悟”开放公测

  • 2023-06-01
    北京
  • 本文字数:1245 字

    阅读完需:约 4 分钟

用大模型自动做笔记、提取PPT、整理访谈,阿里云AI新产品“通义听悟”开放公测

6 月 1 日,阿里云宣布通义大模型进展,聚焦音视频内容的 AI 新品“通义听悟”正式上线,开放公测。


继史无前例的大降价后,阿里云送出人人都能用上的 AI“大礼包”。此前国内语音厂商 AI 转写定价达 19.8 元每小时,而听悟用户可通过每日登陆等多种任务领取免费转写时长。公测期间,阿里云官方微博、微信及各大平台社区还会发放大量 20 小时转写口令码,用户获得的福利权益可累加,一年内有效,免费时长可高达 100 小时以上,市场价值上千元。公测期间,用户预估可领取 100 小时以上听悟免费转写时长。


据悉,通义听悟接入了通义千问大模型的理解与摘要能力,可成为用户工作学习中的得力 AI 助手,帮助随时随地高效完成对音视频内容的转写、检索、摘要和整理,比如用大模型自动做笔记、整理访谈、提取 PPT 等。

 

“换一种方式,让音视频可以被轻松阅读、整理和分享。”阿里云 CTO 周靖人介绍,听悟是一款工作学习 AI 助手,它瞄准具有高知识附加值的音视频内容场景,比如开会、上课、访谈、培训、面试、直播、看视频、听播客等,能通过大模型等最新 AI 技术快速提炼和沉淀知识。   



据悉,听悟融合了十多项 AI 功能,可以全面提升知识从音视频向图文形态转化的效率。除了“听力好”,能高准确度生成会议记录、区分不同发言人,这个 AI 助手“悟性也高”,大模型可以一秒给音视频划分章节并形成摘要、总结全文及每个发言人观点、整理关注重点和待办事项。大模型一键提取 PPT、针对多个音视频内容向 AI 提问、概括特定段落等功能近期也将上线。


通义听悟可自动为音视频生成全文摘要、章节概括、发言总结

 

针对一些细分场景,听悟还设置了不少“宝藏功能”:打开 Chrome 插件,外语学习者和听障人士可以借助双语悬浮字幕条随时随地看无字幕视频,日程冲突时,听悟还可成为职场人士的“开会替身”,在静音情况下入会 AI 可代为记录会议、整理要点;转写结果可下载为字幕文件,方便新媒体从业者视频后期制作;听悟梳理的问答回顾可以让记者、分析师、律师、HR 等群体整理访谈更高效。


通义听悟 Chrome 插件将在近期对所有用户开放下载

 

此外,听悟与阿里云盘打通,一键就能转写云盘上的音视频内容,公测期间注册的听悟用户后续还将获得更大的阿里云盘存储空间,在云盘内在线播放视频时也可自动出字幕。


通义听悟支持一键导入阿里云盘音视频文件

 

周靖人介绍,听悟集成了阿里最先进的语音和语言技术。其内置阿里新一代工业级语音识别模型,识别准确率在多个权威中文数据集上名列第一;融合自研语音语义多模态说话人算法,能对 10 人以上说话场景进行角色区分;接入通义千问大模型后,能够对上万字的音视频内容进行摘要总结,事实准确与要点完备性国内领先,支持跨多音视频内容的精准问答理解。

 

据了解,听悟除个人版本外,还有企业应用。此前,听悟企业版已在阿里集团内部被广泛使用,帮助减少了大量会议记录和整理的工作,受到好评。同时,听悟的能力也可嵌进各类音视频平台,形成实时字幕、智能摘要等,典型应用如钉钉的“钉闪记”背后便集成了听悟。未来听悟还将在夸克 APP、阿里云盘等端口提供服务。


“钉闪记”背后集成通义听悟

2023-06-01 11:364878

评论

发布
暂无评论
发现更多内容

低代码 + 智能体能有啥新花样?直接上实操!

行云创新

低代码 智能体 AI Agent

Dify基础应用篇 (5) | 创建第一个对话型应用:智能客服机器人(保姆级教程)

测吧(北京)科技有限公司

软件测试 人工智能、 dify

技术盘点:消息中间件的过去、现在和未来

Apache RocketMQ

阿里云 云原生 消息队列 EventBridge

医科+AI 人才培养丨首都医科大学AI通识教育新路径探索与实践分享

ModelWhale

人工智能 AI通识教育 首都医科大学

金标联盟发布隐私权限体系,共建安卓生态安全体验

科技热闻

轻量化赋能,小程序容器激活 SuperApp 生态潜能

Byte_Me

小程序 App 小程序容器 轻量化 superapp

告别季末打折清库存 企划阶段即可锁定利润

第七在线

EventBridge消息路由|高效构建消息路由能力

Apache RocketMQ

云原生 消息队列 EventBridge 异地双活 事件总线Eventbridge

新闻速递丨Altair 重磅发布:全球100 个 AI 应用案例,助力企业加速 AI 技术应用

Altair RapidMiner

人工智能 AI 仿真 CAE RapidMiner

【跨国数仓迁移最佳实践6】MaxCompute SQL语法及函数功能增强,10万条SQL转写顺利迁移

阿里云大数据AI技术

sql 阿里云 MaxCompute ODPS BigQuery

信创技术架构:自主可控体系的构建与实践路径

Byte_Me

稳中求进 以进促稳 | 光大永明资产召开2025年年中工作会议

北京中暄互动广告传媒有限公司

多类别的家庭厨房食物、物品识别系统开箱即用教程 (YOLOv8)| 完整源码与部署教程

申公豹

人工智能

消息驱动、事件驱动、流”基础概念解析

Apache RocketMQ

云原生 消息队列 EventBridge

EventBridge 事件总线及 EDA 架构解析

Apache RocketMQ

阿里云 云原生 消息队列 EventBridge 事件总线Eventbridge

API 接口驱动 1688 采购自动化:从商品获取到下单支付的全流程贯通

Noah

Playwright教程基础篇(2)元素定位策略大全

测吧(北京)科技有限公司

软件测试 #人工智能

LevelDB 辅助工具类

数新网络官方账号

互联网 + 共享农业小程序系统:智慧农业

微擎应用市场

从Swatch“辱华”风波看品牌危机应对:舆情监测为何是出海品牌的必修课?

沃观Wovision

舆情监测系统 海外舆情监测 Swatch

Apache RocketMQ + Hudi 快速构建 Lakehouse

Apache RocketMQ

阿里云 RocketMQ 云原生 消息队列

投票活动:高效投票

微擎应用市场

二手车小程序系统:汽车交易

微擎应用市场

RocketMQ-Streams 首个版本发布,轻量级计算的新选择

Apache RocketMQ

印度软件外包业的AI大逃杀

脑极体

AI

5G + AI + 云:电信技术重塑游戏生态与未来体验

GPU算力

云游戏 Stable Diffusion PC集群 PC 农场 PC farm

鸿蒙生态7月技术月报 | HarmonyOS 5.1 开发特性详解

优测云服务平台

鸿蒙 HarmonyOS

基于 EventBridge 构建 SaaS 应用集成方案

Apache RocketMQ

阿里云 云原生 消息队列 事件总线 EventBridge

融云十周年纪录片《十字路口》之《妳很了不起》,看到焦虑的本质

融云 RongCloud

利用Cron定时任务管理OpenVPN用户访问权限

qife122

OpenVPN Bash脚本

在线律师咨询小程序系统:法律服务

微擎应用市场

用大模型自动做笔记、提取PPT、整理访谈,阿里云AI新产品“通义听悟”开放公测_开源_InfoQ编辑部_InfoQ精选文章