写点什么

用大模型自动做笔记、提取 PPT、整理访谈,阿里云 AI 新产品“通义听悟”开放公测

  • 2023-06-01
    北京
  • 本文字数:1245 字

    阅读完需:约 4 分钟

用大模型自动做笔记、提取PPT、整理访谈,阿里云AI新产品“通义听悟”开放公测

6 月 1 日,阿里云宣布通义大模型进展,聚焦音视频内容的 AI 新品“通义听悟”正式上线,开放公测。


继史无前例的大降价后,阿里云送出人人都能用上的 AI“大礼包”。此前国内语音厂商 AI 转写定价达 19.8 元每小时,而听悟用户可通过每日登陆等多种任务领取免费转写时长。公测期间,阿里云官方微博、微信及各大平台社区还会发放大量 20 小时转写口令码,用户获得的福利权益可累加,一年内有效,免费时长可高达 100 小时以上,市场价值上千元。公测期间,用户预估可领取 100 小时以上听悟免费转写时长。


据悉,通义听悟接入了通义千问大模型的理解与摘要能力,可成为用户工作学习中的得力 AI 助手,帮助随时随地高效完成对音视频内容的转写、检索、摘要和整理,比如用大模型自动做笔记、整理访谈、提取 PPT 等。

 

“换一种方式,让音视频可以被轻松阅读、整理和分享。”阿里云 CTO 周靖人介绍,听悟是一款工作学习 AI 助手,它瞄准具有高知识附加值的音视频内容场景,比如开会、上课、访谈、培训、面试、直播、看视频、听播客等,能通过大模型等最新 AI 技术快速提炼和沉淀知识。   



据悉,听悟融合了十多项 AI 功能,可以全面提升知识从音视频向图文形态转化的效率。除了“听力好”,能高准确度生成会议记录、区分不同发言人,这个 AI 助手“悟性也高”,大模型可以一秒给音视频划分章节并形成摘要、总结全文及每个发言人观点、整理关注重点和待办事项。大模型一键提取 PPT、针对多个音视频内容向 AI 提问、概括特定段落等功能近期也将上线。


通义听悟可自动为音视频生成全文摘要、章节概括、发言总结

 

针对一些细分场景,听悟还设置了不少“宝藏功能”:打开 Chrome 插件,外语学习者和听障人士可以借助双语悬浮字幕条随时随地看无字幕视频,日程冲突时,听悟还可成为职场人士的“开会替身”,在静音情况下入会 AI 可代为记录会议、整理要点;转写结果可下载为字幕文件,方便新媒体从业者视频后期制作;听悟梳理的问答回顾可以让记者、分析师、律师、HR 等群体整理访谈更高效。


通义听悟 Chrome 插件将在近期对所有用户开放下载

 

此外,听悟与阿里云盘打通,一键就能转写云盘上的音视频内容,公测期间注册的听悟用户后续还将获得更大的阿里云盘存储空间,在云盘内在线播放视频时也可自动出字幕。


通义听悟支持一键导入阿里云盘音视频文件

 

周靖人介绍,听悟集成了阿里最先进的语音和语言技术。其内置阿里新一代工业级语音识别模型,识别准确率在多个权威中文数据集上名列第一;融合自研语音语义多模态说话人算法,能对 10 人以上说话场景进行角色区分;接入通义千问大模型后,能够对上万字的音视频内容进行摘要总结,事实准确与要点完备性国内领先,支持跨多音视频内容的精准问答理解。

 

据了解,听悟除个人版本外,还有企业应用。此前,听悟企业版已在阿里集团内部被广泛使用,帮助减少了大量会议记录和整理的工作,受到好评。同时,听悟的能力也可嵌进各类音视频平台,形成实时字幕、智能摘要等,典型应用如钉钉的“钉闪记”背后便集成了听悟。未来听悟还将在夸克 APP、阿里云盘等端口提供服务。


“钉闪记”背后集成通义听悟

2023-06-01 11:363823

评论

发布
暂无评论
发现更多内容

算力荒缓解,自主化智算还有必要吗?

脑极体

AI

当Kmesh遇上Ambient Mesh

华为云原生团队

云计算 容器 云原生

WiFi6 IPQ5018 Meets WiFi7 QCN9274/QCN6274 Cards: The Ultimate Performance Analysis

wifi6-yiyi

wifi

人工智能与云计算的结合:如何释放数据的无限潜力?

天津汇柏科技有限公司

云计算 AI 人工智能

音乐NFT系统的技术难点

北京木奇移动技术有限公司

区块链技术开发 软件外包公司 音乐NFT

荣耀 | 7thonline第七在线荣获托比网与易观之星两项大奖

第七在线

财务规划的成功战略之一:建立数据驱动型决策

智达方通

企业管理 全面预算管理 财务规划 智能技术

具身智能赛道很火,值得ALL in吗?

机器人头条

机器人 特斯拉 大模型 人形机器人 具身智能

重塑 Java 开发体验:SoFlu-JavaAI 产品体验官招募!100%有礼!

SoFlu-JavaAI开发助手

开发工具 Java. 有奖评测

新终端·创未来 | 2025上海国际消费电子展开启预定!

AIOTE智博会

消费电子展 消费电子展会 消费电子博览会 消费电子展览会

网络安全养生秘籍-轻松完成等保测评流程

行云管家

网络安全 等保 等级保护 等保测评

京东商品视频数据接口(JD.item_get_video)

tbapi

京东API接口 京东商品视频接口 京东视频接口

秒验简介与下载说明

MobTech袤博科技

10个案例告诉你mysql不使用子查询的原因

威哥爱编程

MySQL sql

推荐一款免费的数据库SQL审核,性能诊断与优化平台

威哥爱编程

sql SQL工具

AI智能体的开发流程

北京木奇移动技术有限公司

AI大模型 AI智能体 软件外包公司

淘宝天猫API接口详解:商品详情与关键词搜索商品的实用指南及代码示例

代码忍者

淘宝API接口 淘宝评论API

华瑞指数云受邀参加航空航天信息技术交流会,以信创存储推动行业高质量发展

科技热闻

周亚辉的朋友圈,揭开潜藏在AI冰山下的秘密

新消费日报

合合信息在视觉内容安全领域的创新与应用 - 应对伪造挑战的前沿进展

申公豹

人工智能 安全

区块链智能合约的开发流程

北京木奇移动技术有限公司

智能合约 区块链技术 软件外包公司

鸿蒙(HarmonyOS)原生AI能力之文本识别

猫林老师

鸿蒙 HarmonyOS 鸿蒙应用开发 鸿蒙原生应用开发 HarmonyOS NEXT

开源轻量级IM框架MobileIMSDK的鸿蒙NEXT客户端库已发布

JackJiang

即时通讯;IM;网络编程 MobileIMSDK-鸿蒙端

第79期 | GPTSecurity周报

云起无垠

AIGC GPT

webGL开发框架的技术难点

北京木奇移动技术有限公司

软件外包公司 数字孪生开发 webgl开发

原生鸿蒙2024年度先锋榜:高品质原生应用焕新数字生活体验

最新动态

【新年专刊】新的一年设定2025目标--催化型画布

ShineScrum

个人目标

数据筑底,构建管理会计数据基础

用友智能财务

数据 会计

荣耀x腾讯云AI代码助手 重构智能时代开发模式

Geek_2d6073

AI 智能体(AI Agent)的应用

北京木奇移动技术有限公司

AI应用 AI智能体 软件外包公司

ClkLog集成指南

ClkLog

sdk 数据集成 开源软件 用户画像 埋点分析

用大模型自动做笔记、提取PPT、整理访谈,阿里云AI新产品“通义听悟”开放公测_开源_InfoQ编辑部_InfoQ精选文章