0
  • 聊天消息
  • 系统消息
  • 评论与回复
登录后你可以
  • 下载海量资料
  • 学习在线课程
  • 观看技术视频
  • 写文章/发帖/加入社区
创作中心

完善资料让更多小伙伴认识你,还能领取20积分哦,立即完善>

3天内不再提示

阿里通义大模型发布新进展 “通义听悟”开放公测

电子麦克风 来源:电子发烧友网 作者:张迎辉 2023-06-03 01:19 次阅读

6月1日,“2023阿里云峰会·粤港澳大湾区”在广州举行,峰会上阿里云CTO周靖人登台向业界宣布了阿里的AI新品的新产品“通义听悟”正式上线开放公测。通义听悟接入了通义千问大模型的理解与摘要能力,可成为用户工作学习中的得力AI助手,帮助随时随地高效完成对音视频内容的转写、检索、摘要和整理,比如用大模型自动做笔记、整理访谈、提取PPT等。公测期间,用户可领取100小时以上听悟免费转写时长。

过去几个月内国内非常多的大模型产品发布,阿里云也在4月7日向业界 宣布自研大模型“通义千问”,邀请用户公测体验。仅过去不到两个月阿里云就再次发布大模型的迭代产品,产品进一步落地到更加专业的场景和应用。

wKgaomR5womAR4YMABD959Mfrcs722.png
(图1:2023阿里云峰会CTO周靖人发布大模型通义听悟 摄影:电子发烧友网)


阿里云CTO周靖人表示:“咱们换一种方式,让音视频可以被轻松阅读、整理和分享。”他介绍,通义听悟是一款工作学习AI助手,它瞄准具有高知识附加值的音视频内容场景,比如开会、上课、访谈、培训、面试、直播、看视频、听播客等,能通过大模型等最新AI技术快速提炼和沉淀知识。

wKgZomR5wpOAX-ZAAAOg4H6uunQ571.jpg 
图2:阿里云通义听悟的应用场非常丰富,帮助提升办公效率 (摄影:电子发烧友网)


根据现场演示,听悟融合了十多项AI功能,可以全面提升知识从音视频向图文形态转化的效率。除了“听力好”,能高准确度生成会议记录、区分不同发言人,这个AI助手“悟性也极高”。大模型可以一秒给音视频划分章节并形成摘要、总结全文及每个发言人观点、整理关注重点和待办事项。

大模型一键提取PPT、针对多个音视频内容向AI提问、概括特定段落等功能近期也将上线。

wKgaomR5wqCAe5mqABIBiMwpU8s271.png
通义听悟可自动为音视频生成全文摘要、章节概括、发言总结


除此以外,通义听悟据说还有一些非常细分场景的功能,例如用户打开Chrome插件,外语学习者和听障人士可以借助双语悬浮字幕条随时随地看无字幕视频。在日程冲突时,听悟还可成为职场人士的“开会替身”,在静音情况下入会AI可代为记录会议、整理要点;转写结果可下载为字幕文件,方便新媒体从业者视频后期制作;听悟梳理的问答回顾可以让记者、分析师、律师、HR等群体整理访谈更高效。

wKgZomR5wquAZXp9AAchqQbZu14367.png
通义听悟Chrome插件将在近期对所有用户开放下载


另一显著优势是,听悟与阿里云云盘打通,一键就能转写云盘上的音视频内容,公测期间注册的听悟用户后续还将获得更大的阿里云盘存储空间,在云盘内在线播放视频时也可自动出字幕。这些都是大模型新用户的福利。小编在此推荐朋友们去使用,在文章下面发表您使用的体验反馈。

wKgaomR5wraAE0ZOAAxEcG9L9hI496.png
通义听悟支持一键导入阿里云盘音视频文件


当然,语音识别生成文字的大模型国内也还有其他的企业在做。我们看看阿里云通义听悟与这类产品的主要区别。

wKgZomR5wr-AXGV_AAECpuoloic370.jpg
图:阿里云CTO周靖人


阿里云CTO周靖人介绍,听悟集成了阿里非常先进的语音和语言技术。其内置阿里新一代工业级语音识别模型,识别准确率在多个权威中文数据集上名列第一;融合自研语音语义多模态说话人算法,能对10人以上说话场景进行角色区分;接入“通义千问”大模型后,能够对上万字的音视频内容进行摘要总结,事实准确与要点完备性国内领先,支持跨多音视频内容的精准问答理解。

继史无前例的大降价后,阿里云再次送出人人都能用上的AI“大礼包”。此前国内语音厂商AI转写定价达19.8元每小时,而听悟用户可通过每日登陆等多种任务领取免费转写时长。公测期间,阿里云官方微博、微信及各大平台社区还会发放大量20小时转写口令码,用户获得的福利权益可累加,一年内有效,免费时长可高达100小时以上,市场价值上千元。

据了解,听悟除个人版本外,还有企业应用。此前,听悟企业版已在阿里集团内部被广泛使用,帮助减少了大量会议记录和整理的工作,受到好评。同时,听悟的能力也可嵌进各类音视频平台,形成实时字幕、智能摘要等,典型应用如钉钉的“钉闪记”背后便集成了听悟。未来听悟还将在夸克APP、阿里云盘端口提供服务。

wKgZomR5wsuAclmFAAyEWJNPHmU781.png
“钉闪记”背后集成通义听悟


虽然我们普通用户没有办法去体会海外的相关版本,但是阿里云的AI大模型能够在非常具体的办公场景中使用人工智能来提升办公的生产效率,相信未来不久国内的互联网又会诞生新的超级应用APP产品出来。电子发烧友网在人工智能方面有专业的分析师跟进,紧跟行业带来一手的资讯报道与分析。


声明:本文内容及配图由入驻作者撰写或者入驻合作网站授权转载。文章观点仅代表作者本人,不代表电子发烧友网立场。文章及其配图仅供工程师学习之用,如有内容侵权或者其他违规问题,请联系本站处理。 举报投诉
  • AI
    AI
    +关注

    关注

    87

    文章

    26472

    浏览量

    264101
收藏 人收藏

    评论

    相关推荐

    联发科天玑9300等旗舰芯片搭载通义千问大模型,成功实现

    通义千问大模型可在离线环境下轻松应对多轮AI对话。此外,阿里云也承诺与联发科进行深度合作,为全球手机制造商提供端侧大模型解决方案。
    的头像 发表于 03-28 16:35 440次阅读

    联发科旗舰芯片部署阿里云大模型

    全球智能手机芯片出货量领先的半导体公司联发科近日宣布,已成功在天玑9300等旗舰芯片上集成阿里通义千问大模型,实现了大模型在手机芯片端的深度适配,此举尚属业界首次。
    的头像 发表于 03-28 13:59 149次阅读

    通义千问首次落地天玑9300移动平台!阿里云携手MediaTek探索端侧AI智能体

    3月28日,阿里云与知名半导体公司MediaTek联合宣布,通义千问18亿、40亿参数大模型已成功部署进天玑9300移动平台,可离线流畅运行即时且精准的多轮AI对话应用,连续推理功耗增量不到3W
    发表于 03-28 10:51 107次阅读
    <b class='flag-5'>通义</b>千问首次落地天玑9300移动平台!<b class='flag-5'>阿里</b>云携手MediaTek探索端侧AI智能体

    联发科天玑9300搭载通义千问大模型阿里云提供解决方案

    通义千问大模型已开源多项版本,包括18亿、70亿、140亿及720亿参数等版本伴随视觉、音频多模态能力提升。阿里云于去年10月发布通义千问
    的头像 发表于 03-28 09:55 132次阅读

    阿里通义千问重磅升级,免费开放1000万字长文档处理功能

    近日,阿里巴巴旗下的人工智能应用通义千问迎来重磅升级,宣布向所有人免费开放1000万字的长文档处理功能,这一创新举措使得通义千问成为全球文档处理容量第一的AI应用。
    的头像 发表于 03-26 11:09 326次阅读

    阿里模型通义听悟”升级

    阿里旗下的强大模型产品“通义听悟”近日迎来了一系列功能升级,其中包括备受瞩目的音视频问答助手“小悟”的正式上线。这一新功能凭借出色的多语言Query处理能力、长篇章文本理解能力以及指令演化框架优化
    的头像 发表于 03-21 11:30 491次阅读

    阿里模型产品发布多项新功能,音视频问答助手“小悟”上线

    通义听悟基于通义千问大模型,集成10余项人工智能功能,涉及转化、翻译、角色分割、全篇摘要、章节浏览、发言总结以及PPT提取等。同时,通义听悟提供标注重点与随手笔记功能。
    的头像 发表于 03-19 15:51 140次阅读

    汽车行业首个大模型GPT-BI应用在中国一汽落地

    近日,中国一汽与阿里通义千问共同宣布,已成功落地汽车行业首个GPT-BI大模型应用。这一创新性的技术突破不仅标志着中国一汽在智能化转型道路上的重要里程碑,也代表着汽车行业在大数据分析与人工智能应用方面的
    的头像 发表于 02-06 16:38 2883次阅读

    两家企业有关LED项目的最新进展

    近日,乾富半导体与英创力两家企业有关LED项目传来最新进展
    的头像 发表于 01-15 13:37 348次阅读

    阿里通义千问720亿参数模型宣布开源

    12月1日,阿里通义千问720亿参数模型Qwen-72B宣布开源。与此同时,他们还开源了18亿参数模型Qwen-1.8B和音频大模型Qwe
    的头像 发表于 12-01 17:08 858次阅读

    阿里发布通义千问2.0,性能超GPT-3.5

    在过去的6个月里,通义千问2.0与4月份推出的1.0版本相比,在复杂的命令理解、文学创作、通用数学、知识记忆、幻觉抵抗力等方面有了很大的提高。目前,通义千问的千托综合性能已经超过gpt-3.5,正在快速赶上gpt-4。
    的头像 发表于 11-01 09:57 442次阅读

    VisionFive 2 AOSP最新进展即将发布

    非常开心地在这里和大家提前预告,我们即将发布VisionFive 2 集成 AOSP的最新进展!请大家多多期待吧~ 此次通过众多社区成员的支持和贡献(https://github.com
    发表于 10-08 09:15

    阿里通义千问大模型已首批通过备案,正式向公众开放

    据悉,通义千问在技术创新和行业应用上均位居大型模型行业前列。在idc的最新ai大模型评估报告中,通义千问在11个测试中,在共同能力、服务能力、创新能力、服务能力、平台能力、生态合作、电
    的头像 发表于 09-13 11:20 901次阅读

    今日看点丨iPhone 15 Pro首次搭载A17 Pro:全球首款3nm芯片;联发科回应“天玑 9300 芯片过热”:毫无根据

    1. 阿里通义千问大模型已首批通过备案,正式向公众开放   “阿里云”13日消息,今天,阿里
    发表于 09-13 10:59 721次阅读
    今日看点丨iPhone 15 Pro首次搭载A17 Pro:全球首款3nm芯片;联发科回应“天玑 9300 芯片过热”:毫无根据

    阿里通义千问”已完成备案 即将上线

    阿里通义千问”已完成备案 即将上线 就在文心一言开放之后,其他的大模型都在加速,阿里旗下的大模型
    发表于 09-02 15:56 304次阅读