阿里研发支出连续三年登顶; 《MIT科技评论》为阿里AI语音技术点赞;达摩院引入以色列著名计算机视觉科学家 | 周博通

简介: 每周一早晨,阿里妹为你呈现最新的阿里技术资讯。

每周一早晨,阿里妹为你呈现最新的阿里技术资讯。这份“技术早餐”里,包含重磅的阿里技术新闻,独特的大牛观点,精彩的活动资讯等,五分钟时间,让你成为“周博通”。

话不多说,这就为你送上新鲜出炉的“技术早餐”。
周 博 通

《麻省理工科技评论》为阿里AI语音技术点赞:“可读懂人类潜藏意图”

阿里巴巴近日一项在国际顶级学术会议上的AI语音技术演示,引起业界轰动。

1
阿里巴巴达摩院的科学家在机器学习领域顶级会议NIPS(神经信息处理系统大会)上,演示了这项已应用于快递领域的AI语音技术。在约30秒的时间里,菜鸟语音助手在经历了被用户打断、更改意图、沉默等交互后,依然能够应对自如,顺利帮助用户完成了快递派送地址的更改。

《麻省理工科技评论》认为,阿里巴巴演示中发生的一幕,揭开了人机语音交互的新序幕,并表示:阿里巴巴的AI语音助手可以完成复杂的人类对话功能,甚至可读懂人类的潜在意图,显示出阿里巴巴拥有居于世界前列的AI语音技术。

《边缘云计算技术及标准化白皮书》开放下载

近日,阿里云与中国电子技术标准化研究院等多家单位共同合作编写的《边缘云计算技术及标准化白皮书》正式发布,在业界首次从标准的角度明确定义了”边缘云计算“的概念、技术特点、应用场景及标准化建议。

1

据IDC预测,到2020年将有超过500亿的终端和设备联网,其中超过50%的数据需要在网络边缘侧分析、处理与存储。万物互联时代的基本需求是“低时延,大带宽,大连接,本地化”, “云、边、端三体协同”是物联网时代的计算组合形态,边缘云计算将是物联网时代不可或缺的通用基础设施。

依据目前边缘云生态中技术、产品、服务、应用等关键环节,结合国内外边缘云技术发展现状以及标准化需求,发挥国家标准化机构和行业领先企业的联合优势,阿里云率先倡议并组织开展了边缘云计算标准化体系框架建设,标准建议包括:基础、技术要求、管理要求、安全要求、行业及应用等,这些标准主要结合现有云计算标准体系做了延续和扩展,以满足边缘云计算的新需求和新特性。
1

普华永道:阿里巴巴研发支出连续三年居中国上市企业之首

近日,普华永道发布了一份名为《2018全球创新企业1000强》的报告,该报告显示2018年中国上市企业的研发投入增幅达到美国4倍,居世界第一,其中阿里巴巴的研发支出连续三年居中国上市企业之首。

普华永道是世界顶级会计师事务所之一,他们调查了2018财年(截止2018年6月30日)全球规模前1000的企业在研发方面的投入,发现以阿里巴巴为代表的中国公司在研发支出上呈现快速上升的趋势,2018年上榜的中国企业数量由125家增加为145家。

1
研发上的持续投入正在产生源源不断的技术成果。在量子计算领域,阿里巴巴达摩院量子实验室成功研制出目前世界最强量子电路模拟器“太章”;在芯片领域,阿里巴巴今年9月宣布成立平头哥半导体有限公司,正在密集的开发多款供广大企业应用的普惠芯片。

达摩院加速布局以色列 引入世界级计算机视觉科学家

近期,以色列理工学院著名计算机视觉科学家Lihi Zelnik-Manor教授,正式入职达摩院以色列机器视觉实验室。

1


Lihi Zelnik Manor从魏茨曼科学研究所获得计算机博士学位,后进入以色列理工学院电气工程系担任副教授、计算图像与多媒体实验室研究员,曾多次获得IEEE与ICCV的杰出论文奖,并连续多年担任ECCV与CVPR等计算机视觉大会主席,也是顶级学术期刊TPAMI的核心编辑。作为实验室负责人,她将带领团队推动达摩院计算机视觉领域的基础研究,以及新零售、智慧城市等广泛领域的应用结合。

以色列机器视觉研究实验室,是达摩院遍布全球的科研机构之一,也是达摩院首支完全由外籍科学家组成的研发团队,成员来自于Intel、三星、特拉维夫大学等世界级研究机构。

除了以色列外,达摩院已在新加坡、美国等多个国家与地区设立研发中心与实验室,并与新加坡南洋理工大学、斯坦福大学、加州大学伯克利分校、清华大学、浙江大学、中国科学院成立多个联合研究基地。

阿里巴巴在澳门推进医疗AI 帮助人类抵御流感疫情

人工智能帮助人类抵御流感疫情?!看似天方夜谭的故事正在被技术实现。目前,阿里医疗AI正在支持澳门构建智能城市,特别是当地卫生局的“疾病趋势”预测,这或将改变传统的流行疾病预防模式。

其中,“智慧医疗”项目的人工智能技术通过疾病趋势以及过往流感疫情综合分析,可以预测未来两周城市流感等疾病的爆发强度和蔓延风险,从而提前帮助市民和卫生机构做好预防措施。
1
以城市为单位构建统一的卫生防疫体系是一种全新的疾病防治策略。它可以同个人的疾病预防、治疗相结合,从而让城市在与流行疾病的“闪电战”中占据主动。

原文发布时间为:2018-12-17
本文作者:抓住2018小尾巴
本文来自云栖社区合作伙伴“阿里技术”,了解相关信息可以关注“阿里技术”。

相关文章
|
人工智能 文字识别 安全
趣丸千音MCP首发上线魔搭社区,多重技术引擎,解锁AI语音无限可能
近日,趣丸千音(All Voice Lab)MCP正式首发上线魔搭社区。用户只需简单文本输入,即可调用视频翻译、TTS语音合成、智能变声、人声分离、多语种配音、语音转文本、字幕擦除等多项能力。
1453 32
|
人工智能 Android开发 iOS开发
安卓版快捷指令,加了AI语音可以一句话操作v0.2.7
Shortcuts for Android(SFA)是一款安卓自动化工具,支持语音创建快捷指令,实现听歌、导航、发消息等操作。操作简单,提升效率,快来体验语音控制的便捷!
1515 0
安卓版快捷指令,加了AI语音可以一句话操作v0.2.7
|
人工智能 自然语言处理 语音技术
深度解析:AI语音客服系统如何重塑客户服务体验与主流解决方案探析
在数字化浪潮下,AI语音客服凭借高效、便捷、24小时在线的优势,成为企业提升服务效率、优化体验的重要工具。本文详解其核心技术、应用价值、选型要点及市场主流方案,如阿里云通义晓蜜、合力亿捷等,助力企业智能化升级。
732 1
|
人工智能 移动开发 开发工具
H5录音、图文视频IndexDB储存最佳实践:用AI生成语音备忘录
随心记是一个由 AI 生成的网页备忘录,它支持语音录入(可下载)、图文视频记录。最重要的是,它支持离线使用,所有数据都储存在浏览器中,不依赖后端,刷新页面数据也不会丢失!
531 0
H5录音、图文视频IndexDB储存最佳实践:用AI生成语音备忘录
|
人工智能 搜索推荐 程序员
程序员圈爆火,狂揽2.4K星!1秒内AI语音双向对话,支持个性化发音和多端适配,颠覆你的交互想象!
RealtimeVoiceChat是一款基于现代Web技术的开源实时语音对话工具,无需下载任何软件,打开浏览器即可与AI实时语音互动。其核心亮点包括零安装体验、超低延迟、高度可定制化以及跨平台兼容等特性。通过Web Speech API实现毫秒级语音合成,支持多参数精细控制(如音色、语速、音调等),并提供隐私安全保障。项目适用于无障碍辅助、语言学习、智能客服及内容创作等多个场景。开发者可快速集成GPT/Claude等大模型,扩展为企业级应用。此外,随着Web Speech API普及率提升,该项目有望推动语音交互在教育、智能家居等领域的发展
2032 4
|
存储 人工智能 Java
Springboot集成AI Springboot3 集成阿里云百炼大模型CosyVoice2 实现Ai克隆语音(未持久化存储)
本项目基于Spring Boot 3.5.3与Java 17,集成阿里云百炼大模型CosyVoice2实现音色克隆与语音合成。内容涵盖项目搭建、音色创建、音频合成、音色管理等功能,适用于希望快速掌握Spring Boot集成语音AI技术的开发者。需提前注册阿里云并获取API Key。
|
人工智能 自然语言处理 搜索推荐
13.5K Star!支持5国语言+全栈语音生成,这个开源AI语音项目绝了!
CosyVoice是由FunAudioLLM团队开发的多语言大语音生成模型,支持中文、英语、日语、韩语和粤语等5种语言。该项目提供从推理、训练到部署的全栈能力,具备零样本语音克隆、跨语言合成、指令控制等前沿功能。其技术架构包括底层模型、多语言支持、框架支持及部方案等,性能优越,RTF<0.2,GPU内存<4GB,QPS>20。相比同类项目,CosyVoice在语言支持、特色功能和部署难度上表现出色,支持本地部署保障数据隐私,并大幅降低商业方案成本。适用于自媒体创作、在线教育、游戏开发、智能硬件和影视制作等多种场景。
1827 0
|
机器学习/深度学习 计算机视觉
AIGC核心技术——计算机视觉(CV)预训练大模型
【1月更文挑战第13天】AIGC核心技术——计算机视觉(CV)预训练大模型
1401 3
AIGC核心技术——计算机视觉(CV)预训练大模型
|
人工智能 测试技术 API
AI计算机视觉笔记二十 九:yolov10竹签模型,自动数竹签
本文介绍了如何在AutoDL平台上搭建YOLOv10环境并进行竹签检测与计数。首先从官网下载YOLOv10源码并创建虚拟环境,安装依赖库。接着通过官方模型测试环境是否正常工作。然后下载自定义数据集并配置`mycoco128.yaml`文件,使用`yolo detect train`命令或Python代码进行训练。最后,通过命令行或API调用测试训练结果,并展示竹签计数功能。如需转载,请注明原文出处。
1703 5
|
机器学习/深度学习 编解码 人工智能
Vision Mamba:将Mamba应用于计算机视觉任务的新模型
Mamba是LLM的一种新架构,与Transformers等传统模型相比,它能够更有效地处理长序列。就像VIT一样现在已经有人将他应用到了计算机视觉领域,让我们来看看最近的这篇论文“Vision Mamba: Efficient Visual Representation Learning with Bidirectional State Space Models,”
1541 7

热门文章

最新文章