大数据&AI产品月刊【2023年9月】

简介: 大数据&AI产品技术月刊【2023年9月】,涵盖本月技术速递、产品和功能发布、市场和客户应用实践等内容,帮助您快速了解阿里云大数据&AI方面最新动态。

一、产品功能发布

【云原生大数据计算服务 MaxCompute】新功能/规格 - 作业分析功能发布    

MaxCompute推出作业分析功能,方便开发者定位作业资源问题。


【实时数仓 Hologres】新功能/规格 - ClickHouse整库迁移Hologres

支持ClickHouse数据整库离线迁移Hologres。


【开源大数据平台 E-MapReduce】新功能/规格 - 新增集群模版功能    

集群模板是一项持久化EMR实例配置功能,可用于快速创建EMR集群。


【实时计算 Flink版】新功能 - CDAS支持新增表后的有状态重启

在整库同步中,如果源库新增表,则作业重新启动后即可生效,对新增表进行数据。


【机器学习平台 PAI】新功能/规格 - DSW/DLC支持挂载加密型NAS

DSW/DLC支持挂载加密型NAS作为实例/任务共享数据集。


【机器学习平台 PAI】新功能/规格 - DSW发布社区版Gallery

DSW发布社区版Gallery,持续提供有竞争力的AI最佳实践内容。


【机器学习平台 PAI】新功能/规格 - DSW基于EasyPhoto的AI写真开发

DSW基于EasyPhoto的AI写真生成能力的开发。


【机器学习平台 PAI】新功能/规格 - DSW支持基于ECI+云盘的按量付费实例

DSW支持基ECI+云盘新建实例,提供免费数据及环境存储,提升拉起速率。


【机器学习平台 PAI】新功能/规格 - 支持配置DSW实例通过专有公网网关访问公网

支持配置DSW实例通过专有公网网关访问公网。


【机器学习平台 PAI】新功能/规格 - PAI 灵骏智算服务支持H800

PAI 灵骏智算支持新算力H800 规格(ml.gu8xf.* 系列)。


【机器学习平台 PAI】功能优化 - 分布式训练产品DLC支持MPI训练框架

DLC支持MPI框架,用户可以提交MPI类型分布式任务。


【机器学习平台 PAI】新功能/规格 - 分布式训练产品DLC 支持监控指标订阅和告警

PAI-DLC 支持查看监控指标数据并订阅告警,帮助用户掌握资源状况。


【机器学习平台 PAI】新功能/规格 - EAS部署ChatGLM&Langchain

通过EAS一键部署ChatGLM及LangChain应用。


【机器学习平台 PAI】新功能/规格 - EAS一键部署通义千问大模型服务

PAI-EAS一键部署开源大模型通义千问。


【机器学习平台 PAI】新功能/规格 - EAS发布异步推理服务自动扩缩容

异步推理服务通过队列长度自动实现资源的弹性扩缩容。


【机器学习平台 PAI】新功能/规格 - EasyCKPT 高性能CKPT发布

PAI为大模型训练场景而开发的高性能Checkpoint框架。


【机器学习平台 PAI】新功能/规格 - FeatureStore公测版发布

中心化的数据管理和共享平台,用于组织、存储和管理AI训练中使用的特征。


【机器学习平台 PAI】功能优化 -特征平台支持表格存储TableStore

FeatureStore支持TableStore在线数据源的同步和建表。


【机器学习平台 PAI】功能优化 - RLHF,大模型训练框架上线

PAI上线人工反馈的强化机器学习训练框架,支持用户快速搭建LLM系统。


【机器学习平台 PAI】新功能/规格 - 支持Stable Diffusion文生图模型微调训练和部署

PAI支持Stable Diffusion模型微调训练、推理服务等。


二、产品快讯

基于阿里云PAI修复50年前亚运会老照片    

德黑兰亚运会是新中国参加的首届亚运会。杭州亚运前夕,亚奥理事会官方资料馆公布了一批德黑兰亚运会老照片,并联合阿里云发起“历久弥新——AI 修复亚运会珍贵史料”活动,吸引了1.5万人参与,共收到1300多张修复照片。本教程教会如何基于 PAI 用 Stable Diffusion 给老照片修复+上色!


国内首家!阿里云 Elasticsearch 8.9 版本释放 AI 搜索新动能    

阿里云作为国内首家上线 Elasticsearch 8.9版本的厂商,在提供 Elasticsearch Relevance Engine™ (ESRE™) 引擎的基础上,提供增强 AI 的最佳实践与 ES 本身的混合搜索能力,为用户带来了更多创新和探索的可能性。此次从8.5版本到8.9版本的全新升级,使得阿里云 Elasticsearch 在向量检索和混合搜索能力都具有显著改善,大大提升了搜索结果的准确性和相关性。


阿里云 Elasticsearch Serverless 全新发布,平均可省 50% 成本    

2023年9月1日,阿里云 Elasticsearch Serverless 正式版上线,基于云原生 Serverless 技术,致力于为用户打造更低成本、弹性灵活、开放兼容、开箱即用的云上 Elasticsearch 使用体验。相比公测版,正式版 Elasticsearch Serverless 对原生 Elasticsearch 的读写 API 及生态组件有更高兼容性,提供默认 Kibana 可视化能力,帮助用户快速构建数据检索与分析应用,可灵活使用在网站搜索、企业信息检索、日志分析、运维监控等多种应用场景中。


议题征集|Flink Forward Asia 2023 正式启动    

作为最受 Apache Flink 社区开发者期盼的年度峰会之一,Flink Forward Asia 2023 已正式启动!延续 FFA 惯例,峰会所有议题均为开放征集而来,并由专业的议题评选委员会评分筛选,确保内容代表行业领先水平。今年,议题组委会将持续集结全球多行业一线厂商,围绕 Flink 核心技术、行业实践、平台建设、实时湖仓、数据集成等多个热门方向,以及 Flink 社区孵化出的 Flink CDC、Apache Paimon、Flink ML 等优质项目,为开发者奉上实时计算领域的技术盛宴。

image.png


DataWorks 增强分析发布,一站式数据查询分析与可视化     

8月31日阿里云郑州峰会,阿里云行业解决方案研发部总经理曾震宇在主论坛飞天发布时刻重磅发布 DataWorks 与 DataV-Card 合作推出的AI增强分析产品,一站式完成从数据查询、分析、可视化、共享的完整链路,1分钟即可形成数据报告,帮助互联网、金融、政务等各个行业客户表达数据观点,讲好数据故事。


阿里云 PAI-灵骏大模型训练工具 Pai-Megatron-Patch 正式开源!    

Pai-Megatron-Patch 工具是阿里云机器学习平台 PAI 算法团队研发,基于阿里云智算服务 PAI-灵骏平台的大模型最佳实践解决方案配套工具,旨在帮助大模型开发者快速上手灵骏产品,完成大语言模型(LLM)的高效分布式训练,有监督指令微调,模型离线推理验证等完整大模型开发链路。该项目提供了业界主流开源大模型基于 Megatron-LM 的训练&离线推理验证流程,方便用户快速上手大模型训练。


EasyPhoto:基于 SD WebUI 的艺术照生成插件来啦!    

EasyPhoto 是一个基于 SD WebUI 的艺术照生成插件,支持低代码操作、自定义风格,让更多开发者灵活地开发自己的风格化艺术照生成应用。允许用户通过上传几张同一个人的照片,快速训练Lora模型,然后结合用户自定义的模板图片,生成 真/像/美的写真图片。诚邀开发者们一起体验,多多提ISSUE,一同优化,让每个AIGCer都拥有自己的AI写真相机!


多场景PAI-Diffusion中文模型家族大升级,12个模型、2个工具全部开源    

在过去几年中,随着AI生成内容(AI Generated Content,AIGC)的快速发展,Stable Diffusion模型在该领域崭露头角。阿里云机器学习PAI团队为推动这一领域的发展,提出了PAI-Diffusion中文文图生成模型,实现了图像生成质量的大幅提升和风格多样化。此次将PAI-Diffusion中文模型家族扩展到多种应用场景,支持文生图、文图生图、图像修复、LoRA、ControlNet等多种常见功能。为了更好地与开源社区互动,将12个PAI-Diffusion中文模型(包括基础模型、LoRA、ControlNet等)全部开源,并支持用户自由下载和使用,与开发者一起共同推动AI生成内容技术的发展,创造出更有创意和影响力的作品。

三、产品学习指南

【客户案例】Hologres RoaringBitmap实践:千亿级画像数据秒级分析    

淘宝用户增长团队使用 Hologres 的 RoaringBitmap 画像方案,并在技术平台落地,成功让 3-5min 的画像分析提升到 10s 左右,显著提升人群分析的效率,为业务决策提供快速的依据。


【最佳实践】基于OpenSearch向量检索版和MaxCompute快速搭建图搜服务    

企业在没有向量数据的情况下,如何通过OpenSearch向量检索版、MaxCompute以及OSS,快速搭建图像搜索服务。用户可以直接导入图片源数据,在OpenSearch内部便捷完成图片向量化、向量搜索等步骤,实现以图搜图、以文搜图等多种图像检索能力。

相关实践学习
基于MaxCompute的热门话题分析
Apsara Clouder大数据专项技能认证配套课程:基于MaxCompute的热门话题分析
相关文章
|
3月前
|
存储 人工智能 安全
拔俗AI临床大数据科研分析平台:让医学研究更智能、更高效
阿里云原生AI临床大数据科研平台,打通异构医疗数据壁垒,实现智能治理、可视化分析与多中心安全协作,助力医院科研提速增效,推动精准医疗发展。
|
3月前
|
人工智能 Cloud Native 算法
拔俗云原生 AI 临床大数据平台:赋能医学科研的开发者实践
AI临床大数据科研平台依托阿里云、腾讯云,打通医疗数据孤岛,提供从数据治理到模型落地的全链路支持。通过联邦学习、弹性算力与安全合规技术,实现跨机构协作与高效训练,助力开发者提升科研效率,推动医学AI创新落地。(238字)
|
3月前
|
传感器 人工智能 监控
拔俗多模态跨尺度大数据AI分析平台:让复杂数据“开口说话”的智能引擎
在数字化时代,多模态跨尺度大数据AI分析平台应运而生,打破数据孤岛,融合图像、文本、视频等多源信息,贯通微观与宏观尺度,实现智能诊断、预测与决策,广泛应用于医疗、制造、金融等领域,推动AI从“看懂”到“会思考”的跃迁。
|
人工智能 大数据 Apache
大数据&AI的16种可能,2020阿里云客户最佳实践合集下载
2020年9月18日下午13:00云栖大会正式发布 《大数据&AI的16种可能,2020阿里云客户最佳实践合集》
73892 4
大数据&AI的16种可能,2020阿里云客户最佳实践合集下载
|
人工智能 大数据 云栖大会
大数据&AI的16种可能,2020阿里云客户最佳实践合集下载
2020年9月18日下午13:00云栖大会正式发布 《大数据&AI的16种可能,2020阿里云客户最佳实践合集》
3645 0
大数据&AI的16种可能,2020阿里云客户最佳实践合集下载
|
3月前
|
消息中间件 人工智能 安全
云原生进化论:加速构建 AI 应用
本文将和大家分享过去一年在支持企业构建 AI 应用过程的一些实践和思考。
776 46
|
4月前
|
人工智能 安全 中间件
阿里云 AI 中间件重磅发布,打通 AI 应用落地“最后一公里”
9 月 26 日,2025 云栖大会 AI 中间件:AI 时代的中间件技术演进与创新实践论坛上,阿里云智能集团资深技术专家林清山发表主题演讲《未来已来:下一代 AI 中间件重磅发布,解锁 AI 应用架构新范式》,重磅发布阿里云 AI 中间件,提供面向分布式多 Agent 架构的基座,包括:AgentScope-Java(兼容 Spring AI Alibaba 生态),AI MQ(基于Apache RocketMQ 的 AI 能力升级),AI 网关 Higress,AI 注册与配置中心 Nacos,以及覆盖模型与算力的 AI 可观测体系。
1048 51
|
3月前
|
人工智能 运维 Kubernetes
Serverless 应用引擎 SAE:为传统应用托底,为 AI 创新加速
在容器技术持续演进与 AI 全面爆发的当下,企业既要稳健托管传统业务,又要高效落地 AI 创新,如何在复杂的基础设施与频繁的版本变化中保持敏捷、稳定与低成本,成了所有技术团队的共同挑战。阿里云 Serverless 应用引擎(SAE)正是为应对这一时代挑战而生的破局者,SAE 以“免运维、强稳定、极致降本”为核心,通过一站式的应用级托管能力,同时支撑传统应用与 AI 应用,让企业把更多精力投入到业务创新。
510 30
|
3月前
|
设计模式 人工智能 自然语言处理
3个月圈粉百万,这个AI应用在海外火了
不知道大家还记不记得,我之前推荐过一个叫 Agnes 的 AI 应用,也是当时在 WAIC 了解到的。
511 1

相关产品

  • 云原生大数据计算服务 MaxCompute