人工智能平台PAI使用问题之如何实现数据在MaxCompute中是永久的

本文涉及的产品
模型在线服务 PAI-EAS,A10/V100等 500元 1个月
模型训练 PAI-DLC,100CU*H 3个月
交互式建模 PAI-DSW,每月250计算时 3个月
简介: 阿里云人工智能平台PAI是一个功能强大、易于使用的AI开发平台,旨在降低AI开发门槛,加速创新,助力企业和开发者高效构建、部署和管理人工智能应用。其中包含了一系列相互协同的产品与服务,共同构成一个完整的人工智能开发与应用生态系统。以下是对PAI产品使用合集的概述,涵盖数据处理、模型开发、训练加速、模型部署及管理等多个环节。

问题一:机器学习PAI中FeatureStore支持特征transform吗?

机器学习PAI中FeatureStore支持特征transform吗?比如频次这个特征,我需要对它做一些映射处理逻辑,FeatureStore提供这种Transformer逻辑吗?



参考答案:

这个处理没必要在这里做,目前支持训练特征的时候处理,推荐使用EasyRec,在config配置上boundary即可应用这个分桶操作。另外easyrec还支持多种处理方式,推荐看一下文档https://easyrec.readthedocs.io/en/latest/

easyrec代码也是开源的:https://github.com/alibaba/EasyRec

后续我们会在feature store推出特征生产的功能应该也能满足你的这些需求。你如果现在就要用的话,可以直接用easyrec ,



关于本问题的更多回答可点击进行查看:

https://developer.aliyun.com/ask/598272



问题二:机器学习PAI中MaxCompute有方法成為永久的嗎?

机器学习PAI中MaxCompute作為Store是有Life time days, 有方法成為永久的嗎?



参考答案:

这个我找了一下,要设置的话,可以参考下这个文档 https://help.aliyun.com/zh/maxcompute/user-guide/lifecycle-management-operations?spm=a2c4g.11186623.0.i5



关于本问题的更多回答可点击进行查看:

https://developer.aliyun.com/ask/598271



问题三:机器学习PAI有沒有非在線類的ML案例該如何運用FeatureStore嗎?

机器学习PAI有沒有非在線類的ML案例該如何運用FeatureStore嗎?

比方說, 我想用XGBoost訓練一個簡單的離線Classifier, 所以我的data不用real time,也不用online,有案例分享嗎?



参考答案:

https://help.aliyun.com/zh/pai/use-cases/manage-features-by-using-featurestore-in-a-recommendation-system?spm=a2c4g.11186623.0.i20#b6bbc1707dm2kLau 文档在这里



关于本问题的更多回答可点击进行查看:

https://developer.aliyun.com/ask/598270



问题四:机器学习PAI有没有安装pyalink卡在qtconsole 4.0上的?

机器学习PAI有没有安装pyalink卡在qtconsole 4.0上的?



参考答案:

机器学习PAI(Platform AI)的安装过程中,如果在安装pyalink时卡在了qtconsole 4.0上,可能是由于以下原因:

  1. 网络连接问题:请确保您的计算机可以正常访问互联网,并且没有任何防火墙或代理服务器阻止了安装进程。您可以尝试使用其他网络连接或者检查防火墙设置。
  2. 下载文件完整性:如果您之前已经下载过qtconsole-4.0.0的安装包,可以尝试重新下载安装包并再次运行安装程序,确保下载的文件完整且未损坏。
  3. 依赖项冲突:某些软件包可能依赖于其他软件包或库。如果这些依赖项无法满足,安装过程可能会失败。您可以尝试查看安装日志以获取更多详细信息,并解决任何依赖项冲突。
  4. 操作系统兼容性:确认您的操作系统与pyalink的要求兼容。有时候,特定版本的操作系统可能需要额外的配置或补丁才能成功安装软件。
  5. 机器资源不足:如果机器的CPU、内存或磁盘空间不足,也可能会导致安装过程卡住。
  6. 安装包损坏:如果安装包损坏,也可能会导致安装过程卡住。



关于本问题的更多回答可点击进行查看:

https://developer.aliyun.com/ask/597742



问题五:机器学习PAI数据从max compute 同步到线上如hologres,帮忙,看看?

机器学习PAI数据从max compute 同步到线上如hologres,可以在页面上面执行了。也可以部署到Dataworks 中去调度?



参考答案:

楼主你好,阿里云机器学习PAI平台可以将数据从MaxCompute同步到Hologres,并且可以在PAI平台的页面上执行该操作。

而且你还可以将这个数据同步任务部署到阿里云DataWorks中进行调度,因为DataWorks是一个全面的数据集成和数据开发平台,可以帮助你实现数据的ETL、任务调度和工作流程管理等功能,通过在DataWorks中配置相关任务,你可以实现自动化地将数据从MaxCompute同步到Hologres,并按照需求进行调度和管理。



关于本问题的更多回答可点击进行查看:

https://developer.aliyun.com/ask/597625

相关实践学习
基于MaxCompute的热门话题分析
本实验围绕社交用户发布的文章做了详尽的分析,通过分析能得到用户群体年龄分布,性别分布,地理位置分布,以及热门话题的热度。
SaaS 模式云数据仓库必修课
本课程由阿里云开发者社区和阿里云大数据团队共同出品,是SaaS模式云原生数据仓库领导者MaxCompute核心课程。本课程由阿里云资深产品和技术专家们从概念到方法,从场景到实践,体系化的将阿里巴巴飞天大数据平台10多年的经过验证的方法与实践深入浅出的讲给开发者们。帮助大数据开发者快速了解并掌握SaaS模式的云原生的数据仓库,助力开发者学习了解先进的技术栈,并能在实际业务中敏捷的进行大数据分析,赋能企业业务。 通过本课程可以了解SaaS模式云原生数据仓库领导者MaxCompute核心功能及典型适用场景,可应用MaxCompute实现数仓搭建,快速进行大数据分析。适合大数据工程师、大数据分析师 大量数据需要处理、存储和管理,需要搭建数据仓库?学它! 没有足够人员和经验来运维大数据平台,不想自建IDC买机器,需要免运维的大数据平台?会SQL就等于会大数据?学它! 想知道大数据用得对不对,想用更少的钱得到持续演进的数仓能力?获得极致弹性的计算资源和更好的性能,以及持续保护数据安全的生产环境?学它! 想要获得灵活的分析能力,快速洞察数据规律特征?想要兼得数据湖的灵活性与数据仓库的成长性?学它! 出品人:阿里云大数据产品及研发团队专家 产品 MaxCompute 官网 https://www.aliyun.com/product/odps 
相关文章
|
27天前
|
SQL 数据可视化 大数据
从数据小白到大数据达人:一步步成为数据分析专家
从数据小白到大数据达人:一步步成为数据分析专家
210 92
|
1月前
|
分布式计算 Shell MaxCompute
odps测试表及大量数据构建测试
odps测试表及大量数据构建测试
|
25天前
|
存储 搜索推荐 大数据
数据大爆炸:解析大数据的起源及其对未来的启示
数据大爆炸:解析大数据的起源及其对未来的启示
89 15
数据大爆炸:解析大数据的起源及其对未来的启示
|
17天前
|
分布式计算 大数据 流计算
玩转数据:初学者的大数据处理工具指南
玩转数据:初学者的大数据处理工具指南
70 14
|
20天前
|
数据采集 存储 机器学习/深度学习
数据的秘密:如何用大数据分析挖掘商业价值
数据的秘密:如何用大数据分析挖掘商业价值
46 9
|
30天前
|
数据采集 存储 分布式计算
解密大数据:从零开始了解数据海洋
解密大数据:从零开始了解数据海洋
66 17
|
2月前
|
SQL 人工智能 自然语言处理
DataWorks年度发布:智能化湖仓一体数据开发与治理平台的演进
阿里云在过去15年中持续为268集团提供数据服务,积累了丰富的实践经验,并连续三年在IDC中国数据治理市场份额中排名第一。新一代智能数据开发平台DateWorks推出了全新的DateStudio IDE,支持湖仓一体化开发,新增Flink计算引擎和全面适配locs,优化工作流程系统和数据目录管理。同时,阿里云正式推出个人开发环境模式和个人Notebook,提升开发者体验和效率。此外,DateWorks Copilot通过自然语言生成SQL、代码补全等功能,显著提升了数据开发与分析的效率,已累计帮助开发者生成超过3200万行代码。
|
2月前
|
存储 机器学习/深度学习 人工智能
科技云报到:人工智能时代“三大件”:生成式AI、数据、云服务
科技云报到:人工智能时代“三大件”:生成式AI、数据、云服务
|
3月前
|
存储 分布式计算 数据挖掘
数据架构 ODPS 是什么?
数据架构 ODPS 是什么?
729 7
|
3月前
|
存储 分布式计算 大数据
大数据 优化数据读取
【11月更文挑战第4天】
97 2

热门文章

最新文章

相关产品

  • 人工智能平台 PAI