|
数据建模 数据管理
|

全链路数据治理-智能数据建模

DataWorks智能数据建模沉淀阿里巴巴数据中台建模方法论,以维度建模为基础,从数仓规划、数据标准、维度建模、数据指标四个方面,以业务视角对业务的数据进行诠释,让数据仓库的建设向规范化,可持续发展方向演进。 通过本书,你可以学习到: 1. 数据建模理论与规范 2. 菜鸟、大淘系数据建模实践 3. 工业、汽车行业数据建模实践 4. 零售电商数据建模实操案例

26152
|
对象存储 专有云 块存储
|

PAI-Megatron-Patch:灵骏集群训练 LLMs

本书深入探讨了如何利用PAI平台提供的高性能计算资源和优化工具来训练大型语言模型,特别是在分布式集群环境下的高效训练方法。

554
来自: 人工智能平台PAI  版块
|

实时数仓workshop(北京站)- 汪宇

339
来自: 实时计算 Flink  版块
|
数据采集 SQL OLAP
|

全链路数据治理-全域数据集成

DataWorks全链路数据治理包含智能数据建模、全域数据集成、高效数据开发、主动数据治理、全面数据安全、快速分析服务六大产品能力,覆盖数据的全生命周期。本篇全域数据集成向开发者介绍通过DataWorks数据集成在多表多表、多表到单表、单表到单表等场景下,进行实时或离线同步的技术选型与核心能力,并以MaxCompute与Hologres引擎为例,演示云上数据同步操作步骤最佳实践。

26794
|
对象存储 专有云 块存储
|

Elasticsearch全观测技术解析与应用(构建日志、指标、APM统一观测平台)

Elasticsearch 是业内比较热门和主流的信息检索分析引擎,在 DB-Engine 指数排行上是全球热度第 7 的数据库。本书将从介绍Elasticsearch、全观测技术原理、行业应用到技术实践,全面系统地解读在大数据背景下,运维人员、开发人员等应用全观测技术的价值和实践上手指南。还有借助阿里云环境进行的 ES 实战演练,详细的图文说明,手把手引导大家系统地使用ES。

312296
|
4月前
|
网络协议 网络架构 RDMA
|

UPN512技术架构白皮书

随着AI算力超节点的演进,xPU Scale up 系统遇到新的挑战,基于此,阿里云提出UPN(Ultra Performance Network)架构,旨在构建“大规模、高性能、高可靠、低成本、可扩展” 的 Scale up 网络系统,本文阐述UPN512系统的关键架构设计。

348
|
对象存储 专有云 块存储
|

阿里云ElasticsearchSeverless版产品发布

586
|
云计算 对象存储 大数据
|

阿里云 JindoFS+OSS 数据上云实战

为了帮助读者能更全面地了解 JindoFS,我们特地编撰了这本电子书。从架构到场景到实操,全方面解读jindoFS。

123840
|

当搜索遇见AI

606
来自: 智能搜索推荐  版块
|

OpenSearch向量检索和大模型方案

743
来自: 智能搜索推荐  版块
|

FFA2024分论坛-核心技术

FFA 2024 核心技术专场由 Apache Flink 核心贡献者与来自阿里云智能、小红书、哔哩哔哩、蚂蚁金服、Shopee等公司的一线技术专家解析 Flink 技术动向与应用实践,重点探讨 Flink 的核心技术(如状态管理、容错机制、数据传输、大规模调度和核心算法等)在实际生产环境中面临的挑战,以及如何通过最佳实践来进行扩展和改进。

978
来自: 实时计算 Flink  版块
|

零基础入门:从0到1学会 Apache Flink

大数据实时计算及 Apache Flink 年度Flink 年度学习资料大礼包,300+页实战应用精华总结!本书内容包含:1、零基础入门,30 天成长为 Flink 大神的经典教程。2、Apache Flink 核心贡献者及阿里巴巴技术专家的一线实战经验总结。3、收录来自 bilibili、美团点评、小米、OPPO、快手、Lyft、Netflix 等国内外一线大厂实时计算平台及实时数仓最佳实践案例

141621
来自: 实时计算 Flink  版块
|
人工智能 算法 云栖大会
|

开启云上 AIGC 动手实践,探索技术创意

面向 GenAI 时代,阿里云人工智能平台 PAI 平台自带海量开箱即用、实时更新的大模型最佳实践,提供高性能、高稳定的大模型工程化能力。本电子书精选 2024 云栖大会动手实践教程,覆盖大语言模型应用、多模态大模型微调训练、低代码 AIGC 创意设计等热门领域,为您带来 AIGC 开发全新体验。

917
来自: 人工智能平台PAI  版块
|
API 数据采集 数据处理
|

大数据&AI实战派 第2期

《大数据&AI实战派》系列电子书由阿里云开发者社区与阿里灵杰共同打造,覆盖数据计算、数据分析、数据湖/湖仓一体、机器学习等多个领域,解读各技术领域基础原理,剖析行业实践案例,培养大数据开发者从“生产-采集-存储-分析-开发-治理-价值体现”的技术能力。

132446
来自: 大数据计算 MaxCompute  版块
|
OLAP 数据管理 数据处理
|

EMR StarRocks 白皮书

StarRocks-新一代极速全场景MPP数据仓库产品解决方案。StarRocks 具备⽔平在线扩缩容,⾦融级⾼可⽤,兼容 MySQL 5.7 协议和 MySQL ⽣态,提供全⾯向量化引擎与多种数据源联邦查询等重要特性。StarRocks 致力于在全场景 OLAP 业务上为⽤户提供统⼀的解决⽅案,适⽤于对性能、实时性、并发能⼒和灵活性有较⾼ 要求的各类应⽤场景。

3963
|
对象存储 专有云 块存储
|

Hologres物化视图升级 构建企业一站式实时数仓

《Hologres物化视图升级 构建企业一站式实时数仓 》技术资料

492
来自: 实时数仓 Hologres  版块
|
对象存储 专有云 块存储
|

阿里巴巴大数据及AI实战

深度剖析淘宝、高德、友盟+、1688、优酷、阿里妈妈、阿里影业大数据实战场景,2020不容错过的企业大数据实战手册。

65325
来自: 大数据计算 MaxCompute  版块
|
对象存储 专有云 块存储
|

MaxCompute半结构化数据思考与创新

《MaxCompute半结构化数据思考与创新》介绍了半结构化数据模型简析,与传统方案优劣对,MaxCompute思考与实践,以及收益分析。

345
来自: 大数据计算 MaxCompute  版块
|
对象存储 专有云 块存储
|

PAI-ChatLearn 灵活易用大规模RLHF高训练框架

《PAI-ChatLearn 灵活易用大规模RLHF高训练框架》介绍了PAI-ChatLearn框架,且通过实际案例演示了PAI-ChatLearn的功能。

695
来自: 人工智能平台PAI  版块
|
流计算
|

Flink峰会 - 徐榜江

基于 Flink CDC高效实现海量数据实时入湖入仓

508
来自: 实时计算 Flink  版块
|
对象存储 专有云 块存储
|

一站式大数据开发治理DataWorks使用宝典

零基础如何开发治理大数据?阿里专家告诉你!《一站式大数据开发治理DataWorks使用宝典》由9位阿里巴巴DataWorks产品专家领学精心打造,全面介绍了DataWorks十大功能模块,以动手实操的方式清晰使用方法及开发流程,帮助用户快速上手DataWorks核心功能。如果你有自定义数据治理方面的需求,学习DataWorks绝对是你的不二选择。此书也定能成为你学习之路的宝典,快来一起过关斩将吧!

12366
|
对象存储 专有云 块存储
|

实时即未来

甄选 Apache Flink 及大数据领域顶级盛会 Flink Forward Asia 大会嘉宾精彩分享,覆盖国内外一线大厂实时平台构建的经验分享与实时数仓的应用实践,为你揭秘实时计算平台从无到有到有、持续优化的详细细节!《Apache Flink 年度最佳实践》首次一次性公布来自B站、美团点评、小米、快手、菜鸟、Lyft、Netflix 等精彩内容,9篇深度文章揭秘一线大厂实时平台构建实践。

56647
来自: 实时计算 Flink  版块
|

FFA2024分论坛-流式湖仓

FFA 2024 流式湖仓专场由 Apache Flink 核心贡献者与来自淘天集团、抖音集团、vivo、小米、中原银行、阿里云智能、蚂蚁集团、贝壳找房、货拉拉等公司的一线技术专家解析流批一体、存算分离、湖仓融合的实时湖仓架构,探讨以 Apache Paimon 为流批一体湖存储的湖仓架构建设实践,如何帮助业务获得更实时的数据来驱动业务决策,并实现数据管理的降本增效。

1197
来自: 实时计算 Flink  版块
|
前端开发 UED 图形学
|

面向Web应用的三维建模实战

得益于游戏产业的发展,目前主流桌面端三维引擎如UE、Unity等三维模型的工作流非常成熟;但是Web端的三维模型开发却面临工作流混乱、规范缺失、人才匮乏等挑战,阻碍了三维模型Web应用的推广。Blender是支持WebGL引擎最好的DCC软件之一,结合pbr/gltf规范可以搭建完整的Web端三维模型工作流,为三维模型Web应用开发提供支撑。

331
来自: 数据可视化DataV  版块
|

FFA2023平台建设专场资料汇总

FFA2023平台建设专场资料汇总

473
来自: 实时计算 Flink  版块
|
对象存储 专有云 块存储
|

阿里云人工智能平台 PAI年度发布

本书聚焦于PAI平台的最新功能更新、技术创新以及在人工智能领域的实际应用案例。

433
来自: 人工智能平台PAI  版块
|
数据挖掘
|

Databricks数据洞察:从入门到实践

Delta Lake 作为数据湖核心存储引擎方案能给企业带来诸多的优势。本书从技术基础介绍到场景应用实践,从大数据平台架构的演进、Delta Lake关键特性、实现原理,以及数据仓库、数据湖的优劣势,湖仓一体架构的应用等多方面解析Lakehouse架构和Delta Lake的应用优势。帮助读者入门数据湖Lakehouse以及部分spark相关应用。

31221
|
对象存储 专有云 块存储
|

大数据工程师必读手册

阿里巴巴如何玩转大数据?十位阿里巴巴大数据专家深度分析 ,飞天大数据平台八款产品最新玩法,2019不容错过的大数据手册——《大数据工程师必读手册》现在可以免费下载阅读啦,赶紧先睹为快吧。

103000
来自: 大数据计算 MaxCompute  版块
|

阿里云产品月刊云栖特刊

阿里云全面投入升级AI大基建,全线产品年度重磅发布,更多详情请点击阿里云产品月刊2024云栖大会特刊

6
|
流计算
|

FFA2023主论坛

FFA2023主论坛资料汇总

437
来自: 实时计算 Flink  版块
|

大数据AI一体化的解读

430
来自: 人工智能平台PAI  版块
|
搜索推荐 Java 分布式计算
|

Elastic Stack 实战手册

本书由数十位 Elasticsearch 技术圈的优秀开发者共创而成,得到了许多资深业界精英,社区技术大咖,Elastic Stack 相关书籍作者的支持,凝聚了众多创作人的实践经验和创作能力。 书籍涵盖了一位 Elastic Stack 开发者所需的必要知识,尤其对于刚入门的开发者,从上篇基础的 Elastic Stack 产品能力到下篇的应用实践,提供了系统性学习参考的上手指南。

24554
|

大数据&AI客户案例集

大数据&AI客户案例集

10597
来自: 大数据计算 MaxCompute  版块
|
3月前
|

UPN512技术架构白皮书(英文版)

随着AI算力超节点的演进,xPU Scale up 系统遇到新的挑战,基于此,阿里云提出UPN(Ultra Performance Network)架构,旨在构建“大规模、高性能、高可靠、低成本、可扩展” 的 Scale up 网络系统,本文阐述UPN512系统的关键架构设计。

72
|

阿里云产品十一月刊

阿里云百炼上线新模型可支持100万超长上下文,通义灵码支持代码逻辑可视化,多款产品能力新升级,详情请点击阿里云产品十一月刊

205
|

FFA2024分论坛-生产实践

FFA 2024生产实践专场由 Apache Flink 核心贡献者与来自快手、eBay、阿里云、抖音集团、Uber、鹰角、移动云、京东、用友畅捷通、搜配云、度小满、天翼云等公司的一线技术专家带来,将聚焦于在生产中使用和部署Flink的痛点, 经验以及最佳实践, 共同探讨如何在真实环境中更高效, 安全, 敏捷地落地实时数据处理框架。

813
来自: 实时计算 Flink  版块
|
云计算 流计算
|

Streaming Lakehouse Meetup

Streaming Lakehouse Meetup · Online 。由阿里云开源大数据表存储团队负责人、阿里巴巴高级技术专家,Apache Flink PMC,Paimon PPMC 李劲松(花名:之信)作为出品人,联合业内大咖共同分享 Apache Paimon 在各场景中的最佳实践、生产经验、技术原理等。

726
来自: 实时计算 Flink  版块
|

FFA2023生产实践专场资料汇总

FFA2023生产实践专场资料汇总

655
来自: 实时计算 Flink  版块
|
Java 数据采集 分布式计算
|

Elastic与阿里云合作宣传信息白皮书

阿里云是 Elastic 在中国最早开展合作的伙伴,长期的合作积淀了深厚的技术实践和丰富的业务经验,本白皮书介绍了自合作以来阿里云和Elastic的联合价值主张、产品功能与优势、客户案例等。

1762
|
大数据 新零售 双11
|

全链路数据治理-主动数据治理

2万字揭秘阿里巴巴数据治理平台建设实践。阿里巴巴一直将数据作为自己核心资产与能力之一,从最早的淘宝、天猫等电商业务,到后续优酷、高德、菜鸟等板块,面对各类数据治理需求的井喷,特别是降本等需求的不断出现,阿里云DataWorks团队将13年的产品建设经验整理成最佳实践,从7个方面为大家揭秘数据治理平台建设实践。

26629
|

阿里云云原生一体化数仓新能力解读

云原生一体化数仓是阿里云推出的一站式大数据处理平台,具备流批一体、实时离线一体、湖仓一体、 全链路数据治理四大核心能力。本书将分为离线实时一体、分析服务一体、湖仓一体、数据安全、数据建模、数据治理,六大热门主题,六位大数据专家,带你了解炙手可热的云数据产品最新演进趋势,为大数据开发者讲述一体化数仓的核心产品能力以及在业务中的应用。

20559
来自: 大数据计算 MaxCompute  版块
|
流计算
|

Flink CDC Meetup PPT - 孙家宝

2022.5.21 Flink CDC Meetup|孙家宝 - Flink CDC MongoDB Connector 的实现原理和使用实践

1083
来自: 实时计算 Flink  版块
|
对象存储 专有云 块存储
|

Flink CDC:新一代数据集成框架

为了帮助读者能更全面地了解 Flink CDC,我们特地编撰了这本中文专刊。在这本专刊里你可以了解到:Flink CDC 的底层原理设计是什么样的?Flink CDC 如何保证数据读取的一致性?如何一步步快速上手 Flink CDC?以及 Flink CDC 在生产实践上的宝贵经验!

22924
来自: 实时计算 Flink  版块
|
对象存储 专有云 块存储
|

Elastic Stack 实战手册(早鸟版)

开源搜索引擎这十来年的发展,基本就是 Lucene 体系的发展。而基于 Lucene 的诸多搜索引擎中,Elasticsearch 以其极好的易用性、开箱即用的体验迅速折服了开发者。其边界也从最早的搜索引擎,扩展到了日志全观察、安全分析等场景,形成了今天的 Elastic Stack,具备从数据采集、处理、分析到展示的强大生态能力。

45700
|
对象存储 专有云 块存储
|

开源大数据前瞻与应用实战

大数据时代对人类的数据驾驭能力提出了新的挑战,也为人们获得更为深刻、全面的洞察能力提供了前所未有的空间与潜力。作为一线技术骨干,每天沉在业务里,怎样才能快速和时代接轨,让自己不落伍?Flink社区重磅推出2021理论与实战精解系列电子书!《开源大数据前瞻与理论实战》收录了多位大数据领域行业开拓者对未来前沿趋势的洞察,揭秘Apache Flink及开源生态的前沿独家应用!

9095
来自: 实时计算 Flink  版块

大数据与机器学习

大数据领域前沿技术分享与交流,这里不止有技术干货、学习心得、企业实践、社区活动,还有未来。

4
今日
68711
内容
128
活动
439612
关注
你好!
登录掌握更多精彩内容

相关产品

  • 大数据开发治理平台 DataWorks
  • 检索分析服务 Elasticsearch版
  • 日志服务