Havenask入门课程第3节:使用hape部署分布式版Havenask
Havenask是阿里巴巴自主研发的大规模分布式搜索引擎,主要专注于智能搜索和海量数据实时检索,其核心能力广泛应用于阿里巴巴内部的众多业务,如淘宝、天猫商品搜索,盒马搜索,菜鸟物流订单实时检索等。并于2022年11月对外正式开源,具有灵活的定制和开发能力,支持算法快速迭代,帮助客户和开发者量身定做适合自身业务的智能搜索服务,助力业务增长。 这次系列课程邀请了负责Havenask研发工作的技术专家们,为大家全面讲解Havenask的相关知识,通过课程可以了解到产品能力、架构原理、安装部署等内容,同时还有详细的操作演示,帮助大家更好了解和使用产品。 课程介绍: 此视频Havenask入门课程第3节《使用hape部署分布式版Havenask》,共讲解3部分内容。 -部署分布式版Havenask -如何写入数据、检索 -问题排查 我们期望通过课程可以帮助您更好的使用Havenask,欢迎广大开发者加入项目开发,共建高质量的搜索引擎,共同推进国产化开源搜索引擎技术快速发展,普惠更多的开发者和企业。 此外,对于有使用需求的企业级开发者,我们也已在阿里云上提供了基于 Havenask 打造的全托管、免运维的一站式对话式搜索服务——阿里云 OpenSearch,欢迎企业级开发者们试用体验。 阿里云 OpenSearch 官网:https://www.aliyun.com/product/opensearch 官网地址:https://havenask.net/ Github:https://github.com/alibaba/havenask 欢迎钉钉扫码加入 Havenask 开源官方技术交流群:
Havenask入门系列第6节:集群扩备份
Havenask是阿里巴巴自主研发的大规模分布式搜索引擎,主要专注于智能搜索和海量数据实时检索,其核心能力广泛应用于阿里巴巴内部的众多业务,如淘宝、天猫商品搜索,盒马搜索,菜鸟物流订单实时检索等。并于2022年11月对外正式开源,具有灵活的定制和开发能力,支持算法快速迭代,帮助客户和开发者量身定做适合自身业务的智能搜索服务,助力业务增长。 这次系列课程邀请了负责Havenask研发工作的技术专家们,为大家全面讲解Havenask的相关知识,通过课程可以了解到产品能力、架构原理、安装部署等内容,同时还有详细的操作演示,帮助大家更好了解和使用产品。 课程介绍:此视频为Havenask入门系列第6节《集群扩备份》,将对Havenask的扩备份进行介绍。 我们期望通过课程可以帮助您更好的使用Havenask,欢迎广大开发者加入项目开发,共建高质量的搜索引擎,共同推进国产化开源搜索引擎技术快速发展,普惠更多的开发者和企业。 此外,对于有使用需求的企业级开发者,我们也已在阿里云上提供了基于 Havenask 打造的全托管、免运维的一站式对话式搜索服务——阿里云 OpenSearch,欢迎企业级开发者们试用体验。 阿里云 OpenSearch 官网:https://www.aliyun.com/product/opensearch 官网地址:https://havenask.net/ Github:https://github.com/alibaba/havenask 欢迎钉钉扫码加入 Havenask 开源官方技术交流群:
【第2讲】正版PyCharm,但是免费!最强Python 编辑器的下载和使用教程,还有中文插件哦~
【第2讲】正版PyCharm,但是免费!最强Python 编辑器的下载和使用教程,还有中文插件哦~
洞悉 Spark 任务调度新能力|Apache Spark + DolphinScheduler Meetup
洞悉 Spark 任务调度新能力|Apache Spark + DolphinScheduler Meetup特邀 - 阿里云 EMR 数据开发平台团队负责人孙一凡、BIGO 大数据研发工程师许名勇、阿里云 EMR Spark 引擎负责人周克勇 ,通过他们的分享让用户能更快更好更便捷的使用 Apahce Spark + Apahce DolphinScheduler 。讲师/嘉宾简介孙一凡(Evans 忆梵) 阿里云 EMR 数据开发平台团队负责人周克勇(一锤) 阿里云 EMR Spark 引擎负责人许名勇 BIGO 大数据研发工程师
Flink Forward Asia 2022 平台建设 11.27 下午
平台建设专场由来自爱奇艺、知乎、Dinky 社区、货拉拉、美团、联通、小米、StreamPark、阿里巴巴、蚂蚁集团的技术专家分享基于 Apache Flink 的实时计算平台演进与实践。讲师/嘉宾简介王世涛|货拉拉大数据实时研发平台负责董剑辉|美团数据系统研发工程师张彬|美团数据系统研发工程师穆纯进|联通数科实时计算团队负责人,Apache StreamPark Contributor周超|小米软件开发工程师王华杰|Apache StreamPark PPMC, 社区发起人
ApacheCon Asia 2022 阿帕奇亚洲大会流处理论坛 7/29
直播介绍:(建议600字以内) 作为当今大数据领域的趋势,流式数据处理的潜在价值正在被不断发掘。如今,很多企业都渴望更及时地洞察自己的数据,曾经的“批处理”思维也正在迅速被流式处理所取代。越来越多的公司,无论大小,都在重新思考技术架构时把实时性作为第一考量,并开始用强大的开源引擎如 Apache Flink, Apache Spark, Apache Kafka, Apache Pulsar, Apache Storm 等构建自己的实时计算平台。 在本次 ApacheCon 上,Apache 软件基金会成员、阿里云 EMR 平台技术及 Flink 存储引擎团队负责人李钰将携手专家团带来“流处理”分论坛分享。在该分论坛中,您将了解到一线大厂把这些 Apache 项目应用到其生产环境中的实际经验,以及这些 Apache 项目生态的最新发展和流计算技术未来的发展方向。 讲师/嘉宾简介 康琪 - 基于 Apache Flink 的流批一体在京东物流的实践 胡焕 - 基于 FlinkSQL 的小米实时数据集成实践 邱从贤 - 大规模集群下的 Apache Flink 稳定性优化实践 张颖,闫莉刚 - 基于 Apache Flink 的实时计算数据流框架在京东零售业务的实践和落地 林立伟 - 腾讯广告 Flink 实战:特征生产、训练样本、策略计算 郑舒力 - 基于 Apache Flink 的金山云实时计算平台实践与防疫场景下的应用
阿里云索信达智能金融平台线上发布会
阿里云联合生态伙伴索信达共同推出“索信达智能金融平台”解决方案。索信达智能金融平台包括批量营销、实时营销、个性化推荐、标签管理、内容管理等多个模块,对客户提供即开即用的一站式落地部署解决方案。欢迎加入钉钉客户沟通群,了解更多解决方案信息
Delta Lake的演进历程和现状优势【Databricks 数据洞察公开课】
Delta Lake作为一个开源项目的演进路径和现状优势,以及怎样帮助在现有存储系统上构建Lakehouse架构。产品技术咨询https://survey.aliyun.com/apps/zhiliao/VArMPrZOR加入技术交流群下期预告《深度解析数据湖存储方案Lakehouse架构》讲师/嘉宾简介筱龙阿里云开源大数据平台技术专家
Flink Forward Asia 2021 平台建设 3
平台建设专场由来自字节跳动、腾讯新闻、网易、小红书、京东、滴滴、bilibili、汽车之家、移动、联通、BIGO、蚂蚁金服、翼支付的技术专家分享基于 Apache Flink 的实时计算平台演进与实践。讲师/嘉宾简介1.《Flink 在移动云实时计算的实践》谢磊 - 移动软件开发工程师2.《Apache Flink 在翼支付的实践应用》曹劼 - 翼支付高级大数据工程师尹春光 - 翼支付高级大数据工程师3.《蚂蚁金服实时计算引擎建设》闵文俊 - 阿里巴巴技术专家,Apache Flink Contributor4.《网易云音乐实时场景应用及优化实践》赵荣生 - 网易云音乐资深平台工程师,Apache Spark/Pulsar Contributor
Apache Flink Meetup 深圳站
8月7日,Apache Flink Meetup 深圳站来啦!本场 Meetup 邀请了来自腾讯、第四范式、阿里巴巴的 4 位资深行业技术专家,将分享 Flink 如何帮助腾讯搭建万亿级实时数据入湖利器 Auto Optimizer Service,以及开发智能化的故障诊断和配置监控工具;又如何帮助第四范式建立 OpenMLDB 数据库实时更新系统。除了企业实践的分享外,Flink 1.14 版本的新特性预览也将会在本场 Meetup 中带给大家。活动亮点【爆款话题】• Flink 如何帮忙腾讯搭建万亿级实时数据入湖利器 Auto Optimizer• Flink 如何帮助腾讯开发智能化的故障诊断和配置监控工具• Flink 如何帮助第四范式建立 OpenMLDB 数据库实时更新系统• Flink 1.14 版本将会带来哪些值得期待的功能特性与体验优化;【多重大礼】丰富周边等你拿,加入钉钉交流群就有机会获得超多 Flink 社区定制的精美周边!Meetup 技术交流群:(Apache Flink 社区)活动议程合作伙伴
开源大数据社区 & 阿里云 E-MapReduce 系列直播 第9期
EMR on ACK是企业级半托管的开源大数据平台,为阿里云E-MapReduce(EMR)提供了一个部署选项,允许您在阿里云容器服务Kubernetes版 (ACK) 上运行开源大数据框架。 目前支持Spark引擎的部署,结合自研的Remote shuffle service(RSS)服务组件,提供用户高稳定、高性价比、灵活的弹性计算服务。RSS解决了计算存储分离和混合架构下的shuffle稳定性和性能问题。本次直播将重点展开RSS的使用和性能展示。讲师介绍吴雪扬(枢木),阿里云高级开发工程师
第四节课:EMR 开通与演示
本节主要介绍开通EMR的环境准备、账号准备、付费情况、实操演示讲师:魏巍,花名念民,阿里巴巴 EMR 产品经理
OpenSearch知名客户业务实践分享——企查查
企查查作为企业征信行业的搜索引擎,一直以来都与阿里云开放搜索团队有深度合作。本次朱总独家揭秘,开放搜索陪伴企查查从创业初期到成为企业征信行业的独角兽的过程中,是如何满足企查查产品海量数据的精准搜索需求的讲师介绍:朱正亮-企查查运维测试总监
JindoFS Fuse 支持
本次直播主要介绍如何利用FUSE的POSIX文件系统接口,像本地磁盘一样轻松使用大数据存储系统, 为云上AI场景提供了高效的数据访问手段。讲师介绍苏昆辉,花名抚月,阿里巴巴计算平台事业部 EMR 高级工程师, Apache HDFS committer. 目前从事开源大数据存储和优化方面的工作。
用Analytics-Zoo实现基于深度学习的胸腔疾病AI诊疗辅助
讲师介绍龚奇源博士,英特尔机器学习专家。从事多年数据隐私和机器学习研究,2017年加入英特尔,目前负责Analytics-Zoo中ClusterServing、Streaming、OpenVINO和推理优化等工作。直播简介:本次分享主要介绍如何利用Analytics Zoo和NIH胸部X光影像数据集,在Apache Spark集群上实现基于深度学习的胸腔疾病分类,为医生提供端到端的胸腔疾病AI诊疗辅助。有兴趣的同学,可以提前关注此开源项目:https://github.com/intel-analytics/analytics-zoo
使用Apache SuperSet和EMR Spark打造交互式的数据探索平台
本次分享主要介绍如何结合Apache SuperSet和EMR Spark,利用EMR Spark提供的JindoCube高级特性在SuperSet进行秒级响应,交互式的可视化数据探索。讲师介绍李呈祥,花名司麟,阿里云智能EMR团队高级技术专家,Apache Hive Committer, Apache Flink Committer,目前主要专注于EMR产品中开源计算引擎的优化工作。
Spark on Kubernetes & YARN
以Kubernetes为代表的云原生技术越来越流行起来,spark是如何跑在Kubernetes之上来享受云原生技术的红利?Spark跑在Kubernetes之上和跑在Hadoop YARN上又有什么区别?以及Kubernetes 和YARN的差异点是什么。讲师介绍何剑,阿里巴巴高级技术专家,专注于Kubernetes容器云和大数据底层调度以及基础架构,负责阿里巴巴容器平台在线服务和离线计算任务混部。此前就职于Hortonworks, 是Hadoop 社区Committer和PMC成员
阿里巴巴大数据产品最新特性介绍—DataWorks |2019大数据技术公开课第三季
本次直播将为您做DataWorks增值版本的高级feature及场景化介绍,帮您更好的了解和使用DataWorks增值版本。 <br/> 直播嘉宾:刘天鸢 阿里云智能事业群 高级产品经理
阿里巴巴大数据产品最新特性介绍—MaxCompute|2019大数据技术公开课第三季
本次直播将为您讲解MaxCompute产品近期最新发布的feature,涵盖SQL多项最新功能、预付费资源监控报警、IP白名单支持IPV6以及Logview中增加SQL复杂度等内容。 直播嘉宾: 曲宁 阿里云智能事业群 产品专家 <br/>
基于阿里云MaxCompute构建企业云数据仓库CDW的最佳实践建议 | 大数据技术公开课第二季
大数据技术公开课第二季直播详情>>>
4节课全面突围企业大数据实践路线(四)
1、直播内容介绍:[MVP 时间]是由阿里云MVP主讲,聚焦行业数字化转型的实战经验的最佳实践课程。重在帮助开发者快速了解中小企业业务搭建中的技术难点与解决方案,减少踩坑。本课程《4节课全面突围企业大数据实践路线》为系列内容,全面介绍企业大数据是如何一步步搭建及应用的过程。课程划分:共计4节课内容,分4次直播进行;每周三晚20:00准时开播,每次1个小时(45分钟的课程,15分钟的答疑)。此次为第四节课程:典型技术架构分析和构建2、分享嘉宾信息:姓名:戚俊 阿里云 MVP职位:浙江银杏谷投资总裁技术助理加钉钉群随时与老师在线互动。
2024FFA分论坛-Data+Ai
FFA2024Data+AI专场由Apache Flink核心贡献者与来自哔哩哔哩、抖音集团、Elastic、京东、硕橙科技等公司的一线技术专家带来,聚焦实时大数据处理与人工智能的前沿融合,共同探讨如何利用Flink助力AI大模型技术的实时化升级,议题涵盖但不限于特征工程、训练、推理、大模型架构优化、以及实时AI大模型在各行业领域的创新应用。
流式湖仓专场(二)
流式湖仓专场邀请阿里云智能、联通、同程旅行、汽车之家、OPPO、网易、滴滴、镜舟科技、广联达、平安证券、快手等企业技术专家解读基于 Flink + Paimon 构建流式数据湖相关问题,更有基于 Paimon + StarRocks、Flink + Paimon + Hologres、Paimon + Spark 的流式湖仓最佳应用实践与分析。
行业实践专场(一)
行业实践专场将由美的、芒果 TV、喜马拉雅、曹操出行、米哈游、腾讯、字节跳动、中原银行、上海汽车集团、中南电力、跨越速运、传音、传智教育等多行业实时计算领域专家详细解读 Flink 在不同企业和行业内的应用与落地,围绕业务场景、业务痛点、面临挑战、如何破局等宝贵实践经验倾囊相授,帮助开发者更全面和深入地了解 Flink 技术如何在实际生产场景中落地。
在现场!2023世界人工智能大会
打卡2023世界人工智能大会# 除了马斯克的机器人,大模型无疑是最热的话题,本次大会将有30多款大模型亮相,我们明天下午将走进《以模型为中心的AI开发新范式 》论坛,看看模型对人工智能行业发展到底有什么意义!欢迎关注我们!
AI技术分享会第十一期 | 展心展力MetaApp:基于DeepRec的稀疏模型训练实践
MetaApp-推荐广告研发部,主要负责 MetaApp 拳头产品 233 乐园的首页信息流的推荐和广告系统,是比较传统的推广搜组。本次议题介绍了 MetaApp-推荐广告研发部 从传统的TensorFlow(cpu)+自研分布式ps方案,逐步迁移到使用基于阿里云开发的开源分布式机器学习训练框架DeepRec的方案,包括了离线训练和线上inference的完整流程。迁移完成后,新方案大大提高了训练效率和线上服务的效率,并且有效的降低了成本。 一、分享议题 展心展力MetaApp:基于DeepRec的稀疏模型训练实践 二、直播时间 2023年7月5日(周三)18:00-18:40 三、听众收益 多级存储的性能问题 模型压缩 基于GPU的训练 完全基于显存训练
Flink Forward 实时湖仓“Flink Table Store 0.3 构建流式数仓最佳实践”
Flink Forward 实时湖仓“Flink Table Store 0.3 构建流式数仓最佳实践”李劲松 Flink PMC
Flink Forward 平台建设“字节跳动Flink大规模云原生化实践”
Flink Forward 平台建设“字节跳动Flink大规模云原生化实践”刘畅 字节跳动基础架构工程师
Flink Forward 平台建设“Flink 在蚂蚁大规模金融场景的平台建设”
Flink Forward 平台建设“Flink 在蚂蚁大规模金融场景的平台建设”李志刚 蚂蚁集团高级技术专家
Flink Forward 核心技术“Flink Unaligned Checkpoint 在 Shopee 的优化和实践”
Flink Forward 核心技术“Flink Unaligned Checkpoint 在 Shopee 的优化和实践”范瑞 Apache StreamPark Committer
使用 Databricks 进行营销效果归因分析的应用实践【Databricks 数据洞察公开课】
本次课程将介绍如何试用Databricks进行广告效果归因分析,完成一站式的部署机器学习,包括数据ETL、数据校验、模型训练/评测/应用等全流程。讲师/嘉宾简介冯加亮,阿里云开源大数据平台技术工程师
Flink Forward Asia 2021 机器学习
人工智能专场由来自阿里巴巴、京东、360 等技术专家呈现 Flink 机器学习的最新进展、具体应用实践与最新技术落地案例。讲师/嘉宾简介1.《Alink 新功能与典型案例》杨旭 - 阿里巴巴资深算法专家2.《Alink、Tensorflow on Flink 在京东的应用》张颖 - 京东搜索推荐算法工程师刘露 - 京东搜索推荐算法工程师3.《基于 Flink AI Flow 的机器学习工作流最佳实践》姜鑫 - 阿里巴巴高级工程师蒋晓峰 - 阿里巴巴技术专家,Apache RocketMQ & Apache ShardingSphere & SOFAJRaft Committer,Apache Flink Contributor4.《伯努利:结构化的工业级流式机器学习系统@阿里妈妈》姜碧野 - 阿里妈妈算法平台与效能架构团队高级算法专家5.《Clink:A C/C++ online feature serving solution for Flink》李志丽 - 360 服务端开发
SaaS模式云数据仓库 MaxCompute 应用场景实践 ——基于MaxCompute的智能推荐解决方案
在互联网行业红利已过、在获客成本越来越高、在用户在线时长全网基本无增长以及信息大爆炸的情况下,如何更好的转化新用户和提升老用户粘性就变得至关重要,智能化的个性化推荐无疑是经过验证的重要手段之一,我们每天使用的移动App或企业内都处处有其身影。本次直播主要讲解基于MaxCompute的智能推荐解决方案。讲师简介吴世龙 阿里云智能 高级产品专家
Hologres系列课程(五)通过JDBC/COPY实现高性能写入
本次主要介绍在Hologres中通过JDBC/COPY命令写入最佳实践,实现高性能批量写入。讲师简介陈嘉雯(瑚桃),阿里巴巴开发工程师,长期从事Hologers引擎开发工作
Hologres系列课程(七)离线数仓加速之云原生加速OSS最佳实践
对象存储服务OSS是一种海量、安全、低成本、高可靠的云存储服务,适合存放任意类型的文件。Hologres通过与OSS打通,支持通过创建外部表的方式,无需导入导出就能直接加速查询OSS的数据。本次主要介绍Hologres加速查询OSS原理,以及如何建外表加速查询OSS不同的文件格式(CSV、ORC等)讲师简介张露(雪胤),阿里巴巴技术专家,长期从事Hologres引擎开发工作
大数据+AI Meetup 2021 第一季·北京站
问题与互动页面3月20日,阿里云开发者社区联合阿里云计算平台事业部、达摩院共同举办的 BIGDATA + AI Meetup · 北京站向量检索专场即将重磅开启!来自阿里云、淘宝、爱奇艺、Zilliz、搜狐、Jina.AI等知名企业的九位重量级讲师将分享最前沿的向量检索相关技术思考与实践。活动亮点:达摩院机器智能实验室资深技术专家揭秘阿里云达摩院自主研发,并广泛应用于阿里集团各个业务场景的 Proxima 向量检索引擎;多位一线厂商技术专家解读向量检索与人脸识别、推荐系统、图片搜索、视频指纹、自然语音处理、文件搜索等各类应用场景交织融合的技术逻辑;无论你是热衷于钻研开源技术的开发者,还是“大数据+AI”的资深爱好者,都能这些前沿的案例从中获得全新的灵感。Meetup 技术交流群:(大数据 + AI Meetup 交流群)活动议程
第二节课:EMR 产品入门
本节主要内容有 EMR 核心组件简介和使用、常用引擎使用示例、数据开发等讲师:孙大鹏,花名诚历,阿里巴巴 EMR 技术专家,Apache Sentry PMC,Apache Commons Committer,目前从事开源大数据存储和优化方面的工作。
从0到1解锁电商行业智能推荐
【开发者优惠来了】全网最低价,阿里云爆款服务器低至8.1元/月,更有针对学生的专享福利全面升级,戳:http://click.aliyun.com/m/1000188819/介绍智能推荐在电商行业的业务价值、实践案例和快速上手指南讲师信息讲师:王亚宁花名:栀露头衔:阿里巴巴集团产品专家
OpenSearch知名客户业务实践分享——趣店
趣店成立于14年3月,并快速在17年上市,在发展如此迅猛的前提下,介绍了开放搜索是如何满足趣店快速膨胀的搜索需求的,其中3天时间从创建到上线、无运维成本 、多种分词方式支持商品搜索,并根据企业特征实现个性化搜索需求等优点,让趣店成为了开放搜索坚实的合作伙伴。讲师介绍:樊庆响-趣店搜索资深技术专家
飞天大数据产品价值解读 — 全托管推荐引擎服务智能推荐
分享人:王亚宁 阿里云智能 产品经理本次直播将从个性化推荐的应用价值着眼,为您介绍智能推荐产品的核心能力和优势,并通过案例呈现为业务带来的实际价值。
JindoFS 存储策略和读写优化
本次分享主要介绍数据读写在计算存储分离的场景下所面临的常见问题以及相关的优化手段,并结合应用场景介绍对数据缓存加速的相关技术和策略。讲师介绍姚舜扬,花名辰山,阿里巴巴计算平台事业部 EMR 高级开发工程师,目前从事大数据存储方面的开发和优化工作
Spark on Zeppelin
Apache Zeppelin 是一个交互式的大数据开发Notebook,从一开始就是为Spark定制的。Zeppelin Notebook的开发环境与传统IDE开发环境相比有几大优势:不需要编译Jar,环境配置简单,交互式开发,数据结果可视化等等。本次直播将会介绍Spark on Zeppelin的一些基本使用方式以及应用场景。章剑锋(简锋),开源界老兵,Apache Member,曾就职于 Hortonworks,目前在阿里巴巴计算平台事业部任高级技术专家,并同时担任 Apache Tez、Livy 、Zeppelin 三个开源项目的 PMC ,以及 Apache Pig 的 Committer。
智能推荐系列公开课——智能推荐在电商的经典打法与实践
智能推荐在电商的经典打法与实践: 阿里巴巴搜索推荐产品团队带来系列公开课,教你提高运营效率,精准匹配海量用户喜好。
大数据与机器学习
大数据领域前沿技术分享与交流,这里不止有技术干货、学习心得、企业实践、社区活动,还有未来。