|
1月前
|
存储 SQL 数据可视化
|

基于阿里云IoT平台的Cat.1电表工厂用电监测方案实践

本文介绍阿里云IoT方案解决工厂用电管理“盲区”:通过Cat.1电表+IoT平台实现分钟级异常用电告警,Lindorm存储46维时序数据,函数计算执行恶性负载检测,DataV可视化分租户独立计费,电费纠纷下降87%。(239字)

175 1
|
1月前
|
SQL 分布式计算 OLAP
|

别再把 OLAP 和 SQL-on-Hadoop 搞混了!都是查数据,它们根本不是一回事

别再把 OLAP 和 SQL-on-Hadoop 搞混了!都是查数据,它们根本不是一回事

206 2
|
2月前
|
人工智能 数据可视化 算法
|

大东鞋业 x Quick BI:用 Quick BI打造 8000家门店的数据导航

大东鞋业借助Quick BI打通ERP、CRM等多源数据,实现商品首铺智能推荐、实时库存预警与AI调价,112家分公司自助建模分析,订单响应从“天级”提速至“实时”,推动“7天快时尚”数智转型。

392 0
|
3月前
|
存储 数据采集 监控
|

一文详解:电商商品选品与价格监控 API 接口实战指南

本文详解如何用API构建自动化选品与价格监控系统:涵盖五层架构设计、主流平台API接入(京东/淘宝/亚马逊等)、Python核心代码实现(采集、监控、存储)、智能选品评分模型及生产级部署优化,助力电商高效捕捉爆款与价格时机。(239字)

666 0
|
3月前
|
SQL 人工智能 监控
|

五年数据开发复盘:从数仓建设到 AI 产品化的阶段性思考

五年数据开发复盘:从数仓建设到AI产品化。作者深耕BI、SaaS数仓、数据血缘与建模,提出“以数仓为根基、实体建模为核心、工程稳定性为底座”,强调业务理解重于工具使用。面对AI浪潮,主张聚焦提示词工程、RAG、实体识别等AI工程化落地,而非算法底层——数据开发正演进为连接业务、数据、工程与AI的复合型角色。

281 3
|
4月前
|
消息中间件 NoSQL Java
|

反向海淘独立站系统设计:如何实现一键同步商品至Shopify/Coupang等多平台并完成自动采购与跨境运输

随着反向海淘商业模式的快速崛起,越来越多的跨境电商创业者和企业希望搭建一套集代购、转运、仓储于一体的智能化系统。然而,仅仅拥有一个独立站往往不够,如何将商品一键上传至Shopify、Coupang、WooCommerce、Base等多个海外电商平台,并在用户下单后自动完成1688/淘宝采购、包裹入库、国际运输全流程,成为技术实现的核心难点。本文基于taoCarts跨境独立站系统的实际开发经验,从技术架构、平台适配、自动采购(1688自动代采系统)、订单同步、集运物流等角度,详细拆解了一套可用于生产环境的反向海淘独立站系统设计方案。文章涵盖了淘宝代购系统、代购集运系统、什么是代采系统、反向海淘为

423 2
来自: 大数据运维SREWorks  版块
|
4月前
|
人工智能 自然语言处理 JavaScript
|

开源 AI 智能体 OpenClaw 安装与使用,电脑自动化效率提升

OpenClaw(小龙虾)是2026年爆火的开源本地AI智能体,GitHub星标超28万。无需编程,纯中文指令即可自动操控电脑完成文件整理、表格生成、浏览器操作等任务。本地运行保隐私,一键部署5分钟搞定,零基础友好!

544 0
|
4月前
|
数据采集 JSON API
|

1688包装信息API接口完全指南(2026版)

本文详解1688商品包装信息获取方案:官方API(alibaba.product.get)字段分散,仅含基础重量/尺寸;推荐使用AliPrice等第三方聚合API,可直接获取净重、毛重、包装方式、内外箱尺寸、装箱数等完整结构化数据,并附Python双通道实战代码与物流计费逻辑。

1227 0
|
5月前
|
存储 SQL Apache
|

(一)走进阿里云实时计算Flink版-产品能力篇

阿里云实时计算Flink版是企业级高性能实时大数据处理平台,由Flink创始团队打造。提供VVR+Flash双引擎,性能达开源Flink的3-4倍;支持动态扩缩容、SQL开发、CEP规则热更新、湖流一体(Fluss+Paimon)、大模型集成等能力,全面兼容开源生态。(239字)

1210 3
来自: 实时计算 Flink  版块
|
5月前
|
XML JSON 监控
|

淘宝宝贝详情数据一键获取,item_getAPI接口讲解

taobao.item.get是淘宝开放平台核心API,通过商品ID(num_iid)一键获取结构化详情,涵盖基础信息、SKU、属性、营销及详情页内容,广泛用于反向海淘、ERP同步、比价工具与自建商城。

595 2
|
5月前
|
编译器 程序员 C语言
|

C语言深度解析:未定义行为(UB)—— 90%玄学bug的根源

C语言因极致性能与硬件控制力成为系统开发首选,但其“自由”伴生未定义行为(UB):语法合法却结果不可控,是“调试正常、上线崩溃”的元凶。UB包括数组越界、有符号溢出、空指针解引用、序列点违规、重复释放等,编译器可任意优化或崩溃。规避需严守边界、开启高警告、判空置空、拆分表达式、预检溢出。(239字)

878 8
|
5月前
|
API 数据库 数据安全/隐私保护
|

别再只会调大模型了:用 Python 搭一套自己的知识库问答系统(RAG 实战指南)

别再只会调大模型了:用 Python 搭一套自己的知识库问答系统(RAG 实战指南)

1223 3
|
6月前
|
机器学习/深度学习 人工智能 物联网
|

烧显卡不烧钱:学生党个人开发者GPU选购指南,看完不再被割韭菜

本文为学生与个人开发者量身打造大模型微调硬件选购指南:解析LoRA/QLoRA等高效微调技术如何大幅降低显存需求,对比RTX 3060/3090/4090等显卡的显存、带宽、算力与性价比,提供2000–8000元梯度配置方案,并分享混合精度、梯度累积等显存优化技巧及云资源省钱策略。

860 5
|
7月前
|
存储 人工智能 关系型数据库
|

传统数据库与向量数据库:一个管“是什么”,一个管“像什么”

向量数据库是AI时代的语义检索引擎,将文本、图片等非结构化数据转化为“语义向量”,支持基于相似性的毫秒级搜索。它不替代MySQL等传统数据库,而是作为大模型的“海马体”,赋能RAG、智能问答与多模态应用,实现从“关键词匹配”到“理解含义”的跃迁。(239字)

1108 7
|
7月前
|
SQL 存储 分布式计算
|

【赵渝强老师】基于Hudi的大数据湖仓一体架构

Apache Hudi(Hadoop Upserts Delete and Incremental)是开源的流式数据湖平台,支持事务、高效upsert/delete、增量处理、多引擎SQL读写(Spark/Flink/Trino等),自动管理小文件与压缩,兼容云存储,助力构建湖仓一体架构。

1016 3
|
7月前
|
存储 人工智能 分布式计算
|

阿里云 OpenLake:AI 时代的全模态、多引擎、一体化解决方案深度解析

阿里云徐晟详解OpenLake:构建全模态、多引擎、一体化智能数据体系,融合大数据与AI,支持湖仓一体、Agentic Data及AI搜索,助力企业降本增效、加速AI落地。(239字)

980 2
|
8月前
|
SQL 关系型数据库 MySQL
|

MySQL 学习资源精选:从入门到优化的高效清单

本文精选MySQL学习资源,按“入门→进阶→实战”三阶段系统梳理视频、书籍、项目等优质资料,结合科学计划与实操建议,帮助学习者高效掌握核心语法、底层原理与性能优化,快速实现从零基础到能独立设计与优化数据库的跃迁。

1291 0
|
8月前
|
数据采集 人工智能 搜索推荐
|

AI 问答占 52%!长沙别墅装修 GEO 突围:30 天引用率暴涨 40%

周有贵,巴黎学院人工智能博士,GGI商学院GEO首席技术专家,专注AI时代数字营销革新。2025年12月1日,长沙著名别墅设计师张主华专程拜访交流,共探GEO技术在装修设计行业中的AI引流逻辑与实操应用。面对生成式AI问答入口占比突破52%的新趋势,传统SEO正被GEO取代——从链接点击到答案呈现,企业需通过构建灯塔内容、E-E-A-T信任链与结构化数据,让品牌信息被AI优先引用。本次对话揭示:未来流量之争,本质是“被AI推荐”的能力之争。

535 11
|
10月前
|
人工智能 自然语言处理 算法
|

【2025云栖大会】AI 搜索智能探索:揭秘如何让搜索“有大脑”

2025云栖大会上,阿里云高级技术专家徐光伟在云栖大会揭秘 Agentic Search 技术,涵盖低维向量模型、多模态检索、NL2SQL及DeepSearch/Research智能体系统。未来,“AI搜索已从‘信息匹配’迈向‘智能决策’,阿里云将持续通过技术创新与产品化能力,为企业构建下一代智能信息获取系统。”

1151 9
来自: 智能搜索推荐  版块
|
11月前
|
大数据 数据挖掘 定位技术
|

买房不是拍脑袋:大数据教你优化房地产投资策略

买房不是拍脑袋:大数据教你优化房地产投资策略

500 2
|
12月前
|
机器学习/深度学习 存储 JSON
|

PyCharm 创建了第一个项目

在 PyCharm 中创建项目时,合理的目录结构有助于代码、依赖和资源的高效管理。本文详细解析了 PyCharm 的默认目录结构,如 `.idea/`(配置文件)、`venv/`(虚拟环境)、`src/`(源代码)、`tests/`(测试代码)、`data/`(数据文件)等,并提供了文件创建建议和最佳实践。同时介绍了核心代码、脚本文件、测试文件的存放位置,以及 PyCharm 的常用操作技巧,帮助开发者构建清晰、可维护的项目结构。

872 2
|
存储 人工智能 API
|

AI代理性能提升实战:LangChain+LangGraph内存管理与上下文优化完整指南

在AI代理系统开发中,上下文工程成为提升系统性能的关键技术。本文探讨了从提示工程到上下文工程的转变,强调其通过为AI系统提供背景信息和工具支持,显著提升智能化程度和实用价值。文章系统分析了上下文工程的理论基础、核心策略(如写入、选择、压缩和隔离),并结合LangChain和LangGraph工具,展示了如何实现上下文工程技术以优化AI代理性能。通过Scratchpad机制、内存管理、RAG系统集成、多代理架构及沙盒环境等技术手段,开发者可以更高效地构建高性能、可扩展的AI系统。

1637 0
|
传感器 算法 数据挖掘
|

Python时间序列平滑技术完全指南:6种主流方法原理与实战应用

时间序列数据分析中,噪声干扰普遍存在,影响趋势提取。本文系统解析六种常用平滑技术——移动平均、EMA、Savitzky-Golay滤波器、LOESS回归、高斯滤波与卡尔曼滤波,从原理、参数配置、适用场景及优缺点多角度对比,并引入RPR指标量化平滑效果,助力方法选择与优化。

2671 0
|
存储 安全 Java
|

2025 年最新 40 个 Java 基础核心知识点全面梳理一文掌握 Java 基础关键概念

本文系统梳理了Java编程的40个核心知识点,涵盖基础语法、面向对象、集合框架、异常处理、多线程、IO流、反射机制等关键领域。重点包括:JVM运行原理、基本数据类型、封装/继承/多态三大特性、集合类对比(ArrayList vs LinkedList、HashMap vs TreeMap)、异常分类及处理方式、线程创建与同步机制、IO流体系结构以及反射的应用场景。这些基础知识是Java开发的根基,掌握后能为后续框架学习和项目开发奠定坚实基础。文中还提供了代码资源获取方式,方便读者进一步实践学习。

3175 2
|
机器学习/深度学习 数据采集 分布式计算
|

阿里云PAI AutoML实战:20分钟构建高精度电商销量预测模型

本文介绍了如何利用阿里云 PAI AutoML 平台,在20分钟内构建高精度的电商销量预测模型。内容涵盖项目背景、数据准备与预处理、模型训练与优化、部署应用及常见问题解决方案,助力企业实现数据驱动的精细化运营,提升市场竞争力。

1896 0
|
SQL 存储 消息中间件
|

Trino权威指南

Trino(原Presto SQL)是一款开源分布式SQL查询引擎,专为大数据联邦查询设计。它支持秒级查询PB级数据,可无缝对接Hive、MySQL、Kafka等20+异构数据源。其核心特性包括高速查询、弹性扩展和低成本使用,适合交互式分析与BI场景。Trino采用无共享架构,通过列式内存格式和动态代码生成优化性能,并提供丰富的连接器实现计算存储分离,最大化下推优化以提升效率。

2275 3
|
监控 API 开发者
|

1688API接口终极宝典:列表、详情全掌握,图片搜索攻略助你一臂之力

1688为开发者提供涵盖商品、交易、物流和会员等核心业务的丰富API接口。商品类接口支持搜索、详情查询及图片搜索;交易类接口实现订单创建与支付;物流类接口提供报价与轨迹查询;会员类接口获取用户信息与认证。示例代码展示如何用Python通过图片搜索商品,并打印关键信息如价格、起订量和供应商详情。建议先在沙箱环境测试,确保稳定后再投入生产,以实现选品分析与价格监控等功能。

468 7
|
机器学习/深度学习 数据采集 API
|

Python自动化解决滑块验证码的最佳实践

Python自动化解决滑块验证码的最佳实践

2913 2
|
SQL 数据采集 分布式计算
|

Dataphin测评:企业级数据中台的「智能中枢」与「治理引擎」

Dataphin是一款智能数据建设与治理平台,基于阿里巴巴OneData方法论,提供从数据采集、建模研发到资产治理、数据服务的全链路智能化能力。它帮助企业解决数据口径混乱、质量参差等问题,构建标准化、资产化、服务化的数据中台体系。本文通过详细的操作步骤,介绍了如何使用Dataphin进行离线数仓搭建,包括规划数仓、数据集成、数据处理、运维补数据及验证数据等环节。尽管平台功能强大,但在部署文档更新、新手友好度及基础功能完善性方面仍有提升空间。未来可引入SQL智能纠错、自然语言生成报告等功能,进一步增强用户体验与数据治理效率。

1389 34
|
SQL 分布式计算 数据挖掘
|

《智能数据建设与治理 Dataphin》的最佳实践

本文介绍了使用Dataphin进行离线数仓搭建的实操教程,涵盖从创建数据板块到数据分析的完整流程。内容包括登录控制台、配置计算源、创建离线管道、生成SQL语句、运行任务及验证数据等步骤。通过详细的操作指南和截图,帮助用户快速上手Dataphin,体验其强大的数据治理能力。总结中提到教程存在部分陈旧问题,建议加深对产品逻辑的理解以更好地掌握工具使用。

761 1
|
JSON 搜索推荐 API
|

淘宝商品详情优惠券API接口全攻略

淘宝商品详情优惠券API接口助力电商精准营销。通过商品ID,开发者可精准检索与特定商品相关的优惠券信息,包括面额、使用门槛、领取条件、有效期等详细数据,并实时监测优惠券状态。此接口支持个性化筛选参数,如优惠券面额范围和类型,返回JSON格式的优惠券列表及状态信息,满足数据整合、营销活动策划等需求,提升用户体验和运营效率。示例代码展示了Python调用方法,帮助快速集成。 供稿者:Taobaoapi2014

724 3
|
监控 搜索推荐 大数据
|

释放大数据的力量:解锁精准投放的市场营销奥秘

释放大数据的力量:解锁精准投放的市场营销奥秘

725 16
|
监控 数据挖掘 API
|

京东商品历史价格 API 接口系列(京东 API)

本文介绍了如何使用京东开放平台API获取商品价格信息。首先,需注册账号并创建应用以获取App Key和App Secret,进而获取Access Token。准备好开发工具后,通过调用`jd.item_search`和`jd.item_get`接口,可以分别按关键字搜索商品和获取指定商品的详细信息及价格。示例代码展示了如何使用Python的requests库进行API请求。应用场景包括价格监控、商家定价策略、电商平台数据分析及商业智能决策支持。

1517 10
|
JSON 数据库 数据格式
|

[开发技巧] 如何获取汉字笔画数?

在开发卜筮小脚本时遇到获取汉字笔画数的需求,起初尝试使用`pypinyin`库却未得理想结果。经过探索,发现Unicode联盟维护的Unihan数据库提供准确的汉字笔画数据。通过下载Unihan数据库文件,解析其中的`kTotalStrokes`字段,利用正则表达式提取所需信息,并将其保存为JSON格式以供快速查询。最终编写函数`get_character_stroke_count`实现任意汉字笔画数的高效获取,满足了项目需求并提供了准确的数据支持。此方法不仅解决了问题,还为类似需求提供了参考方案。

1092 10
|
存储 JSON API
|

淘宝直播间弹幕API接口(taobao.item_video_barrage)

淘宝直播间弹幕 API(`taobao.item_video_barrage`)用于获取直播间的弹幕数据。通过指定直播间 ID 和模式参数(如 `start` 建立连接、`refresh` 获取弹幕),可以获取弹幕消息列表、直播间信息等。响应数据为 JSON 格式,包含状态码、直播间 ID、连接状态和弹幕详情。使用时需注意权限限制、接口稳定性和数据处理。

1689 7
|
存储 分布式计算 大数据
|

【赵渝强老师】阿里云大数据生态圈体系

阿里云大数据计算服务MaxCompute(原ODPS)提供大规模数据存储与计算,支持离线批处理。针对实时计算需求,阿里云推出Flink版。此外,阿里云还提供数据存储服务如OSS、Table Store、RDS和DRDS,以及数据分析平台DataWorks、Quick BI和机器学习平台PAI,构建全面的大数据生态系统。

761 18
|
机器学习/深度学习 人工智能 算法
|

青否数字人声音克隆算法升级,16个超真实直播声音模型免费送!

青否数字人的声音克隆算法全面升级,能够完美克隆真人的音调、语速、情感和呼吸。提供16种超真实的直播声音模型,支持3大AI直播类型和6大核心AIGC技术,60秒快速开播,助力商家轻松赚钱。AI讲品、互动和售卖功能强大,支持多平台直播,确保每场直播话术不重复,智能互动和真实感十足。新手小白也能轻松上手,有效规避违规风险。

795 2
来自: 大数据计算 MaxCompute  版块
|
数据采集 安全 API
|

数据治理:实现原始数据不出域,确保数据可用不可见的创新策略

在数字化时代,数据成为企业宝贵资产,驱动业务决策与创新。然而,数据量激增和流通频繁带来了安全和管理挑战。“原始数据不出域,数据可用不可见”的治理理念应运而生,通过数据脱敏、沙箱技术和安全多方计算等手段,确保数据安全共享与高效利用。这一理念已广泛应用于金融、医疗等行业,提升了数据价值和企业竞争力。

3435 0
|
人工智能 自然语言处理 搜索推荐
|

国内可用的 Web Search API,可以平替Bing Search API

近期人们发现,AI对搜索引擎的需求远远超过人类。这个团队专为AI打造搜索引擎,上线仅60天就已被调用超30万次。

6270 1
|
数据采集 人工智能 监控
|

阿里云百炼模型训练实战流程:从入门到实战应用

【7月更文第2天】阿里云百炼是AI大模型开发平台,提供一站式服务,涵盖模型训练到部署。用户从注册登录、创建应用开始,选择模型框架,配置资源。接着,进行数据准备、预处理,上传至阿里云OSS。模型训练涉及设置参数、启动训练及调优。训练后,模型导出并部署为API,集成到应用中。平台提供监控工具确保服务性能。通过百炼,开发者能高效地进行大模型实战,开启AI创新。

5843 2
|
存储 并行计算 Java
|

Python读取.nc文件的方法与技术详解

本文介绍了Python中读取.nc(NetCDF)文件的两种方法:使用netCDF4和xarray库。netCDF4库通过`Dataset`函数打开文件,`variables`属性获取变量,再通过字典键读取数据。xarray库利用`open_dataset`打开文件,直接通过变量名访问数据。文中还涉及性能优化,如分块读取、使用Dask进行并行计算以及仅加载所需变量。注意文件路径、变量命名和数据类型,读取后记得关闭文件(netCDF4需显式关闭)。随着科学数据的增长,掌握高效处理.nc文件的技能至关重要。

3510 0
|
SQL DataWorks NoSQL
|

DataWorks常见问题之如何自定义日期参数

DataWorks是阿里云提供的一站式大数据开发与管理平台,支持数据集成、数据开发、数据治理等功能;在本汇总中,我们梳理了DataWorks产品在使用过程中经常遇到的问题及解答,以助用户在数据处理和分析工作中提高效率,降低难度。

663 0
|
Python
|

使用ARIMA预测股票未来走势

Python实现使用ARIMA预测股票未来走势

3232 1
|
存储 编解码 iOS开发
|

视频文件格式:MOV与MP4格式的区别是什么?

视频文件有多种格式,很多人在下载时不知道该选择哪种文件格式。不同格式有不同特点,各自有优缺点。本文将详细介绍常见的MOV和MP4的特点与区别,以供读者了解及选择。

11656 3
|
存储 SQL 运维
|

开源大数据OLAP引擎最佳实践

本篇内容分享了开源大数据OLAP引擎最佳实践。 分享人:范振 阿里云高级技术专家

16753 0
来自: 大数据计算 MaxCompute  版块
|
分布式计算 运维 DataWorks
|

DataWorks学习路径

DataWorks学习路径

4355 2
|
存储 JSON Oracle
|

【最佳实践】esrally:Elasticsearch 官方压测工具及运用详解

由于 Elasticsearch(后文简称 es) 的简单易用及其在大数据处理方面的良好性能,越来越多的公司选用 es 作为自己的业务解决方案。然而在引入新的解决方案前,不免要做一番调研和测试,本文便是介绍官方的一个 es 压测工具 esrally,希望能为大家带来帮助。

21528 0
|
12天前
|
数据采集 架构师 网络协议
|

架构师视角:如何设计一套高扩展性的通用爬虫中间件系统?

这篇文章讨论了如何设计一套高扩展性的通用爬虫中间件系统。作者从架构师视角出发,分析了爬虫系统的需求和挑战,并提出了相应的设计原则和解决方案。文章强调了模块化、可配置性和容错性的重要性,旨在帮助读者构建一个稳定、高效且易于扩展的爬虫系统。

76 1
|
14天前
|
人工智能 算法 大数据
|

为什么物流公司都在卷“算法”?大数据如何让配送路线越跑越聪明

为什么物流公司都在卷“算法”?大数据如何让配送路线越跑越聪明

111 3
|
16天前
|
SQL JSON 运维
|

一条SQL同时处理结构化条件和非结构化语义匹配。

本文对比智能客服场景下向量检索的两种架构:独立向量库 vs 内置向量的关系型数据库。结合5万知识库、日增数百条、QPS 20+的实际需求,剖析二者在数据一致性、运维成本、查询性能与扩展性上的真实差异,指出多数创业团队无需“为技术而技术”,关系库向量化已足够成熟可靠。(239字)

97 0

大数据与机器学习

大数据领域前沿技术分享与交流,这里不止有技术干货、学习心得、企业实践、社区活动,还有未来。

0
今日
70017
内容
128
活动
440138
关注
你好!
登录掌握更多精彩内容

相关产品

  • 大数据开发治理平台 DataWorks
  • 检索分析服务 Elasticsearch版
  • 日志服务