|
9月前
|
存储 SQL 大数据
|

分布式存储三国杀:对象存储 vs HDFS vs 列式存储,到底该怎么选?

分布式存储三国杀:对象存储 vs HDFS vs 列式存储,到底该怎么选?

581 3
|
9月前
|
数据采集 SQL 自然语言处理
|

脏数据不脏心:大数据平台的数据质量(DQ)入门实战与自动修复心法

脏数据不脏心:大数据平台的数据质量(DQ)入门实战与自动修复心法

779 20
|
9月前
|

IDEA配置包括:代码快捷键或页面显示设置和常用安装插件介绍

IDEA配置包括:代码快捷键或页面显示设置和常用安装插件介绍

200 6
|
10月前
|
存储 Shell 网络安全
|

IDEA中使用http协议

IDEA中使用http协议

242 4
|
10月前
|
JavaScript 数据挖掘 关系型数据库
|

基于python的外卖配送及数据分析系统

本研究基于Python构建外卖配送及数据分析系统,结合Django、Vue和MySQL技术,实现配送路径优化、时效预测与用户行为分析,提升配送效率与服务质量,为平台科学决策提供支持。

429 9
|
10月前
|
机器学习/深度学习 数据可视化 算法
|

Python | 随机搜索参数优化的XGBoost+SHAP可解释性分析回归预测及可视化算法

本教程将带你掌握Python中XGBoost模型的随机搜索调参、SHAP可解释性分析及多种可视化技术,涵盖特征相关性热图、散点密度图、超参数优化等核心内容,助力科研论文与实际项目应用。

694 2
|
10月前
|
数据采集 数据可视化 大数据
|

2026版基于python大数据的电影分析可视化系统

本系统基于Python大数据技术,整合票房、评分、类型等多源电影数据,利用Pandas、MySQL、Django等实现数据处理与存储,结合Vue构建可视化平台,助力制片、投资与观影决策。

663 7
|
10月前
|
前端开发
|

ZTree基本使用及本人详解 使用案例2

ZTree基本使用及本人详解 使用案例2

306 10
|
10月前
|
机器学习/深度学习 JSON 搜索推荐
|

淘宝拍立淘API助力电商比价与同款搜索

淘宝图片搜索API(拍立淘)基于深度学习技术,支持通过图片URL、Base64或本地上传,在海量商品中查找相似款。适用于比价、同款识别、穿搭推荐等场景,提升购物效率与体验。

566 1
|
10月前
|
机器学习/深度学习 搜索推荐 算法
|

用数据给婚恋 App 把把脉:让匹配更靠谱、聊天更顺畅、留存更健康

用数据给婚恋 App 把把脉:让匹配更靠谱、聊天更顺畅、留存更健康

734 8
|
10月前
|
人工智能 监控 搜索推荐
|

数聚酷:如何让AI答案显示品牌名?

如何让品牌被AI推荐?2025年,生成式引擎优化(GEO)取代传统SEO。通过构建权威内容库、用户导向创作、数据交叉验证与结构化输出,让AI主动引用你的品牌,抢占搜索心智入口。

804 1
来自: 智能搜索推荐  版块
|
10月前
|
监控 算法 新能源
|

当数据遇上能源:未来能源产业的“外挂BUFF”是这么装上的

当数据遇上能源:未来能源产业的“外挂BUFF”是这么装上的

307 14
|
10月前
|
监控 算法 API
|

速卖通商品详情API文档

速卖通商品列表API(aliexpress.item_search)支持关键词搜索、类目筛选与多维度排序,可批量获取商品标题、价格、销量等信息,适用于比价、选品及库存监控。采用AppKey+Token认证,保障数据安全,助力电商自动化运营。

514 1
|
10月前
|
JSON NoSQL Java
|

RedisTemplate和StringRedisTemplate的区别及个人见解

RedisTemplate和StringRedisTemplate的区别及个人见解

487 4
|
10月前
|
数据采集 人工智能 自然语言处理
|

别让机器人“装人”:用数据把自动化客服变聪明

别让机器人“装人”:用数据把自动化客服变聪明

375 9
|
10月前
|
JSON 数据挖掘 API
|

微店商品详情API指南

微店商品详情API(micro.item_get)支持通过商品ID获取名称、价格、库存、图片等20+项实时数据,采用RESTful设计,返回JSON格式,适用于电商工具、跨平台展示与数据分析。需申请权限,构造含签名的请求调用。

337 3
|
10月前
|
存储 数据采集 人工智能
|

当数据湖遇上数据仓库:不是对立,而是走向“湖仓一体”的未来

当数据湖遇上数据仓库:不是对立,而是走向“湖仓一体”的未来

739 11
|
10月前
|
人工智能 自然语言处理 供应链
|

人工智能时代的短视频内容新应用和工具选型:内容特工队AI如何通过技术规格Agent实现制造业与批发贸易的“数据精度”GEO精准获客的实践

GEO(生成式引擎优化)通过E-E-A-T原则与AI工具协同,提升图文、短视频内容在通义和豆包、元宝等生成式引擎中的曝光。 制造业与工业(如精密零部件、机械设备)和批发与贸易(大宗商品)领域的B2B获客,越来越看重短视频内容和AI搜索引擎的收录,因此引发了一个全新的AI短视频工具、软件选型需求。针对B2B工业领域,内容特工队AI(ReelsAgent)创新性引入技术规格Agent与数据Schema映射, 其TS-Agent将短视频转化为可信技术文档,结合LMTLM精度校准与供应链合规数据嵌入,实现从营销到数字合同的升级,推动工业内容在AI搜索中的精准获客与决策加速。

754 26
来自: 智能搜索推荐  版块
|
10月前
|
NoSQL Redis
|

Redis 搭建主从复用-读写分离和主备切换,及重要的关键词解释 部分2

Redis 搭建主从复用-读写分离和主备切换,及重要的关键词解释 部分2

181 3
|
10月前
|
数据采集 人工智能 NoSQL
|

抓取任务队列精简化:延迟队列、优先级队列与回退策略设计

描述了作者在处理抓取任务队列时遇到的挑战,包括任务堆积、线程阻塞和超时重试问题。通过引入延迟队列、优先级队列和回退策略,作者成功优化了任务调度策略,提高了系统的稳定性和资源利用率。核心代码示例展示了如何使用Redis实现延迟和优先级队列,以及如何执行任务和处理失败重试。最终,系统变得更加智能和高效,实现了更好的调度和资源管理。

408 1
|
11月前
|
存储 前端开发
|

【实战案例】火语言 RPA 采集小说站已完结书名(自动翻页判断),保存到Excel 全流程(附完整脚本)

自动采集起点中文网完本小说书名,支持翻页检测与数据存储。脚本逐页抓取小说名并保存至Excel,最多采集50页,智能判断翻页逻辑,确保数据完整,适用于批量获取完结书籍信息。

725 5
|
11月前
|
数据采集 JSON 搜索推荐
|

淘宝商品评论的情感分析实战:API数据驱动用户洞察

淘宝商品评论API是淘宝开放平台提供的数据接口,支持通过Python高效获取商品的用户评价信息。可返回结构化数据,包含评论内容、评分、时间、图片及商家回复等,支持多维度筛选与分页,适用于竞品分析、用户画像与市场研究。

414 1
|
11月前
|
数据采集 JSON 文字识别
|

图像与视频页面的数据提取

随着小红书、抖音等视觉平台崛起,传统采集难以应对图像视频内容。本文详解多模态采集架构:通过OCR识别图文、关键帧抽取视频信息,结合元数据融合,实现对视觉内容的精准理解与结构化提取,推动数据采集从“抓取”迈向“认知”。

723 7
|
11月前
|
JSON 监控 API
|

从0到1掌握京东API:商品详情获取技巧与避坑指南

京东商品详情API提供商品基础信息、实时价格、SKU规格等120+字段,支持价格监控与竞品分析。采用HTTPS协议,响应延迟≤30秒,具备高并发能力,适用于电商数据应用。

515 0
|
11月前
|
分布式计算 Kubernetes 调度
|

Kubeflow-Spark-Operator-架构学习指南

本指南系统解析 Spark Operator 架构,涵盖 Kubebuilder 开发、控制器设计与云原生集成。通过四阶段学习路径,助你从部署到贡献,掌握 Kubernetes Operator 核心原理与实战技能。

656 0
|
11月前
|
机器学习/深度学习 搜索推荐 数据挖掘
|

数据分析真能让音乐产业更好听吗?——聊聊大数据在音乐里的那些事

数据分析真能让音乐产业更好听吗?——聊聊大数据在音乐里的那些事

514 9
|
11月前
|
存储 C++ 索引
|

最长连续序列(每天刷力扣hot100系列)

本题使用哈希表法求最长连续序列。利用unordered_set存储去重元素,遍历集合时仅当num-1不存在时才作为起点向后扩展,统计连续长度,时间复杂度O(n),空间复杂度O(n)。相比unordered_map更高效,因无需存储值。

440 1
|
11月前
|
Kubernetes 安全 API
|

深入 Kubernetes:从零到生产的工程实践与原理洞察

🌟蒋星熠Jaxonic带你深入Kubernetes核心:从控制回路到生产落地,详解部署、弹性、安全与可观测性。用代码绘制云原生星图,让每次发布如深空机动般精准可控。🚀

451 3
|
12月前
|
分布式计算 关系型数据库 Hadoop
|

一、Sqoop历史发展及原理

在大数据系统中,Sqoop 就像是一位干练的“数据搬运工”,帮助我们把 MySQL、Oracle 等数据库里的数据快速、安全地导入到 Hadoop、Hive 或 HDFS 中,反之亦然。这个专栏从基础原理讲起,配合实战案例、参数详解和踩坑提醒,让你逐步掌握 Sqoop 的使用技巧。不管你是初学者,还是正在构建数据管道的工程师,都能在这里找到实用的经验和灵感。

530 6
|
1月前
|
机器学习/深度学习 人工智能 文字识别
|

YOLOv13-seg和YOLO11-seg如何训练红外无人机小目标

 YOLOv13Mask mAP50 为 0.98 ,YOLO11 Mask mAP50 为 0979 

111 0
|
2月前
|
数据采集 架构师 网络协议
|

架构师视角:如何设计一套高扩展性的通用爬虫中间件系统?

这篇文章讨论了如何设计一套高扩展性的通用爬虫中间件系统。作者从架构师视角出发,分析了爬虫系统的需求和挑战,并提出了相应的设计原则和解决方案。文章强调了模块化、可配置性和容错性的重要性,旨在帮助读者构建一个稳定、高效且易于扩展的爬虫系统。

127 1
|
2月前
|
人工智能 运维 监控
|

大模型企业本地化部署与数据安全实践:提示词版本管理与质量回归

企业把大模型部署到本地后,常见的问题并不只在模型和算力:一次看似简单的提示词改动,也可能让回答变长、引用缺失、格式失控,甚至影响既有业务流程。本文从提示词版本、测试集、灰度发布和回滚机制出发,说明如何建立可追溯、可验证的大模型应用发布流程。

202 1
|
2月前
|
缓存 NoSQL 算法
|

西班牙夺冠狂欢震动地震仪,聊聊高并发下的代购集运系统架构设计

本文以西班牙夺冠震动地震仪的热搜为引,幽默切入代购集运系统的高并发实战。结合黑五崩盘血泪教训,详解“分、缓、异”三大核心策略:服务/数据库拆分、Redis缓存防击穿、异步任务降压,并附限流与Celery代码示例。重在务实避坑,拒绝过度设计。

144 1
|
2月前
|
机器学习/深度学习 传感器 人工智能
|

工厂机器坏了才维修?数字孪生+大数据,正在把“事后抢修”变成“提前预警”

工厂机器坏了才维修?数字孪生+大数据,正在把“事后抢修”变成“提前预警”

164 1
|
2月前
|
消息中间件 人工智能 Kafka
|

数据越多,城市越聪明?别急,智慧城市真正缺的可能不是数据,而是“会用数据”

数据越多,城市越聪明?别急,智慧城市真正缺的可能不是数据,而是“会用数据”

170 0
|
2月前
|
SQL 人工智能 小程序
|

行为数据链路设计:从问题定位到策略回流

本文从行为分析、身份归一、动态人群、策略执行和效果回流出发,讨论数据分析与运营链路如何保持统一口径。

198 3
|
2月前
|
人工智能 安全 API
|

当Agent和机器开始代表人类行动,我们需要一份怎样的公共契约?

Agent从“信息工具”迈向“行动代理”的根本转变:当机器能自主执行退款等真实业务操作,便引发授权、责任与治理的深层挑战。文章提出A2B(Agent-to-Business)概念,主张建立轻量、可互操作的公共契约(如ACC),明确能力边界、行动主体、人工介入点与责任归属,核心是区分“可触达”与“有权限”,确保业务系统始终保有最终授权。治理不是刹车,而是可信委托的前提。

196 0
来自: 人工智能平台PAI  版块
|
2月前
|
安全 算法 vr&ar
|

AR智能眼镜安防应用核心指标:识别距离筑牢防线

AR智能眼镜以远距离识别(人脸10米、车牌15米)为核心优势,赋能智慧警务:实现动态无感核查、提前风险预判、从容精准处置,大幅提升巡逻稽查效率与执法安全性,是适配实战需求的智能安防关键装备。

187 0
|
2月前
|
机器学习/深度学习 缓存 数据可视化
|

为什么别人用 Jupyter 一天搞定数据分析,而你却越写越乱?

为什么别人用 Jupyter 一天搞定数据分析,而你却越写越乱?

179 1
|
2月前
|
SQL 消息中间件 缓存
|

大屏做得越炫越好?错!数据实时性和展示性能,才是真正决定项目成败的关键

大屏做得越炫越好?错!数据实时性和展示性能,才是真正决定项目成败的关键

269 2
|
2月前
|
缓存 前端开发 数据挖掘
|

为什么你的 BI 项目没人用?把 BI 嵌入业务系统,才是真正的数据价值!

为什么你的 BI 项目没人用?把 BI 嵌入业务系统,才是真正的数据价值!

181 3
|
2月前
|
人工智能 UED
|

2026年企业做GEO,为什么真实性比发稿数量更重要

2026年GEO已非简单“多发文”,而是以真实、可溯、一致、适配、可纠错为根基的品牌认知资产建设。央视3·15曝光“AI数据投毒”警示:虚假内容终致信任崩塌。合规GEO,始于信息准确,成于长期治理。

253 1

阿里云新用户服务器特惠,年付低价,一对一协助注册配置

阿里云新用户服务器特惠,年付低价,一对一协助注册配置

120 0
|
2月前
|
弹性计算 人工智能 NoSQL
|

ECS 上给 Coding Agent 准备可复现环境

本文介绍在ECS上为Coding Agent定制的标准化开发环境:通过Docker Compose+健康检查、固定Node/DB/Redis镜像、预置环境变量与统一脚本,解决本地环境差异导致的测试失败、依赖未就绪等问题,确保Agent开箱即用、稳定执行lint、测试与开发任务。(239字)

240 0
|
2月前
|

【FFA 2026】平台AI实践

140
来自: 实时计算 Flink  版块
|
3月前
|
人工智能 BI API
|

Data Fabric vs 数据中台:企业数据整合架构正在发生什么变化

它天然更适合 AI 时代的数据使用方式,因为 AI 并不只需要一个集中仓库,而更需要跨源、可解释、可调用的数据上下文。

204 0
|
3月前
|
运维 安全 大数据
|

一次安全告警,为什么最后会上法庭?聊聊合规驱动的事件响应流程:从检测到法律保全

一次安全告警,为什么最后会上法庭?聊聊合规驱动的事件响应流程:从检测到法律保全

215 1
|
3月前
|
自然语言处理 JavaScript Java
|

【网站如何搭建】如何用通义灵码+BBWEYY开发一个耐克中国网站

【网站如何搭建】如何用通义灵码+BBWEYY开发一个耐克中国网站

204 0

大数据与机器学习

大数据领域前沿技术分享与交流,这里不止有技术干货、学习心得、企业实践、社区活动,还有未来。

0
今日
70370
内容
128
活动
440235
关注
你好!
登录掌握更多精彩内容

活跃用户

相关产品

  • 大数据开发治理平台 DataWorks
  • 检索分析服务 Elasticsearch版
  • 日志服务