|
10月前
|
机器学习/深度学习 数据采集 算法
|

量子机器学习入门:三种数据编码方法对比与应用

在量子机器学习中,数据编码方式决定了量子模型如何理解和处理信息。本文详解角度编码、振幅编码与基础编码三种方法,分析其原理、实现及适用场景,帮助读者选择最适合的编码策略,提升量子模型性能。

831 8
|
10月前
|
监控 API
|

阿里云性能监控图api在哪里

219 0
|
10月前
|
分布式计算 安全 大数据
|

别等被黑客敲门才醒悟:大数据如何帮你防住网络攻击?

别等被黑客敲门才醒悟:大数据如何帮你防住网络攻击?

442 32
|
10月前
|
机器学习/深度学习 算法
|

Proximal SFT:用PPO强化学习机制优化SFT,让大模型训练更稳定

本文介绍了一种改进的监督微调方法——Proximal Supervised Fine-Tuning (PSFT),旨在解决传统SFT易过拟合、泛化能力差及导致“熵坍塌”的问题。受PPO强化学习算法启发,PSFT通过引入参数更新的稳定性机制,防止模型在训练中变得过于确定,从而提升探索能力与后续强化学习阶段的表现。实验表明,PSFT在数学推理、模型对齐及泛化能力方面均优于传统SFT。

965 3
|
10月前
|
人工智能 自然语言处理 IDE
|

模型微调不再被代码难住!PAI和Qwen3-Coder加速AI开发新体验

通义千问 AI 编程大模型 Qwen3-Coder 正式开源,阿里云人工智能平台 PAI 支持云上一键部署 Qwen3-Coder 模型,并可在交互式建模环境中使用 Qwen3-Coder 模型。

1493 109
来自: 人工智能平台PAI  版块
|
10月前
|
数据可视化 搜索推荐 大数据
|

基于python大数据的北京旅游可视化及分析系统

本文深入探讨智慧旅游系统的背景、意义及研究现状,分析其在旅游业中的作用与发展潜力,介绍平台架构、技术创新、数据挖掘与服务优化等核心内容,并展示系统实现界面。

889 3
|
10月前
|
数据采集 数据可视化 数据挖掘
|

基于python大数据的nba球员可视化分析系统

本课题围绕NBA球员数据分析与可视化展开,探讨如何利用大数据与可视化技术提升篮球运动的表现评估与决策支持能力。研究涵盖数据采集、处理与可视化呈现,结合SQLite、Flask、Echarts等技术构建分析系统,助力球队训练、战术制定及球迷观赛体验提升。

646 2
|
10月前
|
数据采集 算法 搜索推荐
|

面向教育平台的分层内容采集思路

随着在线教育平台快速发展,其内容采集需应对层级化、动态更新及访问限制等挑战。本文提出分层采集方案,结合代理服务与异步爬虫技术,实现高效稳定的数据抓取,适用于教育平台及其他内容型平台的数据采集需求。

244 1
|
10月前
|
安全 搜索推荐 开发者
|

【适度精简】Windows 7 旗舰版-emmy精简系统

Windows 7旗舰版因硬件占用高、冗余组件多、兼容性差及缺乏安全更新等问题,逐渐难以满足用户需求。适度精简版通过去除无用组件、优化性能与安全性,提升老旧设备运行效率,增强兼容性与稳定性,同时保留用户熟悉的操作界面,降低学习成本,满足个性化需求,延续Windows 7的实用价值。

483 2
|
11月前
|
人工智能 自动驾驶 物联网
|

AI 来当“交通警察”:如何优化 5G 网络资源分配?

AI 来当“交通警察”:如何优化 5G 网络资源分配?

310 9
|
11月前
|
数据采集 数据可视化 数据挖掘
|

从信息捕获到多维研判的链路解析

本案例构建了一套基于爬虫与数据分析的热点监测系统,通过代理IP与Python工具实现新闻内容抓取,结合时间、来源与关键词分析,打造“信息雷达”,助力舆情研判与趋势预测。

330 7
|
11月前
|
自然语言处理 5G 语音技术
|

5G加持下的实时翻译:从“卡顿”到“秒懂”的进化之路

5G加持下的实时翻译:从“卡顿”到“秒懂”的进化之路

390 1
|
11月前
|
传感器 安全 机器人
|

5G+远程手术:当“低延迟”成为一把手术刀

5G+远程手术:当“低延迟”成为一把手术刀

413 3
|
11月前
|
算法 数据挖掘 测试技术
|

HiRAG:用分层知识图解决复杂推理问题

HiRAG是一种分层检索增强生成系统,专为复杂知识图的多层推理设计。它通过构建从具体实体到抽象概念的多层次结构,提升知识推理深度与连贯性,有效减少大模型幻觉,适用于天体物理、理论物理等专业领域。

490 3
|
11月前
|
监控 物联网 5G
|

“地面+天上双保险”:5G遇上卫星互联网,会擦出怎样的火花?

“地面+天上双保险”:5G遇上卫星互联网,会擦出怎样的火花?

514 0
|
11月前
|
传感器 机器学习/深度学习 人工智能
|

从铁钩到“仿生手”:AI正在重写假肢的未来

从铁钩到“仿生手”:AI正在重写假肢的未来

505 4
|
11月前
|
机器学习/深度学习 人工智能 自然语言处理
|

ReasonRank:从关键词匹配到逻辑推理,排序准确性大幅超越传统方法

ReasonRank是一种创新段落重排系统,采用自动化数据合成与两阶段训练(监督微调+强化学习),在BRIGHT等测试中超越更大模型,显著提升信息检索中的推理能力。

350 0
|
11月前
|
机器学习/深度学习 算法 Java
|

Java 大视界 -- Java 大数据在智能物流运输车辆智能调度与路径优化中的技术实现(218)

本文深入探讨了Java大数据技术在智能物流运输中车辆调度与路径优化的应用。通过遗传算法实现车辆资源的智能调度,结合实时路况数据和强化学习算法进行动态路径优化,有效提升了物流效率与客户满意度。以京东物流和顺丰速运的实际案例为支撑,展示了Java大数据在解决行业痛点问题中的强大能力,为物流行业的智能化转型提供了切实可行的技术方案。

897 0
|
11月前
|
机器学习/深度学习 运维 监控
|

[VLDB 2025]面向Flink集群巡检的交叉对比学习异常检测

阿里云与华东师范大学合作论文《Noise Matters: Cross Contrastive Learning for Flink Anomaly Detection》被VLDB 2025接收。该研究聚焦Flink集群热点机器异常检测,提出跨对比学习方法,结合先验知识优化模型训练,有效应对噪声数据干扰,提升检测准确率。该技术已应用于Flink集群智能巡检系统,助力运维风险预警。

478 0
来自: 实时计算 Flink  版块
|
11月前
|
数据采集 监控 数据可视化
|

数据量暴涨时,抓取架构该如何应对?——豆瓣电影案例调研

本案例讲述了在豆瓣电影数据采集过程中,面对数据量激增和限制机制带来的挑战,如何通过引入爬虫代理、分布式架构与异步IO等技术手段,实现采集系统的优化与扩展,最终支撑起百万级请求的稳定抓取。

614 0
|
11月前
|
JSON 监控 BI
|

京东店铺所有商品API响应数据解析

京东店铺商品API由京东开放平台提供,可获取指定店铺的商品基础信息、价格、库存及销量等数据,适用于商品管理、竞品分析、价格监控等场景。支持HTTPS请求、JSON格式返回,提供Python示例,便于第三方系统集成与数据应用。

350 0
|
11月前
|
人工智能 自然语言处理 前端开发
|

《10分钟开发电商页!CodeBuddy自然语言转代码实测:程序员效率革命》

CodeBuddy AI编程助手,实现自然语言到代码全流程生成,支持React开发、Figma转代码,提升效率,限时抽奖送体验码!

560 0
来自: 大数据计算 MaxCompute  版块
|
11月前
|
人工智能 自然语言处理 Java
|

面向 Java 开发者:2024 最新技术栈下 Java 与 AI/ML 融合的实操详尽指南

Java与AI/ML融合实践指南:2024技术栈实战 本文提供了Java与AI/ML融合的实操指南,基于2024年最新技术栈(Java 21、DJL 0.27.0、Spring Boot 3.2等)。主要内容包括: 环境配置:详细说明Java 21、Maven依赖和核心技术组件的安装步骤 图像分类服务:通过Spring Boot集成ResNet-50模型,实现REST接口图像分类功能 智能问答系统:展示基于RAG架构的文档处理与向量检索实现 性能优化:利用虚拟线程、GraalVM等新技术提升AI服务性能 文

986 0
|
11月前
|
传感器 自动驾驶 算法
|

自动驾驶还远吗?关键看“眼睛”

自动驾驶感知系统是智能车的“眼睛”,依赖摄像头、激光雷达、毫米波雷达等传感器实现环境感知。文章详解了感知架构、主流目标检测方法(如2D/3D检测、多传感器融合)、感知挑战(如极端天气、长尾问题)及发展趋势,并结合驭势科技实践,展示了数据闭环、BEV感知、全景分割等技术进展,推动自动驾驶向全天候、全无人目标迈进。

753 0
|
11月前
|
存储 搜索推荐 安全
|

Java 大视界 --Java 大数据在智能教育学习效果评估与教学质量改进中的应用(209)

本文探讨了 Java 大数据在智能教育中的创新应用,涵盖学习效果评估、教学质量改进及个性化教学方案定制等内容,结合实战案例与代码解析,展现技术如何赋能教育智能化转型。

334 0
|
11月前
|
机器学习/深度学习 人工智能 搜索推荐
|

文生图关键问题探索

文生图(Text-to-Image Generation)是AIGC的重要方向,近年来模型效果显著提升,受到投资界与研究界高度关注。本文从评测体系、可控生成、个性化模型及高质量数据集四个角度探讨该领域面临的关键问题与研究进展。尽管生成模型如Diffusion Model和Stable Diffusion在效果与效率上突破显著,但在文本理解、生成控制、模型定制及数据质量等方面仍存在挑战。如何建立统一的评价标准、提升生成与文本的一致性、实现个性化定制及构建高质量多语言数据集,是未来研究与应用的关键方向。文生图的发展有望推动人机交互方式变革,成为人工智能迈向“人性化”的重要一步。

715 0
|
11月前
|
数据采集 存储 缓存
|

构建“天气雷达”一样的网页监控系统

证券级信息精准监测系统,具备雷达感知能力,实时探测网页变动,快速响应公告更新,助力投资决策抢占先机。

504 0
|
11月前
|
文字识别 算法 语音技术
|

基于模型蒸馏的大模型文案生成最佳实践

本文介绍了基于模型蒸馏技术优化大语言模型在文案生成中的应用。针对大模型资源消耗高、部署困难的问题,采用EasyDistill算法框架与PAI产品,通过SFT和DPO算法将知识从大型教师模型迁移至轻量级学生模型,在保证生成质量的同时显著降低计算成本。内容涵盖教师模型部署、训练数据构建及学生模型蒸馏优化全过程,助力企业在资源受限场景下实现高效文案生成,提升用户体验与业务增长。

1088 23
|
11月前
|
Web App开发 Rust 前端开发
|

WebAssembly 与 Java 结合实操指南 基于最新工具链的跨语言开发实践教程

WebAssembly与Java集成实操指南 本文基于2024年最新工具链(GraalVM、TeaVM、Wasmtime),提供两种Java与Wasm结合的实践方案: Java调用Wasm模块:通过Rust编写高性能加密算法并编译为Wasm,在Java中利用Wasmtime运行时进行调用,实现6.7倍的性能提升。重点演示了Wasm内存模型操作和指针传递机制。 Java编译为Wasm:使用TeaVM将Java科学计算代码编译为Wasm模块,供浏览器前端直接调用。包含完整的Maven配置和前端调用示例,特别适合

865 5
|
12月前
|
JSON 数据挖掘 API
|

闲鱼商品列表API响应数据python解析

闲鱼商品列表API(Goodfish.item_list)提供标准化数据接口,支持GET请求,返回商品标题、价格、图片、卖家信息等。适用于电商比价、数据分析,支持多语言调用,附Python示例代码,便于开发者快速集成。

633 0
|
24天前
|
数据采集 JSON API
|

Temu店铺上新1688商品详情数据采集项目总结

本项目依托1688平台,通过API批量采集商品数据,经标准化清洗、跨境适配(标题优化、参数补全、图片处理、文案翻译)及人工复核,实现Temu店铺高效、合规、规模化上新,日均SKU提升3–5倍,审核通过率达98%以上。(239字)

168 0
|
27天前
|
人工智能 数据可视化 数据挖掘
|

连续7年!阿里云凭借Quick BI成为中国唯一上榜Gartner® ABI魔力象限的BI厂商

阿里云Quick BI第七次入选Gartner分析与BI魔力象限挑战者象限,是中国唯一连续七年上榜的BI厂商。作为AI-native智能分析平台,它集多源接入、归因分析、生态协同、按需计费于一体,已服务万家客户,覆盖全球8大区域。(239字)

164 1
|
27天前
|
SQL 人工智能 数据挖掘
|

传统 ChatBI vs 企业级数据分析智能体:差别不只是“能不能聊天”

企业应将 ChatBI 视为数据能力演进的早期阶段,而不是终点。长期来看,应逐步构建语义层与数据整合能力,将数据能力从查询工具升级为分析系统。

100 1
|
29天前
|

【FFA 2026】主论坛

158
来自: 实时计算 Flink  版块
|
1月前
|
人工智能 前端开发 数据挖掘
|

为什么你的 BI 报表没人看?不是数据不准,而是根本看不懂!

为什么你的 BI 报表没人看?不是数据不准,而是根本看不懂!

137 2
|
1月前
|
供应链 监控 Cloud Native
|

子不语 x Quick BI:“爆款飞轮”高速增长背后的数字化助推力

子不语集团(2420.HK)借助瓴羊Quick BI构建数字化底座,打通数据孤岛,将报表开发从两周缩至1天,支撑智能销售、库存预警与语义分析,年降本增效显著。

125 3
|
1月前
|
机器学习/深度学习 SQL 运维
|

Aloudata Agent 分析技能详解:从一个业务问题到一份可用分析

一场完整的分析闭环:口径确认、名单融合、结果呈现、因子拆解、维度下钻、明细验证、What-if 测算、报告交付。

117 0
|
1月前
|
监控 搜索推荐 算法
|

Java 获取淘宝图搜接口(拍立淘)开发文档

本文系统介绍淘宝图片搜索API(拍立淘)在Java环境下的两种主流接入方案:淘宝开放平台TOP接口与阿里云图像搜索服务,涵盖接入准备、图片要求、签名算法、完整代码实现及常见问题解决方案,适用于电商比价、内容带货等场景。

359 0
|
1月前
|
SQL 数据采集 存储
|

数据越多越乱?一套元数据策略,帮你把“大数据垃圾场”变成“数据资产库”

数据越多越乱?一套元数据策略,帮你把“大数据垃圾场”变成“数据资产库”

169 0
|
1月前
|
机器学习/深度学习 人工智能 自然语言处理
|

人工智能|大白话GPT

GPT-1是首个基于Transformer解码器的生成式预训练模型,采用自回归方式逐词生成文本:以起始,依上下文预测下一词,循环直至。其核心为12层Decoder-only架构,通过掩码自注意力实现单向语言建模,并支持分类、蕴含等下游任务微调。(239字)

258 1
|
1月前
|
机器学习/深度学习 编解码 算法
|

PyTorch深度学习实战 |手算​​U-net

本文详细解析了U-Net网络架构及其在医学图像分割中的应用。重点对比了U-Net与FCN的核心区别:U-Net采用特征拼接(Concat)保留所有层级信息,而FCN使用特征相加(Add)进行融合。文章深入剖析了U-Net的编码器-瓶颈-解码器结构,解释了其独特的裁剪拼接机制和Overlap-tile策略,并提供了完整的PyTorch实现代码。现代U-Net通过SamePadding实现了输入输出尺寸一致,显著提升了分割精度。文章还探讨了弹性形变数据增强和带空间权重的损失函数设计,为医学图像分析提供了实用解决

215 2
|
1月前
|
机器学习/深度学习 PyTorch BI
|

PyTorch深度学习实战 |损失函数

本文介绍了PyTorch深度学习中四种核心损失函数及其应用场景。交叉熵损失(CrossEntropyLoss)适用于多分类任务,二进制交叉熵损失(BCELoss)专用于二分类问题,KL散度损失(KLDivLoss)用于衡量概率分布差异(如VAE模型),均方误差(MSELoss)则是回归任务的基础损失函数。通过具体代码示例(如图像分类、广告点击预测、房价预测等),文章展示了每种损失函数的PyTorch实现方式,并比较了不同损失函数的适用场景和计算特点,帮助读者根据任务需求选择合适的损失函数。

222 0
|
1月前
|
机器学习/深度学习 人工智能 数据可视化
|

YOLO26如何涨点系列篇(NEU-DET缺陷检测) | CVPR2026 DEGConv方向引导边缘门控,破解细长裂缝检测难题 ,实现涨点

在NEU-DET数据集下验证:原始mAP50原始为 0.722提升至 0.732 , R 原始为 0.643 提升至 0.682 , mAP50-95原始为0.407提升至0.413

321 6
|
1月前
|
数据采集 Java API
|

为什么我劝你放弃Selenium拥抱Playwright

爬虫选型指南:Playwright全面碾压Selenium!启动快5倍、反爬通过率超90%、原生异步API、代理配置极简,且持续高频更新;Selenium则陷于历史包袱、指纹暴露、维护停滞。新项目请果断迁移!

288 0
|
1月前
|
机器学习/深度学习 人工智能 数据可视化
|

手算神经网络

本文介绍了使用2×3×1神经网络实现房价预测的全过程。首先通过手动计算演示了单个样本的前向传播和反向传播,包括权重初始化和梯度更新。随后使用PyTorch实现了完整的神经网络模型,包含数据准备、网络结构定义、损失函数计算和优化器设置。在训练过程中记录了损失值变化,并可视化展示训练效果。最后提供了一个挖空版本的代码框架,帮助读者逐步完成神经网络的关键实现步骤,包括导入包、定义网络框架、数据准备、训练循环和结果可视化等模块。通过这个完整的项目实践,读者可以掌握神经网络从理论到实现的全流程。

124 0
|
1月前
|
开发框架 API 开发者
|

跨境代购系统物流转运模块开发实战:从API对接到智能集运

跨境代购物流转运模块远非简单查单,而是涵盖集运、多渠道对接、智能计费、实时轨迹与异常处理的复杂系统。本文结合反向海淘实战,详解如何通过适配器模式统一API、策略模式实现动态计费、Webhook+WebSocket保障状态实时性,并构建兜底机制提升稳定性。

216 1
|
1月前
|
监控 搜索推荐 前端开发
|

跨境代购集运架构设计|Taocarts代购系统对接国际集运转运接口实践

在反向海淘、跨境代购业务体系中,采购是基础,集运转运是核心盈利环节。绝大多数跨境独立站的核心利润都来自代购集运、国际集运的服务费和物流差价,因此集运转运模块的架构设计和代码稳定性,直接决定平台的盈利能力和用户留存。我调研过大量开源代购源码和自研代购系统,发现很多项目将采购和物流模块混写在一起,代码耦合度极高,后续无法迭代集运规则、无法对接多渠道国际物流,基本不具备商用价值。

501 1

大数据与机器学习

大数据领域前沿技术分享与交流,这里不止有技术干货、学习心得、企业实践、社区活动,还有未来。

0
今日
69931
内容
128
活动
440109
关注
你好!
登录掌握更多精彩内容

相关产品

  • 大数据开发治理平台 DataWorks
  • 检索分析服务 Elasticsearch版
  • 日志服务