|
6月前
|
机器学习/深度学习 搜索推荐 算法
|

推荐系统为啥都长一个样?聊聊「离线训练 + 在线召回 + 排序」这套大数据架构

推荐系统为啥都长一个样?聊聊「离线训练 + 在线召回 + 排序」这套大数据架构

427 0
|
6月前
|
安全 物联网
|

LoRA 不是“免费午餐”:你省下的算力,往往会在别的地方还回去

LoRA因轻量、易上手成为新手微调首选,但它并非“零代价”方案:虽节省显存与算力,却无法规避目标模糊、数据偏差、行为过拟合、表达能力受限等本质问题。它适合快速验证方向,而非替代系统性微调设计。

310 2
|
6月前
|
存储 SQL 人工智能
|

数据语义层 vs 宽表模式:哪种架构更适合 AI 时代的数据分析?

用户零等待指标交付,逻辑变更分钟级生效,无需 ETL;100%一致口径,所有人与 AI 通过同一语义层访问数据;无缝对接 AI,语义层为 AI 提供标准化查询 API。

698 1
|
6月前
|
人工智能 监控 数据可视化
|

给大模型“开小灶”:零代码实战专属领域微调,手把手教你打造AI专家

本文介绍如何通过“模型微调”将通用大模型打造成特定领域的专家助手,聚焦Web安全场景,借助LLaMA Factory实现零代码、可视化微调。涵盖微调原理(如LoRA、量化)、全流程操作及效果评估,帮助用户低成本构建专属高性能AI模型。

680 0
|
6月前
|
人工智能
|

大模型产生幻觉的原因,如何解决?

大模型“幻觉”指AI生成看似合理但错误或虚构的信息,源于其概率预测机制、训练数据缺陷及缺乏事实核查能力。可通过RAG、微调、联网检索、自我核查等方法降低幻觉风险,提升输出准确性与可靠性。(238字)

1979 3
|
6月前
|
消息中间件 JSON Kafka
|

“字段多一个,凌晨三点炸一次”:聊聊流数据里的 Schema 演化,到底该怎么扛

“字段多一个,凌晨三点炸一次”:聊聊流数据里的 Schema 演化,到底该怎么扛

303 10
|
6月前
|
人工智能 定位技术 API
|

参加2025高德空间智能开发者大赛全国总决赛感悟-坚定空间智能之路

文章带你全面的回顾2025年高德空间智能开发者大赛的全部过程,从初赛到决赛,精彩纷呈,不仅有对参赛项目的介绍,也对本次活动中的硬核技术和产品功能进行了深度介绍。同时也分享了博主的参赛历程,所思所感,请您指正。

555 3
来自: 人工智能平台PAI  版块
|
7月前
|
数据采集 JSON 监控
|

京东店铺所有商品API接口使用指南

本文介绍如何对接京东开放平台“店铺所有商品API”,通过调用`JD.item_search_shop`接口,以编程方式获取POP或自营店铺的商品信息(如ID、标题、价格、库存等),适用于运营分析、库存监控等场景。需配置AppKey、时间戳等公共参数,并传入seller_id、page_no等业务参数实现分页查询,无需access_token授权。

569 1
|
7月前
|
监控 Java 测试技术
|

OOM排查之路:一次曲折的线上故障复盘

本文记录了一次Paimon数据湖与RocksDB集成服务中反复出现的内存溢出(OOM)问题排查全过程。通过MAT、NMT、async-profiler等工具,结合监控分析与专家协作,最终定位到RocksDB通过JNI申请的堆外内存未释放是根因,并分享了转向Flink写入Paimon的解决方案及排查思路,为类似技术栈提供借鉴。(239字)

621 1
|
7月前
|
存储 缓存 JavaScript
|

Vue3 Composition API深度解析:原理、用法与迁移实践

本文深度解析Vue3 Composition API的核心优势、常用API、底层原理与迁移实践,对比Options API的局限性,详解ref、reactive、watch、生命周期钩子等用法,剖析基于Proxy的响应式机制,并提供渐进式迁移策略,助开发者高效掌握Vue3开发范式。

747 0
|
7月前
|
Kubernetes IDE 应用服务中间件
|

2.部署篇(开发部署)

本文介绍如何将SpringCloud应用部署到Kubernetes云端,基于EDAS实现快速上云。涵盖集群导入、应用初始化及通过IDE插件高效部署,助力开发者提升发布效率。

291 1
|
7月前
|
Web App开发 安全 JavaScript
|

5.跨域处理

本文介绍跨域问题及其解决方案。当协议、域名或端口不同时,浏览器会阻止跨域请求。通过CORS(跨域资源共享)机制,可使用@CrossOrigin注解、全局配置WebMvcConfigurer或自定义过滤器实现安全跨域访问。

323 0
|
7月前
|
人工智能 机器人 Java
|

黑马最新项目

AIGC项目涵盖大模型私有化部署、聊天机器人、RAG知识库及代码提示工具;天机AI集成SpringAI与多模型工作流;云岚到家聚焦微服务与分布式架构;四方保险构建统一支付与时序数据应用;星辰WMS与Dify项目即将发布。

431 0
|
7月前
|
人工智能 缓存 自然语言处理
|

大模型推理与应用术语解释

简介:大语言模型核心技术涵盖推理、生成式AI、检索增强生成(RAG)、提示工程、上下文学习、代理、多模态学习与语义搜索。这些技术共同推动AI在内容生成、知识检索、智能决策和跨模态理解等方面的能力跃升,广泛应用于问答系统、创作辅助、企业服务与自动化任务,正重塑人机交互与信息处理范式。(238字)

248 0
|
7月前
|
机器学习/深度学习 数据采集 人工智能
|

大模型训练方法与技术术语解释

预训练、微调、RLHF、思维链等技术共同推动大模型发展。预训练构建语言基础,微调适配特定任务,RLHF融入人类偏好,思维链提升推理能力,少样本与零样本实现快速迁移,指令微调增强指令理解,自监督学习利用海量无标数据,温度控制生成风格,蒸馏压缩模型规模,缩放定律指导模型扩展,全面提升大模型理解、生成与泛化能力。

536 0
|
7月前
|
机器学习/深度学习 数据采集 人工智能
|

大模型训练方法与技术术语解释

预训练、微调、RLHF、思维链等技术共同构建大模型核心能力。预训练夯实语言基础,微调适配特定任务,RLHF对齐人类偏好,思维链提升推理,少/零样本实现快速迁移,指令微调增强指令理解,自监督利用海量文本,温度控制生成风格,蒸馏压缩模型规模,缩放定律指引性能增长路径。

736 0
|
7月前
|
Dubbo Java 应用服务中间件
|

Feign远程调用

本章介绍如何用Feign替代RestTemplate实现更优雅的HTTP跨服务调用。通过引入Feign,解决服务地址硬编码、代码可读性差等问题,结合注册中心实现基于服务名的调用。讲解了Feign的使用方式、自定义配置(如日志级别)、连接池优化(如Apache HttpClient),并总结了继承与抽取两种最佳实践,推荐将Feign客户端抽离为独立模块,提升代码复用性与维护性。

236 0
|
7月前
|
SQL 分布式计算 运维
|

一套平台养百家客户?多租户数据平台不是“分库分表”这么简单

一套平台养百家客户?多租户数据平台不是“分库分表”这么简单

450 6
|
7月前
|
运维 供应链 编译器
|

国产芯片生态:从设计到量产,到底难在哪?

国产芯片生态:从设计到量产,到底难在哪?

435 7
|
7月前
|
消息中间件 分布式计算 Kafka
|

别再全量拉表了兄弟:一篇讲透增量数据处理与 CDC 的实战指南

别再全量拉表了兄弟:一篇讲透增量数据处理与 CDC 的实战指南

367 9
|
7月前
|
存储 Linux 数据处理
|

实用程序:基于Python+Tkinter开发表格比对&整理工具

一款基于Python+Tkinter开发的免费开源Excel处理工具,支持表格差异比对与错乱行整理,完整保留图片,兼容.xlsx和.csv格式。操作简单,支持自定义比对列、多线程处理,解决日常办公中数据比对、行合并及图片丢失等痛点,适用于各类Excel数据清理场景。(239字)

622 12
|
7月前
|
人工智能 智能设计 算法
|

2026 GEO生成搜索优化技术白皮书:章节详解与案例深度分析

周有贵,GEO专家,深耕AI时代流量入口变革,倡导从SEO到GEO(生成式引擎优化)的认知重构,聚焦“被发现-被理解-被推荐”三层框架,推动企业通过结构化内容、信任资产与平台适配,实现AI信源卡位。

1816 2
|
7月前
|
SQL 存储 分布式计算
|

Parquet 和 ORC 到底有啥区别?别再云里雾里了,咱今天把列式存储聊明白!

Parquet 和 ORC 到底有啥区别?别再云里雾里了,咱今天把列式存储聊明白!

666 9
|
8月前
|
关系型数据库 MySQL PHP
|

0 基础建站?PageAdmin CMS 10 分钟搞定,源码免费拿!

PageAdmin CMS 为无编程基础用户提供高效建站方案。步骤包括:准备服务器、域名及源码;上传源码并配置数据库;通过安装向导完成基础设置;在后台创建栏目、填充内容;测试功能后上线。全程无需编程,简单操作即可搭建独立网站,支持后续维护与扩展。

951 1
|
8月前
|
数据采集 JSON API
|

京东工业平台商品详情API

京东工业平台商品详情API基于HTTPS和JSON,提供商品基础信息、SKU规格及批量查询功能,支持分钟级价格库存更新。开发者需注册企业账号并完成签名认证,单次请求可获取最多20个SKU数据,高效便捷,适用于工业品电商集成与数据同步场景。

364 44
|
8月前
|
人工智能 机器人 数据处理
|

ICLR2026 !SAM3重磅来袭:能“听懂人话”的分割模型,性能狂飙2倍

Lab4AI.cn覆盖全周期科研支撑平台,提供论文速递、AI翻译和AI导读工具辅助论文阅读;支持投稿论文复现和Github项目复现,动手复现感兴趣的论文;论文复现完成后,您可基于您的思路和想法,开启论文创新与成果转化。

1307 6
来自: 人工智能平台PAI  版块
|
8月前
|
JSON 监控 供应链
|

天猫商品详情API技术文档:智能电商开发的必备工具

天猫商品详情API(tmall.item_get)通过商品ID实时获取标题、价格、库存、SKU、评价等结构化数据,支持JSON格式返回,适用于电商分析、竞品监控与价格优化,需授权访问,可按需筛选字段,提升数据传输效率。

462 3
|
9月前
|
存储 物联网 Serverless
|

理想汽车基于 Hologres + Flink 构建万亿级车联网信号实时分析平台

理想汽车携手阿里云Hologres+Flink,打造万亿级车联网实时分析平台。面对百万余辆智能车、每秒百万级信号上报的挑战,通过存算分离、冷热分层、流批一体等创新,实现写入性能提升200%、查询QPS超万、成本降低40%,支撑数字孪生、智能诊断等高实时业务,构建高可用、弹性伸缩、低成本的下一代数据底座。

860 4
|
9月前
|
机器学习/深度学习 算法 物联网
|

Google开源Tunix:JAX生态的LLM微调方案来了

Tunix是Google推出的基于JAX的LLM后训练库,支持微调、强化学习与知识蒸馏,集成Flax NNX,主打TPU优化与模块化设计,支持QLoRA等高效训练方法,适用于高性能分布式训练场景。

597 13
|
10月前
|
安全 数据安全/隐私保护 Windows
|

ZyperWin++使用教程!让Windows更丝滑!c盘飘红一键搞定!ZyperWin++解决系统优化、Office安装和系统激活

ZyperWin++是一款仅5MB的开源免费Windows优化工具,支持快速优化、自定义设置与垃圾清理,兼具系统加速、隐私保护、Office安装等功能,轻便无广告,小白也能轻松上手,是提升电脑性能的全能管家。

2605 0
|
10月前
|
数据采集 机器学习/深度学习 人工智能
|

YOLOv11浅浅解析:架构创新

YOLOv11是YOLO系列最新升级版,通过C3k2模块、SPPF优化和解耦检测头等创新,显著提升检测精度与速度,mAP提高2-5%,推理更快,支持多平台部署,适用于工业、安防、自动驾驶等场景。

2045 1
|
10月前
|
数据采集 存储 缓存
|

LLM + 抓取:让学术文献检索更聪明

结合爬虫与大模型,打造懂语义的学术检索助手:自动抓取最新NLP+爬虫论文,经清洗、向量化与RAG增强,由LLM提炼贡献,告别关键词匹配,实现精准智能问答。

1059 0
|
10月前
|
算法 API 数据安全/隐私保护
|

深度解析京东图片搜索API:从图像识别到商品匹配的算法实践

京东图片搜索API基于图像识别技术,支持通过上传图片或图片URL搜索相似商品,提供智能匹配、结果筛选、分页查询等功能。适用于比价、竞品分析、推荐系统等场景。支持Python等开发语言,提供详细请求示例与文档。

891 5
|
11月前
|
监控 Linux iOS开发
|

PyCharm启动项目和调试项目

本文介绍了在 PyCharm 中启动和调试 Python 项目的详细步骤,涵盖单文件运行、配置管理、命令行工具使用、断点调试、变量监控、远程调试及常见问题解决方案,帮助开发者高效利用 PyCharm 的调试功能提升开发效率。

2356 4
来自: 人工智能平台PAI  版块
|
11月前
|
JSON 算法 数据库
|

使用 BAML 模糊解析改进 LangChain 知识图谱提取:成功率从25%提升到99%

在构建基于知识图谱的检索增强生成(RAG)系统时,从非结构化数据中准确提取节点和关系是一大挑战,尤其在使用小型本地量化模型时表现更差。本文对比了传统 LangChain 提取框架的严格 JSON 解析限制,提出采用 BAML 的模糊解析策略,显著提升知识图谱提取成功率。实验表明,在相同条件下,BAML 将成功率从约 25% 提升至 99% 以上,为构建高效、稳定的 RAG 系统提供了有效解决方案。

451 0
|
23天前
|
SQL 消息中间件 缓存
|

大屏做得越炫越好?错!数据实时性和展示性能,才是真正决定项目成败的关键

大屏做得越炫越好?错!数据实时性和展示性能,才是真正决定项目成败的关键

172 2
|
27天前
|
运维 监控 数据可视化
|

别再盯着折线图了!趋势分析与异常检测,真正厉害的人都这样做可视化

别再盯着折线图了!趋势分析与异常检测,真正厉害的人都这样做可视化

192 2
|
28天前
|
弹性计算 人工智能 NoSQL
|

ECS 上给 Coding Agent 准备可复现环境

本文介绍在ECS上为Coding Agent定制的标准化开发环境:通过Docker Compose+健康检查、固定Node/DB/Redis镜像、预置环境变量与统一脚本,解决本地环境差异导致的测试失败、依赖未就绪等问题,确保Agent开箱即用、稳定执行lint、测试与开发任务。(239字)

132 0
|
1月前
|
前端开发 BI 数据处理
|

财通证券 x Quick BI:传统业务数字化升级,沉淀300+营销目标场景

财通证券携手瓴羊构建数据中台,打通多系统“数据孤岛”,打造300+市场标签,依托Quick BI实现零代码分析与智能营销,推动APP用户占比从15%跃升至50%,实现数据驱动的精细化运营与组织升级。

147 0
|
1月前
|
人工智能 算法 数据可视化
|

海亮集团 x Quick BI:数据驱动“看到-知道-做到”,打造集团级智能决策中枢

海亮集团携手Quick BI打造“海亮大脑”,实现人资、营销、仓储三大场景数据智能升级:人岗匹配率提升20%,营销响应提速90%,库存成本下降18%。数据准确率达98%,消费超190万次。

187 0
|
1月前
|
数据采集 前端开发 JavaScript
|

别只盯着HTML了!教你高效抓取并解析PDF/Excel隐藏附件?

本文聚焦网页附件(PDF/Excel)爬取痛点,系统讲解隐藏链接识别、二进制文件下载、pdfplumber/pandas精准解析及代理IP轮换反爬策略,并附完整实战代码,助你高效获取高价值结构化数据。(239字)

310 0
|
1月前
|
人工智能 BI API
|

Data Fabric vs 数据中台:企业数据整合架构正在发生什么变化

它天然更适合 AI 时代的数据使用方式,因为 AI 并不只需要一个集中仓库,而更需要跨源、可解释、可调用的数据上下文。

121 0
|
1月前
|
数据采集 Java API
|

为什么我劝你放弃Selenium拥抱Playwright

爬虫选型指南:Playwright全面碾压Selenium!启动快5倍、反爬通过率超90%、原生异步API、代理配置极简,且持续高频更新;Selenium则陷于历史包袱、指纹暴露、维护停滞。新项目请果断迁移!

283 0
|
1月前
|
机器学习/深度学习 数据可视化 PyTorch
|

PyTorch深度学习实战 |语义分割基础知识

《PyTorch语义分割实战解析》摘要:本文深入探讨语义分割中的标签处理技术,对比P模式与L模式的本质区别。P模式通过调色板实现人机双重视觉效果,底层存储类别索引(0,1,2等),表面呈现彩色可视化效果。针对边缘模糊问题,提出使用255作为忽略标签(IgnoreLabel)的解决方案。文章系统梳理7大评价指标:从基础的像素准确率(PA)到综合性的mIoU和mF1,特别强调mIoU作为核心指标的重要性,其平衡各类别的特性使其成为模型性能评估的黄金标准。通过技术原理与实战经验的结合,为深度学习从业者提供了语义分

185 0
|
1月前
|
机器学习/深度学习 自然语言处理 PyTorch
|

PyTorch深度学习实战 |手动计算 Transformer和完整的代码实现

本文介绍了基于PyTorch实现Transformer模型的完整过程。主要内容包括:1)Transformer架构的核心组件实现,如多头注意力机制、位置前馈网络、位置编码等;2)模型构建步骤,包括词嵌入层、编码器/解码器块和输出层的实现;3)完整的训练流程,包含数据处理、损失计算和参数优化;4)评估方法验证模型性能。文章通过代码示例详细展示了如何从零开始构建Transformer,并应用于机器翻译任务,同时对模型各层的输入输出维度进行了说明。该实现可作为深度学习实践者学习Transformer架构的实用指南

189 0
|
1月前
|
JSON 自然语言处理 前端开发
|

谷歌深夜发布 Gemini 3.5:多模态能力再升级,开发者该怎么抓住这波机会?

Gemini 3.5 Flash于2026年5月发布,主打原生多模态与实时智能体能力:支持图文音视一体化理解、帧级视频诊断、100万token长上下文,并在编码(76.2%)、Agent任务(83.6%)等实测中超越前代。速度快4倍、成本更低,已免费开放。

520 1
来自: 人工智能平台PAI  版块
|
1月前
|
机器学习/深度学习 算法 vr&ar
|

图解强化学习 |手算Actor-Critic

Actor-Critic是一种融合策略优化(Actor)与价值评估(Critic)的强化学习算法:Actor负责选动作,Critic实时打分(如TD误差),实现单步更新、低方差、高效率,兼顾离散/连续动作空间。(239字)

393 0
|
2月前
|
搜索推荐
|

PAI-Rec 多路召回截断实践:用 PriorityAdjustCountFilter 和 SnakeFilter 控制精排入口数量

PAI-Rec推荐开发平台提供PriorityAdjustCountFilter(按优先级截取)与SnakeFilter(按权重蛇形交错)两种多路召回截断策略,无需粗排即可将数百候选精准压缩至200个以内进入精排,兼顾保量性、多样性与业务可控性。

282 0
来自: 智能搜索推荐  版块
|
2月前
|
机器学习/深度学习 人工智能 芯片
|

从理论突破到全面应用——迈向通用智能的深度观察

本报告由灵砚智能发布,系统梳理AI从深度学习到通用智能的技术演进,剖析大模型、多模态、智能体等突破;评估其在医疗、金融、制造等行业的深度应用;并直面算力、数据、伦理与全球治理挑战,提供前瞻性的社会适应路径。(239字)

390 0
|
2月前
|
人工智能 运维 安全
|

让 AI 帮你运维 Elasticsearch:阿里云 ES Agent Skill 正式发布

阿里云Elasticsearch Agent Skill是一套面向AI编程助手的智能运维技能包,覆盖实例创建、故障诊断、网络配置三大核心场景。支持自然语言交互,自动校验参数、识别架构差异、执行幂等操作,并内置49条诊断规则与7套SOP,大幅提升ES运维效率与可靠性。

708 7

大数据与机器学习

大数据领域前沿技术分享与交流,这里不止有技术干货、学习心得、企业实践、社区活动,还有未来。

8
今日
69920
内容
128
活动
440106
关注
你好!
登录掌握更多精彩内容

相关产品

  • 大数据开发治理平台 DataWorks
  • 检索分析服务 Elasticsearch版
  • 日志服务