|
7月前
|
运维 安全 API
|

当安全事件不再“靠人吼”:一文带你搞懂 SOAR 自动化响应实战

当安全事件不再“靠人吼”:一文带你搞懂 SOAR 自动化响应实战

770 10
|
7月前
|
机器学习/深度学习 人工智能 监控
|

NeurIPS 2025 Spotlight!跨模态重识别革命!东北大学等 MDReID 图像信息智能匹配

东北大学等提出MDReID,获NeurIPS 2025 Spotlight!该方法实现跨模态行人重识别,创新性地将图像特征解耦为通用与专用特征,支持RGB、NIR、TIR等任意模态自由匹配,显著提升异源图像检索精度,推动安防、监控等领域智能化发展。

447 1
|
7月前
|
存储 自然语言处理 测试技术
|

一行代码,让 Elasticsearch 集群瞬间雪崩——5000W 数据压测下的性能避坑全攻略

本文深入剖析 Elasticsearch 中模糊查询的三大陷阱及性能优化方案。通过5000 万级数据量下做了高压测试,用真实数据复刻事故现场,助力开发者规避“查询雪崩”,为您的业务保驾护航。

2275 89
|
8月前
|
JSON API 数据处理
|

淘宝天猫API调用指南:获取店铺所有商品数据

淘宝店铺商品API支持通过HTTP POST获取商品数据,返回JSON格式信息。核心接口包括店铺商品列表、分类及促销商品查询,以及商品详情、SKU、图片视频等信息获取,助力商家高效管理商品。

504 2
|
8月前
|
人工智能 小程序 定位技术
|

别让客人“刷”不到你:本地生活GEO布局的4个土办法

别让客人“刷”不到你!本地生活商家必须掌握的GEO四步土办法:画清3公里人群圈、结构化信息让AI秒懂、用顾客原话做内容、每月删旧更新。精准触达AI推荐,把客流引到店门口。(238字)

755 0
来自: 智能搜索推荐  版块
|
8月前
|
存储
|

参数不是越多越好?聊聊模型规模与智能能力的那些“门道”

参数不是越多越好?聊聊模型规模与智能能力的那些“门道”

718 2
|
9月前
|
安全 API
|

LlamaIndex检索调优实战:分块、HyDE、压缩等8个提效方法快速改善答案质量

本文总结提升RAG检索质量的八大实用技巧:语义分块、混合检索、重排序、HyDE查询生成、上下文压缩、元数据过滤、自适应k值等,结合LlamaIndex实践,有效解决幻觉、上下文错位等问题,显著提升准确率与可引用性。

923 8
|
10月前
|
消息中间件 数据采集 NoSQL
|

秒级行情推送系统实战:从触发、采集到入库的端到端架构

本文设计了一套秒级实时行情推送系统,涵盖触发、采集、缓冲、入库与推送五层架构,结合动态代理IP、Kafka/Redis缓冲及WebSocket推送,实现金融数据低延迟、高并发处理,适用于股票、数字货币等实时行情场景。

1586 3
|
10月前
|
存储 人工智能 NoSQL
|

用Context Offloading解决AI Agent上下文污染,提升推理准确性

上下文工程是将AI所需信息(如指令、数据、工具等)动态整合到模型输入中,以提升其表现。本文探讨了“上下文污染”问题,并提出“上下文卸载”策略,通过LangGraph实现,有效缓解长文本处理中的信息干扰与模型幻觉,提升AI代理的决策准确性与稳定性。

1268 2
|
12月前
|
机器学习/深度学习 人工智能 测试技术
|

【ICML2025】大模型后训练性能4倍提升!阿里云PAI团队研究成果ChunkFlow中选

近日,阿里云 PAI 团队、通义实验室与中国科学院大学前沿交叉科学学院合作在机器学习顶级会议 ICML 2025 上发表论文 Efficient Long Context Fine-tuning with Chunk Flow。ChunkFlow 作为阿里云在变长和超长序列数据集上高效训练解决方案,针对处理变长和超长序列数据的性能问题,提出了以 Chunk 为中心的训练机制,支撑 Qwen 全系列模型的长序列续训练和微调任务,在阿里云内部的大量的业务上带来2倍以上的端到端性能收益,大大降低了训练消耗的 GPU 卡时。

1254 1
来自: 人工智能平台PAI  版块
|
1月前
|
大数据 BI 双11
|

红星美凯龙 x Quick BI:数据中台助力,获客成本连续20个月环比下降

红星美凯龙携手阿里云打造数据中台,实现全域、全场景、全链路用户运营:获客成本降92%,线上营收增300%,双11客流涨5倍。Quick BI 30天免费试用,对话式智能分析,助力企业数字化转型。

155 0
|
1月前
|
人工智能 机器人 芯片
|

人工智能|YOLOv8实战

本内容为安全帽检测实战项目,基于YOLOv8模型,涵盖Kaggle数据获取、自定义yaml配置、模型训练(yolo_train.py)与测试(yolo_test.py),并提供服务器(FastAPI+Docker)、边缘(Jetson+TensorRT)及国产嵌入式(RK3588+RKNN)三类部署方案,支持工业场景实时智能识别。(239字)

406 1
|
1月前
|
消息中间件 Java 测试技术
|

API 接口稳定性保障体系建设指南

本文系统讲解分布式微服务中API接口稳定性保障体系,涵盖限流(令牌桶/漏桶)、熔断(三态模型)、降级(读/写/功能降级)三大核心手段,辅以资源隔离、超时重试、异步解耦等进阶策略,并总结落地常见坑点与解决方案,助力构建高可用API服务。(239字)

210 0
|
1月前
|
数据采集 机器学习/深度学习 运维
|

从“秒封”到“日爬十万”:谈谈5个风控机制

这篇文档讨论了Python爬虫常见问题和反爬策略。作者提出五个关键点:1. 控制请求频率;2. 轮换IP;3. 伪装请求头;4. 模拟真实访问路径;5. 使用高匿名代理。这些策略需综合运用,提高爬虫生存率。

365 5
|
2月前
|
JSON Java fastjson
|

java工具:《jsonObject转map》

java工具:《jsonObject转map》

256 0
|
2月前
|
存储 人工智能 运维
|

深度回顾 | 阿里云携手 Elastic 定义 Agent 时代搜索新范式,解锁 Search AI 核心生产力

阿里云Elasticsearch升级为Agent Native搜索底座,推出Agentic Search、知识记忆湖、FalconSeek引擎及Hybrid Retrieval 2.0,实现面向AI智能体的毫秒级上下文检索,支持千亿级数据降本40%-70%,助力企业构建稳定、智能、低成本的下一代AI搜索基础设施。

387 0
|
2月前
|
SQL 人工智能 监控
|

五年数据开发复盘:从数仓建设到 AI 产品化的阶段性思考

五年数据开发复盘:从数仓建设到AI产品化。作者深耕BI、SaaS数仓、数据血缘与建模,提出“以数仓为根基、实体建模为核心、工程稳定性为底座”,强调业务理解重于工具使用。面对AI浪潮,主张聚焦提示词工程、RAG、实体识别等AI工程化落地,而非算法底层——数据开发正演进为连接业务、数据、工程与AI的复合型角色。

249 3
|
3月前
|
存储 算法 安全
|

新增密级管理能力,筑牢数据安全合规防线——基于阿里云密评合规框架的专业实践

本文以某制造企业8000万元数据泄露事件为引,揭示“全员可见”的粗放加密之弊,强调密级管理才是数据安全核心。通过对比传统加密与密级管理差异,剖析越权访问、密钥连锁泄露等风险,并介绍阿里云KMS、CloudHSM、RAM及国密算法四大能力,详解第三方软件如何实现密级标签映射、权限分级绑定与合规审计闭环,助力企业满足等保2.0、密评及《数据安全法》要求。(239字)

1249 0
|
3月前
|
数据采集 JavaScript 前端开发
|

告别空壳HTML!Node.js + Playwright + 代理IP 优雅抓取动态网页实战

本文详解Node.js+Playwright抓取动态网页的实战方案:针对React/Vue等框架渲染的SPA页面,结合代理IP(支持动态/固定转发模式)突破采集限制,并提供BrowserContext级代理配置、IP有效性验证、健壮重试机制及常见报错(407/429/403)应对策略,助你构建高可用工业级爬虫。

580 0
|
3月前
|
人工智能 安全 数据可视化
|

Windows 全版本 OpenClaw 搭建教程 零代码可视化一键部署

OpenClaw(小龙虾)是2026年热门开源AI自动化工具,支持Win10/11本地离线运行。零代码、全图形化、内置依赖、多模型切换、大Token额度,5–10分钟一键部署。数据不出设备,安全可控,适配办公全场景。(239字)

434 1
|
3月前
|
存储 算法 BI
|

【图像加密】基于matlab混沌算法图像加密解密

本文提出一种基于逐段线性混沌映射(PWLCM)的图像加密算法。利用混沌系统对初值和参数的极端敏感性、遍历性及伪随机性,生成高安全性密钥流,与图像数据异或加密;通过动态切换控制参数增强抗攻击能力。仿真表明该算法加密效果好、解密准确、密钥空间大、抗初值微扰能力强。(239字)

219 2
|
4月前
|
人工智能 运维 安全
|

基于云边协同的电线电缆押出机智能调机解决方案设计与落地

本方案基于云边协同架构,融合阿里云云原生技术,破解线缆行业押出机调机效率低、原料损耗高、数据孤岛等难题;边缘毫秒级实时控制+云端Al训练优化,实现调机提效80%、降耗60%,部署快、运维省、可扩展

490 9
|
4月前
|
XML JSON 数据挖掘
|

京东商品详情数据一键获取,item_get API接口讲解

京东item_get是获取单商品详情的核心API,支持一键拉取标题、价格、SKU、库存、详情HTML等结构化数据,适用于反向海淘、代购、ERP同步及比价分析等场景,分基础版与完整版,需认证授权后调用。(239字)

588 2
|
4月前
|
机器学习/深度学习 编解码 JSON
|

从踩坑到高效落地:淘宝拍立淘图片搜索API的实操心得

淘宝拍立淘API提供高精度以图搜品服务,支持Base64/URL传图,基于MobileNet/ResNet提取200+图像特征,毫秒级匹配相似商品。关键需控主体占比≥70%、签名严格ASCII排序、阈值设0.8,单次返回50条结构化结果。(239字)

748 3
|
4月前
|
运维 分布式计算 Cloud Native
|

别再把大数据平台当“巨石”了:聊聊云原生时代的大数据平台怎么活得更久

别再把大数据平台当“巨石”了:聊聊云原生时代的大数据平台怎么活得更久

293 4
|
5月前
|
JSON 监控 供应链
|

亚马逊商品详情数据获取实战:从商品链接提取 ID 到解析详情

亚马逊商品详情API(PA-API v5与SP-API)是官方合规数据接口,分别面向第三方开发者与入驻卖家,支持获取ASIN/关键词对应的商品标题、价格、图片、评价等核心信息,广泛用于比价、选品、竞品分析及Listing优化。接入稳定、数据权威。(239字)

525 0
|
6月前
|
人工智能 分布式计算 算法
|

量子云服务:当量子计算不再关在实验室里

量子云服务:当量子计算不再关在实验室里

394 5
|
6月前
|
机器学习/深度学习 存储 缓存
|

零基础玩转RAG:手把手教你搞定文档切分与大模型微调

本文深入解析RAG中至关重要的文档切分技术,系统对比句子切分、固定长度、重叠窗口、递归切分和语义切分五种策略,结合代码示例与实战技巧(PDF/Markdown/代码处理),并提供量化评估与调优方法,助你夯实RAG基石。(239字)

752 1
|
6月前
|
Web App开发
|

代理ip在浏览器的配置指南

本文分三步详解代理IP配置:①打开浏览器对应设置(Chrome设为“设置”,Firefox为“选项”,Edge为“Internet选项”);②在“局域网设置”中填写代理IP与端口并保存;③百度搜“IP”验证是否生效。附注意事项及稳定IP推荐,操作清晰易上手。

1437 3
|
6月前
|
物联网 测试技术
|

为什么 loss 几乎没用:微调里最容易让人“自嗨”的指标

本文揭示了大模型微调中一个常见误区:过度依赖loss曲线判断训练效果。loss仅反映模型对训练数据的拟合程度,并不衡量实际表现。它可能平稳下降,但模型输出无改善甚至变差。尤其在SFT/LoRA微调中,loss易被“虚假优化”,掩盖行为偏移、泛化缺失等问题。真正关键的是人工对照输出变化,结合loss作为辅助参考,而非决策核心。

944 5
|
6月前
|
机器学习/深度学习 人工智能 算法
|

大模型微调新篇章:从“学会知识”到“理解偏好”,PPO算法全解析与实践指南

本文深入解析大模型对齐人类偏好的核心技术——近端策略优化(PPO)。从原理到实践,详解PPO如何通过Actor、Reference、Reward与Critic四模型协作,结合强化学习实现更自然、安全、有用的对话。涵盖训练流程、常见问题、评估方法及进阶技巧,并以LLaMA-Factory为例演示操作,助力开发者快速上手,打造更“懂你”的AI助手。

1137 3
|
7月前
|
存储 C++
|

C++变量类型

C++变量类型包括基本类型如bool、char、int、float、double等,支持整数、浮点数、字符和布尔值的存储。还包含指针、数组、结构体、类、共用体等复合类型。变量命名由字母、数字、下划线组成,首字符须为字母或下划线。支持变量声明与定义分离,局部变量需显式初始化,静态变量自动初始化为0。

313 1
|
7月前
|
关系型数据库 MySQL Linux
|

开发环境搭建

工欲善其事,必先利其器。学习前请确保电脑内存16G以上(推荐32G),建议配备便携显示器分屏开发以提升效率。下载并安装虚拟机及课程资料,配置CentOS 7虚拟机(IP: 192.168.101.68),使用FinalShell远程连接,启动Docker、MySQL等服务。苹果用户需自行安装Docker与MySQL 8。详见配置文档。

289 0
|
7月前
|
消息中间件 NoSQL 关系型数据库
|

数据不是不想来,是你不会接:聊聊关系库、NoSQL、日志、API 的那些接入姿势

数据不是不想来,是你不会接:聊聊关系库、NoSQL、日志、API 的那些接入姿势

320 0
|
7月前
|
人工智能 自然语言处理 安全
|

AI 十大论文精讲(六):拆解 LLM 智能体的 “通用密码”

本文解读复旦NLP团队2023年重磅综述《The Rise and Potential of Large Language Model Based Agents》,系统剖析LLM智能体“大脑-感知-行动”三大核心模块,涵盖单智能体、多智能体、人机协作与智能体社群四大应用场景,提炼工具SKMA体系、安全护栏、结果检查三大落地要点,并提出AGI路径、虚拟到物理迁移等开放问题,为构建通用智能体提供统一范式,被誉为该领域“入门圣经”。

1142 4
|
8月前
|
机器学习/深度学习 搜索推荐 算法
|

用数据给婚恋 App 把把脉:让匹配更靠谱、聊天更顺畅、留存更健康

用数据给婚恋 App 把把脉:让匹配更靠谱、聊天更顺畅、留存更健康

628 8
|
9月前
|
人工智能 自然语言处理 算法
|

【2025云栖大会】AI 搜索智能探索:揭秘如何让搜索“有大脑”

2025云栖大会上,阿里云高级技术专家徐光伟在云栖大会揭秘 Agentic Search 技术,涵盖低维向量模型、多模态检索、NL2SQL及DeepSearch/Research智能体系统。未来,“AI搜索已从‘信息匹配’迈向‘智能决策’,阿里云将持续通过技术创新与产品化能力,为企业构建下一代智能信息获取系统。”

1105 9
来自: 智能搜索推荐  版块
|
10月前
|
存储 人工智能 数据可视化
|

企业级 AI 模型无代码落地指南:基于阿里云工具链,从 0 到 1 实现业务价值

某汽车零部件厂商通过阿里云PAI、OSS等工具,实现无代码AI质检落地:仅用控制台操作完成数据治理到部署,质检效率提升3倍,模型周期从2月缩至2周。本文详解全栈可视化方案,助力企业零代码落地AI。

1148 1
|
11月前
|
人工智能 分布式计算 自然语言处理
|

多智能体系统设计:5种编排模式解决复杂AI任务

本文探讨了多AI智能体协作中的关键问题——编排。文章指出,随着系统从单体模型向多智能体架构演进,如何设计智能体之间的通信协议、工作流程和决策机制,成为实现高效协作的核心。文章详细分析了五种主流的智能体编排模式:顺序编排、MapReduce、共识模式、分层编排和制作者-检查者模式,并分别介绍了它们的应用场景、优势与挑战。最后指出,尽管大模型如GPT-5提升了单体能力,但在复杂任务中,合理的智能体编排仍不可或缺。选择适合的编排方式,有助于在系统复杂度与实际效果之间取得平衡。

2241 10
|
14天前
|
数据采集 网络协议 JavaScript
|

为什么爬虫并发拉到几百,吞吐反而掉了?记一次高并发爬虫性能瓶颈排查与实战

本文探讨了高并发环境下数据采集和爬虫扩容的挑战,强调了提高并发量可能不会提升吞吐量,反而可能导致系统变慢。文章介绍了排查单机资源瓶颈的方法,并讨论了代理隧道的瓶颈。提供了一个Python asyncio + aiohttp的生产级爬虫代码示例,整合了连接池控制、隧道代理接入等,以解决高并发下的吞吐抖动和429报错。最后,总结了爬虫调优的分层治理法则,强调了在遇到问题时,应遵循迭代路径,找准真正的瓶颈层进行优化。

126 0
|
1月前
|
存储 缓存 NoSQL
|

前台多币种汇率定时同步架构:跨境独立站外币定价底层实现方案

本文详解Taocarts多币种汇率架构:基于Laravel实现分级定时同步(主流币种每小时/小众币种每4小时)、Redis分布式锁与缓存、Fixer.io接口集成、bcmath高精度计算、多层兜底(缓存→DB→静态保底)及前台无感切换。覆盖代购系统核心痛点,助力跨境独立站稳健定价。

189 1
|
1月前
|
机器学习/深度学习 PyTorch 测试技术
|

PyTorch深度学习实战 |多头注意力机制

摘要:本文详细介绍了Transformer中的多头自注意力机制,从整体结构到实现细节,包括四部分内容:(1)多头自注意力的基本架构;(2)内部计算流程解析;(3)注意力计算公式详解;(4)代码实现。重点阐述了多头并行的计算方式、缩放点积注意力的计算步骤(QK转置、缩放、softmax和加权求和),以及残差连接和层归一化的作用。通过"Are you OK?"示例展示了输入张量如何经过8个64维注意力头处理后拼接成512维输出。文章最后提供了完整的PyTorch实现代码,并附测试用例验证模型

210 0
|
1月前
|
人工智能 自然语言处理 安全
|

Graph RAG + GEO 技术全景解析:构建企业AI搜索时代的核心技术竞争力

本文深度解析Graph RAG(图谱增强检索生成)与GEO(生成式引擎优化)融合技术,揭示其如何突破大模型幻觉、传统RAG碎片化等瓶颈,提升事实准确性、多跳推理与知识可控性;结合制造、零售、本地生活等实战案例,展现其在AI搜索时代构建企业核心技术壁垒的关键价值。(239字)

270 0
来自: 智能搜索推荐  版块
|
2月前
|
安全 API 开发者
|

语雀如何导出别人的知识库!超实用教程!支持导出markdown/html/word/pdf等超多格式!一键解析,批量下载!保留大纲的层级结构!一键克隆!原格式

语雀重度用户亲测推荐:「语雀文档批量下载克隆助手」浏览器插件。一键备份知识库、小记、表格、白板等全类型内容,完美保留目录结构与图片附件;支持导出MD/HTML/Word/PDF,并可克隆公开库至个人账号。100%本地运行,不传数据、无需Token或超级会员,安全可靠。(239字)

623 2
|
3月前
|
人工智能 小程序 语音技术
|

如何制作虚拟实时数字人系统

一句话速览:从需求定义到上线部署,标准化流程兼顾专业精度与落地效率,30 分钟可完成低成本快速生成。

633 0
|
3月前
|
人工智能 数据可视化 JavaScript
|

剪视频不用再开 PR 的 AI 工作流

本文对比OpenClaw三种部署方式(本地、全托管、阿里云轻量自托管),重点推荐后者:兼顾7×24在线、数据自主、灵活扩展与开箱即用。结合真实视频剪辑场景,详解字幕生成、批量处理、竖屏裁切等高效AI功能,适合Vlog/知识类博主提效减负。

472 0
|
4月前
|
人工智能 文字识别 测试技术
|

AutoGod:一款拥有AI视觉的安卓自动化框架

AutoGod是一款面向安卓的AI视觉自动化框架,融合多引擎OCR、YOLO目标检测与VMP混淆引擎,解决传统方案元素定位脆弱、兼容性差、安全性低等痛点,支持自动化测试、游戏脚本与企业RPA,兼顾智能性、鲁棒性与安全性。

766 11
|
5月前
|
数据采集 人工智能 安全
|

别再用ChatGPT群发祝福了!手把手教你“喂”出一个懂人情的AI,连马术梗都能接住

本文揭秘春节祝福AI背后的数据构建逻辑:不靠大模型堆参数,而用“关系感知”六维框架(称呼/关系/细节/场合/风格/篇幅)定义人情分寸;通过人工精写种子数据、模型辅助繁殖(400→3107条)、结构化提示词模板,让AI写出有记忆点的专属祝福。技术是导盲犬,帮人打捞真心。

465 3

大数据与机器学习

大数据领域前沿技术分享与交流,这里不止有技术干货、学习心得、企业实践、社区活动,还有未来。

3
今日
69911
内容
128
活动
440102
关注
你好!
登录掌握更多精彩内容

相关产品

  • 大数据开发治理平台 DataWorks
  • 检索分析服务 Elasticsearch版
  • 日志服务