|
9月前
|
数据采集 人工智能 自然语言处理
|

开源大模型微调对比:选对模型,让定制化更高效

本文对比Llama 3、Qwen2.5、Mistral三款开源大模型在中文场景下的微调表现,从算力门槛、数据效率、任务适配性等维度分析,结合实战案例与主观评估,为开发者提供选型建议,助力高效构建定制化AI模型。

1288 10
|
9月前
|
存储 缓存 数据建模
|

StarRocks + Paimon: 构建 Lakehouse Native 数据引擎

12月10日,Streaming Lakehouse Meetup Online EP.2重磅回归,聚焦StarRocks与Apache Paimon深度集成,探讨Lakehouse Native数据引擎的构建。活动涵盖架构统一、多源联邦分析、性能优化及可观测性提升,助力企业打造高效实时湖仓一体平台。

961 39
来自: 实时计算 Flink  版块
|
9月前
|
XML JSON 算法
|

淘宝商品详情API接口指南

淘宝商品详情API(taobao.item.get)可获取商品标题、价格、图片、库存、销量等核心信息。支持POST/GET请求,返回JSON格式数据。需提供app_key、timestamp、sign等参数,常见响应码包括200(成功)、401(权限不足)、403(签名错误)等,适用于电商数据对接与分析。

1092 0
|
9月前
|
API 数据格式 Windows
|

通过 KlineCharts 获取和展示印度股票数据

本文介绍如何通过KlineCharts对接印度股票数据,涵盖获取股票PID、调用K线接口、数据格式转换及图表渲染全流程。支持日线、小时线等周期,并可扩展实时更新功能,助力快速实现K线图展示。

455 1
|
10月前
|
数据采集 领域建模 数据库
|

领域模型图(数据架构/ER图)

通过四色原型法进行领域建模,提取数据架构核心要素:红色时标原型(MI)表征业务流程节点,绿色参与方-物品原型(PPT)作为实体,黄色角色原型(Role)体现参与关系,蓝色描述原型(DESC)定义属性。基于风控系统实例,从业务流程提炼出MI骨架,逐步补充PPT实体与Role角色,最后添加DESC描述信息,进而映射为ER图。其中PPT对应实体,MI对应关系,结合一对一、一对多、多对多约束,构建清晰的数据模型,支撑系统设计与数据库实现。(239字)

552 0
|
10月前
|
JSON 前端开发 Java
|

第六章 SpringMVC框架

Spring MVC核心组件包括DispatcherServlet、HandlerMapping、HandlerAdapter、Handler和ViewResolver,协同完成请求分发、处理与响应。其流程为:请求经DispatcherServlet分发,通过HandlerMapping定位处理器,由HandlerAdapter执行Handler,再经ViewResolver解析视图并渲染返回。此外,可通过拦截器实现登录校验等操作,结合@RestControllerAdvice和@ExceptionHandler统一处理异常,并使用@RequestMapping等注解简化开发。

627 0
|
10月前
|
自然语言处理 fastjson Java
|

FastJson:大面积故障规避案例

本文记录了一次由Kotlin语法混淆引发的FastJson反序列化故障排查过程。因误将 `{}` 赋值给Java对象字段,导致FastJson解析时触发 `kotlin_error` 静态标记位异常,进而引发全局反序列化失败。问题隐蔽且影响广泛,最终通过深入源码定位并反思多语言混编下的开发规范与框架风险,强调了对底层机制理解的重要性。(239字)

460 0
|
10月前
|
Shell 测试技术 Apache
|

Jmeter快速入门

本文介绍了Apache JMeter的下载、解压与运行方法,并指导用户进行中文语言设置及基本使用。通过添加线程组、HTTP取样器和监听器,快速完成性能测试配置,适合初学者入门学习。

515 0
|
10月前
|
SQL 安全 网络协议
|

常见的网络攻击

恶意软件指具有险恶目的的程序,如病毒、勒索软件、间谍软件等,常通过钓鱼邮件或漏洞入侵系统,窃取数据、破坏功能。网络钓鱼伪装成可信来源骗取敏感信息。中间人攻击窃听通信,DDoS攻击以海量流量瘫痪服务,SQL注入窃取数据库,零日漏洞利用未修复缺陷,DNS隧道则隐蔽传输恶意数据,均为常见网络安全威胁。

758 0
|
10月前
|
存储 缓存 Java
|

自定义注解

本文介绍Java自定义注解的实现原理与应用,结合Spring AOP和过滤器实现日志、权限控制等功能。通过@Target、@Retention等元注解定义注解,并在Controller中使用,配合拦截器完成登录验证等实际场景,提升代码可读性与复用性。

378 0
|
10月前
|
前端开发 安全 Java
|

用户自定义认证

本文介绍如何自定义Spring Security认证前端页面,包含login.html前端代码配置与后端接口及安全策略设置,通过SecurityConfig实现表单登录、路径放行与跳转控制,最终实现认证访问。

301 0
|
10月前
|
安全 Java 关系型数据库
|

OAuth2.0实战案例

本教程介绍如何搭建Spring Boot集成Security与OAuth2的项目,包括创建父工程、配置依赖管理、添加资源模块及数据库连接,实现安全认证服务的基础架构。

1079 0
|
10月前
|
数据采集 安全 API
|

高精度IP定位:准确性提升与数据优化全攻略

使用IP数据云、IPinfo、IPnews这类专业的IP数据服务平台检测,不仅可以查询IP,更是一个网络风险识别仪器。对于跨境电商、安全研究人员,或者想提高上网隐私的人来说,都挺值得收藏学习。

1509 1
|
10月前
|
机器学习/深度学习 数据采集 运维
|

宕机不是突然的,是你没提前看见 —— 聊聊 IT 事件预测,机器学习如何把事故掐死在摇篮里

宕机不是突然的,是你没提前看见 —— 聊聊 IT 事件预测,机器学习如何把事故掐死在摇篮里

294 3
|
10月前
|
人工智能 自然语言处理 安全
|

AI 十大论文精讲(六):拆解 LLM 智能体的 “通用密码”

本文解读复旦NLP团队2023年重磅综述《The Rise and Potential of Large Language Model Based Agents》,系统剖析LLM智能体“大脑-感知-行动”三大核心模块,涵盖单智能体、多智能体、人机协作与智能体社群四大应用场景,提炼工具SKMA体系、安全护栏、结果检查三大落地要点,并提出AGI路径、虚拟到物理迁移等开放问题,为构建通用智能体提供统一范式,被誉为该领域“入门圣经”。

1319 4
|
11月前
|
Web App开发 人工智能 前端开发
|

网站搭建黑科技:AI 写前端页面 + CMS 管理系统搭建实操指南

本文聚焦 AI 编程前端开发与 PageAdmin CMS 集成的可落地技术方案。先详解 AI 编程前端的三类核心途径(设计稿直转、提示词驱动、脚手架生成)及标准化操作步骤,再阐述 PageAdmin CMS 的环境配置、部署流程,以及栏目模型配置、API 对接、数据渲染等集成实操,形成 “AI 提效 + CMS 赋能” 的网站搭建技术闭环,为开发者提供工程化指引。

2521 14
来自: 人工智能平台PAI  版块
|
11月前
|
缓存 关系型数据库 MySQL
|

网站源码二次开发基础:环境搭建与简单修改步骤

本文围绕 PageAdmin(PA)开源 CMS 展开,聚焦新手二次开发核心:先明确 PHP、MySQL 等环境需求,以 PHPStudy 为例详解安装配置、源码部署、数据库创建及系统安装步骤;再阐述后台登录、基础信息修改、栏目与内容管理、简单模板调整及缓存清理等实操流程,为新手提供清晰易懂的入门指南。

1415 11
来自: 人工智能平台PAI  版块
|
11月前
|
数据采集 人工智能 JavaScript
|

双解析引擎VS单一架构:DataEyes如何用视觉革命重塑AI数据基建

Jina与DataEyes代表AI数据工具两大技术路径。本文从架构、场景、赋能三维度对比,揭示DataEyes如何通过“视觉+代码”双模解析,提升动态数据捕获效率,实现电商、金融、农业等多行业落地,推动企业级数据获取迈向自动化与智能化。

942 154
|
11月前
|
数据采集 JSON 供应链
|

1688商品列表API完整指南

1688商品列表API是阿里巴巴B2B平台核心接口,支持通过关键词、分类、价格等多条件筛选,分页批量获取商品信息、价格、供应商及库存数据,采用JSON格式与AppKey签名认证,助力企业高效实现商品搜索、数据采集与供应链自动化管理。

703 3
|
11月前
|
数据采集 机器学习/深度学习 数据可视化
|

基于python大数据的小说数据可视化及预测系统

本研究基于Python构建小说数据可视化与预测系统,整合多平台海量数据,利用爬虫、数据分析及机器学习技术,实现热度趋势预测与用户偏好挖掘。系统结合Django、Vue等框架,提供动态交互式可视化界面,助力平台精准运营、作者创作优化与读者个性化阅读体验,推动网络文学数据智能化发展。

663 19
|
11月前
|
人工智能 安全 数据可视化
|

教育行业如何用AI搜索优化实现低成本获客?数聚酷实战指南

一、教育行业的“流量焦虑”与AI搜索的破局机会 “用户越来越难被触达了!”这是深圳某K12机构负责人的真实感叹。传统广告投放成本飙升,社交媒体流量见顶,用户决策路径从“主动搜索”转向“向AI提问”——数据显示,2025年教育类AI搜索咨询量同比激增350%,但能被AI优先推荐的机构不足5%。 数聚酷的观察:AI搜索(G…

824 3
来自: 智能搜索推荐  版块
|
11月前
|
存储 人工智能 自然语言处理
|

AI 十大论文精讲(五):RAG——让大模型 “告别幻觉、实时更新” 的检索增强生成秘籍

本文解读AI十大核心论文之五——《Retrieval-Augmented Generation for Knowledge-Intensive NLP Tasks》。该论文提出RAG框架,通过“检索+生成”结合,解决大模型知识更新难、易幻觉、缺溯源等问题,实现小模型高效利用外部知识库,成为当前大模型落地的关键技术。

2283 155
|
11月前
|
人工智能 安全 算法
|

数据共享又怕泄露?聊聊隐私计算:让数据“可用不可见”的绝活儿

数据共享又怕泄露?聊聊隐私计算:让数据“可用不可见”的绝活儿

1476 15
|
11月前
|
存储 人工智能 自然语言处理
|

阿里云 Elasticsearch 的 AI 革新:高性能、低成本、智能化的搜索新纪元

本文介绍了数智化浪潮下, 阿里云 Elasticsearch 打通了 云原生内核优化、RAG 闭环方案、云原生推理平台 三大能力模块,实现了从底层到应用的全链路升级,助力企业构建面向未来的智能搜索中枢。

1299 22
|
11月前
|
人工智能 自然语言处理 数据可视化
|

2025 ChatBI 产品选型推荐:智能问数+归因分析+报告生成

当企业站在 ChatBI 选型的十字路口,技术架构的先进性、场景适配的完整性、落地实践的可验证性应成为核心考量标准。

1282 0
|
11月前
|
人工智能 运维 监控
|

【2025云栖大会】AI 搜索引擎如何驱动亿级物流:货拉拉 x 阿里云 Elasticsearch

2025云栖大会 AI搜索与向量化模型专场上,拉拉 Elasticsearch技术负责人——陈敏华先生分享了 Elasticsearch 在全球化高并发业务场景下的深度实践,以及在迁移至阿里云 Elasticsearch Serverless 后的显著收益。货拉拉的案例为业界提供了可复制、可落地的技术范本。

760 4
|
12月前
|
算法 搜索推荐 大数据
|

当“爆款书”遇上大数据:出版业的老路,正在被算法改写

当“爆款书”遇上大数据:出版业的老路,正在被算法改写

1280 8
|
12月前
|
canal 关系型数据库 MySQL
|

canal从mysql同步数据到es进行增量同步失效

436 0
|
12月前
|
数据采集 监控 NoSQL
|

优化分布式采集的数据同步:一致性、去重与冲突解决的那些坑与招

本文讲述了作者在房地产数据采集项目中遇到的分布式数据同步问题,通过实施一致性、去重和冲突解决的“三板斧”策略,成功解决了数据重复和同步延迟问题,提高了系统稳定性。核心在于时间戳哈希保证一致性,URL归一化和布隆过滤器确保去重,分布式锁解决写入冲突。

599 2
|
12月前
|
机器学习/深度学习 传感器 算法
|

基于yolo8的深度学习室内火灾监测识别系统

本研究基于YOLO8算法构建室内火灾监测系统,利用计算机视觉技术实现火焰与烟雾的实时识别。相比传统传感器,该系统响应更快、精度更高,可有效提升火灾初期预警能力,保障生命财产安全,具有重要的应用价值与推广前景。

1135 10
|
20天前
|
人工智能 自然语言处理 安全
|

GEO优化实战工程中的:权威性与EEAT

本文剖析EEAT在生成式搜索中的真实作用:权威不可自证,需拆解为可核验的结构化字段(作者、来源、时间等);可信靠积累,非靠宣称。强调分平台验证信号有效性,反对“缺一不可”等误读,主张用实体标注替代笼统评分。(239字)

112 3
|
20天前
|
数据采集 人工智能 监控
|

AI时代-架构重构:API+大模型=智能决策中枢

大模型是推理大脑,解决 “看懂数据、做出判断

111 0
|
27天前
|
存储 传感器 算法
|

硬核科技赋能一线警务!AR 眼镜动态追踪解锁安防执法新能力

AR警务眼镜历经三代升级,3.0动态AR追踪技术突破静态识别局限,实现移动中人脸/车牌毫秒级精准识别、实时虚实融合与智能预警,全面提升巡逻、稽查、应急及执法效能,成为智慧警务关键轻量化装备。(239字)

116 0
|
27天前
|
数据采集 人工智能 搜索推荐
|

4大AI引擎引用偏好实测:光伏B2B工业品内容建设的数据结论

本文基于2026年Q1对豆包、DeepSeek、Kimi、秘塔四大AI引擎的实测,揭示其在光伏逆变器、储能系统等B2B工业品内容引用上的显著偏好差异。指出传统搜索入口萎缩(年减9600万用户),AI正成新获客主渠道。提出“问题型标题+可验证数据+直接引语”三要素内容策略,并警示软文堆积已失效。

119 0
来自: 智能搜索推荐  版块
|
28天前
|
供应链 Oracle 关系型数据库
|

RWA解决供应链金融中的痛点:从应收账款数字化到链上资产融资

供应链金融长期面临“信用难传导、资产难验证”困局:中小供应商缺资金,核心企业信用却无法有效下沉。RWA(现实世界资产)并非简单上链,而是通过数字资产将真实资产、法律权利、业务数据与智能合约深度融合,实现资产状态可验证、确权自动化、融资可编程、结算原子化,构建可信高效的数字金融基础设施。

176 0
|
1月前
|
数据采集 人工智能 算法
|

六大AI引擎引用偏好实测:展会内容如何被豆包与DeepSeek摘录

本文基于2026年5月对豆包、DeepSeek等六大AI引擎的实测,揭示其引用偏好:豆包71%引用国内平台,CSDN独占34%。提出展会行业AI可见性三步法——信息块拆解(数据+结论自洽)、平台公式适配(CSDN重干货、头条重情绪)、月度覆盖检验,助力展会内容进入AI引用库。

145 0
来自: 智能搜索推荐  版块
|
2月前
|
JSON 自然语言处理 监控
|

京东商品评论API技术解析与落地应用

京东商品评论API(jd.item_review)提供标准化JSON格式的全量评论数据,涵盖主评、追评、晒图视频、评分、用户标签及商家回复等。本文详解接口接入、参数、返回结构与实战经验,助力舆情预警、竞品分析、NLP情感分析等场景。(239字)

118 0
|
2月前
|
存储 JSON 监控
|

1688商品详情API数据解析与开发实践

本文详解1688商品详情API(1688.item_get)的接入实践:涵盖鉴权调用、关键字段解析(阶梯价、SKU、供应商资质等)、分层数据建模及价格监控、货源同步等业务落地方案,助力B端系统稳定高效对接。

212 1
|
2月前
|
数据采集 算法 机器人
|

自变量开源 HOST 框架,让机器人看一条数十秒视频学会新技能,较主流方法提速 500 倍

自变量机器人发布开源HOST框架,首创“观察学习”范式:机器人仅凭一段29秒人类视频,即可理解任务目标、动态对齐进度、反推自身动作,技能习得成功率62%,速度提升500倍,且不遗忘旧技能,让普通人也能轻松教学。

175 1
|
2月前
|
人工智能 运维 Serverless
|

开发者生态的AI信任基建:睿擎GEO双五模型在阿里云开发者社区的工程化落地与量化运营路径

本文提出睿擎GEO双五模型V1.2,面向AI时代技术社区信任建设,构建“先治理、后建设、再验证、长迭代”的标准化路径。通过五层架构(L4-L5)与五级成熟度(M1-M5),适配通义千问、豆包、DeepSeek差异化信任机制,助力阿里云开发者社区从内容平台升级为可信技术基础设施。(239字)

383 0
来自: 智能搜索推荐  版块
|
3月前
|
人工智能 运维 Serverless
|

开发者生态的AI信任基建:睿擎GEO双五模型在技术社区场景的工程化落地与量化运营路径

本文提出GEO双五模型V1.2,以“先治理、后建设、再验证、长迭代”路径,构建面向大模型的AI信任基建。通过五层架构(L4-L5)与五级成熟度(M1-M5)量化体系,助力技术社区从“内容分发平台”升级为AI时代“可信技术基础设施”,抢占开发者决策入口。(239字)

156 0
来自: 智能搜索推荐  版块
|
3月前
|
数据采集 机器学习/深度学习 自然语言处理
|

电商口碑自动化监控方案:搭建商品评论实时采集 + 情感分析系统

本文详解电商口碑自动化监控系统搭建:覆盖数据采集(多平台API)、清洗预处理、NLP情感分析(SGD+BERT双模型)、分级预警(P0-P2)及可视化看板,提供完整Python代码,助企业实现分钟级差评响应与闭环运营。

379 1
|
3月前
|
SQL 人工智能 安全
|

企业级 AI Agent 的安全防护实践:防止提示注入与数据泄露

AI Agent正重塑企业安全边界:其自主调用API、数据库、知识库等能力,在提升自动化效率的同时,也引入提示注入、工具滥用、记忆污染等新型风险。本文系统剖析十大威胁与防护策略,提出“模型管推理、系统管安全”的多层防御架构,涵盖输入检测、Prompt隔离、工具白名单、RAG权限治理及全链路审计,助力企业构建可信AI智能体。

370 0
|
3月前
|
人工智能 自然语言处理 监控
|

AI Native, Now|阿里云 Milvus AI Function,从能力集成走向产品化落地

作为 AI Native 的 Milvus 云服务,阿里云 Milvus 用一套原生架构把数据、向量检索与模型能力真正串在了一起:Embedding、Rerank、Generate 和多模态处理原生进入数据链路,AI-Gateway 提供统一模型出口,并与 Milvus Auth、配额、审计、观测和模型切换无缝协同。

359 1
|
3月前
|
人工智能 算法
|

GEO EEAT实战拆解:AI搜索判断内容可信的4个信任信号

本文拆解AI搜索EEAT与Google EEAT的本质差异:AI不看品牌声誉,而依赖4个可验证的信任信号——可点击外链、结构化内容(FAQ/列表/表格)、站内信息一致性、近90天时效性。基于4个月实测,提供零品牌背书也能落地的四步法。

307 0
来自: 智能搜索推荐  版块
|
3月前
|
SQL NoSQL Java
|

团队暂时没有条件部署 SkyWalking

本文详解APM链路追踪核心实践:先定位慢在哪一跳。通过SkyWalking开箱即用方案(Java零侵入Agent接入)或自研轻量方案(MDC+AOP日志埋点),快速生成耗时瀑布图,将3.2秒慢请求精准定位至2.35秒SQL,大幅提升性能排查效率。(239字)

198 1
|
3月前
|
数据采集 人工智能 搜索推荐
|

AI搜索引用监测实战:基于数据采集与分析的4步技术方案

本文提出基于数据驱动的AI搜索引用监测方案,涵盖4个核心指标(引用频次、位置、竞品对比、AI流量)、4大主流AI引擎(豆包/Kimi/DeepSeek/元宝)定期采集及时间序列分析,助力技术团队量化内容在AI搜索中的可见性与竞争力。

374 0
来自: 智能搜索推荐  版块
|
3月前
|
人工智能 搜索推荐 数据挖掘
|

AI搜索引用转化链路的数据分析:三层漏斗与优化方法

本文提出AI搜索“引用→点击→咨询”三层转化漏斗模型,基于45条引用记录发现:首位引用点击率15%–25%,第5位后不足3%;内容完整度70%时咨询率最高(超15%),过高反致用户自助流失;决策型关键词转化率是学习型的10倍。实证优化60天,咨询量增长约10倍。

305 0
来自: 智能搜索推荐  版块
|
3月前
|
数据采集 Python
|

手把手带你用Python撸一个多线程+代理池下载器

这篇文章介绍了如何使用Python标准库开发一个支持并发和代理池管理的流媒体下载器,以提高大规模数据采集效率。文章提出了基于多线程分段下载的解决方案,并强调了高并发环境下代理IP池的重要性。主要方法包括:构建代理字典、下载文件块和多线程下载合并。实战技巧包括设置超时、指数退避重试和合理使用代理IP,以平衡并发速度和稳定性。

297 1

大数据与机器学习

大数据领域前沿技术分享与交流,这里不止有技术干货、学习心得、企业实践、社区活动,还有未来。

0
今日
70384
内容
128
活动
440238
关注
你好!
登录掌握更多精彩内容

相关产品

  • 大数据开发治理平台 DataWorks
  • 检索分析服务 Elasticsearch版
  • 日志服务