|
3月前
|
人工智能 数据可视化 数据挖掘
|

连续7年!阿里云凭借Quick BI成为中国唯一上榜Gartner® ABI魔力象限的BI厂商

阿里云Quick BI第七次入选Gartner分析与BI魔力象限挑战者象限,是中国唯一连续七年上榜的BI厂商。作为AI-native智能分析平台,它集多源接入、归因分析、生态协同、按需计费于一体,已服务万家客户,覆盖全球8大区域。(239字)

376 1
|
3月前
|
数据采集 Python
|

手把手带你用Python撸一个多线程+代理池下载器

这篇文章介绍了如何使用Python标准库开发一个支持并发和代理池管理的流媒体下载器,以提高大规模数据采集效率。文章提出了基于多线程分段下载的解决方案,并强调了高并发环境下代理IP池的重要性。主要方法包括:构建代理字典、下载文件块和多线程下载合并。实战技巧包括设置超时、指数退避重试和合理使用代理IP,以平衡并发速度和稳定性。

298 1
|
4月前
|
监控 druid OLAP
|

别再盲选数据库了!ClickHouse、Druid、QuestDB 到底怎么选?一篇文章帮你避开 90% 的坑

别再盲选数据库了!ClickHouse、Druid、QuestDB 到底怎么选?一篇文章帮你避开 90% 的坑

388 0
|
4月前
|
人工智能 搜索推荐 SEO
|

从搜索可见到AI可见:品牌智能传播评价体系构建

AI品牌指数是衡量品牌在生成式AI(如ChatGPT、Kimi等)回答中可见度、准确度与推荐质量的新型评估体系,涵盖提及率、推荐率及可见度、引用度、推荐度、准确度、风险度五大维度,助力企业提升AI时代数字竞争力。

256 0
|
4月前
|
安全 数据可视化 数据挖掘
|

零代码应用搭建平台选型指南:2026 年企业落地实践

目前,很多企业管理者和 IT 负责人都面临一个共同难题:想上线业务系统,但传统开发模式成本高、周期长,专业技术人才招聘和留存难度大。一个基础的报销管理系统定制开发费用动辄十几万元,开发周期半年起步,等系统正式上线,业务流程往往已经发生了变化。零代码应用搭建平台的出现,为解决这一难题提供了新的思路,让不具备编程能力的业务人员也能自主构建简单的业务应用。

451 0
来自: 数据可视化DataV  版块
|
4月前
|
数据采集 存储 JSON
|

京东商品详情 API 实战总结(技术复盘)

本文为京东商品详情API实战复盘,聚焦后端开发落地:基于合规封装接口(如Taobaoapi2014),通过jd.item_get实现自营/第三方商品全维度采集,涵盖基础信息、价格库存、图文素材及口碑数据;攻克签名校验、限流、区域差异等难点,优化调度与容错,保障企业级稳定调用。(239字)

339 3
|
4月前
|
SQL 数据可视化 Linux
|

一个基于 .NET 与 Avalonia 构建、面向 TrinityCore 的开源 WoW 数据库编辑器

WoWDatabaseEditor 是一款基于 .NET 与 Avalonia 构建的开源跨平台编辑器,专为 TrinityCore/AzerothCore 服务端设计,可视化编辑数据库及 Smart Scripts,支持 TC 3.3.5–10.x、DBC 多版本及 Win/macOS/Linux。

265 7
|
5月前
|
SQL 人工智能 自然语言处理
|

数据平台主管做智能问数选型,最该先看技术路线还是实施能力?

本文为数据平台主管提供智能问数选型的系统化框架,聚焦2026年关键矛盾:技术路线决定能力上限与长期成本曲线,实施能力决定上限能否落地。从四类主流路线(预置SQL、宽表、指标平台、本体语义层)对比出发,结合实施能力三要素(语义构建、知识校准、持续运营)与场景成熟度判断,助力企业在“先进性”与“可行性”间找到平衡点。

537 4
|
5月前
|
人工智能 搜索推荐 开发者
|

GEO 技术赋能传统媒体数字化转型:广电场景下的 AI 获客与内容创新实践

生成式引擎优化(GEO)作为 AI 时代全域增长的关键技术,正推动传统媒体与前沿技术的深度融合。本文以湖南广电金鹰卡通与 GEO 技术专家周有贵团队的合作为案例,从技术原理、场景落地、价值共创三个维度,解析 GEO 技术在广电客户精准运营、品牌全域建设、内容生态创新中的应用路径,为传媒行业数字化转型提供可复用的技术实践参考。

567 0
|
5月前
|
Web App开发 人工智能 自然语言处理
|

2026 爆火 OpenClaw 小龙虾 AI 部署教程|Win10/11 一键搭建本地 AI 数字员工,零代码零基础即用

OpenClaw(“小龙虾”)是2026年爆火的开源本地AI智能体,GitHub星标超28万。本教程专为小白设计,Win10/11一键部署,零代码、全图形化操作,10分钟即可启用AI数字员工,自动完成文件整理、Excel生成、浏览器操作等办公任务,数据全程本地运行,隐私安全无忧。(239字)

1136 1
|
5月前
|
JSON 数据挖掘 API
|

阐述:通过商品ID获取淘宝天猫商品评论数据教程

淘宝商品评论API(taobao.item.reviews.get)提供结构化评论数据,支持按商品ID、评分、图文、追评等条件查询。返回内容含评论文本、星级、晒图、用户信息、商家回复、点赞数及标签统计等,助力数据分析与风控。

413 2
|
6月前
|
JSON 供应链 API
|

B2B-1688获取工厂信息接口总览

1688 B2B工厂接口提供工厂详情(item_get_factory)与搜索(item_search_factory)两大核心能力,覆盖工商、产能、认证、信用等60+字段。企业认证后可获全量数据与高QPS,支持供应商尽调、选品及ERP集成。含官方/第三方两种接入方案及调用示例。(239字)

915 0
|
6月前
|
人工智能 安全 开发工具
|

开发者效率神器|OpenClaw 本地AI一键部署,无需Python/命令行(Win11适配)

OpenClaw(小龙虾)是GitHub星标28W+的开源本地AI智能体,专为Windows 11优化,支持一键部署、零代码、全离线运行。无需联网、数据不出设备,可自动完成文件整理、浏览器操控、办公自动化等任务,10分钟轻松上手,开发者隐私与效率兼得。(239字)

784 0
|
6月前
|
SQL 人工智能 Java
|

基于 NoETL 语义编织技术构建 AI-Ready 数据底座

AI时代,数据平台选型的核心是选择能构建“统一语义层”的下一代架构。

435 1
|
6月前
|
监控 Java BI
|

如何通过 NoETL 指标平台根治跨业务口径混乱

本文剖析企业跨部门指标口径混乱顽疾,提出基于NoETL语义编织技术的Aloudata CAN指标平台,构建动态“唯一指标注册中心”,实现定义即开发、治理与服务。

295 5
|
6月前
|
算法 调度 数据库
|

演化计算与抽样方法构造新算法流程:从 AlphaEvolve 看 LLM × EA 融合范式

本文系统解析AlphaEvolve——Google DeepMind提出的LLM×EA融合新范式:以语义引导的抽样机制、双模型协同进化(Gemini Flash+Pro)、自动评估闭环,实现算法的自主发现与优化,已突破矩阵乘法纪录并提升训练效率。(239字)

549 15
|
6月前
|
机器学习/深度学习 分布式计算 搜索推荐
|

PAI-Rec 召回引擎:构建高性能推荐系统的核心引擎

PAI-Rec是阿里云智能推荐平台的核心召回引擎,经阿里大规模场景验证。支持多路召回融合(U2I/I2I/向量/随机)、召回即过滤、毫秒级实时更新与分布式弹性架构,开箱即用,助力企业构建毫秒级、高精度、强实时的推荐系统。

605 9
来自: 智能搜索推荐  版块
|
7月前
|
SQL 机器学习/深度学习 人工智能
|

从 NL2SQL 到本体论智能问数:为什么复杂企业数据问答需要新的方法

当“大模型+数据问答”成智能化入口,真正难点不在NL2SQL,而在理解业务对象、关系、口径与动作。本文剖析传统方法的天花板,提出以本体论构建业务语义层——将问数从“查表工具”升维为“决策基础设施”,揭示UINO等厂商通过ABC(Acquire-Build-Compute)范式,推动智能问数迈向可持续演进的语义底座。

1238 4
|
7月前
|
机器学习/深度学习 SQL 自然语言处理
|

数据智能体技术路线深度对比:本体神经网络 vs 预制指标平台

本文剖析数据智能体四大技术路径:RAG(简单但精度低)、NL2SQL(单表准、多表差)、预制指标(高维护成本、扩展性差)、本体神经网络(UINO首创,95%+准确率,维护成本线性增长)。推荐企业优先选择本体论路线,实现高精准、低成本、强扩展的AI原生问数。

521 1
|
7月前
|
机器学习/深度学习 BI
|

数据智能体目前能做到多少准确率?

本文客观分析字节、帆软、京东、Palantir、UINO等主流数据智能体的准确率表现,揭示NL2SQL、宽表、本体+智能体等技术路线的真实水平(单表最高98%+,多表本体路线达95%+),指出语义深度、知识积累、测试集差异等核心影响因素,并提供可落地的POC评估框架。(239字)

621 0
|
7月前
|
机器学习/深度学习 人工智能 JSON
|

AI 术语满天飞?90% 的人只懂名词,不懂为什么!

本文不堆砌概念,只讲前因后果:从大模型底层逻辑,到 Context、RAG、Function Calling、MCP、Skills 的核心关联,拆解所有面试高频考点,让你告别 “名词解释”,吃透原理,面试直接碾压面试官!

1828 7
|
7月前
|
Java 编译器 C++
|

#Java 逃逸分析与栈上分配:JIT 编译的极致性能优化底层

逃逸分析是JVM核心优化技术,JDK 1.6起默认启用。它通过分析对象动态作用域,对无逃逸对象实施栈上分配、标量替换和同步消除,显著降低GC压力、提升执行效率,是高性能Java开发的必备底层知识。(239字)

461 3
|
8月前
|
存储 分布式计算 Java
|

PySpark入门教程(非常详细)从零基础入门到精通

本教程聚焦Spark Core核心原理,基于3.5.8版本,用Python详解RDD五大特性(分区、计算函数、依赖关系、分区器、首选位置)、容错机制、Shuffle、DAG调度及共享变量等,并通过WordCount实战演示。

798 4
|
8月前
|
安全 C++
|

关系记忆不是越完整越好:chunk size 的隐性代价

本文揭示关系型RAG(如祝福/道歉生成)中一个反直觉真相:关系信息并非越完整越好。大chunk会将“可引用的触发点”异化为“需总结的材料”,诱使模型转向安全、抽象、概括性表达,丧失走心感。核心原则是——切分重在“可被直接引用”,而非“逻辑完整”。

1011 11
|
8月前
|
人工智能 Kubernetes 物联网
|

轻量化部署:让你的祝福模型在小显卡上跑起来

本文揭秘春节祝福AI的轻量化部署:无需昂贵GPU,消费级显卡即可运行!通过INT4量化(模型缩至1/8)、LoRA微调(仅训MB级参数)及QLoRA组合,搭配vLLM推理优化与K8s弹性扩缩容,7B小模型高效生成祝福语。低成本、低门槛、高可用——大模型应用,人人可及。

487 0
|
8月前
|
数据采集 人工智能 安全
|

别再用ChatGPT群发祝福了!30分钟微调一个懂你关系的“人情味”拜年AI

春节祝福太难写?本文手把手教你用LoRA微调大模型,让AI学会“看人下菜”:识别关系、风格、细节,30分钟训练出懂人情世故的拜年助手。无需代码,量化+批处理保障秒级响应,让每条祝福都像你亲手写的。(239字)

641 35
|
8月前
|
运维 监控 安全
|

NTP时间同步服务器:安徽京准助力公共资源交易中心

安徽京准为公共资源交易中心提供NTP时间同步解决方案,践行“时间即证据,同步即公平”理念。通过北斗/GPS双模授时、分层同步架构,确保投标截止、自动开标、日志审计等关键环节时间毫秒级统一,夯实电子化交易的法律效力、公正性与等保合规基础。(239字)

354 0
|
8月前
|
缓存 负载均衡 安全
|

Nginx 反向代理:原理、优势与配置指南

Nginx反向代理是核心服务器架构技术,可实现请求转发、负载均衡、高可用与安全防护。它隐藏后端服务器,自动剔除故障节点,并支持SSL终止、缓存等高级功能,配置简洁灵活,广泛应用于高性能Web系统。

805 13
|
8月前
|
人工智能 自然语言处理 架构师
|

AI Agent 职业路线全指南:从智能体普及浪潮到分层能力构建

2026年,“AI+”进入产业级落地期,智能体成为数字化转型核心基础设施。全球市场规模达2.3万亿,我国2027年普及率将超70%。人才缺口巨大,教育部已设“智能体技术应用”新专业。本文系统梳理四类职业路径(管理者、架构师、多智能体专家、垂直领域专家)及企业治理框架,助力职场人锚定定位、实战进阶。(239字)

1101 2
|
8月前
|
安全 物联网 测试技术
|

为什么 loss 看起来很好,模型却更危险了

本文揭示大模型微调中一个关键陷阱:loss持续下降≠模型更安全。相反,当loss“好看”时,模型可能因过度拟合训练数据中的偏差、模板或错误表达而变得更危险——回答更笃定、拒答率下降、边界问题越界更隐蔽。根本原因在于:loss衡量的是“复现训练文本”的能力,而非“行为是否可靠/合规”。工程上应转向以事实正确率、拒答率、自信度、越界率等为核心的行为评估体系,将loss仅作为训练健康度的辅助信号。

591 1
|
9月前
|
XML JSON API
|

淘宝商品详情API(tb.item_get)

本文详解淘宝开放平台商品详情核心API(如item_get),涵盖对接流程、权限申请、请求规范、参数说明及返回字段,并列举代购集运、选品分析、比价导购等典型应用场景,助力开发者合规高效获取商品数据。(239字)

1035 3
|
9月前
|
机器学习/深度学习 人工智能 算法
|

告别关键词搜索:手把手教你用向量数据库,解锁大模型的“最新”知识

本文用通俗语言详解向量数据库原理与实践:它通过“语义向量化”实现按意思而非关键词检索,是RAG系统中连接大模型与私有数据的核心“外挂大脑”。附Faiss+Sentence-Transformers实战Demo,10分钟搭建可运行的语义检索系统。(239字)

1044 0
|
9月前
|
人工智能 运维 供应链
|

智能体来了:生产企业如何用AI赚钱

在“智造”转型浪潮下,AI已成为制造企业发展的必选项。本文系统解析AI在研发、生产、供应链、管理等场景的应用路径,提出从数据筑基到智能体落地的四阶段实施框架,揭示避免技术陷阱、组织阻力的关键策略,助力企业以价值驱动、稳步推进智能化升级。

669 0
|
9月前
|
存储 缓存 数据建模
|

StarRocks + Paimon: 构建 Lakehouse Native 数据引擎

12月10日,Streaming Lakehouse Meetup Online EP.2重磅回归,聚焦StarRocks与Apache Paimon深度集成,探讨Lakehouse Native数据引擎的构建。活动涵盖架构统一、多源联邦分析、性能优化及可观测性提升,助力企业打造高效实时湖仓一体平台。

961 39
来自: 实时计算 Flink  版块
|
9月前
|
存储 人工智能 物联网
|

【AI大模型面试宝典七】- 训练优化篇

【AI大模型面试宝典】聚焦微调核心技术:详解指令微调、RLHF对齐、LoRA高效参数调整原理与实现,涵盖矩阵低秩分解、初始化策略、变体优化及Prompt Tuning等方法对比,助你攻克大模型面试核心考点,精准提升offer竞争力!

584 0
来自: 人工智能平台PAI  版块
|
9月前
|
人工智能 自然语言处理 算法
|

最近比较火的GEO适合哪些行业的推广?

GEO(生成式引擎优化)正重塑营销格局,通过优化内容结构与语义逻辑,抢占AI问答场景的引用权。据IDC与中国信通院数据,2025年全球市场规模超120亿美元,中国占55.4%。其在本地生活、跨境电商、文旅、房地产、教育、B2B制造及金融医疗等行业广泛应用,助力企业实现精准获客、提升转化率并构建长期数字资产,成为AI时代营销新基建。

1255 3
|
9月前
|
JSON 安全 JavaScript
|

闲鱼商品列表API接口指南

本指南基于逆向分析,提供闲鱼商品列表数据获取的技术方案,适用于关键词、地区、价格等条件筛选。支持网页端GET与移动端POST请求,返回HTML或JSON格式数据,需注意登录态与参数编码,仅用于学习研究。

1132 2
|
9月前
|
机器学习/深度学习 算法 安全
|

基于yolov8深度学习的农作物识别检测系统

本研究基于YOLOv8深度学习技术,构建农作物识别检测系统,旨在实现对作物种类、生长状态及病虫害的快速精准识别。通过Python与先进算法结合,提升农业智能化水平,助力精准施肥、减少农药使用,推动农业可持续发展,具有重要应用价值。

520 1
|
10月前
|
搜索推荐 容灾 Java
|

Flink 最近又“进化”了:状态后端与 Savepoint,真不是背概念那么简单

Flink 最近又“进化”了:状态后端与 Savepoint,真不是背概念那么简单

336 4
|
10月前
|
存储 缓存 算法
|

零拷贝

实现文件传输时,传统方式因频繁的上下文切换和内存拷贝导致性能低下。零拷贝技术通过减少系统调用和内存复制,提升传输效率,尤其适用于小文件;而大文件则推荐使用异步IO结合直接IO,避免PageCache负面影响,从而优化高并发场景下的性能表现。

766 0
|
10月前
|
消息中间件 物联网 测试技术
|

语音通知

适用于科技公司服务器或物联网设备异常时的语音告警场景。通过语音服务,可拨打电话并播放含变量的预设模板通知。需先开通服务,申请资质、话术、号码及模板,支持公共/专属模式。可通过API发起呼叫并查询记录,推荐使用消息回执接收结果。

308 0
|
10月前
|
SQL Dubbo Java
|

线程池:故障梳理总结

本文从故障与技术双视角,总结线程池满导致服务不可用的典型场景与根因,涵盖数据库慢查询、连接池配置不当、超时设置缺失等问题,结合真实案例剖析,并提出fast-fail、流控背压、谨慎重试等防护策略,助力开发者提升系统稳定性。

359 0
|
10月前
|
消息中间件 人工智能 NoSQL
|

RocketMQ for AI:重新定义 AI 应用通信范式

RocketMQ LiteTopic 专为 AI 场景设计,支持百万级轻量队列,实现会话级私有通道与细粒度订阅。LiteConsumer 动态管理节点订阅,免依赖 Redis 与广播,简化架构。原生支持断点续传、状态恢复,保障 AI 多轮交互可靠闭环,构建高效、弹性通信模型。

404 0
|
10月前
|
XML 算法 安全
|

详解RAG五种分块策略,技术原理、优劣对比与场景选型之道

RAG通过检索与生成结合,提升大模型在企业场景的准确性与安全性。分块策略是其核心,直接影响检索效果与回答质量。本文系统解析五种主流分块方法:固定大小、语义、递归、基于文档结构及LLM分块,对比其优缺点与适用场景,并提出组合优化路径,助力构建高效、可信的RAG系统。

818 0
|
10月前
|
NoSQL Linux Shell
|

MongoDB单机部署

本文介绍MongoDB在Windows与Linux系统的安装启动方法,包括下载32/64位安装包、解压配置、命令行或配置文件方式启动服务,并设置数据目录与端口。同时说明如何通过mongo shell连接数据库,使用Compass图形化工具管理,以及Linux下的部署、防火墙配置和安全关闭服务等操作,助你快速搭建MongoDB运行环境。(238字)

1108 0
|
10月前
|
canal 缓存 关系型数据库
|

微服务原理篇(Canal-Redis)

本文介绍了ES索引同步的常见方案,重点讲解Canal+MQ数据同步机制。通过解析MySQL的binlog日志,Canal模拟slave伪装接入主库,实现增量数据捕获,并结合RabbitMQ保证消息顺序性地同步至Elasticsearch。同时探讨了缓存一致性问题,提出使用分布式锁(如Redis)控制并发写操作,避免双写不一致。还涵盖Redis持久化、集群模式、过期淘汰策略及缓存三剑客(穿透、雪崩、击穿)的解决方案,系统梳理了高并发场景下的数据同步与缓存保障技术体系。

1092 0
|
10月前
|
存储 NoSQL 关系型数据库
|

1-MongoDB相关概念

MongoDB是一款高性能、无模式的文档型NoSQL数据库,适用于高并发、海量数据、高扩展性场景。它以BSON格式存储数据,灵活支持复杂数据结构,广泛应用于社交、游戏、物联网、物流和视频直播等领域。适合无需事务、需快速迭代、高读写负载及大规模地理查询的应用,相较MySQL可大幅降低开发运维成本。

356 0
|
10月前
|
存储 JSON NoSQL
|

3-MongoDB常用命令

本文介绍如何使用MongoDB存储文章评论数据,涵盖数据库与集合的创建、增删改查操作及分页排序查询。使用`use`创建数据库,通过`insert()`插入文档,`find()`查询数据并支持投影与条件筛选,`update()`结合`$set`实现局部更新,`remove()`删除文档,配合`limit()`、`skip()`和`sort()`实现分页排序功能。所有操作均基于BSON格式,适用于高效管理非结构化数据。

569 0
|
10月前
|
数据采集 人工智能 监控
|

GEO优化核心:高权重新闻信源筛选与AI收录实战指南

在 GEO(搜索引擎地理优化)实操中,新闻信源的质量直接影响内容的 AI 收录率、关键词排名及转化效果。多数开发者面临两大核心问题:1. 低价值信源浪费成本:部分新闻平台价格低廉(30-50 元 / 篇),但发布后未被 AI 抓取,无法为 GEO 排名提供权重支撑;2. 广告属性触发审核拒绝:含联系方式(电话、微信号)的软文易被平台判定为广告,导致审核驳回,影响发布效率。

1213 7

大数据与机器学习

大数据领域前沿技术分享与交流,这里不止有技术干货、学习心得、企业实践、社区活动,还有未来。

0
今日
70385
内容
128
活动
440239
关注
你好!
登录掌握更多精彩内容

相关产品

  • 大数据开发治理平台 DataWorks
  • 检索分析服务 Elasticsearch版
  • 日志服务