|
9月前
|
人工智能 算法 新能源
|

从入门到选型:GEO生成式引擎优化科普与优质geo优化服务商推荐

GEO(生成式引擎优化)正取代SEO,助力企业在AI搜索中抢占流量先机。本文解析GEO核心逻辑,对比SEO差异,揭示其提升获客效率2.8倍的潜力,并结合国内外权威数据,分场景推荐适配的优质服务商,助企业从懂原理到会选型,规避布局风险。

3216 2
|
10月前
|
NoSQL Linux Shell
|

MongoDB单机部署

本文介绍MongoDB在Windows与Linux系统的安装启动方法,包括下载32/64位安装包、解压配置、命令行或配置文件方式启动服务,并设置数据目录与端口。同时说明如何通过mongo shell连接数据库,使用Compass图形化工具管理,以及Linux下的部署、防火墙配置和安全关闭服务等操作,助你快速搭建MongoDB运行环境。(238字)

1133 0
|
人工智能 自然语言处理 IDE
|

模型微调不再被代码难住!PAI和Qwen3-Coder加速AI开发新体验

通义千问 AI 编程大模型 Qwen3-Coder 正式开源,阿里云人工智能平台 PAI 支持云上一键部署 Qwen3-Coder 模型,并可在交互式建模环境中使用 Qwen3-Coder 模型。

1670 109
来自: 人工智能平台PAI  版块
|
机器学习/深度学习 人工智能 算法
|

Post-Training on PAI (4):模型微调SFT、DPO、GRPO

阿里云人工智能平台 PAI 提供了完整的模型微调产品能力,支持 监督微调(SFT)、偏好对齐(DPO)、强化学习微调(GRPO) 等业界常用模型微调训练方式。根据客户需求及代码能力层级,分别提供了 PAI-Model Gallery 一键微调、PAI-DSW Notebook 编程微调、PAI-DLC 容器化任务微调的全套产品功能。

1978 17
来自: 人工智能平台PAI  版块
|
关系型数据库 MySQL 数据库
|

基于Flink CDC 开发,支持Web-UI的实时KingBase 连接器,三大模式无缝切换,效率翻倍!

TIS 是一款基于Web-UI的开源大数据集成工具,通过与人大金仓Kingbase的深度整合,提供高效、灵活的实时数据集成方案。它支持增量数据监听和实时写入,兼容MySQL、PostgreSQL和Oracle模式,无需编写复杂脚本,操作简单直观,特别适合非专业开发人员使用。TIS率先实现了Kingbase CDC连接器的整合,成为业界首个开箱即用的Kingbase CDC数据同步解决方案,助力企业数字化转型。

3503 5
|
人工智能 供应链 API
|

反向海淘实战:Pandabuy、Hoobuy、CNFans 代购集运系统搭建真实体验

2025年,反向海淘成为新趋势。CSDN博主耗时2个月,模拟留学生、海外华人等场景,深度体验Pandabuy、Hoobuy、CNFans三大代购平台。Pandabuy极简易用,Hoobuy稳健实用,CNFans技术强大。通过真实案例分析,探讨各平台优劣及未来AI发展趋势,帮助用户避开常见陷阱,选择最适合的购物方案。

3315 1
|
分布式计算 并行计算 调度
|

基于HPC场景的集群任务调度系统LSF/SGE/Slurm/PBS

在HPC场景中,集群任务调度系统是资源管理和作业调度的核心工具。LSF、SGE、Slurm和PBS是主流调度系统。LSF适合大规模企业级集群,提供高可靠性和混合云支持;SGE为经典开源系统,适用于中小规模集群;Slurm成为HPC领域事实标准,支持多架构和容器化;PBS兼具商业和开源版本,擅长拓扑感知调度。选型建议:超大规模科研用Slurm,企业生产环境用LSF/PBS Pro,混合云需求选LSF/PBS Pro,传统小型集群用SGE/Slurm。当前趋势显示Slurm在TOP500系统中占比超60%,而商业系统在金融、制造等领域保持优势。

3998 32
|
JSON 监控 API
|

唯品会商品详情接口(唯品会 API 系列)

唯品会商品详情接口助力电商发展,提供商品名称、价格、规格等详细信息,支持HTTP GET/POST请求,响应为JSON格式。开发者可通过API Key和商品ID获取数据,应用于电商数据分析、竞品调研、应用开发及价格监控,提升业务效率与竞争力。示例代码展示Python调用方法,方便快捷。

593 9
|
机器学习/深度学习
|

知识蒸馏技术原理详解:从软标签到模型压缩的实现机制

**知识蒸馏**是一种通过性能与模型规模的权衡来实现模型压缩的技术。其核心思想是将较大规模模型(称为教师模型)中的知识迁移到规模较小的模型(称为学生模型)中。本文将深入探讨知识迁移的具体实现机制。

2142 12
|
Ubuntu 关系型数据库 PostgreSQL
|

部署harbor

在Ubuntu 22.04 LTS环境下,部署Harbor私有仓库的步骤包括:确保已安装Docker(版本24.0.6),参考官方v2.5.3安装指南,注意避免在NFS4挂载磁盘上部署以防止PostgreSQL相关问题。首先,生成SSL证书,然后更新Docker配置并重启服务。解压并配置Harbor离线安装包,修改`harbor.yml`,执行`prepare`和`install.sh`脚本,最后将Harbor设置为系统服务。

975 0
|
存储 搜索推荐 Linux
|

CDN服务器真实地址

Discover CDN server real IP addresses using Traceroute & Whois, CDN provider logs (with provider cooperation), analyzing HTTP headers, online tools, or the ping command. Note that CDN

1491 0
|
存储 SQL 分布式计算
|

Hologres RoaringBitmap在Lazada选品平台的最佳实践

Lazada选品平台包含全网商家、商品的圈选,通过Hologres RoaringBitmap能力帮助业务突破选品池20w大小限制,6000+选品池调度完成由12h下降至1h,单个选品池调度时间由90s下降至2s。

1055 4
来自: 实时数仓 Hologres  版块
|
SQL 分布式计算 数据库
|

离线数仓--大数据技术之DolphinScheduler

离线数仓--大数据技术之DolphinScheduler

4033 2
|
SQL 关系型数据库 MySQL
|

基于 Flink CDC 打造企业级实时数据集成方案

阿里云智能 Flink 数据通道负责人,Flink CDC 开源社区负责人,Flink PMC Member & Committer 徐榜江在 2023 云栖大会开源大数据专场的分享。

59656 11
来自: 实时计算 Flink  版块
|
机器学习/深度学习 编解码 PyTorch
|

CVPR 2023 | 主干网络FasterNet 核心解读 代码分析

本文分享来自CVPR 2023的论文,提出了一种快速的主干网络,名为FasterNet。核心算子是PConv,partial convolution,部分卷积,通过减少冗余计算和内存访问来更有效地提取空间特征。

11621 58
|
并行计算 算法 数据挖掘
|

geatpy遗传算法包使用介绍

Geatpy是国内几所高校做的一个开源遗传算法包,是一个高性能实用型进化算法工具箱,提供许多已实现的进化算法中各项重要操作的库函数,并提供一个高度模块化、耦合度低的面向对象的进化算法框架,利用“定义问题类 + 调用算法模板”的模式来进行进化优化,可用于求解单目标优化、多目标优化、复杂约束优化、组合优化、混合编码进化优化等。

2179 0
|
数据采集 机器学习/深度学习 编解码
|

数字孪生核心技术揭秘(三):倾斜摄影

对真实世界的自动化三维重建一直是CG/CV行业前赴后继不断尝试解决的难题;目前业内的进展,对于微型场景如单个饮料瓶等物体,结合AI已经可以实现语义化切割的自动三维重建,媲美人工建模。但是对于室外大场景的自动三维重建,从算法到采集硬件等等,都还未能做到类似微型场景的理想水平。 目前,倾斜摄影虽然在模型语义化分割、模型精度等方面不太完美,但是在贴近真实世界、过程自动化、实施成本、整体技术链成熟度等方面,已经是市面上最理想的低成本大规模三维重建技术方案。 随着国家政策的鼓励和“全景中国”的推进,预计倾斜摄影将会成为数字孪生项目的主流三维模型来源之一。

12472 2
来自: 数据可视化DataV  版块
|
13天前
|
人工智能 安全
|

Anthropic 用 Claude 发现新酶系统,AI 开始走进生物学的未知地带

Anthropic 利用 Claude 智能体在海量噬菌体 DNA 数据中发现了一种此前未被完整描述的新酶系统 ART,其特征让人联想到 CRISPR,但功能与用途尚不明确。搜索共启动 949 个智能体会话、消耗约 2.156 亿 token。文章借此指出,通用大模型与 Agent 正从跑分竞赛走向基础生物学研究,可能成为 AI 参与科学发现的一个分水岭。

120 3
|
29天前
|
人工智能 分布式计算 Serverless
|

EMR Serverless Daft 算子市场免费公测|10分钟极速实战(附视频教程)

Daft 算子市场公测来了!开箱即用的 AI 算子,覆盖 视频 / 图片 / 文本 / 音频 四大场景,搭配 Qwen3.7 大模型,零成本跑通 AI 数据处理全流程。 以训练一个能理解厨房操作的智能机器人为例,我们通常需要采集数千小时由人类佩戴摄像头拍摄的操作视频。然而,当这些视频被解码后,往往会膨胀为数亿张图像帧。更棘手的是,原始数据中充斥着静止画面、模糊镜头和无效空帧等海量“噪音”。如何从这些冗余信息中高效提取出高质量训练样本,已成为多模态技术发展的核心瓶颈。 本次实战将带您深入这一典型场景,借助 Daft 算子市场,一步步拆解并跑通从视频抽帧、数据清洗到高质量样本提取的完整链路。

216 0
|
3月前
|
人工智能 自然语言处理 机器人
|

AI大模型工具深度运用实践:AI客服系统怎么搭建?基于大语言模型的企业智能客服实践与应用分析

企业正借力大语言模型,将传统规则客服升级为AI Agent智能客服:从关键词匹配跃升至意图理解,由人工配置转向文档驱动,从被动应答进化为主动执行任务,实现7×24全时服务与低成本能力扩展。(239字)

297 2
来自: 大数据运维SREWorks  版块
|
3月前
|
人工智能 自然语言处理 文字识别
|

AI Agent时代的流程自动化:RPA、Workflow与LLM协同架构实践

本文探讨AI Agent与RPA的融合趋势:RPA擅长稳定执行规则化任务,AI Agent长于自然语言理解、推理与决策。二者非替代关系,而是协同构建“Agentic Process Automation(APA)”——Agent负责“做什么”,Workflow编排任务,RPA精准执行,知识库赋能持续学习。企业应分阶段推进,迈向目标驱动的智能自动化新范式。(239字)

458 1
|
3月前
|
人工智能 分布式计算 Serverless
|

阿里云 EMR Serverless Spark 全托管 Ray 再进化:加速构建全模态数据处理新基建

阿里云 EMR Serverless Spark + Ray 双引擎构建全模态数据处理的新基建,通过极致内核优化和统一数据、算力底座,彻底打通了大数据工程与 AI 模型训练的割裂。结合 RayData、Daft、Data-Juicer 等多模态引擎,以及 CPFS、OSS 等高性能存储生态,阿里云正在为全球的 AI 开发者提供一套最具竞争力的数据新基建。

555 0
|
3月前
|
数据采集 人工智能 搜索推荐
|

AI搜索时代内容匹配机制:从关键词匹配到语义匹配的范式转换

本文剖析AI搜索引擎(如豆包、Kimi)依赖RAG技术实现语义匹配的底层逻辑,揭示其以向量相似度替代BM25关键词匹配的本质。指出关键词堆砌已失效,并提出四大语义时代内容策略:覆盖多元问法的语义覆盖、结构化段落提升可引用性、权威引用增强可信度、FAQ打造天然语义锚点。

437 0
来自: 智能搜索推荐  版块
|
6月前
|
存储 人工智能 算法
|

工程师高培解读XilinxVivadoFPGA设计进阶与AI自动编程

本文系统梳理Vivado FPGA开发八大核心模块:底层结构、时序收敛、综合策略、IP复用、非项目模式、HLS高级综合、DFX动态重构及AI辅助编程,融合中际赛威实战经验,助力工程师突破技术瓶颈,提升设计效率与可靠性。(239字)

656 0
来自: 人工智能平台PAI  版块
|
6月前
|
数据采集 JavaScript 前端开发
|

告别空壳HTML!Node.js + Playwright + 代理IP 优雅抓取动态网页实战

本文详解Node.js+Playwright抓取动态网页的实战方案:针对React/Vue等框架渲染的SPA页面,结合代理IP(支持动态/固定转发模式)突破采集限制,并提供BrowserContext级代理配置、IP有效性验证、健壮重试机制及常见报错(407/429/403)应对策略,助你构建高可用工业级爬虫。

787 0
|
7月前
|
机器学习/深度学习 BI
|

数据智能体目前能做到多少准确率?

本文客观分析字节、帆软、京东、Palantir、UINO等主流数据智能体的准确率表现,揭示NL2SQL、宽表、本体+智能体等技术路线的真实水平(单表最高98%+,多表本体路线达95%+),指出语义深度、知识积累、测试集差异等核心影响因素,并提供可落地的POC评估框架。(239字)

645 0
|
8月前
|
数据采集 JSON 供应链
|

1688商品详情API数据采集指南

1688商品详情API(1688.item_get)是阿里开放平台核心接口,支持通过商品ID获取标题、价格、库存、SKU、图文详情、商家资质等50+字段,JSON格式返回。广泛用于ERP同步、跨境铺货、比价监控与供应链管理,需签名认证,调用稳定高效。(239字)

4160 5
|
8月前
|
JSON 监控 安全
|

小红书笔记详情数据获取实战:从笔记链接提取 ID 到解析详情

小红书笔记详情API可获取标题、正文、作者、互动数据、图文/视频资源及话题标签等结构化信息,支持自定义字段与评论拉取。适用于内容分析、竞品监控、营销优化与用户研究,HTTPS+JSON接口,Python调用便捷。(239字)

2216 6
|
8月前
|
机器学习/深度学习 PyTorch 算法框架/工具
|

PyTorch 入门指南:深度学习的瑞士军刀

PyTorch 是Meta开源的动态深度学习框架,以灵活的计算图、类NumPy的直观API和强大GPU加速著称。支持快速原型设计与生产部署,涵盖张量运算、自动求导、神经网络构建等核心功能,是研究与工程首选工具。(239字)

1333 0
|
9月前
|
机器学习/深度学习 存储 缓存
|

零基础玩转RAG:手把手教你搞定文档切分与大模型微调

本文深入解析RAG中至关重要的文档切分技术,系统对比句子切分、固定长度、重叠窗口、递归切分和语义切分五种策略,结合代码示例与实战技巧(PDF/Markdown/代码处理),并提供量化评估与调优方法,助你夯实RAG基石。(239字)

959 1
|
11月前
|
人工智能 自然语言处理 机器人
|

中小企业也能玩转大模型:把AI搬到自己机房里不是梦

中小企业也能玩转大模型:把AI搬到自己机房里不是梦

2159 3
|
12月前
|
人工智能 自然语言处理 算法
|

【2025云栖大会】AI 搜索智能探索:揭秘如何让搜索“有大脑”

2025云栖大会上,阿里云高级技术专家徐光伟在云栖大会揭秘 Agentic Search 技术,涵盖低维向量模型、多模态检索、NL2SQL及DeepSearch/Research智能体系统。未来,“AI搜索已从‘信息匹配’迈向‘智能决策’,阿里云将持续通过技术创新与产品化能力,为企业构建下一代智能信息获取系统。”

1340 9
来自: 智能搜索推荐  版块
|
12月前
|
机器学习/深度学习 数据采集 人工智能
|

【机器学习算法篇】K-近邻算法

K近邻(KNN)是一种基于“物以类聚”思想的监督学习算法,通过计算样本间距离,选取最近K个邻居投票决定类别。支持多种距离度量,如欧式、曼哈顿、余弦相似度等,适用于分类与回归任务。结合Scikit-learn可高效实现,需合理选择K值并进行数据预处理,常用于鸢尾花分类等经典案例。(238字)

2493 7
|
存储 人工智能 数据可视化
|

企业级 AI 模型无代码落地指南:基于阿里云工具链,从 0 到 1 实现业务价值

某汽车零部件厂商通过阿里云PAI、OSS等工具,实现无代码AI质检落地:仅用控制台操作完成数据治理到部署,质检效率提升3倍,模型周期从2月缩至2周。本文详解全栈可视化方案,助力企业零代码落地AI。

1406 1
|
人工智能 开发框架 自然语言处理
|

企业级AI搜索解决方案:阿里云AI搜索开放平台

本文介绍了 阿里云 AI 搜索开放平台作提供丰富的 AI 搜索组件化服务,兼容主流开发框架 LangChain和 LlamaIndex,支持搜索专属大模型、百炼等大模型服务,以及 Elasticsearch、Havenask 等开源引擎。用户可灵活调用多模态数据解析、大语言模型、效果测评等数十个服务,实现智能搜索、检索增强生成(RAG)、多模态搜索等场景的搭建。

1492 0
来自: 智能搜索推荐  版块
|
人工智能 自然语言处理 算法
|

大模型备案需要通过算法备案才能进行吗?

本内容详细介绍了算法备案与大模型备案的流程、审核重点及两者关系。算法备案覆盖生成合成类等5类算法,需提交安全自评估报告,审核周期约2个月;大模型备案针对境内公众服务的大模型,涉及多维度审查,周期3-6个月。两者存在前置条件关系,完成算法备案是大模型备案的基础。阿里云提供全流程工具支持,包括合规预评估、材料校验和进度追踪,助力企业高效备案。此外,文档解答了常见问题,如算法迭代是否需重新备案,并解析政策红利与技术支持,帮助企业降低合规成本、享受补贴奖励。适用于需了解备案流程和技术支持的企业和个人开发者。

2582 4
|
人工智能 网络安全 开发工具
|

vscode代码推送到github库菜鸡专用教程

vscode代码推送到github库菜鸡专用教程

4167 3
|
编解码 网络协议
|

如何轻松地 rip 3D Blu-ray:详细步骤指南

随着3D电影和家庭影院的普及,越来越多的人希望将3D Blu-ray电影转换为数字文件,以便在多种设备上播放。本文介绍了使用DVDFab、MakeMKV+HandBrake和Leawo Blu-ray Ripper等软件轻松rip 3D Blu-ray的方法,帮助用户享受高质量的3D观影体验。这些工具不仅提供了便捷性和高质量的输出,还能节省存储空间。

1633 9
|
开发框架 自然语言处理 API
|

基于RAG搭建企业级知识库在线问答

本文介绍如何使用搜索开发工作台快速搭建基于RAG开发链路的知识库问答应用。

9866 17
来自: 智能搜索推荐  版块
|
资源调度 PyTorch 调度
|

多任务高斯过程数学原理和Pytorch实现示例

本文探讨了如何使用高斯过程扩展到多任务场景,强调了多任务高斯过程(MTGP)在处理相关输出时的优势。通过独立多任务GP、内在模型(ICM)和线性模型(LMC)的核心区域化方法,MTGP能够捕捉任务间的依赖关系,提高泛化能力。ICM和LMC通过引入核心区域化矩阵来学习任务间的共享结构。在PyTorch中,使用GPyTorch库展示了如何实现ICM模型,包括噪声建模和训练过程。实验比较了MTGP与独立GP,显示了MTGP在预测性能上的提升。

737 7
|
SQL 存储 OLAP
|

实时数仓Hologres OLAP场景核心能力介绍

Hologres提供统一、实时、弹性、易用的一站式实时数仓引擎,解决复杂OLAP难题。

3810 8
来自: 实时数仓 Hologres  版块
|
存储 SQL 分布式计算
|

【史上最全】Hadoop精选18道面试题(附回答思路)

【史上最全】Hadoop精选18道面试题(附回答思路)

2451 1
|
存储 人工智能 Cloud Native
|

云原生大数据架构实践与思考-DataFunTalk

导读: 作者:振策-阿里云计算平台-产品解决方案, 20230805 本文将分享当前云原生大数据架构的发展历程/架构定义/核心能力/应用场景及趋势思考。主要包括以下四个部分: - 从大数据上云看架构 - 云原生数据平台的核心能力 - Data+AI with Cloud-Native - 未来趋势与思考

4446 0
|
Web App开发 JavaScript 前端开发
|

(ElasticsSearch学习)歌词检索Demo的实现:二. 搭建spring boot+spring data+jest+elasticsearch环境,实现歌词的全文检索

一个ElasticSearchDemo,讲解如何使用Jsoup爬取歌词数据写入阿里云Elasticsearch,并搭建Web框架实现歌词的全文检索。 本文主要讲解如何使用Spring Boot快速搭建Web框架,结合Spring Data 和 Jest 快速实现对阿里云ElasticSearch的全文检索功能。

10633 1
|
2小时前
|
人工智能 搜索推荐 数据库
|

把 AI 监测指标组装成一份能发给老板的 PDF报告:数据报告生成的示意逻辑

AI正重塑企业选型方式:从搜“XX系统哪个好”变为直接问大模型“XX场景用什么工具”。2026年SaaS增长持续,但新挑战浮现——你的产品在AI推荐短名单里吗?本文详解如何将零散监测数据,通过指标层→章节层→文档层三步组装,自动生成可交付、带AI分析的PDF报告,让AI可见性“可汇报、可追踪”。

24 0
|
12小时前
|
人工智能 运维 调度
|

Parquet、Lance、Vortex 争的,其实是一张行号到字节的映射表。

Apache Iceberg v3规范正式引入Deletion Vector(删除向量),以位图方式实现高效行级删除,终结v2时代copy-on-write、position/equality delete三轨并存的复杂局面;v4将禁用equality delete,推动全栈收敛至更优默认路径。(239字)

24 1
|
14天前
|
人工智能 安全 SEO
|

为什么 AI 会被伪权威误导——PoisonedRAG 与知识库污染防御

本文剖析AI被伪权威误导的根源:非能力不足,而是默认省略审计级穿透核验以控成本。揭示PoisonedRAG投毒本质是优化攻击,并提出多层防御框架——源头校验、可信分级、多源交叉验证与内容治理,为白帽GEO与知识库安全提供实操路径。(239字)

97 0
|
19天前
|
人工智能 运维 开发者
|

AI搜索引用机制解析:中小企业内容供给到留存的全链路实现

本文面向中小企业开发者,解析AI搜索引用机制,指出内容结构化(问题明确、出处可验、边界清晰)是提升引用率的关键。提出“供给—承接—确认—维护”全链路闭环方案,助企业降低线索成本、提升复购率。

117 1
来自: 智能搜索推荐  版块
|
21天前
|
数据采集 人工智能 搜索推荐
|

AI搜索引用机制解析:内容结构与平台分布对收录的影响

本文解析AI搜索优化新机制:聚焦豆包、元宝等生成式AI引擎如何组织答案与引用来源,揭示引用分布差异、信息块拆解方法及验证路径,助力开发者提升技术内容被AI引用的概率与实效性。

138 0
来自: 智能搜索推荐  版块
|
22天前
|
人工智能 中间件 API
|

LangChain+Llama.cpp 本地模型与Agent工具调用

本文介绍如何用LangChain对接本地llama.cpp服务:通过`llama-server`启动Qwen量化模型,配置OpenAI兼容接口;安装LangChain生态包;实现基础对话与自定义工具Agent(如查天气、时间),全程离线运行,零依赖云端API,适合私有化AI原型开发。(239字)

174 3

大数据与机器学习

大数据领域前沿技术分享与交流,这里不止有技术干货、学习心得、企业实践、社区活动,还有未来。

1
今日
70461
内容
128
活动
440254
关注
你好!
登录掌握更多精彩内容

相关产品

  • 大数据开发治理平台 DataWorks
  • 检索分析服务 Elasticsearch版
  • 日志服务