|
人工智能 分布式计算 BI
|

妙用OSGraph:发掘GitHub知识图谱上的开源故事

OSGraph (Open Source Graph) 是一个开源图谱关系洞察工具,基于GitHub开源数据全域图谱,实现开发者行为、项目社区生态的分析洞察。可以为开发者、项目Owner、开源布道师、社区运营等提供简洁直观的开源数据视图,帮助你和你的项目制作专属的开源名片、寻求契合的开发伙伴、挖掘深度的社区价值。

657 0
|
人工智能 Python Shell
|

CodeFormer——AI驱动的面部图像修复与增强

CodeFormer是由南洋理工大学和商汤科技联合研发的AI人脸复原模型,结合VQGAN和Transformer技术,能从模糊或马赛克图像中生成清晰图像。它具备老照片修复、黑白照片彩色化、马赛克修复和低码率视频增强等功能。安装过程涉及miniconda3、Python环境配置、相关库的安装及模型训练数据下载。在测试视频增强时,虽然初期遇到ffmpeg导入问题,但通过安装ffmpeg-python得以解决,不过CPU占用率高。此外,还展示了对图片进行增强的命令行操作及结果示例。

1865 1
|
网络安全 Python Windows
|

pyspark--完美解决 Could not find a version that satisfies the requirement 安装包名字 (from versions: )

pyspark--完美解决 Could not find a version that satisfies the requirement 安装包名字 (from versions: )

2440 9
|
Ubuntu Linux
|

linux怎么查看自己的ip地址

在Linux系统中,有多种方法可以查看自己的IP地址。

2334 2
来自: 智能搜索推荐  版块
|
机器学习/深度学习 资源调度 数据可视化
|

Mamba详细介绍和RNN、Transformer的架构可视化对比

Transformer体系结构已经成为大型语言模型(llm)成功的主要组成部分。为了进一步改进llm,人们正在研发可能优于Transformer体系结构的新体系结构。其中一种方法是Mamba(一种状态空间模型)。

2087 2
|
SQL 人工智能 自然语言处理
|

【2023云栖】田奇铣:大模型驱动DataWorks数据开发治理平台智能化升级

随着大模型掀起AI技术革新浪潮,大数据也进入了与AI深度结合的创新时期。2023年云栖大会上,阿里云DataWorks产品负责人田奇铣发布了DataWorks Copilot、DataWorks AI增强分析、DataWorks湖仓融合数据管理等众多新产品能力,让DataWorks这款已经发展了14年的大数据开发治理平台产品,从一站式向智能化不断升级演进。

60462 8
|
Python
|

使用ARIMA预测股票未来走势

Python实现使用ARIMA预测股票未来走势

3229 1
|
JavaScript 机器人 vr&ar
|

19 个最佳Three.JS 示例

分享threejs.org 的 19个最佳三个 JS 示例

1724 0
|
API 索引
|

带你读《Elastic Stack 实战手册》之28:——3.4.2.13.Rollover API(3)

带你读《Elastic Stack 实战手册》之28:——3.4.2.13.Rollover API(3)

331 0
|
SQL 存储 Apache
|

Apache Paimon 在同程旅行的探索实践

本文主要介绍 Apache Paimon 在同程旅行的生产落地实践经验。

5720 0
来自: 人工智能平台PAI  版块
|
机器学习/深度学习 资源调度 算法
|

推荐系统[四]:精排-详解排序算法LTR (Learning to Rank)_ poitwise, pairwise, listwise相关评价指标,超详细知识指南。

推荐系统[四]:精排-详解排序算法LTR (Learning to Rank)_ poitwise, pairwise, listwise相关评价指标,超详细知识指南。

2833 0
来自: 人工智能平台PAI  版块
|
SQL 存储 分布式计算
|

MaxCompute上如何处理非结构化数据

0. 前言 MaxCompute作为阿里云大数据平台的核心计算组件,拥有强大的计算能力,能够调度大量的节点做并行计算,同时对分布式计算中的failover,重试等均有一套行之有效的处理管理机制。 而MaxCompute SQL能在简明的语义上实现各种数据处理逻辑,在集团内外更是广为应用,在其上实现

13690 0
来自: 大数据计算 MaxCompute  版块
|
17天前
|
机器学习/深度学习 人工智能 自然语言处理
|

视频理解RAG:从视觉感知到时序多模态检索系统的架构设计

企业视频数据正成为下一代知识库核心。面对监控、会议、培训等海量视频,传统文本RAG难以处理时序、多模态事件(如“设备停机原因”)。视频理解RAG融合视觉、语音、时间信息,构建可检索、可推理的视频知识引擎,助力智能制造、安防、会议分析等场景,释放沉睡的视频资产价值。

117 1
|
17天前
|
数据采集 监控 NoSQL
|

如何设计一套高可用的爬虫任务队列,保证断点续爬与故障转移?

这篇文章提出了一种基于Redis的任务队列解决方案,增强了爬虫任务的稳定性和可靠性。文章分析了Celery的不足,并设计了一个包含任务状态机、断点续爬、故障转移和代理层的架构。通过checkpoint、心跳和租约机制,以及隧道代理模式,有效解决了爬虫任务执行中的稳定性问题。

91 0
|
20天前
|
数据采集 网络协议 API
|

单机万级并发:利用Python asyncio与aiohttp打造极致性能的异步爬虫

文章介绍了使用asyncio和aiohttp实现高并发新闻数据采集的方法。它指出了传统多线程的局限性,并强调了异步编程的优势。文章还讨论了环境配置和关键参数设置,并提供了一个实现示例。

122 0
|
2月前
|
存储 人工智能 运维
|

2026 SelectDB AI 产品发布会:Agent Native 数据基础设施能力全景发布

“只有解决好极速、统一、Agent Native 与 Cloud 弹性四个挑战,才能成为 Agent 时代最好的分析引擎。”

237 0
|
2月前
|
存储 搜索推荐 大数据
|

优路教育借助阿里云Flink+StarRocks+Paimon湖仓一体化构建职业教育业务全链路实时数据服务平台

优路教育大数据团队携手阿里云,基于实时计算 Flink + EMR Serverless StarRocks + DLF(Paimon) 构建了全链路实时数据服务平台,从学员画像、营销筛选到题库关联查询,实现了从“分钟级延迟”到“秒级响应”的质变,为成人教育行业的数据化转型提供了标杆实践。

706 5
|
2月前
|
机器学习/深度学习 编解码 算法
|

PyTorch深度学习实战 |手算​​U-net

本文详细解析了U-Net网络架构及其在医学图像分割中的应用。重点对比了U-Net与FCN的核心区别:U-Net采用特征拼接(Concat)保留所有层级信息,而FCN使用特征相加(Add)进行融合。文章深入剖析了U-Net的编码器-瓶颈-解码器结构,解释了其独特的裁剪拼接机制和Overlap-tile策略,并提供了完整的PyTorch实现代码。现代U-Net通过SamePadding实现了输入输出尺寸一致,显著提升了分割精度。文章还探讨了弹性形变数据增强和带空间权重的损失函数设计,为医学图像分析提供了实用解决

237 2
|
2月前
|
运维 安全 网络协议
|

精选 5 款基于 .NET 开源免费、功能强大的 Windows 系统优化工具

本文精选5款基于.NET开源免费的Windows优化工具:Optimizer(全能系统调优)、SophiApp(Win10/11深度微调)、WinMemoryCleaner(智能内存清理)、ZyperWin++(轻量美观全系适配)和Winhance(一站式环境定制),助你提升性能、保障隐私、简化运维。

328 0
|
2月前
|
消息中间件 Java 测试技术
|

API 接口稳定性保障体系建设指南

本文系统讲解分布式微服务中API接口稳定性保障体系,涵盖限流(令牌桶/漏桶)、熔断(三态模型)、降级(读/写/功能降级)三大核心手段,辅以资源隔离、超时重试、异步解耦等进阶策略,并总结落地常见坑点与解决方案,助力构建高可用API服务。(239字)

240 0
|
2月前
|
人工智能 供应链 监控
|

2026 国内电商 ERP 权威测评:全链路数字化能力与技术实力深度解析

2026年,电商ERP已成生存刚需。通天晓全链路数字化方案(OMS+WMS+TMS+BMS+SCV)以CyberCloud云平台为底座,实现订单→仓储→配送→财务→决策“四流合一”,提升订单效率60%、库存周转35%、降本20万–50万元/年,赋能多渠道、大促、跨境等复杂场景。

322 2
|
2月前
|
数据采集 JSON 程序员
|

为什么说掌握了HTTP协议状态码,就解决了50%的爬虫报错

文章强调了HTTP状态码在爬虫中的重要性,提供了应对常见问题的解决方案。例如,使用代理IP绕过403和429状态码,以及对200状态码的二次校验。理解状态码对提高爬虫效率至关重要。

357 0
|
2月前
|
机器学习/深度学习 算法 自动驾驶
|

图解强化学习 |手算DDPG

DDPG(深度确定性策略梯度)是一种面向连续动作空间的Actor-Critic强化学习算法。它采用4网络结构(Actor/Critic及其对应目标网络),结合经验回放与软更新,通过确定性策略梯度优化策略,广泛应用于机器人控制、自动驾驶等场景。(239字)

321 1
|
3月前
|
机器学习/深度学习 人工智能 芯片
|

从理论突破到全面应用——迈向通用智能的深度观察

本报告由灵砚智能发布,系统梳理AI从深度学习到通用智能的技术演进,剖析大模型、多模态、智能体等突破;评估其在医疗、金融、制造等行业的深度应用;并直面算力、数据、伦理与全球治理挑战,提供前瞻性的社会适应路径。(239字)

427 0

养龙虾不破产,OpenClaw 三种使用技巧,降低 Token 消耗

这是一份OpenClaw降本增效实战指南,聚焦三大核心:①斜杠命令(/compact、/reset、/new)秒级优化对话长度;②多Agent分工实现上下文隔离与故障可控;③memory-search机制以查代记,精准调用长期知识。三法协同,直击Token浪费与响应迟缓痛点。(239字)

572 0
|
3月前
|
人工智能 运维 安全
|

Windows10用户部署OpenClaw的终极指南|路径规范+权限配置+故障排查

专为Windows 10 64位深度优化的OpenClaw(小龙虾)一键部署包:免命令行、免环境配置,解压即装;内置全部依赖与28万Tokens,全程可视化操作;独家解决SmartScreen拦截、权限限制等Win10特有问题,新手也能一次成功“养虾”!

491 9
|
4月前
|
算法 安全 测试技术
|

多智能体协同中的任务拆解与动作映射:关键指标对比与算法设计思路

本文聚焦2026年企业级多智能体落地核心瓶颈——任务拆解不准与语义到动作映射断层,提出“分层级树状拆解+分布式角色调度”算法及五维特征驱动的动作映射技术,构建可评估、可复用、强合规的工程化方案,并通过实测数据验证其在跨系统长链路任务中96.2%执行成功率与92.3%异常自修复率。

529 6
|
4月前
|
人工智能 数据可视化 JavaScript
|

剪视频不用再开 PR 的 AI 工作流

本文对比OpenClaw三种部署方式(本地、全托管、阿里云轻量自托管),重点推荐后者:兼顾7×24在线、数据自主、灵活扩展与开箱即用。结合真实视频剪辑场景,详解字幕生成、批量处理、竖屏裁切等高效AI功能,适合Vlog/知识类博主提效减负。

506 0
|
4月前
|
人工智能 自然语言处理 安全
|

当 AI Agent 进入生产环境:我们为什么需要 ClawVault 这样的"安全 vault"?

ClawVault 是面向AI Agent时代的安全治理基础设施,填补AI从Demo走向生产的关键缺口。它以透明代理网关为核心,提供敏感数据检测、提示词注入防护、原子化权限控制、Token预算管理及自然语言驱动的生成式策略编排,助力企业合规落地(适配欧盟AI Act、NIST RMF等),让AI既强大又可控。

336 1
|
4月前
|
人工智能 架构师 Apache
|

相约深圳,全球征集|Flink Forward Asia 2026 演讲议题征集正式启动

Flink Forward Asia 2026将于6月26–27日首次落地深圳,聚焦实时计算与AI深度融合。面向全球征集议题(截止5月29日),涵盖实时AI、AI Agent、湖流一体等前沿方向。免费报名开启,共探下一代实时计算范式!

867 4
来自: 实时计算 Flink  版块
|
4月前
|
关系型数据库 MySQL Apache
|

Flink CDC 3.6.0:支持 Flink 1.20/2.2, MySQL/PostgreSQL入湖入流支持Schema Evolution

Apache Flink CDC 3.6.0 正式发布!支持 Flink 1.20.x/2.2.x 与 JDK 11,增强端到端 Schema Evolution(MySQL/PostgreSQL 入湖入流),新增 Oracle Source 与 Hudi Sink 连接器,全面覆盖主流数据湖生态,并优化 Transform 框架、YAML 路由及多连接器能力。(239字)

1162 2
来自: 实时计算 Flink  版块
|
6月前
|
数据采集 缓存 NoSQL
|

从踩坑到高效落地:关键词搜索淘宝天猫商品列表API的实操心得

本文分享淘宝/天猫关键词搜索API的实战避坑指南:直击搜不到、翻页断、价格假、限流封号等6大痛点,详解合规调用、精简字段、分页策略、缓存熔断与二次校验等高效落地方案,助选品、比价、代购、数据分析等场景稳定运行。(239字)

578 3
|
6月前
|
机器学习/深度学习 人工智能 JSON
|

大模型太“通用”?一文搞懂模型微调:从原理到实战,让AI听懂你的行话

本文深入浅出地讲解大模型微调的必要性、原理与实践:针对通用LLM在专业性、时效性、幻觉及业务适配上的不足,详解LoRA等参数高效微调技术,并以IT知识助手为例,手把手演示数据准备、模型选择、训练评估到部署的全流程,助力开发者低成本打造专属领域专家模型。(239字)

931 9
|
7月前
|
存储 机器学习/深度学习 人工智能
|

别让大模型“失忆”:手把手教你用向量数据库打造它的专属知识库

本文深入浅出地讲解向量数据库原理与实践:用“语义身份证”比喻Embedding,以图书管理员类比关键词与语义搜索差异;手把手用Python+Faiss+BGE搭建中文语义检索系统,并详解RAG流程、效果评估与调优要点,助你为大模型装配真正懂业务的“外挂大脑”。

771 4
|
7月前
|
存储 人工智能 数据库
|

2026 AI Agent 搭建师职业全景指南:从技术基石到商业闭环

2026年,AI职业迎来范式变革,“AI Agent搭建师”取代提示词工程师,成为集架构设计、系统集成与智能协同于一体的“数字流程总设计师”。他们构建具备感知-思考-行动闭环的智能体,推动企业从“聊天机器人”迈向“行动中心”与“数字员工团队”。通过异构模型路由、多智能体编排、MCP工具协议与GraphRAG记忆系统等核心技术,实现业务流程自动化与决策智能化。该职业融合技术、业务与战略,人才缺口巨大,薪酬领先,被誉为AI时代的“黄金职业”,并持续向AI架构师与伦理治理等方向演进。

2055 1
|
7月前
|
人工智能 搜索推荐 算法
|

不懂向量数据库?一文讲透其原理与应用场景

向量数据库通过将文本、图像等非结构化数据转化为“数学指纹”(向量),实现语义级相似性检索。它突破传统数据库的精确匹配局限,支撑智能客服、推荐系统与RAG应用。核心原理是Embedding编码+高效索引(如HNSW、IVF),支持亿级数据毫秒搜索。结合元数据过滤的混合查询,显著提升准确性。未来将迈向多模态融合与自适应智能检索,是AI时代不可或缺的基础设施。

1005 0
|
7月前
|
存储 安全 API
|

隐私合规红线不能碰:大模型微调3大重灾区防护手册

本文聚焦大模型微调中训练数据、中间产物与部署链路三大隐私泄露重灾区,剖析90%开发者易踩的技术陷阱,从分层脱敏、差分隐私到权限管控,提供全链路可落地的防护方案,并结合性能与安全双重验证,助力企业实现合规与效能双赢。

696 0
|
7月前
|
人工智能 分布式计算 DataWorks
|

阿里云大数据AI产品月刊-2025年12月

大数据& AI 产品技术月刊【2025年 12 月】,涵盖 12 月技术速递、产品和功能发布、市场和客户应用实践等内容,帮助您快速了解阿里云大数据& AI 方面最新动态。

611 2
|
8月前
|
运维 监控 Linux
|

Linux 学习资源精选:从入门到运维的高效清单

本文精选Linux学习资源,按入门、运维、进阶三阶段系统推荐视频、书籍、工具与项目,强调分阶段精准匹配、重实操强总结,助力学习者高效构建知识体系,少走弯路,快速提升实战能力。

913 0
|
8月前
|
XML JSON Java
|

JSONUtil

本文介绍了Java中常用的数据结构与JSON之间的相互转换方法,涵盖一维、二维数组、List、Map、XML等转JSON或Object的操作,使用Hutool、FastJSON和net.sf.json等工具类实现,适用于常见数据处理场景。

378 0
|
8月前
|
消息中间件 存储 人工智能
|

基于 RocketMQ LiteTopic 打造企业级 Session 管理

AI场景下,Session需满足低延迟、时序性、隔离性与上下文压缩四大要求。基于RocketMQ LiteTopic实现,可提供会话持久化、断点恢复、多会话隔离与流量削峰能力,保障会话不丢失、可追溯、高并发稳定,助力构建企业级多智能体系统。(238字)

322 0
|
8月前
|
存储 文字识别 数据可视化
|

实用代码工具:Python打造PDF选区OCR / 截图批量处理工具(支持手动/全自动模式)

一款基于Python的PDF区域OCR与截图工具,支持精准框选、文字识别、图片截取及Excel一键导出。内置手动审核与全自动批量处理模式,结合PyMuPDF、easyocr等技术,实现高效、可视化的PDF数据提取,适用于发票、报表等场景,显著提升办公效率。

1203 11
|
8月前
|
SQL 大数据 数据挖掘
|

十、HQL:排序、联合与 CTE 高级查询

Hive 查询不仅能查,还能查得漂亮、高效。我们这次聚焦 HQL 中的高级技巧——从 ORDER BY 到 SORT BY、DISTRIBUTE BY 与 CLUSTER BY,带你理解排序在分布式环境中的执行逻辑;再深入讲解 UNION 与 CTE 等查询组织方式,帮你将复杂 SQL 拆解得更清晰。我还特意写了丰富示例与实战练习,适合正在提升 Hive 查询能力的你阅读、收藏和练习。

521 6
|
8月前
|
人工智能 运维 监控
|

开源项目分享:Gitee热榜项目 2025年12月第二周 周榜

本文档汇总Gitee本周热门开源项目,涵盖Fay、JeeLowCode等明星项目,结合AI与低代码趋势,深入分析技术融合与场景创新,助力开发者把握前沿动态。

792 2
|
8月前
|
C++
|

报错解决:Selenium报错“Message: session not created: probably user data directory is already in use” 等

本文详解Selenium操作Edge浏览器时常见的“版本不匹配”和“进程冲突”问题,分析报错根源,并提供手动替换驱动与webdriver-manager自动管理两种解决方案,助你高效稳定实现浏览器自动化。

1081 6
|
8月前
|
存储 传感器 人工智能
|

AI 十大论文精讲(八):知识蒸馏如何让大模型 “瘦身不减能”

本篇解读DistilBERT,一篇解决大模型落地难题的里程碑论文。面对BERT等大模型参数多、耗能高、部署难的问题,DistilBERT提出预训练阶段知识蒸馏,结合三重损失与轻量化设计,在保留97%性能的同时,模型缩小40%,推理提速60%,推动NLP迈向高效、绿色、边缘化应用。

1102 8
|
9月前
|
人工智能 安全 算法
|

当AI开始一本正经“胡说八道”,我们该怎么办?——聊聊大模型安全与反“幻觉”技术

当AI开始一本正经“胡说八道”,我们该怎么办?——聊聊大模型安全与反“幻觉”技术

932 7
|
10月前
|
机器学习/深度学习 数据采集 人工智能
|

从ChatGPT到文心一言:AI为什么能“懂人话”?——大语言模型的底层逻辑揭秘

从ChatGPT到文心一言:AI为什么能“懂人话”?——大语言模型的底层逻辑揭秘

1186 9
|
10月前
|
JSON 监控 API
|

小红书笔记评论API:一键获取分层评论与用户互动数据

小红书笔记评论API可获取指定笔记的评论详情,包括内容、点赞数、评论者信息等,支持分页与身份认证,返回JSON格式数据,适用于舆情监控、用户行为分析等场景。

1411 1
|
10月前
|
JSON 供应链 监控
|

批量获取1688商品数据,精准筛选与分页查询

1688商品列表API(alibaba.product.list.get)支持按关键词、类目、价格等条件批量获取商品信息,适用于B2B场景下的商品管理与竞品分析。返回JSON格式数据,含商品ID、标题、价格、库存等核心字段,支持分页查询、动态筛选与排序,实时性强,字段可定制。

528 0

大数据与机器学习

大数据领域前沿技术分享与交流,这里不止有技术干货、学习心得、企业实践、社区活动,还有未来。

0
今日
70014
内容
128
活动
440136
关注
你好!
登录掌握更多精彩内容

相关产品

  • 大数据开发治理平台 DataWorks
  • 检索分析服务 Elasticsearch版
  • 日志服务