|
人工智能 算法 云栖大会
|
置顶

开启云上 AIGC 动手实践,探索技术创意

面向 GenAI 时代,阿里云人工智能平台 PAI 平台自带海量开箱即用、实时更新的大模型最佳实践,提供高性能、高稳定的大模型工程化能力。本电子书精选 2024 云栖大会动手实践教程,覆盖大语言模型应用、多模态大模型微调训练、低代码 AIGC 创意设计等热门领域,为您带来 AIGC 开发全新体验。

1197
来自: 人工智能平台PAI  版块
|
1小时前
|
数据采集 人工智能 JavaScript
|

"问豆包"哪家好"总搜不到你的官网?企业官网AI搜索可见性(GEO)的排查与改造实战

官网在百度能搜到,问AI却总不带出你?根因是页面缺GEO三层:OG标签(AI识别层)、Schema结构化数据(理解层)、llms.txt(推理层)。本文记录一次企业官网GEO改造:llms.txt从404到生效、JSON-LD从0到3类27项、AI爬虫访问从0到53次、第18天Kimi与豆包带出公司名,附robots放行AI爬虫与四步自测。

15 0
|
2小时前
|
数据采集 JSON 监控
|

一文读懂淘宝店铺在售商品接口:整店商品批量拉取用于竞品研究

本文详解淘宝开放平台taobao.items.search.shop接口,涵盖授权、调用、分页、数据解析及Python实战,助开发者稳定获取竞品店铺全量在售商品,构建低维护、高合规的竞品监控体系。(238字)

16 0
|
4小时前
|
人工智能 语音技术 异构计算
|

Windows 中文语音输入怎么选:六款工具横评

把 Saymore、Typeless、微信输入法、OpenWispr、Handy、Windows 语音访问六款工具,放在免费开源、离线程度、中文识别、文本整理四个维度下逐项对比。Saymore 免费开源、离线程度高,识别、整理、热词均在本机运行,支持轻度、深度、邮件等整理方式;Typeless 闭源,音频云端处理,AI 润色与结构化较强;微信输入法闭源,语音通常联网,中文聊天输入顺手,文本整理偏轻量;OpenWispr 开源,基于 Whisper 类模型本地运行,需自行配置,中文转写后常需调整。文章最后按断网、隐私、中文口述、文本整理等场景给出选型建议。

19 0
|
19小时前
|
存储 缓存 分布式计算
|

Parquet、Lance、Vortex 争的,其实是一张行号到字节的映射表。

本文剖析Parquet、Lance与Vortex三种列存格式在随机访问(如按行号点查、随机采样)上的根本差异:Parquet为顺序扫描优化,页不可分导致“取一行读一整页”;Lance取消行组,引入细粒度迷你块索引,实现字节级定位;Vortex采用可配置布局树与多级裁剪,平衡灵活性与性能。三者之争,实为“行号→字节位置”映射精度与加载成本的博弈。(239字)

30 1
|
22小时前
|
数据采集 存储 JSON
|

淘宝商品列表 API 构建跨境电商选品系统

本系统基于淘宝开放API,实现跨境选品自动化:支持关键词批量检索、销量/价格智能过滤、毛利与物流评分计算,并通过限流控制、数据清洗与定时更新,稳定获取结构化货源数据,显著降低爬虫维护成本,提升选品效率与准确性。(238字)

28 0
|
22小时前
|
传感器 数据可视化 物联网
|

化工厂危化品AR巡检系统的架构设计与技术实现路径

化工厂危化品AR巡检解决方案的核心在于构建一套基于增强现实终端、物联网数据融合与云端协同的闭环管理系统。该方案通过AR眼镜实现现场作业的可视化引导、实时数据采集与远程专家协作,结合3D数字孪生模型与后端业务系统(ERP/MES),解决传统巡检中信息孤岛、操作不规范及响应滞后问题。其技术本质是将物理世界的设备状态、人员行为与数字世界的工单流、知识库及三维模型进行毫秒级同步,从而实现从“被动记录”向“主动辅助”的作业模式转变。 AR巡检系统的整体技术架构设计 一套成熟的工业AR巡检系统通常采用“端 边 云”三层架构,确保低延迟交互与高可靠性数据处理。 终端层 是交互入口,主要载体为工业级AR智能眼

29 0
|
1天前
|
人工智能 自然语言处理 搜索推荐
|

智能客服系统不是万能药,企业如何把它用好才是真本事

智能客服上线≠用好!60%项目一年内未达预期。本文以阿里云瓴羊Quick Service为例,拆解“场景聚焦、知识库建设、人机协同、数据驱动、持续进化”五大关键,破解“答得对但办不成”困局,助力企业从工具落地走向服务升级。

27 0
|
1天前
|
人工智能 自然语言处理 运维
|

数字化转型指南:企业如何选择合适的智能客服系统?

智能客服选型正从“能答问”转向“能办事”。瓴羊Quick Service融合大模型与AI Agent,支持语义理解、任务闭环执行(查物流、改地址等)、全渠道统一接入及灵活部署,已服务5万+企业。选型需聚焦场景匹配、任务完成率与知识库运营,而非仅看问答准确率。

35 0
|
1天前
|
算法 JavaScript 前端开发
|

自动化生成 LED显示屏的钢结构CAD施工图和尺寸图

针对LED显示屏项目中CAD绘图效率低、易出错的痛点,本方案基于DXF协议解析与矩阵算法,实现Web端参数化自动出图:输入箱体尺寸与行列数,一键生成含钢结构、标注的施工图,大幅提升设计精度与交付效率。(239字)

24 0
来自: 实时计算 Flink  版块
|
1天前
|
机器学习/深度学习 数据采集 人工智能
|

人工智能、机器学习、深度学习的区别(全网最详细)

本文通俗解析人工智能(AI)、机器学习(ML)与深度学习(DL)的区别与联系:AI是宏观目标,ML是实现AI的核心方法,DL则是ML中以多层神经网络为特征的前沿分支。三者呈逐级包含关系,层层递进。

35 0
|
1天前
|
Python
|

Python 装饰器到底是个啥?从 @ 符号到手写一个,5 个例子讲透

装饰器(decorator)本质是一个「接收函数、返回函数」的高阶函数,@log 写在 def foo() 上等价于 foo = log(foo)。本文从最朴素的包装工厂讲起,用 5 个例子把 @ 语法、functools.wraps、带参数装饰器、类装饰器一次讲透。

32 0
|
1天前
|
数据采集 人工智能 自然语言处理
|

手把手教你:传统企业如何建设数据系统实现数字化转型

过去五年,传统企业虽建好数据中台,却难见业务价值——70%以上企业卡在数据整合与实时分析,主因是数据能力与业务脱节。本文以阿里云瓴羊Dataphin为实践范本,系统拆解“顶层规划→全域集成→统一标准→AI治理”四步建设路径,助力企业打通数据孤岛、统一指标口径、降低用数门槛,真正让数据驱动决策。

28 0
|
1天前
|
人工智能 数据可视化 BI
|

企业如何应用BI系统:从数据孤岛到智能决策的完整路径

数据孤岛致决策滞后,91%企业受困于此。阿里云瓴羊Quick BI以AI-native架构破局:50+数据源直连、统一指标口径、对话式智能分析(小Q问数/解读/搭建)、MCP连接驱动行动闭环。已服务5万家企业,助雅戈尔等实现从“看数”到“决策”的跃迁。

33 0
|
1天前
|
人工智能 供应链 API
|

按行业设计 AI 采购问题库:以出口制造为例

GEO调研常陷“通用题库”误区:同一问题(如MOQ)在宠物营养品、化妆品、API等行业,答案逻辑与证据体系截然不同。本文提出四层行业题库架构——按行业特有事实、买家角色、通用方法、复测验收分层,并强调角色标签、不可复用标记与持续验证机制,助力精准评估AI对B2B采购场景的理解力。

31 0
来自: 智能搜索推荐  版块
|
1天前
|
人工智能 搜索推荐 数据库
|

把 AI 监测指标组装成一份能发给老板的 PDF报告:数据报告生成的示意逻辑

AI正重塑企业选型方式:从搜“XX系统哪个好”变为直接问大模型“XX场景用什么工具”。2026年SaaS增长持续,但新挑战浮现——你的产品在AI推荐短名单里吗?本文详解如何将零散监测数据,通过指标层→章节层→文档层三步组装,自动生成可交付、带AI分析的PDF报告,让AI可见性“可汇报、可追踪”。

39 1
|
1天前
|
人工智能 运维 调度
|

Parquet、Lance、Vortex 争的,其实是一张行号到字节的映射表。

Apache Iceberg v3规范正式引入Deletion Vector(删除向量),以位图方式实现高效行级删除,终结v2时代copy-on-write、position/equality delete三轨并存的复杂局面;v4将禁用equality delete,推动全栈收敛至更优默认路径。(239字)

35 1
|
1天前
|
安全 Python 容器
|

Python 深拷贝和浅拷贝到底差在哪?6 个让你半夜 debug 的案例 + 对照表

浅拷贝只复制第一层,嵌套的可变对象(list/dict/set)仍共享同一块内存;深拷贝递归复制所有层,新旧对象彻底解耦。6 个半夜 debug 的真实案例 + 对照表,把 copy.copy / copy.deepcopy 的坑一次讲清。

34 1
|
1天前
|
存储 缓存 弹性计算
|

阿里云CDN流量包,代理商渠道采购折扣大概多少?

阿里云CDN流量包是企业控制网站、图片、下载和视频分发成本的常见方式。由于资源包通常采用预付费,不少企业在采购时会询问:“通过代理商渠道购买,大概能有多少折扣?”

29 0
|
2天前
|
安全 API 数据库
|

给 Agent 选模型:先别问哪个聪明,问哪个你敢用

很多人在给 Agent 选模型时只看跑分和榜单,但对生产环境来说,更关键的问题是"哪个模型你敢用"。本文从工具调用正确率、拒答能力、长任务稳定性三个指标出发,讲怎么建自己的评估集、分阶段选型,以及选模型时容易忽略的 API 通道稳定性问题。

34 0
|
2天前
|
JSON API 数据库
|

淘宝图片搜索API落地实战:基于以图搜货搭建跨境电商选品系统

本文介绍一套基于淘宝拍立淘图片搜索API的自动化跨境选品系统,摒弃传统关键词检索,直接用海外竞品主图反向查找国内同款货源。涵盖图片预处理、API调用、相似度过滤、毛利自动核算等全流程,显著提升选品准确率与效率。(239字)

34 0
|
2天前
|
人工智能 自然语言处理 API
|

EmbeddingGemma 2:740M 多模态嵌入怎么跑离线 RAG

EmbeddingGemma 2 是 Google DeepMind 发布的 740M 开放权重嵌入模型。本文拆解它的模块化编码器:文本与代码 270M、视觉 +170M、音频 +300M,四档参数落在同一个 768 维向量空间,扩模态不必重建向量库;并说明 MRL 截断到 512/256/128 维时的质量取舍(256 维时图像、视频、语音约保留 95%)、截断后需重新做 L2 归一化,以及把检索链路整体塞进手机、笔记本或浏览器、不经过网络请求相比云端嵌入 API 的取舍。

69 0
|
2天前
|
消息中间件 存储 缓存
|

集中器离线后的电费怎么算准:阿里云AMQP服务端订阅与断点续传

本文详解集中器离线后电费精准计量方案:基于阿里云AMQP服务端订阅实现断点续传。通过设备本地缓存+平台消息队列持久化,解决网络中断导致的数据缺失问题;强调位点与业务同事务落库、消息ID去重、72小时补招窗口等关键实践,保障日冻结完整率、去重率及表底一致性,让离线不再是抄表盲区。(239字)

39 0
|
2天前
|
缓存 Python 容器
|

Python 里 `is` 和 `==` 到底差在哪?5 个让你怀疑人生的案例 + 对照表

is 比的是对象身份(id 相同),== 比的是值(__eq__ 结果)。本文用 5 个真实案例讲透二者区别,附对照表与最佳实践,并避坑小整数池 / 字符串驻留陷阱。

46 1
|
3天前
|
人工智能 运维 安全
|

阿里云开发者社区GEO建设白皮书:基于睿擎GEO双五模型V3.0的技术社区"AI信任基建"落地框架

本文介绍睿擎GEO双五模型V3.0,面向AI时代技术社区升级需求,提出“先治理、后建设、再验证、长迭代”路径。模型含五层架构(L1–L5)与五级成熟度(M1–M5),融合四项国标/国际标准,强化双时序逻辑、双判定规则及四大项目红线,助力技术平台构建可量化、可落地的“AI信任基建”。

54 0
来自: 智能搜索推荐  版块
|
4天前
|
缓存 Python
|

Python 装饰器把函数"搞丢"了?5 个必踩的坑与完整避坑对照表

装饰器的坑不是"不会写",而是写完原函数被悄悄换掉——名字、文档、签名、身份都可能变。functools.wraps 救得回大部分,救不了全部。5 个坑逐个给复现代码和修法,附完整对照表。

41 0
|
5天前
|
测试技术 数据库 Python
|

pytest 写了用例却不跑、fixture 不生效、参数化全失效?9 个高频坑对照表

pytest 里 90% 的用例不执行、fixture 报错、参数化失效,都不是框架 bug,而是命名约定和作用域没踩准。9 组「症状→原因→修法」对照表一次讲清。

64 0
|
5天前
|
人工智能 运维 安全
|

自研知识库还是买GEO服务?中小企业架构选型怎么选

本文为中小企业提供品牌AI收录决策框架,聚焦“资产主权归属”核心问题:自研路径确保100%资产自主,引用率78%;采购服务存在资产流失风险,回收成本高5万元;混合架构兼顾主权与专业度,6个月引用率升至70%,成本降60%。(239字)

69 1
|
5天前
|
Linux iOS开发 Python
|

Python 虚拟环境到底怎么选?venv / conda / pipenv / poetry 一张对比表 + 9 个真实踩坑

venv、conda、pipenv、poetry 到底怎么选?本文用一张对比表 + 9 个真实踩坑讲清楚:什么时候 venv 就够了、什么时候必须上 poetry、conda 真正解决的是什么问题,以及虚拟环境里最常见的路径与依赖冲突该怎么排查。

84 0
|
6天前
|
缓存 人工智能 运维
|

接大模型 API 之前,这 5 个坑先看完

本文总结接入大模型 API 最常见的 5 个坑:密钥安全、限流策略、上下文管理、缓存计价和循环任务失控,每一条都有具体解法,帮助开发者在接入和运维阶段少踩坑、控成本。

96 1
来自: 人工智能平台PAI  版块
|
6天前
|
JSON 网络协议 前端开发
|

0.8MB 跑通 Qwen|第 20-3 篇:SSE 流式——推理引擎响应怎么写一半就发给客户端

本系列《0.8MB跑通Qwen》用纯C手搓零依赖推理引擎,适配Qwen3-VL多尺寸模型,在RK3588(aarch64)实测SSE流式响应:首token延迟130ms,后续约50ms/token,支持标准+自定义事件,真正实现端侧“打字机”体验。(239字)

69 0
|
6天前
|
JSON 自然语言处理 算法
|

0.8MB 跑通 Qwen|第 18-1 篇:BPE 入门与 tokenizer.json——为什么推理引擎不直接跑 BPE

本系列《0.8MB跑通Qwen》聚焦ARM端零依赖纯C推理引擎,适配Qwen3-VL多尺寸模型,在RK3588上实测通过。本文详解分词器工程近似方案:以“字节流最长前缀+空格标记”替代官方BPE merge,三方对拍15条语料达成9/15一致,并精准归因差异为“贪心vs排序”与“空格丢失”两类机制,践行技术诚实。(239字)

75 0
|
6天前
|
编解码 算法 C++
|

0.8MB 跑通 Qwen|第 17-3 篇:位级一致性实验——推理引擎两条转换路产物逐字节对拍

本系列《0.8MB跑通Qwen》聚焦ARM端零依赖纯C推理引擎实现,实测RK3588上位级一致性验证:同源重跑确定性、无损源跨格式殊途同归、有损源再量化边界清晰可测。覆盖Qwen3-VL多模型,强调sha256/逐张量哈希/块级比对三位一体验证。(239字)

57 0
|
6天前
|
算法 定位技术 C语言
|

0.8MB 跑通 Qwen|第 16-3 篇:推理引擎的 tensor 目录与布局重排的落盘顺序

《0.8MB跑通Qwen》系列实录:30天手搓零依赖纯C推理引擎,适配Qwen3-VL多模态模型(2B/8B/30B-A3B),真机跑通RK3588(aarch64)。详解VQFTensor目录结构、64字节对齐落盘、FNV校验及mmap加载机制,含零依赖Python解析器。

66 0
|
6天前
|
存储 缓存 编解码
|

0.8MB 跑通 Qwen|第 19-2 篇:推理引擎的 vision_tokens 客户端预编码协议

本系列《0.8MB跑通Qwen》专注手搓零依赖纯C推理引擎,适配Qwen3-VL多模态大模型,在RK3588(aarch64)实测通过。本文详解`encode_media_item`三路协议:`image_url`(板端ViT+128位缓存)、`video_frames`(帧序列)与`vision_tokens`(客户端预编码跳过ViT),支持字节数自校验与缓存命中优化,真机实测ViT耗时295ms→缓存后仅301ms。

65 0
|
6天前
|
JSON 移动开发 Java
|

0.8MB 跑通 Qwen|第 20-1 篇:极简 HTTP——推理引擎的 socket/bind/select 轮询

本系列《0.8MB跑通Qwen》聚焦ARM端零依赖纯C推理引擎,适配Qwen3-VL多模态模型,在RK3588芯片实测通过。核心亮点:单文件`vllm_http.c`实现socket监听、select轮询、有界线程池与SSE流式响应,不依赖任何第三方库,专为板端轻量服务而生。(239字)

55 0
|
6天前
|
编解码 应用服务中间件 API
|

# 0.8MB 跑通 Qwen|第 19-3 篇:视频帧与媒体模块——推理引擎默认不启用的 H.264 独立模块

本系列《0.8MB跑通Qwen》聚焦ARM端零依赖纯C推理引擎,适配Qwen3-VL多模态模型(2B/8B/30B),在RK3588上实测。视频支持分两层:帧序列路径已落地;MP4/H.264解码为独立未完成模块,API清晰、默认不构建、不演示未验证功能,体现严谨工程边界。(239字)

62 0
|
6天前
|
C语言 C++
|

0.8MB 跑通 Qwen|第 17-1 篇:safetensors → VQF——推理引擎的 vqf_write 一次成型

本系列《0.8MB跑通Qwen》聚焦ARM端零依赖纯C推理引擎,适配Qwen3-VL多模态模型(2B/8B/30B),在RK3588平台实测通过。核心突破:safetensors→VQF转换与推理共用同一量化路径,实现位级可复现,体积压缩至2.2–4.2GB,真机重转SHA256完全一致。(239字)

62 0
|
6天前
|
编解码 缓存 计算机视觉
|

0.8MB 跑通 Qwen|第 19-1 篇:ViT 编码——推理引擎里图片是怎么变成视觉 token 的

本系列《0.8MB跑通Qwen》用纯C手写零依赖推理引擎,实现在RK3588(aarch64)上部署Qwen3-VL多模态模型。真机实测:64×64图经24层ViT编码得4个视觉token,耗时仅295.3ms,支持图文理解与视频分析。(239字)

77 0
|
6天前
|
JSON 测试技术 API
|

0.8MB 跑通 Qwen|第 20-2 篇:推理引擎的路由与自研最小 JSON

本系列《0.8MB跑通Qwen》用纯C手搓零依赖推理引擎,适配Qwen3-VL多模型,在RK3588(aarch64)实测通过。核心含strcmp路由表与自研轻量JSON解析器,精准拦截非法请求(如`msgs`→400),严守兼容边界,代码精简可控,专注教学与边缘部署。(239字)

51 0
|
6天前
|
JSON 数据格式 Python
|

0.8MB 跑通 Qwen|第 18-2 篇:tokenizer.json → vocab.bin——推理引擎的 build_vocab_bin.py 在干嘛

本系列《0.8MB跑通Qwen》聚焦ARM端零依赖纯C推理引擎,适配Qwen3-VL多模态模型(2B/8B/30B),在RK3588平台实测通过。本文详解词表编译:将7MB tokenizer.json编译为1.95MB可审计vocab.bin,精准处理byte-level解码(如0xAD/0x7F等历史坑),实现板端逐位一致、冷启动仅约2秒。(239字)

63 0
|
6天前
|
存储 容器
|

0.8MB 跑通 Qwen|第 17-2 篇:GGUF → VQF——推理引擎的 Q4_0…Q8_K 反量化再量化

本系列《0.8MB跑通Qwen》聚焦ARM零依赖纯C推理引擎,适配Qwen3-VL多版本模型,在RK3588平台实测。本文详解GGUF→VQF的“反量化再量化”路径:将llama.cpp已量化权重(Q4_0/Q8_0等)先还原为F32,再经统一量化与重排固化为VQF格式,确保内核兼容性与可验证性。(239字)

62 0
|
6天前
|
JSON C语言 数据安全/隐私保护
|

0.8MB 跑通 Qwen|第 16-1 篇:VQF 的野心——推理引擎如何把量化与布局固化到文件

本系列手搓零依赖纯C推理引擎,仅0.8MB即可在RK3588上跑通Qwen3-VL多模态大模型。核心创新VQF格式将量化类型、内核布局与模型属性固化于2.17GB单文件中,实现mmap直挂、零转换加载,真正达成“加载即用”。

70 0
|
6天前
|
缓存 安全 数据安全/隐私保护
|

0.8MB 跑通 Qwen|第 16-2 篇:逐字段解剖——推理引擎权重格式的 VQFHeader / VQFSig / VQFTensor

本篇深度解析Qwen推理引擎VQF v2文件头:432字节固定布局、小端序、64B对齐目录起始(448偏移),通过`_Static_assert`严控结构体尺寸,以`magic/version/size`三重门禁保障零依赖纯C加载安全。真机RK3588实测,揭穿注释与字节不符彩蛋,夯实字节序纪律。(239字)

55 0
|
6天前
|
编解码 Java 测试技术
|

0.8MB 跑通 Qwen|第 18-3 篇:MRoPE——推理引擎的 3D 位置编码给视觉留的席位

本篇详解Qwen3-VL多模态推理中MRoPE三维位置编码机制:通过`mrope_section=[24,20,20]`将64维旋转频率分给时间/高/宽三轴,支持视觉token网格定位;并数值推演“强行降维至1D”的相位偏差——7×7图像下最高达4.71弧度(近270°),40/64维严重失准,导致注意力失效。纯文本因t=h=w自动退化,故该bug无法被文本测试捕获。(239字)

71 0
|
6天前
|
人工智能 JSON API
|

从零打通 MCP 访问创世虚拟世界CRM的 3D 数据,我搭了一个可直接调用的演示站

作者把创世虚拟世界CRM(创世Genesis,自部署 3D 虚拟世界)的 AI Agent 通道(HTTP + WebSocket + JSON 约定)封装成 8 个 MCP 工具(discover/enter/observe/say/walk_to/follow/chat_history/leave),stdio 版已上 npm 与官方 MCP Registry,随后为零安装补了 Streamable HTTP 远端点。本文实录打通过程:stdout 纯净性、initialize 必填字段、Mixed Content 协议陷阱、官方 SDK 拖入 34 包后的零依赖重写、GET 400 被目

60 0
|
6天前
|
NoSQL C语言 C++
|

0.8MB 跑通 Qwen|第 15-1 篇:推理引擎入口架构——参数 → 分发(serve/自检)→ 退出

本系列《0.8MB跑通Qwen》聚焦ARM端零依赖纯C推理引擎,实测适配Qwen3-VL-2B/8B及30B-A3B模型,在RK3588板端完成真机验证。本文详解`main()`入口如何通过命令行参数分发至serve、离线转换或自检三种命运,并用GDB抓取真实调用链,厘清初始化与退出逻辑。(239字)

62 0
|
6天前
|
Java Linux 调度
|

0.8MB 跑通 Qwen|第 4-3 篇:核绑定实验——推理引擎在 ARM 大小核上为什么叮嘱"勿设 8 线程"

本系列《0.8MB跑通Qwen》聚焦ARM端零依赖纯C推理引擎,实测RK3588(4×A76+4×A55)上适配Qwen3-VL-2B/8B及30B-A3B模型。通过三组真机实验揭示“核多≠快”本质:仅绑4大核最优,设8线程反降效12%,验证大小核架构下线程配置需严守硬件特性。(239字)

60 0

大数据与机器学习

大数据领域前沿技术分享与交流,这里不止有技术干货、学习心得、企业实践、社区活动,还有未来。

3
今日
70474
内容
128
活动
440261
关注
你好!
登录掌握更多精彩内容

相关产品

  • 大数据开发治理平台 DataWorks
  • 检索分析服务 Elasticsearch版
  • 日志服务