在阿里云上用最小成本做 GEO:复用现有云资源的可行路径
中小企业做GEO(生成式引擎优化),只需复用现有云资源,以低于5%的边际成本,将官网与文档库改造为结构化内容资产,使其可被豆包、通义千问等6大AI平台检索引用。核心是构建E-E-A-T友好的语义实体网络,14天即可上线,首季引用率提升3倍。(239字)
EMR Serverless Daft 算子市场免费公测|10分钟极速实战(附视频教程)
Daft 算子市场公测来了!开箱即用的 AI 算子,覆盖 视频 / 图片 / 文本 / 音频 四大场景,搭配 Qwen3.7 大模型,零成本跑通 AI 数据处理全流程。 以训练一个能理解厨房操作的智能机器人为例,我们通常需要采集数千小时由人类佩戴摄像头拍摄的操作视频。然而,当这些视频被解码后,往往会膨胀为数亿张图像帧。更棘手的是,原始数据中充斥着静止画面、模糊镜头和无效空帧等海量“噪音”。如何从这些冗余信息中高效提取出高质量训练样本,已成为多模态技术发展的核心瓶颈。 本次实战将带您深入这一典型场景,借助 Daft 算子市场,一步步拆解并跑通从视频抽帧、数据清洗到高质量样本提取的完整链路。
新手入门:DGL在昇腾上的安装问题
本文介绍了在aarch64架构和Python 3.10环境下安装DGL(Deep Graph Library)的过程。首先通过`uname -a`确认硬件架构,接着使用`python --version`检查Python版本。为确保兼容性,从指定链接下载适合的whl包或通过pip安装dgl。过程中遇到了torchdata版本不兼容的问题,通过降级torchdata至0.7.1版本解决。此外,针对NPU芯片适配,重新安装了与CANN 8.0.RC2兼容的torch和torch_npu组件。最终成功导入dgl包并准备进行模型训练验证。
被AI引用不等于被吸收:GEO跨平台度量框架解读
该文解读arXiv最新研究,提出GEO“引用选择→引用吸收”两阶段度量框架,揭示被AI列出不等于被真正采用;实证发现ChatGPT重深度、Perplexity/Gemini重广度,推动KPI从“提及率”转向可量化的“引用吸收度”。(239字)
基于python的地铁客流量预测系统
本研究基于FastAPI框架构建地铁客流量预测系统,融合AFC、天气等多源数据,优化机器学习模型与后端适配,提升实时性与准确性,助力运力调度与精细化运营。
AI搜索引用机制解析:内容结构与平台分布对收录的影响
本文解析AI搜索优化新机制:聚焦豆包、元宝等生成式AI引擎的引用逻辑,从引用分布实测、内容结构拆解、平台匹配策略三方面,揭示如何让技术输出成为AI答案的可靠信源,助力开发者、顾问与创作者构建可持续的内容分发通道。
图解强化学习 |手算近端策略优化算法(PPO)
PPO(近端策略优化)是当前最主流的强化学习算法,以训练稳定、上手简单、泛化性强著称。它通过Actor-Critic双网络架构,结合PPO-Clip损失函数限制策略更新幅度,并利用GAE优势估计提升样本效率,广泛应用于游戏AI、机器人控制、大模型对齐等领域。
OpenClaw 接入百炼模型:密钥创建+配置+报错排查全攻略
本教程详解OpenClaw客户端接入阿里云百炼的完整流程:从账号准备、API Key创建与保存,到客户端密钥配置、模型选择及连通测试,图文并茂,步骤清晰。涵盖自检清单与高频问题排查,助你快速稳定调用Qwen等百炼大模型。(239字)
产品经理-B 端与C端
B端与C端是IT互联网产品经理的类型划分,分别面向企业和个人消费者。C端产品如微信、淘宝,注重用户体验和快速迭代;B端产品如CRM系统、ERP软件,强调功能复杂性和定制化服务。此外,还有G端产品,主要服务于政府机构,注重数据安全和合规性。产品经理起源于20世纪20年代末的美国宝洁公司,随着互联网的发展,该角色在IT领域变得愈加重要。
回顾 | Apache Flink Meetup · 线上(附 PPT 下载)
8.7 线上 Meetup 视频和 PPT 分享来啦~另外,下一期实时数仓 Meetup 议题征集中!
从RAG检索链路看GEO:企业如何构建一套可被大模型理解的可信信息体系
本文剖析GEO(生成式引擎优化)本质,指出其并非简单“批量发稿”,而是面向大模型的信息工程:需构建结构化企业知识库、打造机器可理解的官网、分层建设可信信源,并建立覆盖发现—理解—引用—推荐—稳定—业务结果的六维监测闭环。
3组实测数据拆解DeepSeek引用机制:从平台推荐到证据链构建
本文基于2026年初实测与普林斯顿AI搜索研究,揭示DeepSeek引用机制:内容需先被知乎、CSDN等平台推荐,再进入其语料库。实证表明,含引用来源、统计数据、直接引语的内容被引用率分别提升34.4%、32.1%、29.7%。文章提供平台适配、证据块拆解、深水区监测等可复现路径。
抖音视频详情API秘籍!轻松获取视频详情数据
抖音视频详情API是抖音开放平台的核心接口,通过视频ID可获取包括标题、播放量、点赞数、评论等50多个字段,适用于内容分析、竞品监控和广告评估等场景。接口支持HTTP GET请求,返回JSON格式数据,便于解析处理。文中还提供了使用Python调用该接口的示例代码,包含请求发送、认证、响应处理等功能,帮助开发者快速获取视频数据。
如何将Kindle电子书下载到电脑:技术流程与操作解析
随着数字阅读兴起,Kindle成为主流电子书平台。然而,Amazon的封闭生态和DRM限制,使用户难以灵活管理书籍。本文从技术角度出发,讲解如何合法下载Kindle电子书至电脑,包括使用Kindle for PC、USB导出及进阶方案(如Android模拟器、WINE环境)。同时介绍文件格式处理、自动化备份与阅读体验优化方法,并强调版权合规的重要性,助您构建个人数字图书馆。
淘宝天猫商品评论API接口解析(附 JSON 样例)
本文详解淘宝开放平台taobao.item.reviews.get接口,合规获取商品近180天公开评价数据(含评分、文本、晒图、SKU、追评及商家回复),涵盖鉴权、签名、参数、JSON示例、字段释义与生产避坑指南。(239字)
大模型API中转站避坑:满血验证、倍率换算与降智识别(附压测代码)
从工程师视角系统梳理大模型API中转站的评估方法:讲清兑换比例与倍率的真实换算关系,给出满血模型验证三招(复杂推理压测、模型指认、长上下文压力测试)与可运行的Python压测脚本,并总结稳定性、协议兼容、计费透明等接入要点和先测后充的避坑建议。
10个行业AI搜索获客实战:从本地餐饮到工业制造的GEO策略
AI搜索正取代传统SEO,用户从“点击链接”转向“直接要答案”。本文基于餐饮、装修、法律等10大行业实战,揭示GEO(生成式引擎优化)本质:不求被搜到,而要成为AI主动推荐的“唯一答案”。通过认知重塑、策略原点、行业剖解与系统飞轮四步,助企业预制结构化“答案单元”,抢占AI时代获客先机。
PNG、JPG、WebP 有什么区别?浏览器端图片格式转换原理与实践
本文介绍一款纯浏览器端的在线图片格式转换工具(支持PNG/JPG/WebP/AVIF),详解各格式差异与适用场景,并分享如何利用Canvas、File API和toBlob()实现零上传、保隐私、高效率的本地转换方案。
2026年GEO(生成引擎优化)技术指南:从原理到实战
2026年,AI搜索成企业信息入口,传统SEO失效。GEO(生成引擎优化)聚焦让AI模型“引用”而非仅“排名”你的内容。本文详解GEO三大支柱:结构化标记(Schema)、语义意图优化、AI可信度工程,并结合实战案例与多模态、实时数据等前沿趋势,助技术决策者抢占AI时代信息分发主动权。(239字)
DataWorks Data Agent:一句话搞定数据开发,让周期从天级到分钟级
DataWorks Data Agent 是阿里云推出的AI原生数据开发智能体,覆盖集成、开发、运维、治理、分析全链路。它深度适配业务逻辑与开发规范,支持自然语言一键生成可信SQL及全流程交付。淘宝闪购实测:指标开发从6–8小时缩短至5–10分钟,真正实现“一句话交付”。
阿里巴巴国际站商品详情接口深度解析与实战指南
阿里巴巴国际站开放平台提供`alibaba.product.get`等API,支持获取商品全维度数据(标题、价格、SKU、多媒体、交易量、供应链、SEO等)。仅限企业认证接入,需OAuth2.0签名认证,适用于选品、比价、ERP集成等场景。(239字)
大模型RAG实战:从零搭建专属知识库问答助手
本文介绍如何用RAG技术从零搭建个人Python知识库问答助手,无需代码基础,低成本实现智能问答。涵盖数据准备、向量存储、检索生成全流程,附避坑技巧与优化方法,助力新手快速上手大模型应用。
MySQL 学习资源精选:从入门到优化的高效清单
本文精选MySQL学习资源,按“入门→进阶→实战”三阶段系统梳理视频、书籍、项目等优质资料,结合科学计划与实操建议,帮助学习者高效掌握核心语法、底层原理与性能优化,快速实现从零基础到能独立设计与优化数据库的跃迁。
阿里云 AI 搜索 DeepSearch 技术实践
阿里云OpenSearch LLM版推出DeepSearch技术,实现从RAG 1.0到RAG 2.0的升级。基于多智能体协同架构,支持复杂推理、多源检索与深度搜索,显著提升问答准确率,助力企业智能化升级。
TKM帮您管理编程开发过程中多语言、多版本的切换烦恼
TakMll(特客猫)是一款多语言环境管理工具,支持PHP、Java、Python等多版本快速切换。通过“tkm”命令实现环境添加、查询、切换与删除,简化开发环境配置流程,提升效率。官网:[https://tkm.youqiong.net/](https://tkm.youqiong.net/)
小微主体AI搜索优化:单点穿透的机制与8种执行路径
本文专为小微企业与个人品牌撰写,破除“全平台覆盖”误区,揭示生成式AI搜索依赖平台推荐的两层引用机制。提出“单点穿透”策略:通过引用侦察锁定2–3个高权重平台,改造内容为可摘录信息块,多形态适配各平台规则,并以可对质性保障可信度。强调可观测、可验证的闭环执行路径。
AI搜索引用机制解析:小微团队30天验证内容分发路径
本文面向小微团队,聚焦AI搜索优化核心——如何让内容进入生成式引擎引用集。解析引用机制、平台差异验证法,并提供30天可落地的内容分发与观测路径,涵盖引用版图构建、平台匹配策略及信息块结构优化,助力技术决策者高效启动AIGC时代SEO。
1688商品列表API接口快速上手指南
本文介绍如何通过1688开放平台官方API,合规高效地获取店铺商品列表数据。以`item_search_shop`接口为例,详解请求参数、签名生成规则与调用限制,结合Python实战实现稳定采集。强调签名安全、频率控制与数据合规使用,助力B2B电商分析、选品监控等场景高效落地。(238字)
闲鱼商品详情API接口文档
本接口用于获取闲鱼商品详情,包括标题、价格、库存、卖家信息、图片链接、交易记录等核心数据,返回JSON格式,适用于商品监控、竞品分析等合规场景。需通过模拟请求或授权方式调用,注意反爬机制。
英伟达谷歌都在用的(开源特征存储平台Feast)-架构学习指南
欢迎来到Feast的世界!这是一个开源的生产级机器学习特征存储系统,专为解决特征数据高效管理与服务而设计。本指南将带你从零掌握其架构、核心概念与实战技巧,助你像架构师一样思考,像工匠一样编码,轻松应对训练与推理的一致性挑战。
利用爬虫技术自动化采集汽车之家的车型参数数据
汽车之家是一个专业的汽车网站,提供了丰富的汽车信息,包括车型参数、图片、视频、评测、报价等。如果我们想要获取这些信息,我们可以通过浏览器手动访问网站,或者利用爬虫技术自动化采集数据。本文将介绍如何使用Python编写一个简单的爬虫程序,实现对汽车之家的车型参数数据的自动化采集,并使用亿牛云爬虫代理服务来提高爬虫的稳定性和效率。
GEO日志观测实操:用User-Agent追踪AI爬虫访问
本文详解如何通过User-Agent从服务器日志精准识别GPTBot、Google-Extended、博查搜索Bot等AI爬虫,统计其访问页面与频次;强调UA仅反映“谁来过”,不可推断“是否被收录或引用”,需结合robots.txt配置与静态HTML保障抓取可达性。(239字)
AI搜索引擎引用机制解析:决定内容被选中的5个因素
本文解析AI搜索与传统搜索在收录、判断和分发逻辑上的本质差异,面向开发者与技术决策者,从信息块结构、平台分发、交叉印证、时间积累及内容可验证性五方面,系统阐述AI引擎引用来源的机制、验证方法与实践边界。
告别“垃圾进垃圾出”:打造高质量数据集的完整指南
本文深入解析AI时代“数据比算法更重要”的核心理念,系统阐述高质量数据集的定义、黄金标准(含16条可操作规范)与七步构建法,并提供自动化检查、基线验证及人工评审等实用评估手段,助力开发者高效打造可靠、合规、可持续迭代的优质训练数据。(239字)
实用程序:无需付费软件!自制音视频转字幕工具,复制代码直接运行
一款基于Whisper模型的音视频转字幕工具,支持多格式文件,提供可视化界面与实时进度反馈,可自动识别语音并生成简体SRT字幕,操作简单,开源免费,显著提升字幕制作效率。
大数据之路:阿里巴巴大数据实践——实时技术与数据服务
实时技术通过流式架构实现数据的实时采集、处理与存储,支持高并发、低延迟的数据服务。架构涵盖数据分层、多流关联,结合Flink、Kafka等技术实现高效流计算。数据服务提供统一接口,支持SQL查询、数据推送与定时任务,保障数据实时性与可靠性。
解锁3D创作新姿势!Autodesk 3ds Max 2022中文版安装教程(附官方下载渠道)
Autodesk 3ds Max 2022 是一款专业三维建模、动画和渲染软件,广泛应用于影视、游戏、建筑等领域。其特点包括智能建模工具、高效Arnold渲染引擎、跨平台协作及多语言支持。安装需满足Win10/11系统、i5以上处理器、8GB内存等要求。正版安装流程包括下载官方程序、配置组件、激活许可证并验证功能。常见问题如安装失败、中文乱码等提供了解决方案。扩展学习资源推荐Forest Pack、V-Ray等插件,助力用户深入掌握软件功能。
【免费资料】IEEE33节点系统参数及拓扑图visio
初学者入门配电网可参考经典的IEEE 33节点系统,此系统在文献中广泛应用。资源包括节点和支路参数的Excel表格及Visio的网络拓扑图,可免费下载。配电网以闭环设计增强灵活性和可靠性,故障恢复涉及网络拓扑约束。提供的MATLAB相关链接探讨了孤岛、重构及故障恢复策略。
企业信息全网一致性:AI搜索引用机制与多平台协同实践
本文面向企业技术管理者,解析AI搜索对信息的交叉验证机制,提出“关键事实对齐而非文本复制”的核心理念,拆解聚合平台、内容平台、地图平台三层信息源差异,定义关键事实基线,提供分层治理路径与可复现核验清单。
【淘宝API】商品列表采集
本项目通过Taobaoapi2014调用jd.item_search接口,无需卖家权限,POST方式+Bearer鉴权,一键批量获取淘宝/天猫搜索页商品数据(标题、价格、销量、店铺等),支持导出Excel/CSV/数据库,适用于电商分析与竞品监控。(238字)
人工智能|大白话GPT
GPT-1是首个基于Transformer解码器的生成式预训练模型,采用自回归方式逐词生成文本:以起始,依上下文预测下一词,循环直至。其核心为12层Decoder-only架构,通过掩码自注意力实现单向语言建模,并支持分类、蕴含等下游任务微调。(239字)
【DSW Gallery】基于MOCOV2的自监督学习示例
EasyCV是基于Pytorch,以自监督学习和Transformer技术为核心的 all-in-one 视觉算法建模工具,并包含图像分类,度量学习,目标检测,姿态识别等视觉任务的SOTA算法。本文以自监督学习-MOCO为例,为您介绍如何在PAI-DSW中使用EasyCV。
3天撸完一个团队半年的项目,单客户数据动辄几百万的行业也玩云?
自97年成立至今已接近20年,在前十六七年 明源云主要跑在传统ERP软件轨道上,4年前世界变了,云计算&移动互联网来了,两个最大的行业变量,如果不做出改变就可能被颠覆。因此,明源云决定开辟新战场,用互联网的方式来做地产行业。
DataWorks AI 助理:实现数据异常诊断工作流
本文介绍DataWorks数据异常诊断AI助理,通过语义映射、多维诊断(任务状态/数据质量/代码变更/血缘分析)和经验沉淀,实现业务方自助提报、研发高效定位。典型场景如任务依赖漏配、指标口径不一致等,可大幅压缩排查耗时,提升数据问题响应效率。
商城小程序商品详情页加载慢怎么办?2026 前端性能优化实战
从图片、接口、渲染三个维度拆解商城小程序商品详情页的性能优化:首图压缩到150KB以内、接口拆分、长图文分段渲染,附首屏耗时从5.8s降到1.9s的实测数据。
AI大模型工具深度运用实践:如何搭建自己的AI助手_AI Agent工作流构建与智能体来了案例解析
本文详解AI Agent从理论到实践:对比普通AI工具,揭示智能体“理解目标→拆解任务→调用工具→执行闭环”的核心机制;系统梳理LLM、任务规划、工具调用与知识库四大能力;提供零代码搭建AI助手三步法(定目标、建知识库、设工作流),助普通人快速打造专属智能助手。(239字)
2026 GEO优化技术解析:AI搜索引擎内容引用机制与5步落地方法
2026年Q1中国AI搜索月活破2亿,豆包、Kimi等生成式引擎重塑内容分发。传统SEO失效,GEO(生成式引擎优化)成为新关键——聚焦RAG架构下语义理解与可信度评估。本文解析AI引用三机制,提出5步结构化方法:问题标题、前置FAQ、因果链正文、权威引用、知识图谱钩子,助技术团队提升AI可见度。
大数据与机器学习
大数据领域前沿技术分享与交流,这里不止有技术干货、学习心得、企业实践、社区活动,还有未来。