开启云上 AIGC 动手实践,探索技术创意
面向 GenAI 时代,阿里云人工智能平台 PAI 平台自带海量开箱即用、实时更新的大模型最佳实践,提供高性能、高稳定的大模型工程化能力。本电子书精选 2024 云栖大会动手实践教程,覆盖大语言模型应用、多模态大模型微调训练、低代码 AIGC 创意设计等热门领域,为您带来 AIGC 开发全新体验。
AI建筑:从图像渲染到意图建模,ADAI在本土AEC工作流中的实践探索
海外 AEC 领域出现以意图驱动建模的新探索,行业开始讨论 AI 建模不再单纯追求画面美感,而是优先承接设计师的空间构想。本文脱离概念直译,基于本土建筑项目工作流,实测国产垂直建筑 AI ADAI,探讨图像生成类建筑 AI 的价值边界、技术取舍,以及国内 AEC AI 向三维几何生成演进的可行路线。
taobao.item_get 落地实战:淘宝商品详情 API 完成电商店铺数据搬家
本文介绍基于淘宝开放平台taobao.item_get API的商品数据迁移方案,替代传统爬虫,解决页面改版、IP封禁、SKU错乱等痛点。涵盖接口选型、字段映射、批量策略、异常处理及生产实践,实现合规、稳定、高质的结构化数据搬家。(239字)
AR 技术科普:光波导是什么,为什么警务要用它
光波导是AR眼镜的核心光学技术,将显示屏“藏”于镜腿,通过压扁光纤实现全反射成像。我们选用衍射波导(SRG),兼顾轻薄、高透与量产性,搭配Micro LED弥补低光效。它正赋能警务:不遮视野、外观隐蔽、久戴舒适,让民警边走边查、秒级响应——技术之取舍,恰为实战而生。
【建站实战】用 ESA + Cloudflare 把网站月费压到接近零费用
本文以geojsoncn.com为例,详解如何用阿里云ESA(中国边缘)+ Cloudflare Workers + R2构建百度友好型静态站:ESA保障国内可达与ICP备案,Workers无服务器计算,R2低成本存储。三者协同,月成本压至约10元,兼顾SEO硬指标与极致性价比。(239字)
DuckDB 把 S3 上的查询提速 3 到 20 倍,这次大版本值得湖仓的人认真读一遍。
DuckDB 2.0 预览版重磅升级:聚焦“作为服务器”新定位,核心突破异步I/O(远端S3查询提速3–20倍)、递归CTE性能跃升42倍、原生CONNECT协议支持跨库查询、PEG解析器开启方言生态、VARIANT半结构化一等公民、完整触发器及稳定ABI扩展体系。非简单优化,而是架构级演进。(239字)
探源者 GEO 全链路评估框架 --面向 AI 搜索时代的品牌可见度量化方法论
随着大语言模型(LLMs)与生成式搜索引擎的普及,传统 SEO 正逐渐向生成式引擎优化(GEO)转变。然而,当前业界缺乏对品牌在 AI 搜索中可见度的系统性量化评估方法。本文提出"探源者"GEO 全链路评估框架,包含"观局—析因—取法—成文"四步执行模型,以及"可见度—可信度—推荐度—相关度"四度评估指标体系(BAMSI)。通过对 20 个行业、X 个核心词(CORE)在 DeepSeek、豆包等主流 AI 平台上的实证追踪,本文验证了该框架在提升品牌提及率与优化内容信源方面的有效性,为企业数字资产构建提供了理论支撑与自动化评估架构。
Spark 选 join 策略靠的是估算值,估错了它只会悄悄降级。
Spark Join算法选择完全由统计信息驱动,但估算偏差常致计划“选错路”:小表估大则弃广播,大表估小则误用ShuffleHash,非等值或collation字段直接降级笛卡尔积。AQE可动态修正,但未shuffle的扫描仍依赖静态估算。调优需结合EXPLAIN、UI指标与WARN日志,而非盲目改配置。
基于python的地铁客流量预测系统
本研究基于FastAPI框架构建地铁客流量预测系统,融合AFC、天气等多源数据,优化机器学习模型与后端适配,提升实时性与准确性,助力运力调度与精细化运营。
基于深度学习微信小程序的农作物病害识别系统
本系统基于YOLOv8深度学习模型,融合Vue+SpringBoot+Flask+MySQL技术栈,支持图像、视频、实时摄像多模态病害识别,提供用户分级管理与直观结果展示,兼具高精度、易用性与可扩展性,助力智慧农业落地。
Databricks 实测 Spark 比 Flink 快 92%,流计算要变天了。
Databricks 3月2日发布测评:Spark Real-Time Mode(RTM)在实时特征计算(编码、enrichment、聚合)中,较Flink最高快92%(p99延迟9ms vs 95ms)。RTM打破微批限制,实现毫秒级低延迟、全状态支持与流式Shuffle,挑战“必须双引擎”行业共识。
语义、信源与上下文:GEO传播中的安全边界清单
本文提出GEO传播安全边界清单,将语义对齐、信源偏好、上下文构造与黑帽风险拆解为可观测变量,指导内容、品牌与搜索从业者判断哪些说法可直接采用、哪些须限于实验边界。作者王涛强调可观测性与答案质量工程,拒斥黑帽操作,倡导长期信任价值。(239字)
B/S 架构智能一卡通系统全介绍:车牌识别、电动两轮车、梯控、访客、人脸识别、消费、人行通道闸机等
多奥B/S架构一卡通系统DAIC-YKT-SF,统一管理车牌识别、梯控、通道闸、访客、电动两轮车、消费、考勤等12大子系统;支持人脸/国密卡/动态二维码认证,具备防重放、端到端加密与设备OTA能力,适配园区、校园、企业等多场景,实现“一次授权、全网通行”。
Anthropic 用 Claude 发现新酶系统,AI 开始走进生物学的未知地带
Anthropic 利用 Claude 智能体在海量噬菌体 DNA 数据中发现了一种此前未被完整描述的新酶系统 ART,其特征让人联想到 CRISPR,但功能与用途尚不明确。搜索共启动 949 个智能体会话、消耗约 2.156 亿 token。文章借此指出,通用大模型与 Agent 正从跑分竞赛走向基础生物学研究,可能成为 AI 参与科学发现的一个分水岭。
拼图软件不是要会员就是加水印?这个开源工具就够了
「简单拼图」(Easy Collage)是一款开源、纯本地的在线拼图工具:照片全程在浏览器处理,不上传、不加水印、无需登录,零学习成本。支持2–9图模板、高清导出(1x–4x)、自定义间距/圆角,Apache 2.0协议,连访问统计都已移除,真正隐私友好。(239字)
SensorFlow vs GrowingIO:2026 年如何选择事件分析方案
客观比较 GrowingIO 与 SensorFlow 的产品分析范围、SDK 迁移成本和 ClickHouse 数据所有权,并给出可执行的验证步骤与适用边界。
UE 物体高亮插件 HighLightActors(完全开源纯免费)
HighLightActors 是一个适用于 Unreal Engine 5.8 的运行时插件(同时适用于UE5.0-5.8之前的所有版本),用 Custom Depth/Stencil 和后处理材质给 Actor 绘制可配置的轮廓。插件支持 C++ 与蓝图调用。
中小企业AI搜索优化:低投入内容生产与引用验证路径
本文面向开发者,解析AI问答引擎引用内容的形成机制,提出“平台推荐—抓取频率—结构适配”三要素协同模型,提供可验证的选题、生产、分发与效果评估路径,并明确适用边界与常见失效模式。
闲鱼商品详情 API 接口解析(附 JSON 样例)
本文详解闲鱼TOP平台`goodfish.item_get`接口:涵盖鉴权(需店铺托管OAuth授权)、参数规范、签名算法、字段释义及实战避坑经验,强调仅限查询已托管商品,不支持跨店/陌生人商品。
为什么 AI 会被伪权威误导——PoisonedRAG 与知识库污染防御
本文剖析AI被伪权威误导的根源:非能力不足,而是默认省略审计级穿透核验以控成本。揭示PoisonedRAG投毒本质是优化攻击,并提出多层防御框架——源头校验、可信分级、多源交叉验证与内容治理,为白帽GEO与知识库安全提供实操路径。(239字)
一文吃透闲鱼 API:关键词搜品 + 单品详情 ,搭建二手商品监控平台
本文详解闲鱼ISV官方三大合法接口:整店商品拉取、单品详情查询、店铺内关键词筛选,对比逆向抓包风险,提供参数规范、JSON示例、架构设计及避坑指南,助开发者合规构建二手监控与选品系统。(238字)
一次中文 AI 引用的结构分析:如何区分 RETRIEVED 与 SELECTED
用 74 条中文商业问句对两个中文大模型应用做独立会话采集,落盘 6183 条信源记录,并把「检索到」与「被引用」严格分开统计。给出归一化参考实现与统计口径,得到三个结构性发现:不同平台信源结构差异极大、长尾极长但头部仍值得优先投入、自建域名必须单独设对照组测量才能区分内容层与索引层问题。
阿里云 Milvus 自研内核 EAGLE 发布:向量检索的SOTA,我们决定自己造
阿里云Milvus全新自研内核EAGLE发布:在全内存场景和内存磁盘混合场景下,性能与性价比双突破。实测吞吐领先、P99延迟大幅降低。完全开源可复现,拒绝“拼凑式” benchmark——真性能,经得起物理规律与真实业务检验。
Apache Doris 高性能 Open Lake Variant 读写技术解析(含对比数据)
相比 Spark,Doris 冷跑综合加速 15.10×、热跑 19.14×;拆列场景热跑综合加速达 58.64×,部分 Paimon 测试超过 106×
淘宝天猫商品评论API接口解析(附 JSON 样例)
本文详解淘宝开放平台taobao.item.reviews.get接口,合规获取商品近180天公开评价数据(含评分、文本、晒图、SKU、追评及商家回复),涵盖鉴权、签名、参数、JSON示例、字段释义与生产避坑指南。(239字)
淘宝天猫商品详情 API 接口解析(附 JSON 样例)
本文详解淘宝开放平台taobao.item_get接口,支持获取淘宝/天猫商品标题、价格、SKU、图文、属性等结构化JSON数据,规避爬虫风控与维护难题,适用于ERP同步、竞品监控、选品及跨平台铺货等场景。(239字)
在阿里云上用最小成本做 GEO:复用现有云资源的可行路径
中小企业做GEO(生成式引擎优化),只需复用现有云资源,以低于5%的边际成本,将官网与文档库改造为结构化内容资产,使其可被豆包、通义千问等6大AI平台检索引用。核心是构建E-E-A-T友好的语义实体网络,14天即可上线,首季引用率提升3倍。(239字)
GEO日志观测实操:用User-Agent追踪AI爬虫访问
本文详解如何通过User-Agent从服务器日志精准识别GPTBot、Google-Extended、博查搜索Bot等AI爬虫,统计其访问页面与频次;强调UA仅反映“谁来过”,不可推断“是否被收录或引用”,需结合robots.txt配置与静态HTML保障抓取可达性。(239字)
小微主体AI搜索优化:单点穿透的机制与8种执行路径
本文专为小微企业与个人品牌撰写,破除“全平台覆盖”误区,揭示生成式AI搜索依赖平台推荐的两层引用机制。提出“单点穿透”策略:通过引用侦察锁定2–3个高权重平台,改造内容为可摘录信息块,多形态适配各平台规则,并以可对质性保障可信度。强调可观测、可验证的闭环执行路径。
从SEO到GEO:AI生成式搜索时代,企业网络优化的全新变革
随着AI生成式搜索全面普及,用户信息检索习惯彻底变革,传统SEO优化模式难以适配大模型问答场景,行业迎来迭代拐点。GEO生成式引擎优化作为新一代网络优化体系,依托语义理解、多模态内容构建、实时动态监测三大核心能力,适配AI大模型收录与推荐逻辑,打破传统流量局限。本文结合行业技术探索实践,中立解析GEO的技术原理、行业价值与发展趋势,对比传统优化模式的核心短板,阐述AI时代企业数字化优化的转型方向,为企业布局AI搜索生态、沉淀数字化品牌资产提供专业参考。
AI搜索引用机制解析:无额外投入的内容适配与验证路径
本文解析AI引擎引用机制,指出平台推荐先于AI引用,强调内容需适配目标平台规则(如CSDN重技术深度、头条重结构清晰),而非盲目多发。提出“平台地图构建—分平台改写—信息块设计—月度覆盖率观测”四步法,助力开发者在有限投入下提升可引用性。
面向大模型 RAG 的企业知识库工程化:Schema、信源与效果监测
本文提出面向大模型RAG的企业知识库工程化五层架构(GEO):L1 Schema结构化锚定实体,L2场景化FAQ提升召回,L3四级信源加权增强采信,L4全域信息一致性治理,L5可量化效果监测。聚焦“让大模型准确识别、优先采信、交叉验证”,提供可落地的技术方案与配置示例。(239字)
微店商品列表 API 接口解析(附 JSON 样例)
本文介绍微店官方商品列表接口micro.item_search(v2.0),支持按店铺/类目批量获取SPU/SKU基础信息(标题、价格、销量、主图等),适用于私域ERP同步、店铺搬家、分销选品及多店统一管理,安全合规、免维护,替代高风险网页爬虫方案。(239字)
AI搜索引用机制解析:小微团队30天验证内容分发路径
本文面向小微团队,聚焦AI搜索优化核心——如何让内容进入生成式引擎引用集。解析引用机制、平台差异验证法,并提供30天可落地的内容分发与观测路径,涵盖引用版图构建、平台匹配策略及信息块结构优化,助力技术决策者高效启动AIGC时代SEO。
AI搜索引用机制解析:内容结构与平台分布对收录的影响
本文解析AI搜索优化新机制:聚焦豆包、元宝等生成式AI引擎的引用逻辑,从引用分布实测、内容结构拆解、平台匹配策略三方面,揭示如何让技术输出成为AI答案的可靠信源,助力开发者、顾问与创作者构建可持续的内容分发通道。
结构化数据互转(上):JSON 与 CSV 的字段映射、类型推断
本文详解JSON与CSV互转的核心陷阱:字段映射易错、类型自动推断致精度丢失(如`000128`变`128`)、嵌套结构扁平化无标准解。强调“JSON是树,CSV是表”,厘清记录路径选取、数组处理策略、安全引号转义及长数字/前导零必须字符串化等关键规则。(239字)
1688查询榜单列表API接口解析(附 JSON 样例)
本文详解1688开放平台官方接口`1688.item_search_best`,支持按类目ID查询热销/好价/综合等榜单,返回结构化商品数据(排名、offerId、标题、价格、销量等),替代高维护成本的网页爬虫,适用于跨境选品、趋势分析与竞品监控。(239字)
StarRocks 迁移至 Apache Doris 完整指南:三步完成结构、数据与业务平滑切换
StarRocks 怎么迁移到 Apache Doris?SR 迁移 Doris 是否需要重新建表?几亿、几十亿数据怎么搬?DataX、Flink、Parquet 应该怎么选?全量迁移之后又如何保证增量数据不丢?
商城小程序商品详情页加载慢怎么办?2026 前端性能优化实战
从图片、接口、渲染三个维度拆解商城小程序商品详情页的性能优化:首图压缩到150KB以内、接口拆分、长图文分段渲染,附首屏耗时从5.8s降到1.9s的实测数据。
AI搜索引用机制解析:中小企业内容供给到留存的全链路实现
本文面向中小企业开发者,解析AI搜索引用机制,指出内容结构化(问题明确、出处可验、边界清晰)是提升引用率的关键。提出“供给—承接—确认—维护”全链路闭环方案,助企业降低线索成本、提升复购率。
GEO策略与引用思维:从争网页排名到争AI答案席位
GEO策略聚焦AI答案席位争夺,超越传统SEO排名思维,强调可追溯引用与实体准确性。涵盖七层体系:目标转向答案席位、引用思维替代排名、AI爬虫可访问性、Schema结构化表达、多平台采样观测、时效与质量平衡、电商本地化适配,全程以实证验证为根基。(239字)
电商与本地服务GEO:Product Schema、FAQ、评价与多城市页面的引用策略
本方案聚焦电商与本地服务的GEO实战,提出六层引用策略:从引用思维出发,通过Product Schema、FAQ、评价、多城市页面等结构化内容建设可信信源,并强调实体准确、来源可溯、跨平台一致,以实现AI答案中品牌被整段引用与署名。(239字)
豆包与Kimi的内容引用机制:信息密度与平台分布解析
本文分析豆包与Kimi在内容引用上的差异:豆包偏好CSDN等平台的高信息密度技术干货,强调可操作性;Kimi倾向知乎、36氪等平台的深度分析与观点类内容,重视论证逻辑。二者均要求内容具备可验证性、数据支撑与语义完整性,为开发者提供AI搜索优化实践指南。
GEO认知度量6维评分模型:权重、归一化与防幻觉
本文提出生成式引擎优化(GEO)认知度量归因方法:基于6维正交认知框架(品牌直达、品类词、卖点、场景、地域、对比),采用单维归一化、双证据闭合校验与动态权重机制,实现可数学化、可证伪、可审计的品牌AI认知量化评估,数据覆盖2024–2026年六大主流大模型平台。
GEO文章发布后为什么仍可能失效?
GEO文章发布后失效,常因内容无法长期存活。本文提出“六层验证模型”:Survive(存活)→Retrieve→Read→Use→Cite→Recommend,强调内容须先稳定公开、可访问、可验证,方能成为AI可信信源。官网为原始事实源,第三方平台仅作传播放大器。(239字)
用 Java 接入大模型(三):temperature、top_p、max_tokens 到底怎么调
本文详解大模型调用核心参数:厘清temperature、top_p等作用边界,强调“参数只影响选词,不改变理解”;提供分场景配置清单与故障排查指南,助开发者高效调试、避免无效调参。(239字)
AI搜索引用机制解析:内容结构与平台分布对收录的影响
本文解析AI搜索优化新机制:聚焦豆包、元宝等生成式AI引擎如何组织答案与引用来源,揭示引用分布差异、信息块拆解方法及验证路径,助力开发者提升技术内容被AI引用的概率与实效性。
大数据与机器学习
大数据领域前沿技术分享与交流,这里不止有技术干货、学习心得、企业实践、社区活动,还有未来。