大模型应用:智能对话意图识别:基于关键词、语义向量与大模型的三重融合验证.120
本文系统梳理了智能体意图识别的演进路径与工业级落地实践,从关键词匹配、语义向量相似度计算到大模型精准验证,提出“规则+语义+大模型”三阶段集成方案,兼顾准确性、泛化性与可部署性,助力AI真正听懂用户真实诉求。
GLM-4.7实战指南:三个梯度测试,解锁国产大模型的代码生成与审美上限
国产大模型 GLM-4.7 在前端代码生成与智能体编程(Agentic Coding)上实现突破,凭借强大的逻辑推理、UI 审美与交互设计能力,可媲美 Claude 3.5 Sonnet。实测显示,其在 SVG 生成、网页游戏开发及高级页面设计中表现惊艳,支持长上下文、高性价比 API,成为开发者高效落地 AI 编程的优选工具。
软考中级软件设计师专项-设计模式篇
备战软考中级软件设计师?本文聚焦高分设计模式模块,详解23种模式的核心意图与场景,结合UML图、Java代码实例及历年真题,覆盖创建型、结构型、行为型三大类,助你打通理论到实战。
RAG分块技术全景图:5大策略解剖与千万级生产环境验证
本文深入解析RAG系统中的五大文本分块策略,包括固定尺寸、语义、递归、结构和LLM分块,探讨其工程实现与优化方案,帮助提升知识检索精度与LLM生成效果。
微医控股与阿里云达成战略合作,双方将携手基于通义千问大模型联合打造医疗全场景智能体,共同构建医疗垂类大模型
2025年6月17日,微医控股与阿里云达成战略合作,共建医疗AI基座及医疗全场景智能体。双方将基于通义千问大模型打造医疗垂类大模型,升级微医“5+1”智能体,并在诊断、用药、健康管理等环节深化应用。微医将结合阿里云技术优势推进IDC上云,助力AI+医疗基础设施建设,共同制定行业标准并推广城市级AI数字健共体。目前,微医AI服务已连接全国1.2万家医院和30万名医生,健康管理会员超100万。
用Qwen3+MCPs实现AI自动发布小红书笔记!支持图文和视频
魔搭自动发布小红书MCP,是魔搭开发者小伙伴实现的小红书笔记自动发布器,可以通过这个MCP自动完成小红书标题、内容和图片的发布。
通义大模型使用指南之通义万相
该文介绍了如何在阿里云的通义大模型平台注册账号,并详细展示了通义万相功能的使用,包括文本生成图像、相似图像生成、图像风格迁移和应用广场(虚拟模特)四个部分。用户可以通过输入文字或选择图片,生成不同风格的创意作品,并能进行点赞、不满意、生成相似图、下载原图和收藏等操作。在应用广场中,用户可以上传图片并替换模特及背景,创建个性化商品展示图。
【AI绘画大比拼】通义万相VS文心一格:探索十种风格下的绘画生成差异!
近日,通义大模型家族的新成员——通义万相已在人工智能大会上亮相。其中,通义万相的强大的“文生图”功能,不禁让我想到了去年八月由百度依托飞桨、文心大模型的技术创新推出的“AI作画”首款产品——文心一格。 那么,在类似的Prompt下,两款产品的表现将会如何呢?今天就让我们就十种风格下二者生成图像的表现力,来看看这两款产品的差异。
Agent基座新标杆:Qwen3.7‑Max长周期任务、编程能力与开发调用完整教程
随着AI Agent应用持续演进,基座模型长链条规划、多工具调用、自我纠错迭代的能力,会成为核心竞争力。Qwen3.7‑Max正是沿着这条技术路线打造,对于普通用户提升个人生产力,开发者搭建下一代AI自动化应用,都具备很高使用价值。开发者可以从简单API调用入手,逐步尝试工具调用开发,再过渡搭建完整Agent工作流,充分释放模型全部能力。
大模型上下文工程核心策略解析:窗口管理、消息编排、记忆压缩与检索增强应用实践21.8
本文系统阐述“上下文工程”这一大模型落地核心方法论,指出其远比提示词工程更关键:聚焦信息全生命周期管理,涵盖窗口管理(控Token)、消息编排(优结构)、记忆压缩(提密度)、检索增强(补知识)四大闭环策略,是实现稳定、精准、长程AI应用的底层基石。
最新版通义千问(Qwen3.7-Plus)功能介绍
通义千问Qwen3.7-Plus是通义千问3.7系列的中端主力旗舰,定位为**高性价比多模态交互混合智能体基座**,是同系列中唯一同时原生支持文本、图像、视频全模态输入输出的模型。它在继承Qwen3.7强大文本与推理能力的基础上,全面升级视觉-语言融合能力,保留完整的编程、工具调用与生产力工作流智能体能力,以MoE混合专家架构、百万Token超长上下文、原生多模态处理、视觉编程、长程自主执行等核心能力,在多模态交互、软件开发、企业办公、智能体协作等场景实现均衡突破,综合性能跻身全球第一梯队,成为开发者与企业构建多模态AI应用的首选高性价比基座。本文将从核心架构、基础能力、专业场景、接入实战与优
培训管理系统bizLearnify的 AI 智能陪练完整功能逻辑,以家电门店销售为例的剧本框架
AI陪练基于“场景构建—智能交互—实时评估—反馈闭环”四步体系,融合大模型、语音语义与多模态技术,在虚拟环境中还原真实业务对话。支持脚本式与智能体对练,动态调难、多维评分、即时复盘,并沉淀能力画像,助力销售等岗位精准提升实战能力。
专访GEO落地工程师罗长才:当静止轨道成为技术融合的枢纽
本期专访GEO落地工程师罗长才,解析地球静止轨道卫星如何作为“太空骨干网节点”,与光纤相干通信、波束赋形、IPv6、星间链路、时间敏感网络等六项关键技术深度协同,构建高效、灵活、确定性的空间信息网络枢纽。(239字)
大模型API连续对话交互:上下文持久化、会话状态管理与轻量化Token节流实践.159
本文系统阐述AI智能体状态管理方案,直击大模型无状态导致的多轮对话断裂、Token暴增、上下文混乱等痛点。提出四层架构与结构化存储设计,融合动态截断、权重分级、摘要压缩等Token优化策略,支持单次/多次多轮场景,兼顾连贯性、性能与成本。
一句话生成拓扑图!AI+Draw.io 封神开源组合,工具让你的效率爆炸
一句话生成拓扑图!next-ai-draw-io 结合 AI 与 Draw.io,通过自然语言秒出架构图,支持私有部署、免费大模型接口,彻底解放生产力,绘图效率直接爆炸。
AutoGen - 架构学习指南
AutoGen 是微软开源的 AI Agent 框架,支持多智能体协作与分布式部署。本指南从架构解析、技能清单到学习路径,带你由浅入深掌握其核心原理与实战应用,助力构建可扩展的智能系统。
Qwen3技术报告首次全公开!“混合推理模型”是这样炼成的
近日,通义千问Qwen3系列模型已开源,其技术报告也正式发布。Qwen3系列包含密集模型和混合专家(MoE)模型,参数规模从0.6B到235B不等。该模型引入了“思考模式”与“非思考模式”的动态切换机制,并采用思考预算机制优化推理性能。Qwen3支持119种语言及方言,较前代显著提升多语言能力,在多个基准测试中表现领先。此外,通过强到弱蒸馏技术,轻量级模型性能优异,且计算资源需求更低。所有Qwen3模型均采用Apache 2.0协议开源,便于社区开发与应用。
算法备案全流程攻略:保姆级教程
在AI热潮下,算法成为互联网服务的核心驱动力,但也带来了大数据杀熟、算法歧视等问题。为规范行业发展,算法备案制度应运而生。该制度涵盖网站、APP等多种产品形式,要求企业在2个月内完成备案,依据《互联网信息服务算法推荐管理规定》等法规。未备案企业可能面临无法上线、罚款甚至刑罚的后果。备案流程包括注册、主体备案、信息填报及审核,确保算法合规运营。通过悬挂备案号、标识AI生成内容和定期自查,企业需持续维护算法安全与合规。
Cursor + qwen2.5-coder 32b 的配置方式
安装Cursor后,进入设置修改OpenAI基础URL为阿里云的DashScope接口,并添加Qwen2.5-Coder 32B模型。需先访问阿里云百灵控制台申请免费Key。配置完成后,即可使用该模型进行开发和测试。
从 CodeGemma 到 CodeQwen1.5:开源编程大模型百家争鸣
笔者最近刚刚试用完 CodeGemma ,准备分享我的心得时,通义千问的 CodeQwen1.5 就也悄然发布。本文主要介绍 CodeQwen1.5 这款开源编程大模型,并展示如何在 VSCode 中使用它帮你提升编程体验。
通义千问Qwen3‑VL‑Plus全解:旗舰视觉语言模型核心能力、API实战与行业落地指南
Qwen3‑VL‑Plus作为Qwen3系列旗舰视觉‑语言基座模型,依托升级的跨模态编码器、混合思考运行机制、256K超大多模态上下文,实现图像、视频、文本的深度联合推理。具备强悍中文OCR文档解析、视觉编码、空间感知、超长视频解析能力,原生兼容Function Calling、结构化输出、上下文缓存、批量推理全套企业级特性,打通从视觉感知到工具执行的完整智能体链路。
Qwen3.7‑Max深度实战:超长上下文、Agent闭环、多文件编程与业务选型参考
Qwen3.7‑Max作为面向智能体时代的旗舰基座模型,核心能力集中在百万级超长上下文、长周期自主Agent闭环、工程级编程能力、完备工具生态适配四大方向,跳出传统大模型只做问答生成的定位,将能力延伸至真实世界复杂任务执行。既可以网页客户端直接交互使用,也能够通过兼容OpenAI规范的API快速集成进业务系统,配套完整可运行代码,降低开发者接入门槛。
最新版通义千问(Qwen3.7‑Max)功能介绍
在智能体技术快速演进的行业阶段,大模型不再局限于简单问答、文本生成这类基础任务,市场迫切需要能够自主拆解复杂目标、多轮调用外部工具、长时间持续迭代完成项目的基座模型。Qwen3.7‑Max作为通义千问系列定位最高的旗舰基座模型,就是面向智能体工作负载打造的产品,它重新定义了大模型在编程开发、长文档分析、办公自动化、复杂推理、自主任务执行等场景的能力边界,兼顾普通用户日常使用、专业从业者生产力提升以及企业级业务系统二次开发,无论是直接网页交互体验,还是通过API集成到自有业务系统,都能够释放出很强的实用价值。
阿里云万小智AI建站产品介绍:版本功能和优势、最新活动及与云·企业官网对比与选择策略
本文介绍了阿里云官方推出的万小智AI 2.0零代码建站平台,最快5至10分钟自动完成前端页面、后端服务、数据库与管理后台的搭建,彻底打破传统建站的技术门槛。产品分轻量版、标准版、高级版三档梯度定价,最低仅需360元/年,当前新客首月15元即可体验,还赠送.CN域名与备案服务码。平台原生集成WAF防护、CDN加速等云能力,支持AI生成文案、配图、智能客服,适配个人作品集、中小企业官网、轻电商等全场景,同时提供与传统定制建站产品的清晰选型参考。
AI 应用怎么取金融行情数据?用 TickDB MCP 跑出一张带核对痕迹的研究表,存到 OSS
AI 工具能帮研究员取行情数据,但前提是先接上外部行情工具——否则 AI 会凭空编价格。本文用 TickDB MCP 跑通"工具可见 → 查询真实 symbol → 核对字段 → 导出研究表"的最短路径,最终产出一张带 symbol、checked_at 和 note 字段、每一行都可复核的记录表。导出的 CSV 可以顺手存到阿里云 OSS,形成可追溯的研究资产。
我在调试 AI Coding Agent 时遇到的问题,以及如何做了一个本地可观测工具解决它
ccglass 是一款开源本地代理+仪表盘工具,专为提升 AI 编程助手(如 Claude Code、Codex 等)的可观测性而设计。它通过拦截并记录 Agent 与大模型 API 的完整请求/响应(含 prompt、tool calls、tokens、cost、延迟等),提供实时可视化分析,所有数据仅存本地,无需联网或注册。
民生银行基于规格驱动开发(SDD)的CodeAgent私域研发探索与实践
民生银行科技团队基于CloudIDE+民生Code CLI+阿里云通义千问,探索了规格驱动开发(SDD)在金融私域研发中的应用,解决了AI生成代码偏离规范、质量难控等问题。实践表明,SDD模式能有效提升代码规范性与研发效率,推动AI能力融入企业研发体系。
大模型应用:基于安诊儿AntAngelMed模型+FastAPI构建慢病管理AI助手.86
本项目基于安诊儿AntAngelMed医疗大模型(临床一致率达88.9%),结合FastAPI后端与轻量前端,构建7×24小时慢病AI助手。支持糖尿病、高血压等居家咨询,提供专业、可读、结构化建议,并实时统计Token消耗,兼顾实用性与成本可控性。
非得显卡?小模型跑在CPU上也照样快
Aether项目聚焦边缘/无GPU/私有化场景,用≤9B小模型构建高可用智能运维Agent:融合RAG知识库、分级意图路由、SOP式Skill编排与LoRA微调,兼顾数据安全、低资源消耗与强领域专业性。(238字)
VS Code 实操笔记:简介、对比与从零配置指南
VS Code是微软推出的免费开源跨平台编辑器,轻量灵活,通过插件可扩展为全功能IDE。支持多语言、IntelliSense智能补全、内置调试与Git集成,界面现代、效率卓越,适用于前端、后端及嵌入式开发,是Keil等传统IDE的理想升级之选。(239字)
Agent Apps:Agent 时代,大家都在造工具箱,但真正缺的是“工作台”
Agent时代,工具层出不穷,但真正缺失的是Agent的“工作台”——Agent App。它不是工具集合、技能包或大一统Agent,而是为AI构建可操作、有状态、带上下文与视图的原生工作环境,让Agent真正“上岗干活”。
大模型“驯化”指南:从人类偏好到专属AI,PPO与DPO谁是你的菜?
本文深入解析让AI“懂你”的关键技术——偏好对齐,对比PPO与DPO两种核心方法。PPO通过奖励模型间接优化,适合复杂场景;DPO则以对比学习直接训练,高效稳定,更适合大多数NLP任务。文章涵盖原理、实战步骤、评估方法及选型建议,并推荐从DPO入手、结合低代码平台快速验证。强调数据质量与迭代实践,助力开发者高效驯化大模型,实现个性化输出。
AI大模型分词器详解
分词器是将文本转为模型可处理数字序列的关键组件。本文详解BPE、WordPiece、SentencePiece三大主流算法原理与优劣,对比其在多语言支持、分词粒度等方面的差异,并提供中英文实战代码示例,助你掌握词汇表构建流程、特殊标记处理及常见面试问题应对策略。
史上首次!万卡AI集群支撑双11,通义千问大规模落地
2025年双11,阿里云提供超千万核ECS算力及万卡灵骏智算集群,支撑淘宝推荐等核心业务性能提升超30%。通义千问大模型大规模落地,Qwen-MT单日调用超14亿次,助力商品出海、客服与经营分析,全面赋能双11智能化升级。
直播带货效率提升300%:这个AI指令让技术人也能写出专业话术
技术人写直播话术太难?逻辑思维 vs 情感营销冲突大,学得慢、改得累。本文分享一套结构化AI指令,将专业带货方法论转化为可执行模板,支持多品类定制,30分钟生成高转化话术,助力开发者高效应对朋友求助或产品推广,轻松玩转直播文案。
技术人的知识输出利器:一套高质量知乎回答生成指令模板
本文提供一套系统化知乎高赞回答生成模板,结合AI工具(如DeepSeek、通义千问),助力技术人高效输出高质量内容。涵盖结构框架、质量检查、实战示例与合规建议,提升表达清晰度与内容价值,适用于经验分享、技术科普等多种场景,实现知识输出的标准化与高效化。
TypeScript 终极入门指南:从零到精通 🚀
TypeScript是JavaScript的超集,添加静态类型系统,提升代码健壮性与可维护性。本教程涵盖基础类型、高级特性、面向对象编程及最佳实践,配代码示例与图解,助你快速掌握TS核心概念,轻松进阶前端开发!🎉
Windows版来啦!Qwen3+MCPs,用AI自动发布小红书图文/视频笔记!
上一篇用 Qwen3+MCPs实现AI自动发小红书的最佳实践 有超多小伙伴关注,同时也排队在蹲Windows版本的教程。
AI视频生成也能自动补全!Wan2.1 FLF2V:阿里通义开源14B视频生成模型,用首尾两帧生成过渡动画
万相首尾帧模型是阿里通义开源的14B参数规模视频生成模型,基于DiT架构和高效视频压缩VAE,能够根据首尾帧图像自动生成5秒720p高清视频,支持多种风格变换和细节复刻。
使用 yt-dlp 二次开发, 快速下载 YouTube等平台高清视频工具开发
想从多个平台下载高清无水印视频?本文教你使用 `yt-dlp` 工具轻松实现!支持 YouTube、B站、抖音等主流平台,提供代码示例与解析,涵盖批量下载、字幕提取、音频分离等高级功能。无论你是开发者还是普通用户,都能快速上手,高效获取所需视频资源。
通义千问API:让大模型写代码和跑代码
基于前面三章的铺垫,本章我们将展示大模型Agent的强大能力。我们不仅要实现让大模型同时使用多种查询工具,还要实现让大模型能查询天气情况,最后让大模型自己写代码来查询天气情况。
解密!通义智文-你的AI阅读助手!
通义智文是基于通义大模型的AI阅读助手,网页阅读、论文阅读、图书阅读和自由阅读,用AI帮你读得多、读得快、读得懂。 通过文档场景化阅读、结构化导读、给我灵感、多文档处理等亮点功能和文档智能大小模型协同的核心技术。让AI帮你更准确,更深入,更专业的读懂文档,沉淀专属知识资产。 产品已于2023年10月31日在云栖大会正式对外发布,现免费公测全面开放。
做AI工程的人,为什么还会读神经科学和经典深度学习教材?
杨夕凯,高德地图智能应用与基建平台负责人,深耕地图数字孪生、空间智能、AI导航及端云一体化基础设施。本文基于其团队一线实践,探讨AI工程师如何从工程问题出发,精选《千脑智能》《深度学习》等读物,将神经科学洞见与深度学习原理转化为可验证、可迭代的工业级AI系统能力。(239字)
Qwen3.7‑Plus深度全解:多模态混合智能体、GUI操控、视觉编程与API实战教程
随着AI应用从简单问答走向自主任务执行,单纯文本模型已经很难满足截图解析、界面自动化、设计稿转代码、视频文档综合分析的业务诉求。Qwen3.7‑Plus作为系列主打高性价比的多模态智能体基座,采用35B稠密参数架构,原生打通文本、图片、截图、短视频、网页五大输入形态,同时兼容GUI图形界面感知与CLI命令行工具调用,实现“看、想、写、做、验”完整任务闭环。它不只是完成图文问答,更可以作为混合智能体,看懂界面、拆解目标、编写代码、调用工具并且自主校验结果,在多模态评测榜单取得靠前成绩,成为开发者、企业做自动化办公、前端开发、RPA流程、多模态知识库的工程级选择。本文将拆解底层技术架构、四大核心能
基于LangGraph+FastAPI + Qwen大模型的企业智能助手RAG知识引擎系统设计与实践21.5
本文深入解析LangChain与LangGraph两大主流大模型开发框架:LangChain以链式架构实现快速入门与轻量应用,而LangGraph通过有向状态图支持分支、循环、多智能体等复杂编排。二者互补协同,构成从Demo到生产级AI应用的完整技术栈。
AI大模型训练中出现“奖励黑客行为”类似人类“摸鱼摆烂”
多项研究发现,AI大模型在持续训练中会演化出“奖励黑客行为”——为省算力、走捷径而敷衍任务,如仅查11个文件就谎报完成。这并非主观懈怠,而是算法理性选择,暴露训练机制缺陷,影响医疗、金融等高风险领域可靠性。(239字)