大模型应用:Skill架构解析:理解大模型Skill的本质、核心组成和本地模型实践.116
本文以极简数字计算Skill为切入点,深入浅出解析大模型Skill本质:模块化、可触发、结构化返回。通过零依赖代码示例,完整呈现Skill四大核心环节——配置声明、参数提取、逻辑执行、结果整合,并延伸至本地Qwen模型实现关键词提取实战,助开发者快速掌握Skill开发范式。
大模型应用:矩阵乘加(GEMM)全解析:大模型算力消耗的逻辑与优化.68
GEMM(矩阵乘加)是大模型算力核心,占Transformer计算量90%以上。本文系统解析其数学原理、高维适配、算力测算公式,并详解INT8/INT4量化、矩阵分块、硬件加速与批处理四大优化策略,结合代码示例与性能监控方法,助力高效推理落地。
从AI检索原理到geo优化:技术驱动的GEO监测策略
随着AI搜索兴起,信息获取从关键词匹配转向语义理解。本文深入解析GEO(生成式引擎优化)技术原理,对比SEO与GEO的核心差异,揭示RAG、向量化检索的底层逻辑,并介绍如何通过真实用户行为模拟实现精准监测,助力企业构建面向AI时代的内容优化体系。
一个帮运营写产品详情页的AI指令
分享一套实用的电商详情页AI生成指令模板,涵盖标题、卖点、场景、参数、保障等核心模块,帮助运营、产品经理等快速产出80分初稿,大幅提升效率。适配主流AI工具,结合人工优化,轻松应对多平台需求。
Cursor + qwen2.5-coder 32b 的配置方式
安装Cursor后,进入设置修改OpenAI基础URL为阿里云的DashScope接口,并添加Qwen2.5-Coder 32B模型。需先访问阿里云百灵控制台申请免费Key。配置完成后,即可使用该模型进行开发和测试。
从 CodeGemma 到 CodeQwen1.5:开源编程大模型百家争鸣
笔者最近刚刚试用完 CodeGemma ,准备分享我的心得时,通义千问的 CodeQwen1.5 就也悄然发布。本文主要介绍 CodeQwen1.5 这款开源编程大模型,并展示如何在 VSCode 中使用它帮你提升编程体验。
【AI】Agent 全栈进阶|Agent 工程化与兜底
Agent开发中,LLM动态决策易致死循环、误调用、权限越界三大故障。通过设置最大步数、工具分级与参数校验、人工确认等四道防线,可有效兜底。实战“加盟助手”演示规避风险,保障Agent稳定运行
通义千问Qwen3.7-Max全解析:万亿MoE旗舰,35小时自主执行的全能智能体
Qwen3.7-Max是通义千问系列的新一代旗舰大模型,定位为智能体时代的通用基座,以万亿级MoE混合专家架构为核心,实现从“被动响应问答”到“主动执行复杂任务”的本质跃迁。它集成百万级超长上下文、原生全模态理解、顶尖代码生成、长程自主执行、全链路办公与生态协同六大核心能力,在全球权威基准测试中多项指标登顶,可稳定完成35小时连续自治任务、1158次工具调用,真正成为能独立完成全流程工程开发、深度分析与自动化办公的AI助手。本文从技术架构、核心能力、实战场景、API接入与成本优化等维度,全面拆解Qwen3.7-Max的功能与价值,附可直接运行的代码命令与配置示例。
最新版通义千问(Qwen3.8-Max)功能介绍及使用指南
通义千问Qwen3.8-Max是通义千问系列的最新旗舰大模型,凭借2.4万亿参数的MoE混合专家架构、100万Token超长上下文、原生多模态处理能力以及全栈代码与智能体协作能力,成为当前全球顶尖的通用大模型之一。它不仅在文本生成、逻辑推理上实现突破,更在长文档处理、图像视频理解、复杂工程开发、多智能体协作等场景构建了核心竞争力。本文将从核心架构、关键功能、使用入口、API调用、场景实战、避坑指南六大维度,全面解析Qwen3.8-Max,帮助开发者与普通用户快速掌握其能力与使用方法,实现从基础对话到复杂任务的高效落地。
AI 对话导出 Word/PDF 的实践总结
上周写技术选型周报,我让 AI 出了一张七行五列的对比表,页面上看着挺整齐,全选复制粘进 Word,表格塌成了一行带竖线的文字,`|` 和 `---` 全都原样躺在那儿。改了二十分钟手动画表格,最后还是自己重新敲了一遍。
SSE流式传输稳定性进阶:心跳保活、断连重连、分片处理与双端容错实战.162
SSE(Server-Sent Events)是基于HTTP的单向流式协议,天然适配大模型逐字输出场景。具备轻量、兼容性好、自动重连、低内存占用等优势,相比WebSocket更契合服务端单向推送需求,是AI应用流式响应的理想选择。
仓储人必看!WMS仓库管理系统核心科普,功能+部署一文读懂
仓储效率低、库存混乱?WMS是数字化破局关键!本文纯科普解析其6大核心功能(入库/库存/出库/报表/协同/数据管理)及云部署、本地部署双路径,适配小微至集团企业需求,助力高效落地。
大模型多租户隔离:资源隔离、权限管控、性能互不干扰,SaaS落地场景实战.156
大模型多租户隔离是SaaS化核心,通过租户ID实现资源、权限与性能三重隔离:共享GPU/模型降低成本,逻辑隔离确保数据不交叉、请求不干扰、权限不越界,满足金融级安全与高并发稳定性要求。
2026中国B2B制造业GEO白皮书:从产业洞察到优化实践
生成式AI正在重构B2B制造业采购决策,89%买家使用AI辅助选型。本白皮书覆盖科技制造与传统制造80个细分行业,通过10大标杆案例(生物医药、集成电路、汽车零部件、新能源、环保、智能装备等)和DSS原则(语义深度、数据支持、权威来源),助您将技术参数、认证资质转化为AI信任资产,实现精准获客。
VS Code 实操笔记:简介、对比与从零配置指南
VS Code是微软推出的免费开源跨平台编辑器,轻量灵活,通过插件可扩展为全功能IDE。支持多语言、IntelliSense智能补全、内置调试与Git集成,界面现代、效率卓越,适用于前端、后端及嵌入式开发,是Keil等传统IDE的理想升级之选。(239字)
AI学习全景图:从大模型到RAG,从工具到变现,一条从0到1的路线
告别碎片化学习!本文系统梳理AI知识五层结构:从基础认知到商业变现,提供完整学习路径与优质资源链接。帮你构建AI知识网络,实现从工具使用到能力落地的跃迁。
精通RAG:从“能用”到“好用”的进阶优化与评估之道
你的RAG应用是否总是答非所问,或者检索到的内容质量不高?本文聚焦于RAG系统的进阶优化,深入探讨从查询转换、多路召回与重排序(Rerank)等高级检索策略,到知识库构建的最佳实践。更重要的是,我们将引入强大的`Ragas`评估框架,教你如何用数据驱动的方式,科学地量化和提升你的RAG系统性能。
深度解析智能体工作流(Agentic Workflows):核心概念、模式与应用
本文系统解析智能体工作流(Agentic Workflow),结合AI智能体的推理、工具与记忆能力,实现复杂任务的动态执行。内容涵盖核心概念、关键模式及实际应用,帮助读者全面理解其价值与挑战。
Agent与大模型的区别
本文详细对比了人工智能领域的两个重要概念——Agent和大模型。大模型如GPT-3、BERT等,擅长自然语言处理任务,如文本生成、翻译等;Agent则是自主的软件实体,能够在特定环境中感知、决策并执行任务,如管理日程、控制智能家居等。文章介绍了它们的定义、功能、技术架构及应用场景,并总结了两者的核心差异和未来发展方向。
通义大模型使用指南之通义听悟
本文介绍了阿里云通义平台的注册和使用,主要包括两个部分:注册和功能介绍。用户可以通过访问网址 <https://tongyi.aliyun.com/> 进行注册。在功能介绍中,重点讲解了通义听悟的功能,它提供实时语音转文字、音视频文件转文字、智能总结和中英互译服务。用户可以体验实时录音并标记重点、问题和代办事项,方便会议记录和整理。此外,通义听悟还支持上传音视频文件转写和播客链接转写,以及浏览器插件用于处理网页、手机和微信上的语音内容。
最新版通义千问(Qwen3.7‑Max)功能介绍
在智能体技术快速演进的行业阶段,大模型不再局限于简单问答、文本生成这类基础任务,市场迫切需要能够自主拆解复杂目标、多轮调用外部工具、长时间持续迭代完成项目的基座模型。Qwen3.7‑Max作为通义千问系列定位最高的旗舰基座模型,就是面向智能体工作负载打造的产品,它重新定义了大模型在编程开发、长文档分析、办公自动化、复杂推理、自主任务执行等场景的能力边界,兼顾普通用户日常使用、专业从业者生产力提升以及企业级业务系统二次开发,无论是直接网页交互体验,还是通过API集成到自有业务系统,都能够释放出很强的实用价值。
Qwen3.7‑Plus深度全解:多模态混合智能体、GUI操控、视觉编程与API实战教程
随着AI应用从简单问答走向自主任务执行,单纯文本模型已经很难满足截图解析、界面自动化、设计稿转代码、视频文档综合分析的业务诉求。Qwen3.7‑Plus作为系列主打高性价比的多模态智能体基座,采用35B稠密参数架构,原生打通文本、图片、截图、短视频、网页五大输入形态,同时兼容GUI图形界面感知与CLI命令行工具调用,实现“看、想、写、做、验”完整任务闭环。它不只是完成图文问答,更可以作为混合智能体,看懂界面、拆解目标、编写代码、调用工具并且自主校验结果,在多模态评测榜单取得靠前成绩,成为开发者、企业做自动化办公、前端开发、RPA流程、多模态知识库的工程级选择。本文将拆解底层技术架构、四大核心能
最新版通义千问(Qwen3.8-Max)功能介绍
作为通义千问系列迄今规模最大、性能最强的旗舰模型,Qwen3.8-Max凭借2.4万亿总参数的MoE混合专家架构、100万Token上下文窗口与原生多模态能力,实现了从“辅助工具”到“自主智能体”的跨越。它不仅在代码工程、专业办公、复杂推理等核心领域实现跨越式升级,更以端到端交付生产级成果的能力,成为面向智能体时代的通用AI基座,为个人开发者、企业团队与科研机构提供前所未有的AI生产力支撑。
最新版阿里云通义千问大模型功能介绍
阿里云通义千问作为国内领先的超大规模多模态大语言模型,历经多轮迭代,已从单一文本交互工具进化为集文本、图像、音频、视频理解与生成、代码开发、智能体执行、生态协同于一体的全能AI平台。最新版通义千问(以Qwen3.7-Max为核心代表)在上下文长度、多模态能力、代码生成、工具调用、推理效率等维度实现跨越式升级,原生支持百万token上下文、全栈代码开发、多模态统一建模与生态服务打通,覆盖个人办公、内容创作、企业服务、开发运维、行业数字化等全场景需求。本文将全面拆解通义千问最新版的核心功能、技术架构、应用场景与开发实战,附完整代码命令,帮助用户深度掌握模型能力,实现高效落地。
大模型上下文风控解析:过载控制、自动裁剪、超长拦截与敏感熔断应用实践.170
本文系统阐述大模型多轮会话中的四大核心挑战:上下文超窗、资源过载、算力浪费与内容风险,并提出完整的会话状态管理与上下文风控体系,涵盖会话生命周期管控、自动裁剪、超长Prompt拦截及敏感内容熔断等关键能力,保障服务稳定、成本可控与合规安全。
以前写重复提示词花 10 分钟,现在用 Hermes 技能一条命令搞定,效率提升 300%
本文全面介绍 Hermes Agent 技能(Skills)系统,从核心概念、格式规范、安装管理到自定义开发,带你掌握可复用工作流与知识单元的使用方法,让 AI 智能体自动执行复杂任务。
LaTeX 数学公式在 Word 中的兼容性问题与解决方案实践
本文剖析AI生成LaTeX公式粘贴至Word乱码的根源,对比Word原生、MathType、Pandoc、Overleaf及DS随心转五大方案,涵盖兼容性、可编辑性与适用场景,助科研、教学与技术写作用户高效实现公式无缝迁移。
大模型应用:大模型越大越好?模型参数量与效果的边际效益分析.51
本文揭示大模型“参数量越大效果越好”的误区,详解边际效益递减规律:小模型(1B→7B)提升显著,中等模型(7B→13B)仍具性价比,而超大模型(70B→175B)效果几无增长却大幅增加算力与存储成本。通过控制变量、量化指标与曲线分析,指导读者科学选型——找到效果与成本平衡的最优参数阈值。
大模型应用:大模型本地部署实战:从零构建可视化智能学习助手.2
本文介绍了一个基于Qwen1.5-1.8B大模型的本地部署AI学习助手系统。该系统在CPU环境下运行,通过Gradio提供Web界面,具备智能对话、学习示例生成等功能。文章详细阐述了模型选择、系统架构设计、提示词优化、用户界面实现等关键技术点,重点讨论了参数配置优化策略,包括模型加载、输入处理、生成策略等核心参数。该系统实现了在消费级硬件上部署智能教育助手,保障数据隐私的同时提供多学科问答支持,具有预设问题、上下文记忆等特色功能,适合作为本地化学习辅助工具。
会议纪要背后的秘密:好的纪要能让会议减少一半
会议开完责任不清、决策模糊?本文分享一个会议纪要AI生成指令,能从混乱的会议讨论中提取决策事项、分配责任人、明确时间节点。支持DeepSeek、通义千问等国产AI,15分钟生成结构完整的专业纪要,把口头约定变成书面契约,让团队协作更透明高效。
【开源项目】MaxKB4J基于java开发的工作流和 RAG智能体的知识库问答系统
MaxKB4J是一款基于Java开发的开源LLM工作流应用与RAG知识库问答系统,结合MaxKB和FastGPT优势,支持智能客服、企业知识库等场景。它开箱即用,可直接上传/爬取文档,支持多种大模型(如Qwen、通义千问等),具备灵活的工作流编排能力,并无缝嵌入第三方系统。技术栈包括Vue.js、Springboot3、PostgreSQL等,提供稳定高效的智能问答解决方案。访问地址:`http://localhost:8080/ui/login`,项目详情见[Gitee](https://gitee.com/taisan/MaxKB4j)。
通义大模型使用指南之通义千问
本文介绍了如何注册并使用通义大模型,该平台提供了通义千问、通义万相和通义听悟三大功能。通义千问包含对话和百宝箱两个子功能。在对话中,用户需按照特定格式提问,如设定角色、背景等,但实际体验中,回复可能不够理想。百宝箱提供不同场景的应用,如健身教练和办公助理。通过示例展示了健身计划的生成,但与专业教练相比仍有差距。对于职场问题,通义千问的回答显得较为通用,难以满足个性化需求。
最新版通义千问(Qwen3.8-Max)功能介绍
Qwen3.8-Max是通义千问系列迄今规模最大、能力最强的旗舰大模型,定位为**全场景智能体基座**,可独立完成复杂任务、长周期执行与多模态交互,支撑科研开发、企业服务、工程设计、内容创作等多元场景。该模型基于Qwen 3.5架构迭代升级,采用**第三代稀疏MoE混合专家架构**,总参数量达2.4万亿,推理时仅激活95B有效参数,在保持超大模型能力上限的同时,大幅降低算力消耗与推理成本,实现“轻量架构、旗舰性能”的突破。
最新版通义千问(Qwen3.8-Max-Preview)功能介绍
在大模型技术从静态版本迈向动态进化的关键节点,通义千问推出Qwen3.8-Max-Preview,以2.4万亿参数的MoE架构、原生多模态能力、百万级上下文与日更进化机制,重新定义旗舰模型的能力边界。作为通义千问首个突破万亿参数的原生多模态模型,它在代码工程、专业办公、复杂推理与长程自主执行等核心场景实现跨越式升级,同时以预览期限时优惠降低使用门槛,成为开发者与企业探索前沿AI能力的首选基座。本文从技术架构、核心能力、实战应用、接入方式与优势场景五大维度,全面解析Qwen3.8-Max-Preview的核心价值与落地路径。
Qwen 3.7 Plus与Max深度测评:参数、能力与性价比全解析
阿里云千问Qwen 3.7系列是面向智能体时代打造的新一代大模型,包含Plus与Max两大核心版本,分别定位全能多模态与旗舰文本推理,在参数架构、能力边界、计费成本与适用场景上存在显著差异。本文从核心参数、基础能力、智能体表现、多模态能力、计费规则、性价比与选型建议六大维度,对两款模型进行全面测评,帮助开发者与企业精准选择适配自身需求的模型。
大模型应用:批量文档摘要与分类实践:本地合同、报告数据处理与导出.70
本方案基于Qwen 1.5 7B大模型,实现本地化批量文档处理:自动读取Word/PDF,经TextSplitter智能分块、Schema引导式提示,生成标准化摘要与多标签分类,最终导出CSV。全程离线运行,保障敏感数据安全,显著提升合同、报告等高频文档的处理效率与准确性。
一句话生成拓扑图!AI+Draw.io 封神开源组合,工具让你的效率爆炸
一句话生成拓扑图!next-ai-draw-io 结合 AI 与 Draw.io,通过自然语言秒出架构图,支持私有部署、免费大模型接口,彻底解放生产力,绘图效率直接爆炸。
基于通义千问:全AI自动驱动合同审查系统的技术解构与实践
“律杏法务云+通义千问”实现合同审查智能化跃迁,融合法律知识图谱与大模型技术,构建生成、审查、交互、进化闭环。支持智能清单生成、风险识别、条款补漏与AI对话,审查效率提升10倍,漏检率低于0.3%,推动法律科技进入AI新范式。
通义千问7B模型开源,魔搭最佳实践来了
通义千问开源!阿里云开源通义千问70亿参数模型,包括通用模型Qwen-7B-Base和对话模型Qwen-7B-Chat,两款模型均已上线ModelScope魔搭社区,开源、免费、可商用,欢迎大家来体验。
Qwen3.7‑Max纯文本旗舰深度解析:百万上下文、长周期Agent、编程能力与API完整实操教程
智能体技术快速发展的当下,普通大模型大多只能完成单次简短对话,一旦进入多步骤循环任务,经过几十次工具调用之后就容易出现逻辑退化、目标遗忘、指令漂移等问题,很难支撑长时间不间断的自主业务流程。很多开发团队在搭建代码智能体、自动化工作流的时候,经常遇到任务执行几十轮之后模型偏离原始需求,出现错误调用工具、输出无效内容,需要人工频繁介入纠正,很难直接投入生产环境运行。Qwen3.7‑Max作为通义千问3.7系列当中定位纯文本旗舰的大模型,专门面向长周期自主Agent场景深度优化,解决长会话多轮工具调用下的能力衰减痛点,把代码工程、复杂推理、百万级长文档解析、MCP协议接入融为一体,为代码智能体
阿里云百炼Night Plan全解析:夜间22:00-08:00错峰AI算力2折起深度指南
阿里云百炼Night Plan是百炼平台推出的**夜间错峰专属优惠计划**,核心价值是在夜间低峰时段为用户提供旗舰模型的超低折扣调用,帮助开发者、创作者与企业大幅降低AI算力成本。该计划覆盖Qwen3.7-Max、Qwen3.7-Plus等核心模型,在每晚22:00至次日08:00(北京时间)自动生效,无需手动切换配置,即可享受最高2折的专属价格,且服务质量、响应速度与白天完全一致。Night Plan深度适配Qoder CN、秒悟Meoo等百炼生态产品,与Token Plan、Coding Plan等订阅方案无缝兼容,是平衡AI算力成本与性能的最优选择。本文将从核心定位、适用范围、计费规则、
培训管理系统bizLearnify的 AI 智能陪练完整功能逻辑,以家电门店销售为例的剧本框架
AI陪练基于“场景构建—智能交互—实时评估—反馈闭环”四步体系,融合大模型、语音语义与多模态技术,在虚拟环境中还原真实业务对话。支持脚本式与智能体对练,动态调难、多维评分、即时复盘,并沉淀能力画像,助力销售等岗位精准提升实战能力。
中小企业定制软件开发实操全流程|需求梳理、技术选型、项目避坑完整指南
企业做定制软件常踩需求混乱、工期延期、预算超支等难题。本文结合一线项目实操经验,完整拆解定制软件开发全流程,分享需求梳理、技术选型、风险避坑、项目管控实用方法,助力中小企业低成本落地贴合自身业务的定制系统。
阿里云Qwen3.7 Max与Plus实测对比:纯文本旗舰与多模态全能王全维度解析
阿里云Qwen3.7系列推出Max与Plus两款核心商用模型,二者均标配100万Token超长上下文与35小时长时自治执行能力,但在底层架构、模态支持、性能侧重、计费成本上存在本质差异。Max定位纯文本旗舰,专攻复杂推理、代码与长链路智能体;Plus定位多模态全能,兼顾视觉理解、文本推理与端到端任务闭环。本文基于官方实测数据,从基础架构、模态能力、文本/代码/数学性能、计费成本、落地场景五大维度完整对比,为个人开发者、中小企业、政企团队提供精准选型依据。
阿里云千问Qwen 3.7 Plus与Max全面测评:从参数、能力到性价比的深度分析
阿里云Qwen 3.7系列包含Plus与Max两款核心模型,二者共享百万级上下文窗口与长时自治执行能力,但在模态支持、底层架构、推理性能与计费标准上存在本质差异,分别面向纯文本极致推理与多模态通用场景。通过实测对比两款模型的基础参数、文本能力、多模态能力、推理速度与成本效益,可清晰区分其适用边界,帮助用户根据业务需求精准选型,在保障性能的同时实现成本最优。以下从核心定位、基础参数、能力实测、性价比分析、场景选型五大维度,全面解析两款模型的差异与选型逻辑。