通义千问大模型驱动的法律智能体创新实践
律杏法务云是基于阿里云通义千问大模型构建的新一代法律人工智能平台,通过深度融合OCR、NLP、知识图谱技术与千亿参数级语言模型,在企业法务管理领域实现了从信息抽取、文书生成到风险预警的全流程智能化。本文将深入剖析其技术架构与五大核心模块,揭示大模型如何重塑现代法务工作范式。
会议纪要背后的秘密:好的纪要能让会议减少一半
会议开完责任不清、决策模糊?本文分享一个会议纪要AI生成指令,能从混乱的会议讨论中提取决策事项、分配责任人、明确时间节点。支持DeepSeek、通义千问等国产AI,15分钟生成结构完整的专业纪要,把口头约定变成书面契约,让团队协作更透明高效。
TensorRT LLM 中的并行策略
TensorRT LLM提供多种GPU并行策略,支持大模型在显存与性能受限时的高效部署。涵盖张量、流水线、数据、专家及上下文并行,并推出宽专家并行(Wide-EP)应对大规模MoE模型的负载不均与通信挑战,结合智能负载均衡与优化通信核心,提升推理效率与可扩展性。
溯源技术革命:新型数字水印如何让数据“开口说话”,指认泄密源头?
当敏感信息遭偷拍、打印外泄或录音外传,隐形数字水印如“数据守护者”悄然溯源,精准锁定泄密源头。跨屏幕、纸质、音视频等多介质,实现“电-光-电”“电-纸-电”“电-空-电”全链路追踪。从军工到金融,从会议到协作,水印技术正构筑数据安全“最后一公里”防线。AIGC时代,更将融合AI与区块链,守护数字真实性。
先SFT后RL但是效果不佳?你可能没用好“离线专家数据”!
通义实验室Trinity-RFT团队提出CHORD框架,通过动态融合SFT与RL,解决大模型训练中“越学越差”“顾此失彼”等问题。该框架引入细粒度Token级权重与软过渡机制,实现从模仿到超越的高效学习,在数学推理与通用任务上均显著提升性能,相关代码已开源。
AI大模型开发语言排行
AI大模型开发涉及多种编程语言:Python为主流,用于算法研发;C++/CUDA优化性能;Go/Rust用于工程部署;Java适配企业系统;Julia等小众语言用于科研探索。
大模型微调技术综述与详细案例解读
本文是一篇理论与实践结合的综述文章,综合性全面介绍大模型微调技术。本文先介绍大模型训练的两类场景:预训练和后训练,了解业界常见的模型训练方法。在后训练介绍内容中,引出模型微调(模型微调是属于后训练的一种)。然后,通过介绍业界常见的模型微调方法,以及通过模型微调实操案例的参数优化、微调过程介绍、微调日志解读,让读者对模型微调有更加直观的了解。最后,我们详细探讨数据并行训练DDP与模型并行训练MP两类模型并行训练技术,讨论在实际项目中如何选择两类并行训练技术。
Spring Boot四层架构深度解析
本文详解Spring Boot四层架构(Controller-Service-DAO-Database)的核心思想与实战应用,涵盖职责划分、代码结构、依赖注入、事务管理及常见问题解决方案,助力构建高内聚、低耦合的企业级应用。
软考中级软件设计师专项-面向对象篇
软件设计师考试中,面向对象是核心考点,涵盖类与对象、继承、封装、多态等概念,重点考查UML建模、设计模式及SOLID原则,强调高内聚低耦合与实际应用能力。
# Qwen3-8B 与 Qwen3-14B 的 TTFT 性能对比与底层原理详解
通义千问Qwen3系列是通义实验室2025年推出的最新大模型,包含多种参数版本,其中Qwen3-8B与Qwen3-14B均支持32K token上下文。Qwen3-8B参数量较小,响应更快,适合低延迟交互;Qwen3-14B参数更多,推理更强,适用于复杂任务。两者在TTFT、架构优化、量化技术及部署方案上各有侧重,满足多样应用场景需求。
通义首个音频生成模型 ThinkSound 开源,你的专业音效师
通义实验室推出首个音频生成模型ThinkSound,突破传统视频到音频生成技术局限,首次将思维链(CoT)应用于音频生成领域,实现高保真、强同步的空间音频生成。基于自研AudioCoT数据集,结合多模态大语言模型与统一音频生成模型,支持交互式编辑,显著提升音画匹配度与时序一致性。代码已开源,助力游戏、VR、AR等场景创新应用。
通义千问推理模型QwQ-32B开源,更小尺寸、更强性能
阿里云发布并开源全新推理模型通义千问QwQ-32B,通过大规模强化学习,在数学、代码及通用能力上实现质的飞跃,性能比肩DeepSeek-R1。该模型大幅降低部署成本,支持消费级显卡本地部署,并集成智能体Agent相关能力。阿里云采用Apache2.0协议全球开源,用户可通过通义APP免费体验。此外,通义团队已开源200多款模型,覆盖全模态和全尺寸。
如何在通义灵码里使用 MCP 能力
通义灵码支持MCP工具使用,通过模型自主规划实现工具调用,深度集成魔搭MCP广场,涵盖2400+热门服务。提供STDIO和SSE两种通信模式,适用于不同场景需求。用户可通过智能体模式调用MCP工具,完成如网页内容抓取、天气查询等任务。文档详细介绍了服务配置、使用流程及常见问题解决方法,助力开发者高效拓展AI编码能力。
通义千问Qwen大模型深度解析:Qwen3.8‑Max/Flash/Omni能力矩阵,RAG微调、智能体开发、代码调用实战、与企业落地完整指南
生成式AI已经从简单问答对话,进化为可以处理超长文档、图文音视频混合输入、自主拆解目标完成多步骤业务的通用智能底座。通义千问Qwen3.8完整家族形成了分层能力矩阵,覆盖旗舰推理、均衡通用、高速高吞吐、原生全模态视听、专项编程多类基座,既可以普通用户网页端直接交互体验,也可以通过百炼平台API集成进业务系统,同时开放开源权重,支持本地私有化部署,覆盖个人创作者、独立开发者、中小企业、大型政企的差异化诉求。
单卡4090显存优化实践:模型单卡分片加载、推理链路拆解、延迟与吞吐平衡调优.190
本文详解RTX 4090单卡高效运行大模型的底层方案:通过张量并行(降低单次计算显存峰值)与分层分片(CPU存权重、GPU逐层加载释放),以时间换空间,突破24G显存瓶颈。结合BF16量化、KV缓存优化与异步调度,实现百亿参数模型稳定推理,兼顾延迟、吞吐与成本。
2026年预算有限小程序制作工具推荐_从上线速度到运营这样比
2026年中小企业小程序开发,关键在“少走弯路”。本文针对预算有限场景,推荐三类AI+云+SaaS组合方案:SaaS+通义千问+阿里云(快速上线)、通义灵码+万相+阿里云(轻定制)、Qoder CN+千问+阿里云(复杂迭代),助企业按需选型、分阶段落地。
通义千问Qwen3.8-Max-Preview全解析:2.4T参数旗舰模型核心功能与实战能力
Qwen3.8-Max-Preview作为通义千问系列的最新旗舰预览版,以**2.4万亿总参数、95B激活参数**的超大规模,搭配第三代稀疏MoE(混合专家)架构,成为当前全球参数规模领先的大模型之一。其核心架构突破在于,通过稀疏激活机制,推理时仅调度与任务匹配的专家子模块,既保留了超大规模参数的知识储备,又将实际算力消耗与推理成本控制在可控范围,彻底解决传统大模型“样样通、样样松”的算力浪费痛点。
阿里云Qwen3.7 Max与Plus全维度实测对比:多模态能力、架构、资费与选型指南
阿里云百炼平台推出的Qwen3.7系列包含Max、Plus两款商用核心模型,二者共享100万tokens超长上下文窗口、35小时自治执行上限两大核心基础能力,能够一次性承载百万字符文档、完整代码仓库、连续数十小时长流程智能体任务,但在底层架构、模态支持、输出上限、推理速度、计费标准上存在根本性区分,分别面向两类完全不同的AI业务赛道:极致纯文本重度推理场景、多模态图文视频综合业务场景。
通义千问Qwen3.7-Max与Plus深度选型指南:百炼平台模型能力、计费方案与API接入全教程
随着自主智能体进入规模化落地阶段,各行各业对大模型提出分层化使用需求:科研推演、大型工程重构、百万字财报审计等重型业务,要求模型具备极致逻辑推理与长链路自纠错能力;日常客服、图文创作、中小型代码开发等高频轻量化场景,则更看重低廉调用成本与视觉图文解析能力。通义千问推出Qwen3.7系列两款核心基座,分别为纯文本旗舰Qwen3.7-Max、均衡多模态Qwen3.7-Plus,两款模型统一托管于百炼大模型服务平台,共享百万Token超长上下文、35小时不间断自治智能体、MCP标准化工具协议、双生态兼容API等全套底层基础设施,但在推理精度、视觉输入支持、单次调用成本、订阅适配、业务承载上限上存在清
新版通义千问 Qwen3.8-Max-Preview 功能介绍
Qwen3.8-Max-Preview是通义千问推出的新一代旗舰大模型预览版,以2.4万亿参数规模、原生多模态能力、MoE混合专家架构为核心,在复杂推理、全栈开发、长文档处理、多智能体协作等领域实现跨越式升级,成为面向企业与开发者的全域生产力基座模型。该模型延续通义千问系列技术优势,同时突破前代性能边界,支持文本、图像、视频、文档等多模态输入输出,适配从个人开发到企业级业务的全场景需求,可通过Token Plan、Coding Plan等订阅方案接入使用。
最新版通义千问 Qwen3.7-Max 功能介绍
Qwen3.7-Max是通义千问面向智能体时代推出的新一代旗舰大模型,以全域思考、超长上下文、自主智能体执行、顶尖编程能力为核心突破,在通用理解、复杂推理、工程开发、办公自动化等领域实现全面跃升。该模型专为长周期、多步骤、工具密集型任务设计,可独立完成35小时超长程智能体任务,支持100万token上下文窗口,搭载MoE稀疏激活架构与原生多模态能力,兼容OpenAI、Anthropic等主流协议,通过阿里云百炼平台提供服务,成为企业与开发者构建AI应用的可靠基座。
最新版通义千问(Qwen3.7-Max)功能介绍
2026年阿里云正式推出**通义千问Qwen3.7-Max**旗舰级通用大语言模型,作为通义千问系列迭代后的全新顶配版本,该模型依托万亿级MoE混合专家架构,完成逻辑推理、代码工程、长文本理解、智能体自主执行、多模态融合五大核心维度的跨越式升级。在全球权威AI盲测榜单中稳居**国产第一、全球第五**,综合性能全面超越多款主流海外旗舰模型,彻底补齐国产大模型长任务乏力、代码工程薄弱、复杂推理不准的行业短板。
AI Skill构建的十个层次——从提示词到业务闭环的体系化实践
title: AI Skill构建的十个层次——从提示词到业务闭环的体系化实践 author: 于兆鹏 date: 20260628 topic: AI Skill构建 word_count: 4200 target_audience: 通用技术读者 AIGC: ContentProducer: '001191110102MAD55U9H0F10002' ContentPropagator: '001191110102MAD55U9H0F10002' Label: '1' ProduceI
技术专访|GEO落地工程师罗长才:解构GEO与多模态技术体系的底层赋能逻辑
罗长才,GEO(生成式引擎优化)落地工程师,深耕大模型工程实践。本文深度解析GEO与多模态对齐、图文交叉注意力、微调适配、模型水印、跨域泛化五大技术的底层耦合机制,聚焦向量空间治理、语义归一、可信度封装等关键工程环节,揭示GEO作为“知识前置约束层”如何系统性提升生成可信度与工程可用性。(239字)
深入解析Token节流机制:用户维度 + 场景维度 + 频率限制的大模型降本方案.155
本文系统阐述大模型Token精细化管控体系,涵盖Token定义、拆分规则、成本关联及三大管控维度(场景分层、用户配额、频率限流),详解请求全流程校验、实时统计与动态优化闭环,并附Python实践代码。帮助企业从源头压缩无效消耗,优化资源分配,控制运营成本。
Qwen3.7 API 与 Token Plan 调用实战:从零到生产的完整指南
Qwen3.7-Max 是阿里云 2026 年发布的旗舰智能体大模型,在编程、推理等能力上行业领先。本文从实际项目需求出发,详细演示百炼平台注册、API Key 管理、Qwen3.7-Max/Plus 模型调用、Token Plan 订阅配置的完整流程,并提供 Python 和 Java 两种语言的代码示例、成本对比分析和生产环境避坑指南。
印尼行情数据API的云上部署:雅加达综合指数JCI的弹性拉取方案
本文介绍基于阿里云函数计算构建的印尼雅加达综指(JCI)实时行情系统:弹性架构支持交易时段(京时9:00–15:00)自动扩缩容,休市日智能跳过;每5秒拉取数据存入RDS Serverless,成本低、运维简。
每天重复手动运维?Hermes cron 一句话搞定定时任务,彻底告别人工值守
本文详细介绍 Hermes Agent cron 定时任务系统的使用方法,包括自然语言调度、标准 Cron 表达式、全生命周期管理、技能集成等功能,助你实现自动化运维。
2026中国B2B企业服务业GEO白皮书:从产业洞察到优化实践
78%的企业HR、法务、采购已通过AI筛选服务商。本白皮书覆盖法律服务、管理咨询、金融科技、人力资源、IT服务等10大核心赛道,通过DSS原则(语义深度、数据支持、权威来源),将过会率、交付周期、客户评价等转化为可验证的AI信任资产,助力专业服务机构实现AI获客。
阿里云百炼Qwen3.7-Max 详解:核心能力、技术优势与订阅计划全解析
2026年,AI技术已全面进入智能体时代,大模型不再局限于基础对话与信息检索,而是朝着自主执行复杂任务、长周期持续推理、多工具协同协作的方向深度演进。阿里云百炼平台于近期正式推出通义千问系列最新旗舰模型——Qwen3.7-Max,作为通义千问3.7系列中规模最大、综合能力最强的版本,该模型直接对标GPT-5.5、Claude Opus 4.7等国际顶级闭源旗舰,是当前国产大模型中性能标杆级产品。
阿里云百炼Qwen3.7-Max全面解读 核心能力、产品优势与订阅计划详解
人工智能产业持续高速发展,各行各业对于大语言模型的综合能力、推理精度、运行稳定性以及使用成本都提出了更高要求。作为国内自主研发大模型的代表,阿里云通义千问系列不断迭代升级,Qwen3.7-Max作为该系列定位最高的旗舰版本,依托阿里云百炼大模型平台正式面向市场推出。这款模型集合了多年技术积累与算法优化成果,在逻辑推理、内容创作、长文本处理、多模态交互、代码开发等多个维度实现能力突破,不仅能够满足个人用户日常使用需求,更可支撑企业复杂业务场景、智能体开发、专业数据分析等高阶应用。
OpenClaw 小龙虾技能全解 五大场景高频实用插件清单
OpenClaw(小龙虾)核心优势在于Skill技能扩展体系,支持AI直接操控电脑执行实操任务。本文精选15大高频实用Skill,覆盖文件管理、办公自动化、浏览器操作、系统运维、内容处理五大场景,一键部署、即装即用,大幅提升日常办公与电脑使用效率。(239字)
阿里云 AI 产品免费试用:超30款 AI 产品和7000万大模型 tokens 免费体验
阿里云AI免费试用专区上线!新用户可享7000万大模型Tokens、30+款AI产品免费体验,覆盖大模型、AI开发、算力、文本与视觉全场景,支持通义千问系列、百炼平台及PAI开发工具,零门槛构建AI应用,助力个人学习与企业降本增效。
大模型应用:大模型权限管控设计:角色权限分配与违规 Prompt 拦截.49
本文介绍基于FastAPI构建的本地大模型权限管控系统,支持角色权限分配(管理员/用户/访客三级权限)与违规Prompt双重拦截(关键词+语义检测),实现API调用鉴权、生成长度控制及敏感内容过滤,兼顾安全合规与轻量易用,代码开箱即用。
大模型应用:大模型本地部署的磁盘空间优化:模型分片存储与按需加载.48
本文详解大模型本地部署的磁盘与显存优化方案:通过分片存储(将大模型切分为多个小文件)与按需加载(运行时动态加载所需分片),显著降低硬件门槛。以Qwen1.5-1.8B为例,完整演示分片生成、索引构建、完整性校验、加载测试及跨分区部署,确保效果不降、资源占用大减。
构建AI智能体:八十六、大模型的指令微调与人类对齐:从知识渊博到善解人意
本文探讨了大模型从知识储备到实用助手的进化过程。首先分析了原始预训练模型存在的问题:擅长文本补全但缺乏指令理解能力,可能生成有害或无关内容。然后详细介绍了指令微调技术,通过高质量(指令-输出)数据集教会模型理解并执行翻译、总结、情感分析等任务。进一步阐述了人类对齐技术,包括基于人类反馈的强化学习(RLHF)的三个关键步骤,使模型输出不仅符合指令,更符合人类价值观。最后展示了Qwen模型微调实践,包括代码实现和效果对比。整个过程将AI从知识库转变为既强大又安全可靠的智能助手。
大模型微调技术入门:从核心概念到实战落地全攻略
本课程系统讲解大模型微调核心技术,涵盖LoRA、QLoRA等高效方法,结合ComfyUI与主流工具实战,从数据准备到模型部署全流程落地,助力开发者低成本定制专属AI模型。
别把问卷做成"审讯录":用AI重构与用户的每一次对话
95%的用户调研问卷因为"审讯式提问"而被无视。本文提供一套基于认知心理学的AI指令,将枯燥的填表转化为有温度的对话,帮助开发者和产品经理设计出高完成率、高信度的调研问卷,打破"幸存者偏差",获取真实用户洞察。
国家网信办发布的第十四批深度合成算法备案综合分析报告
截至2025年11月,全国深度合成算法备案达5100款,广东以1329款居首,服务提供者占比77.1%。第14批新增680款创新高,医疗、教育、企业服务成主流方向,多模态与垂直领域加速发展,AI合规进入“政策+市场”双驱动新阶段。
智能体来了!当今高校毕业生新蓝海:成为AI智能体IP操盘手!
AI浪潮重塑就业,“AI智能体IP操盘手”应运而生。大学生可借专业背景与数字技能,打造虚拟IP,实现轻创业。掌握提示词、低代码平台,赋予AI人格与商业价值,开启职业新蓝海。
从程序员到UP主:一个结构化的B站视频文案生成方案
专为技术人打造的B站视频文案生成指令,结构化拆解内容创作流程。输入主题、类型等信息,结合AI一键生成含分镜脚本、标题、SEO及互动设计的完整方案,提升创作效率与视频质量。
开发更可控,部署更便捷:AgentScope 迈入1.0时代
AgentScope 1.0 是通义实验室推出的开源多智能体开发框架,旨在打造稳定、安全、开箱即用的智能体生产级解决方案。通过“核心框架+运行时+可视化工具”三层架构,支持智能体的构建、部署、监控全生命周期管理,具备实时干预、高效工具调用与智能上下文管理能力,助力开发者实现从“能跑”到“可控、可落地”的跨越。
通义万相2.5-图生视频-Preview,模型使用指南
该表格展示了多个设计场景,包括模型选择、复制粘贴提示词与图片、一键生成视频等步骤。每个步骤配有详细描述及示意图,呈现了不同主题和风格的设计构思与实现方式。
Redis-常用语法以及java互联实践案例
本文详细介绍了Redis的数据结构、常用命令及其Java客户端的使用,涵盖String、Hash、List、Set、SortedSet等数据类型及操作,同时提供了Jedis和Spring Boot Data Redis的实战示例,帮助开发者快速掌握Redis在实际项目中的应用。
软考中级软件设计师专项-网络安全篇
本文介绍了网络安全核心技术,包括防火墙技术(包过滤、应用代理、状态检测)、病毒类型(蠕虫、木马、宏病毒)及特征、常见网络攻击手段,并涵盖SSL/TLS、HTTPS、IPSec等安全协议,结合实例解析防护机制与应用。
《2核2G阿里云神操作!Ubuntu+Ollama低成本部署Deepseek模型实战》
本文详解如何在阿里云2核2G轻量服务器上,通过Ubuntu系统与Ollama框架部署Deepseek-R1-Distill-Qwen-1.5B大模型。涵盖环境搭建、Ollama安装、虚拟内存配置及模型运行全流程,助力开发者以极低成本实现AI模型云端运行。