|
5月前
|
自然语言处理 算法 知识图谱
|

高维数据新突破!大语言模型赋能特定领域文本分类标注,效率精准双提升

合肥高维数据提出“大模型+工具箱”专业文本标注新方法:为LLM配备7类查询接口,支持术语查解、知识积累与专家协同;结合流程化工作流与遗传算法优化指令,显著提升医疗、金融、法律等领域的标注准确率与自动化水平。(239字)

368 4
|
5月前
|
数据采集 人工智能 缓存
|

ModelEngine思想落地指南:用“智能体 + 插件”构建可复用AI应用.76

ModelEngine是一种AI应用开发范式,通过角色化智能体分工、插件化工具集成与双模式(低代码+代码)开发,解决重复造轮子、流程碎片化、技术门槛高等痛点,实现高效、灵活、可复用的AI应用构建。

438 13
|
6月前
|
机器学习/深度学习 JSON 缓存
|

粗心了

MAXUR 是专为 Qwen3.5-9B 设计的轻量级诊断包(单文件、零外部依赖),内置动态稀疏注意力、自我反思门与上下文压缩器三大推理模块,通过**层替换**深度集成至模型架构,非hook挂载。开箱即用,显著降低幻觉(↓94.4%),提升事实性与长上下文稳定性。

327 3
|
6月前
|
机器学习/深度学习 人工智能 机器人
|

大模型应用:稀疏注意力 vs 滑动窗口:大模型扩窗技术完全解析.58

本文详解大模型“扩窗”核心技术:滑动窗口注意力(快而局部,适合中短文本)与稀疏注意力(兼顾局部+跨步+首尾,支持超长上下文)。二者均通过降低O(n²)计算复杂度至线性,解决大模型长文本处理的内存与算力瓶颈,推动其从聊天工具升级为长文档分析、代码全量理解等实用AI。

893 26
|
6月前
|
运维 调度 数据中心
|

Infiniband/以太网,算力组网布线方案

本文详解SuperPOD构建:以32台DGX H100/H200为单元(SU),采用叶脊(Spine-Leaf)网络架构,通过多模光纤/DAC短距连接服务器与叶交换机,单模光纤长距连接叶与脊交换机;支持点对点与结构化布线,提升扩展性、管理效率与运维灵活性。(239字)

895 0
|
6月前
|
数据采集 存储 机器学习/深度学习
|

大模型应用:大模型训练数据治理:噪声过滤与高质量中文语料构建实践.40

本文系统阐述中文大模型训练数据治理的核心方法,涵盖噪声分类(内容/格式/偏见/纯净性)、高质量语料四大标准(准确性、全面性、纯净性、新颖性)及五步闭环流程,并通过规则与模型驱动的实践案例,验证数据质量对模型性能的显著影响。

814 3
|
6月前
|
机器学习/深度学习 存储 运维
|

大模型应用:大模型权重敏感性分析:L1/L2 范数、梯度贡献深入解读.39

本文系统讲解大模型权重敏感性:即权重微小变化对模型输出的影响程度。核心依据是“静态潜力”(L1/L2范数)与“动态贡献”(梯度范数),二者结合可精准识别高敏感(需保护/精细调优)与低敏感(可剪枝/量化)权重,支撑模型压缩、加速与稳定性优化。

988 2
|
7月前
|
人工智能 算法 安全
|

AI Agent 职业路线:从工具使用者到智能体生态构建者

本文探讨AI Agent驱动的职场范式转移:从人机交互迈向人机协同。提出技术从业者三层角色(执行者、协作者、生态管理者),并系统阐述上下文工程、输出校验、智能体调优三大核心能力,以及单点应用→多体编排→生态治理的进阶路径。(239字)

438 5
|
8月前
|
算法 知识图谱
|

专注主权:智能体领航员夺回你的心智带宽

本文阐述“智能体领航员”如何成为心智护盾:通过语义拦截噪音、守护专注力、逆向对抗算法成瘾、重塑慢生活仪式,并坚守人类决策权、过滤透明性与现实优先原则——终极目标是帮你在信息洪流中夺回深度思考与真实自由。(239字)

272 0
|
8月前
|
机器学习/深度学习 人工智能 调度
|

从单体到集群:AI Agent 中“指挥官”与“调度官”的双层协作模式设计

本文提出一种“指挥官+调度官”双层治理架构,解决多智能体系统中的通信混乱与任务死锁问题。指挥官负责高层规划,调度官专注任务分发,通过职责解耦实现高效协作,并结合Python代码展示核心实现,提升复杂场景下多Agent系统的稳定性与可扩展性。

922 0
|
8月前
|
人工智能 JSON 并行计算
|

建议收藏:大模型模型实战手册,让你的AI从“通才”变成“专才”

本文深入浅出地讲解了如何让大模型真正懂你的业务。针对开源模型“胡说八道”的痛点,系统拆解CPT、SFT、DPO三大微调技术,结合Qwen 2.5、Llama 3等主流模型实战对比,并手把手指导数据准备、环境配置与训练优化,助你用低成本打造专属AI专家,少走半年弯路。

483 2
|
8月前
|
开发者
|

Qwen的新里程碑🥳

Qwen衍生模型数量突破20万,成为全球首个达成此目标的开源大模型!

461 0
|
8月前
|
机器学习/深度学习 人工智能 算法
|

给大模型“上上价值”:用PPO算法让AI更懂你的心

本文深入浅出讲解PPO算法——大模型“价值观对齐”的核心引擎。以教育孩子为喻,解析其“剪切更新”“优势估计”“KL约束”等机制,涵盖原理、实战(数据准备→奖励建模→五步微调)、避坑指南及DPO等前沿方向,助你让AI既聪明又懂你。(239字)

707 7
|
8月前
|
机器学习/深度学习 人工智能 缓存
|

构建AI智能体:九十八、实践出真知:本地AI大模型部署的核心要点与经验总结

本文介绍了如何在个人电脑上加载和运行轻量级AI大语言模型。首先解析了大语言模型的基本概念和工作原理,包括Tokenizer、Prompt等关键术语。然后详细演示了三种模型加载方式:通过ModelSpace下载Qwen模型、使用HuggingFace加载BERT模型、利用SentenceTransformer获取句子嵌入。特别强调了在CPU环境下的配置技巧,如设置torch.float32数据类型和优化内存使用。文章还提供了完整的中文对话生成示例代码,展示了Qwen1.5-1.8B-Chat模型的实际应用效果

1723 6
|
8月前
|
数据采集 人工智能 物联网
|

教AI学会说'我是小喵'竟然这么神奇?LlamaFactory微调揭秘

想让AI助手记住自己叫什么名字?就像教小孩背诵身份证信息一样简单!通过LlamaFactory的SFT微调,你的AI不仅能记住自己是谁,还能在千万个问题中准确回答身份信息。从技术小白到微调高手,一篇文章搞定! #人工智能 #LlamaFactory #模型微调 #AI助手

677 2
|
8月前
|
人工智能 安全 搜索推荐
|

一个尚在公测的产品,凭什么能登顶AI排行第一名

OiiOii内测即登顶AIWW动画生成榜首,揭示AI应用竞争逻辑之变:从流量堆砌转向价值共鸣。市场正由“技术参数”比拼,迈向“可感知价值”的终极战场——真实需求、清晰定位与体验差异成关键。此非流量奇迹,而是行业向产品本质回归的信号。

782 1
|
9月前
|
机器学习/深度学习 人工智能 搜索推荐
|

构建AI智能体:七十一、模型评估指南:准确率、精确率、F1分数与ROC/AUC的深度解析

本文系统介绍了机器学习模型评估的核心指标与方法。首先阐述了混淆矩阵的构成(TP/FP/FN/TN),并基于此详细讲解了准确率、精确率、召回率和F1分数的计算原理和适用场景。特别指出准确率在不平衡数据中的局限性,强调精确率(减少误报)和召回率(减少漏报)的权衡关系。然后介绍了ROC曲线和AUC值的解读方法,说明如何通过调整分类阈值来优化模型性能。最后总结了不同业务场景下的指标选择策略:高精度场景侧重精确率,高召回场景关注召回率,平衡场景优选F1分数,不平衡数据则推荐使用AUC评估。

1002 20
|
9月前
|
机器学习/深度学习 人工智能 自然语言处理
|

构建AI智能体:六十一、信息论完全指南:从基础概念到在大模型中的实际应用

摘要: 信息论是人工智能尤其是大语言模型的核心数学工具。本文系统介绍了八大核心概念: 信息量:衡量事件意外程度,公式为I(x)=-log₂P(x) 信息熵:评估系统不确定性,H(X)=-ΣP(x)log₂P(x) 联合熵/条件熵:分析多变量关系及条件不确定性 互信息:量化变量间共享信息量 KL散度:衡量概率分布差异 交叉熵:模型训练的核心损失函数 在大语言模型中,这些概念被广泛应用于: 训练阶段:交叉熵优化预测,KL散度防止过拟合 推理阶段:温度参数调节生成文本的创造性(高熵增加多样性)

1109 2
|
9月前
|
人工智能 自然语言处理
|

构建AI智能体:四十一、大模型思维链提示工程:技术原理与行业应用案例分析

本文介绍了思维链提示技术及其应用。思维链提示是一种引导大模型进行逐步推理的提示工程技术,通过结构化提示模拟人类解决问题的逻辑分析路径,使模型能够显式化中间推理步骤,从而提升推理准确性与可解释性。文章详细阐述了思维链提示的关键特征(步骤可解释性、逻辑链条完整性、问题分解能力)和工作原理,并通过数学推理、逻辑分析和多轮复杂问题三个案例展示了其具体应用流程。该技术在教育辅导、商业决策和科研分析等领域具有重要价值,能够突破传统大模型的黑箱推理瓶颈,提高AI系统的决策透明度和可靠性。

1103 13
|
10月前
|
安全 算法 数据安全/隐私保护
|

屏幕拍照精准溯源:从“防不住”到“不敢泄”的震慑闭环是如何形成的?

屏幕拍照泄密频发,隐形水印技术以“无感嵌入、拍必留痕”破解防护难题。通过在显示画面中嵌入用户身份、设备信息等溯源数据,实现拍照即锁定责任人,构建“事前威慑、事中记录、事后追责”的全链路闭环,筑牢“不敢泄、不能泄、不想泄”安全防线。

930 7
|
10月前
|
人工智能 API 开发者
|

企业级大模型市场,阿里通义份额第一

国际市场调研机构沙利文(Frost&Sullivan)发布了最新的《中国GenAI市场洞察:企业级⼤模型调⽤全景研究,2025》报告——2025年上半年,中国企业级市场大模型的日均总消耗量为10.2万亿Tokens,其中,阿里通义占比17.7%位列第一,成为目前中国企业选择最多的大模型。

1771 1
|
10月前
|
人工智能 安全 云计算
|

中国银联基于通义千问打造金融支付垂域大模型

中国银联携手阿里云,基于通义千问打造金融支付大模型,依托AI技术推动支付清算、风控反欺诈等环节智能化升级,共建安全高效的大模型应用范式,助力金融行业高质量发展。

1339 2
|
12月前
|
缓存 监控 Java
|

SpringBoot @Scheduled 注解详解

使用`@Scheduled`注解实现方法周期性执行,支持固定间隔、延迟或Cron表达式触发,基于Spring Task,适用于日志清理、数据同步等定时任务场景。需启用`@EnableScheduling`,注意线程阻塞与分布式重复问题,推荐结合`@Async`异步处理,提升任务调度效率。

1678 128
|
12月前
|
JavaScript 前端开发 IDE
|

TypeScript vs. JavaScript:技术对比与核心差异解析

TypeScript 作为 JavaScript 的超集,通过静态类型系统、编译时错误检测和强大的工具链支持,显著提升代码质量与可维护性,尤其适用于中大型项目和团队协作。相较之下,JavaScript 更灵活,适合快速原型开发。本文从类型系统、错误检测、工具支持等多维度对比两者差异,并提供技术选型建议,助力开发者合理选择。

1794 1
|
12月前
|
存储 JSON 数据建模
|

鸿蒙 HarmonyOS NEXT端云一体化开发-云数据库篇

云数据库采用存储区、对象类型、对象三级结构,支持灵活的数据建模与权限管理,可通过AGC平台或本地项目初始化,实现数据的增删改查及端侧高效调用。

639 1
|
12月前
|
存储 数据库 开发工具
|

HarmonyOS APP应用开发项目- MCA助手(Day04持续更新中~)

本项目为基于HarmonyOS的端云一体化记账App,集成华为AGC云数据库与认证服务,实现用户注册登录及数据云端存储。通过DevEco Studio开发,解决CloudProgram模块显示问题,完成云数据库初始化与用户信息关联功能。

456 1
|
12月前
|
IDE 开发工具 Python
|

通义灵码+支付 MCP:30 分钟实现创作打赏智能体

本文介绍如何使用通义灵码智能体与 qwen3 和支付 MCP 编写创作打赏智能体,该智能体能够完成日常聊天、诗词创作和请求打赏并生成支付链接功能。

995 1
|
存储 人工智能 自然语言处理
|

告别文字乱码!全新文生图模型Qwen-Image来咯

通义千问团队开源了Qwen-Image,一个20B参数的MMDiT模型,具备卓越的文本渲染和图像编辑能力。支持复杂中英文文本生成与自动布局,适用于多场景图像生成与编辑任务,已在魔搭社区与Hugging Face开源。

2026 2
|
人工智能 缓存 Kubernetes
|

几大AI知识库致命坑点:避开它们,少走3个月弯路!

本文详解AI知识库在企业中的应用,涵盖架构设计、文档处理、工作流优化与性能调优等核心技术,结合实际案例帮助读者避开落地过程中的常见陷阱,适合希望提升AI应用能力的技术人员阅读。

1083 2
|
数据采集 人工智能 监控
|

人工智能驱动的软件工程:测试左移的崛起价值

本文探讨了人工智能驱动下测试左移理念在软件工程中的重要性,分析测试工程师在需求评估、AI代码生成及遗留系统优化中的关键作用,揭示AI带来的挑战与机遇,并指出测试工程师需提升技能、关注合规与可维护性,以在AI时代保障软件质量。

673 89
|
存储 缓存 资源调度
|

# Qwen3-8B 的 TTFT 性能分析:16K 与 32K 输入 Prompt 的推算公式与底层原理详解

Qwen3-8B 是通义实验室推出的 80 亿参数大模型,支持最长 32,768 token 上下文,适用于长文本处理场景。通过 FP8 量化、CUDA Kernel 优化及 RoPE 位置编码技术,提升推理效率与稳定性。模型在 16K 输入下 TTFT 约 150-200ms,32K 输入下约 250-300ms,适用于文档摘要与长对话交互。

3423 8
|
存储 缓存 资源调度
|

# Qwen3-8B 与 ChatGPT-4o Mini 的 TTFT 性能对比与底层原理详解

Qwen3-8B 是通义实验室推出的80亿参数模型,支持32K上下文,采用FP8量化和CUDA优化,提升推理效率;ChatGPT-4o Mini 为OpenAI轻量模型,参数约3.8B,支持128K上下文,通过蒸馏技术实现低延迟。两者在TTFT、长文本处理和部署优化上各有优势,适用于不同应用场景。

1977 9
|
编解码 自然语言处理 安全
|

📣通义大模型新成员Qwen-VLo,重磅上线,它实现了从“看懂”世界到“描绘”世界

通义千问团队推出全新多模态统一理解与生成模型Qwen VLo,具备强大的图像理解与生成能力。它不仅能“看懂”图像内容,还能基于理解进行高质量再创造,实现从感知到生成的跨越。支持开放指令编辑、多语言交互及复杂任务处理,适用于图像生成、风格迁移、检测标注等多种场景。

1950 1
|
人工智能
|

接入通义千问3后,B站618期间商单成交效率提升5倍+

B站引入通义千问Qwen3、Qwen-VL等模型打造智能体InsightAgent,助力商业平台“花火”与“必达”提效。花火AI选人功能实现商单成交效率提升5倍以上,必达平台数据洞察效率提升3倍以上,大幅优化品牌合作流程。

507 1
|
JSON 数据格式
|

本地部署的qwen3-8b模型和百炼上的qwen3-8b模型效果不一致

我在使用Function Call时发现,百炼平台上的Qwen3-8B模型与本地部署的Qwen3-8B模型效果存在差异,主要体现在函数参数生成上,本地模型常出现漏参或JSON格式错误,而百炼模型表现正常。想确认百炼平台的Qwen3-8B是否为更高版本?

1999 1
|
人工智能 数据可视化 JavaScript
|

颠覆开发效率!国内首个微服务编排框架Juggle开源啦!

Juggle是国内首个开源的微服务编排框架,专注于解决企业微服务进程中接口重复开发、系统对接复杂等问题。它提供零代码、低代码和AI增强功能,通过可视化拖拽快速组装简单API为复杂接口,支持多协议、多语言脚本和流程多版本管理。相比国外框架如Conductor,Juggle更贴合国内需求,具备高效开发、企业级可靠性及信创适配等优势,助力企业实现敏捷创新与数字化转型。

1317 0
|
Arthas 监控 Java
|

Arthas vmtool(从 jvm 里查询对象,执行 forceGc)

Arthas vmtool(从 jvm 里查询对象,执行 forceGc)

1049 16
|
JavaScript 前端开发 Java
|

通义灵码 Rules 库合集来了,覆盖Java、TypeScript、Python、Go、JavaScript 等

通义灵码新上的外挂 Project Rules 获得了开发者的一致好评:最小成本适配我的开发风格、相当把团队经验沉淀下来,是个很好功能……

2333 103
|
人工智能 架构师 前端开发
|

手把手体验通义灵码2.0:AI程序员如何让我从“调参侠”进阶“架构师”?

通义灵码2.0是一款强大的AI编程工具,帮助开发者从“调参侠”进阶为“架构师”。它通过跨语言开发支持、智能单元测试生成和图生代码等功能,大幅提升开发效率。例如,将Python数据处理函数一键转为React+ECharts组件,自动生成单元测试用例,甚至通过草图生成前端布局代码。此外,新增的QwQ模型具备“代码脑补”能力,可推荐性能优化策略。尽管功能强大,但仍需注意环境隔离与代码审查,避免过度依赖。通义灵码2.0不仅是工具,更是开发者的“外接大脑”。

762 8
|
机器学习/深度学习 人工智能 文字识别
|

从“泛读”到“精读”:合合信息文档解析如何让大模型更懂复杂文档?

随着deepseek等大模型逐渐步入视野,理论上文档解析工作应能大幅简化。 然而,实际情况却不尽如人意。当前的多模态大模型虽然具备强大的视觉与语言交互能力,但在解析非结构化文档时,仍面临复杂版式、多元素混排以及严密逻辑推理等挑战。

720 0
|
存储 人工智能 自然语言处理
|

通义千问 Qwen 系列的 Agent 方向探索

通义千问Qwen系列在AI领域展现了强大的Agent方向探索能力,包括灵活的Tool调用、单/多Agent场景实践等,通过丰富的代码示例展示了其在文本生成、信息检索、任务自动化及专业领域应用等方面的优势,为复杂应用场景提供了多元且实用的解决方案。

2158 3
|
弹性计算 Serverless 数据安全/隐私保护
|

针对【图像生成 - ComfyUI】使用的深度评测

ComfyUI 是一款支持自定义工作流的图像生成工具,适用于创意设计、游戏开发和电商等多个行业。它能根据项目需求灵活调整图像生成流程,提高创意实现效率,同时具备成本效益和弹性伸缩能力,适应业务量变化。尽管如此,ComfyUI 在技术门槛和数据安全方面仍存在挑战,需注意非专业用户的学习曲线和敏感数据保护。

2256 8
|
人工智能 自然语言处理 并行计算
|

探索大模型部署:基于 VLLM 和 ModelScope 与 Qwen2.5 在双 32G VGPU 上的实践之旅

本文介绍了使用 `VLLM` 和 `ModelScope` 部署 `Qwen2.5` 大模型的实践过程,包括环境搭建、模型下载和在双 32G VGPU 上的成功部署,展现了高性能计算与大模型结合的强大力量。

4288 3
|
SQL 安全 UED
|

通义灵码在DBA日常SQL优化中的使用分享

通义灵码在DBA日常SQL优化中的使用分享

1137 1
|
JSON 人工智能 自然语言处理
|

Way To Prompt系列(1): 为什么大模型连"Strawberry"的"r"都数不对?一招“理由先行”显著提升模型思考能力

本文将从两个常见的大模型翻车问题入手解析这些问题背后体现的大模型技术原理(Tokenization与预测下一个Token),并解释了为什么会导致这些问题,接着我们利用CoT(思维链)方法解决这些问题并基于上述原理试图剖析CoT方法起作用的可能原因,最后提出【理由先行】风格这一简单有效的Prompt Trick。

623 2
|
数据可视化 API 索引
|

ES常见Index API操作最佳实践!

【10月更文挑战第21天】

1062 1
|
人工智能
|

Agent应用对话情感优化

【10月更文挑战第2天】

638 0
|
人工智能 架构师 测试技术
|

【云故事探索】NO.7:「越用越上瘾」,中华财险60%研发人员用通义灵码提效

保险业被视为社会“稳定器”与经济“助推器”,正快速数字化转型。中华联合财产保险股份有限公司运用“云+大模型”技术革新业务,通过阿里云的通义灵码大幅提升编码效率,近60%的研发人员采用,采纳的生成代码占比约20%,显著提升了团队创新能力与代码质量,并积极探索大模型在更多垂直业务场景的应用。

353 0
|
人工智能 前端开发 搜索推荐
|

AI大模型企业应用实战-Agents是什么?

【8月更文挑战第13天】

697 2
|
Java API 数据中心
|

百炼平台Java 集成API上传文档到数据中心并添加索引

本文主要演示阿里云百炼产品,如何通过API实现数据中心文档的上传和索引的添加。

1692 4

千问大模型

阿里云自主研发的千问大模型,凭借万亿级超大规模数据训练和领先的算法框架,实现全模态高效精准的模型服务调用。https://www.aliyun.com/product/tongyi

0
今日
2669
内容
8
活动
1657
关注
你好!
登录掌握更多精彩内容

相关产品

  • 大模型服务平台百炼