|
人工智能 前端开发 搜索推荐
|

AI大模型企业应用实战-Agents是什么?

【8月更文挑战第13天】

697 2
|
人工智能 自然语言处理 算法
|

阿里云通义大模型助力“小爱同学”!

阿里云通义大模型助力“小爱同学”!

1689 2
|
人工智能 自然语言处理 Java
|

首次体验中文竞技场大模型体验!!!

我将分别从知识常识、中文游戏、NLP专业领域、代码相关、写作创作、人类价值观六大领域测评不同模型的效果,以及一些看法。

414 0
|
1月前
|
机器学习/深度学习 JSON 文字识别
|

做文档解析的人该看看 Infinity-Parser2:一个模型把版面、表格、公式、图表全端了

Infinity-Parser2 是一款端到端多模态文档解析大模型,融合可控数据合成与多任务联合强化学习(GRPO),开源500万双语数据及Flash/Pro双版本模型,支持精准解析文本、表格、公式、图表等,显著提升RAG与文档智能效果。(239字)

176 1
|
2月前
|
自然语言处理 并行计算 调度
|

本地大模型常见异常全解:显存溢出、推理慢、驱动报错、环境冲突调试指南.181

本文系统讲解本地大模型部署的核心原理与实战避坑指南:涵盖定义优势、硬件要求(GPU/内存)、软件生态(CUDA/PyTorch/量化框架)、九大标准部署流程,并深度解析显存溢出、推理缓慢、驱动/CUDA版本冲突、环境依赖混乱等高频问题的根因与解决方案,附可直接运行的优化代码示例。

249 2
|
2月前
|
消息中间件 SQL JSON
|

5层通信栈:多Agent集群为什么不能用一种方式通信

多Agent集群通信的5层架构设计:传输层、会话层、路由层、协作层、语义层。像TCP/IP那样分层,让Agent协作从prompt艺术变成工程问题。完整实现见GitHub开源仓库agent-cluster-comm。

191 2
|
2月前
|
人工智能 移动开发 文字识别
|

企业微信25场景AI:从客服到运营的全覆盖

--- title: "企微端25个AI场景全解析:银行人的智能助手实战手册" date: 2026-06-08 author: BetaAgent_Brain series: series6 tags: [企业微信, 银行AI, 场景落地, 智能助手, 长尾客户] --- 企微端25个AI场景全解析:银行人的智能助手实战手册 覆盖4大行业×36岗位×116场景,已上线25个真实可用

267 3
|
2月前
|
人工智能 监控 C++
|

技能架构设计:208个金融AI Skill的分类体系

银行智能体架构:7个Skill如何协同工作 实战代码:基于 financial-ai-skills 项目 | 架构设计 | Skill协同 | 数据流 单体架构 vs 微服务架构 银行系统常见的两种架构: `` 单体架构: 微服务架构: ┌─────────────┐ ┌─────┐ ┌─────┐ ┌─────┐ │ 核心系统 │ │信贷 │ │风控 │ │营销 │ │ ├─信贷

177 8
|
2月前
|
人工智能 运维 监控
|

银行运营自动化:7大场景的AI Skill落地实战

银行运营中心每天数万笔工单依赖人工流转,平均耗时4.2小时。本文详解7x24无人值守的自动化闭环:工单智能分发三引擎(规则匹配+关键词评分+风险升级)、SLA四级监控与自动升级、发票OCR识别与字段校验、费用审计规则引擎(金额限额/重复检测/时间范围),并用Python完整实现PaddleOCR发票识别、WOE+IV值评分模型、YAML工作流编排。附带21项落地清单和16项能力矩阵。

259 0
|
2月前
|
人工智能 算法 API
|

大湾区算力Token服务为什么需要民营力量

本文剖析大湾区算力Token服务的结构性需求,指出其本质非信任问题,而是需“国有底座+民营灵活”的双重供给生态。民营平台凭借技术迭代快、服务颗粒度细等优势,精准填补中小企业碎片化、低成本、高定制的AI算力需求空白。(239字)

179 1
|
2月前
|
存储 编解码 文字识别
|

Hawa Code Computer use 优化项

Hawa Code 的 Computer MCP 提供桌面自动化能力:通过截屏识别 UI 元素,支持点击、输入、滚动等操作;内置 key/type/click_element 等十余种精准控制工具,并兼容多平台无障碍 API 与 OCR。

151 1
|
2月前
|
算法 安全 测试技术
|

大模型服务熔断限流计费联动:异常流量风控拦截与超限自动降配架构实践.165

本文系统阐述大模型服务的熔断、限流、计费联动与自动降配四大核心机制:熔断通过状态机隔离故障防雪崩;限流基于令牌桶等算法多维管控流量;计费联动实现风控/熔断/限流结果与计费精准挂钩;超限自动降配动态优化算力资源。四者协同保障服务稳定、成本可控、商业合规。

232 2
|
2月前
|
人工智能 API 开发工具
|

如何用 10 行代码接入全网 10 个大模型(附完整 Python 源码)

本文介绍了通过统一AI网关(如OpenRouter)简化多模型调用的方法,对比原生调用方式(需修改代码结构、参数和响应解析)与网关方案(仅需修改一行模型名)。以OpenAI和Anthropic为例,原生调用存在API差异(如方法名、参数层级、响应结构),而网关通过“方言翻译”统一输入输出格式,支持快速切换GPT-4、Claude 3.5、Gemini等模型。方案优势在于学习成本低、切换高效(3秒完成),适合开发者快速实验或生产环境灵活调整。附有OpenRouter配置指南及可选开源方案。

260 1
|
2月前
|
人工智能 JSON 安全
|

AI Skill构建的十个层次——从提示词到业务闭环的体系化实践

title: AI Skill构建的十个层次——从提示词到业务闭环的体系化实践 author: 于兆鹏 date: 20260628 topic: AI Skill构建 word_count: 4200 target_audience: 通用技术读者 AIGC: ContentProducer: '001191110102MAD55U9H0F10002' ContentPropagator: '001191110102MAD55U9H0F10002' Label: '1' ProduceI

189 2
|
3月前
|
人工智能 API 调度
|

为什么很多 AI Agent 一上线就开始烧钱?我在这个开源项目里看到了答案

ClawRouter 是一个面向 AI Agent 的开源本地路由层,它关注的不只是多模型调用,而是模型选择、成本控制、fallback、Token 压缩和 Agent 运行时调度。

318 0
|
3月前
|
自然语言处理 监控 安全
|

长任务Agent设计规范,让工作流真实落地

本系统提出“三件事×三次交互”智能任务框架:以**理解拆解→分配执行→监控验证**为不可逆信息链,通过DAG建模、梯度蒙版、物质还原验证与四类阻碍回溯机制,实现可解释、可审计、可修复的多Agent协同。用户仅需在关键节点确认意图与分工,全程兼顾效率与可信。(239字)

370 1
|
3月前
|
人工智能 自然语言处理 语音技术
|

从RAG到实时语音理解:AI在企业服务场景的工程化实践

2025年底至2026年上半年,企业AI正悄然落地:不炒概念,专注实效——RAG知识库提效、实时语音理解赋能一线、幻觉工程化治理、轻量化混合部署、领域数据构筑护城河。AI已从Demo走向生产,核心在细节落地,而非参数大小。(239字)

237 0
|
3月前
|
人工智能 程序员
|

游戏行业最好的 AI 编程大模型

15年游戏开发经验者打造的AI编程工具FreeUltraCode,深度适配虚幻引擎,支持UMG界面、3D模型、2D动画、音频等全类型游戏资产生成与管理,让大模型真正懂材质、蓝图、骨骼动画等游戏开发语义。

374 2
|
3月前
|
人工智能 安全 算法
|

GEO 行业大清洗:倒闭的不是公司,是整个行业的投机小聪明

本文深度剖析GEO行业2026年集体暴雷的根源:AI技术迭代彻底颠覆旧有商业逻辑。指出虚假繁荣源于信息差红利,而今算法升级、监管加码与品牌认知觉醒共同终结“铺量套利”模式。文章穿透表象,从商业本质、技术底层、人性痛点、产业终局四维拆解,宣告低端中介退场,真GEO已升级为以AI认知基建、品牌信用沉淀为核心的高价值赛道。(239字)

521 1
|
3月前
|
机器学习/深度学习 自然语言处理 C++
|

大模型应用:大模型实测对比:1.8B vs 6B,本地部署的极限拉扯与真实体感.119

本文对比Qwen1.5-1.8B与ChatGLM2-6B两大中文大模型:前者轻量易部署,CPU即可运行,代码简洁,但易幻觉、指令遵循弱;后者参数量大,中文理解与逻辑更强,但需GPU、加载复杂。二者代表“小而美”与“大而全”的典型路径。

589 2
|
4月前
|
机器学习/深度学习 人工智能 自然语言处理
|

大模型应用:马尔可夫链\HMM与大模型的融合:经典序列算法+语义理解.109

本文详解马尔可夫链与HMM如何与大语言模型融合:前者提供可解释、稳定的序列结构控制(如对话状态流转),后者赋予深度语义理解与高质量内容生成能力,实现“结构稳+语义准”的协同范式,覆盖多轮对话、语音识别等场景。

343 2
|
4月前
|
人工智能 自然语言处理 安全
|

适配 Win11 专业版家庭版 OpenClaw 本地 AI 部署避坑指南

OpenClaw(小龙虾)是GitHub获28W+星标、纯本地运行的AI智能体,支持Win11全版本。具备全自动操控、文件整理、浏览器/办公自动化等能力,数据不出本机,隐私安全拉满。本教程提供Windows 11专属一键部署包,免配环境、双击安装,专治Defender拦截、中文路径报错等痛点,新手5分钟极速上手。(239字)

636 0
|
4月前
|
人工智能 安全 搜索推荐
|

GEO资深专家卢鑫,推出GEO衡量标准:为什么AI(AAES理论)决定一切!

生成式AI重塑信息分发,传统SEO失效,GEO(生成式搜索优化)亟需新标准。虎博科技CEO卢鑫提出AAES(AI Answer Eligibility Score),唯一衡量内容是否“值得被AI托付为答案来源”的资格指标——聚焦可信度、稳定性、角色清晰与风险可控,摒弃流量、提及等误导性旧指标。(239字)

280 0
|
5月前
|
存储 自然语言处理 安全
|

大模型应用:医疗行业大模型:从生成前校验到生成后审计的应用实践.73

本文提出医疗大模型“生成前校验+生成后审计”全链路管控方案,通过输入完整性/合规性校验、隐私脱敏、标准化处理,及输出格式/准确性/隐私审计等闭环流程,确保病历撰写、医嘱辅助等场景安全、合规、准确落地。

596 7
|
6月前
|
人工智能 弹性计算 自然语言处理
|

如何快速拥有OpenClaw?使用阿里云轻量应用服务器快速部署流程与常见问题参考

OpenClaw是一款开源的本地优先AI代理与自动化平台,可将AI转变为高效的“数字员工”。通过阿里云轻量应用服务器快速部署,集成阿里云百炼大模型,用户可享受强大的文本生成与任务处理能力,同时利用云服务器的稳定与自主可控优势,打造随时可通过钉钉操控的专属AI服务。文章详细介绍了计费方式、购买与配置流程、个性化配置能力,并解答一些常见问题。

912 1
|
7月前
|
机器学习/深度学习 自然语言处理 并行计算
|

大模型应用:混合专家模型(MoE):大模型性能提升的关键技术拆解.37

MoE(混合专家模型)是一种高效大模型架构,通过“智能调度+稀疏激活”机制,让多个专业化子网络(专家)按需协作。它兼顾性能与效率:参数规模大但推理仅激活2-4个专家,显著降本提速;既保持通用能力,又在医疗、法律等细分领域更专精,是当前大模型落地的关键技术。

1418 17
|
7月前
|
自然语言处理 算法
|

大模型应用:大模型的词元化处理详解:BPE、WordPiece、Unigram.11

本文详解大模型中文词元化三大核心算法:BPE(基于频率合并)、WordPiece(基于似然增益合并)和Unigram(自顶向下概率筛选)。通过原理、流程、代码与示例对比,揭示其在中文分词中的适用性与优化要点,强调语料质量、参数配置及中文特性适配的关键作用。(239字)

1474 2
|
8月前
|
人工智能 JSON 调度
|

架构设计实践:如何构建基于 LLM 的 AI Agent "指挥官" (Commander) 模式

本文提出一种基于“指挥官(Commander)”的中心化调度架构,解决多Agent协作中的循环沟通、目标漂移等问题。通过Prompt工程与状态机设计,实现任务拆解、分发与验收,并结合阿里云百炼平台与通义千问模型,提供可落地的代码级实现方案,构建稳定可控的AI多智能体系统。(238字)

821 3
|
8月前
|
人工智能 运维 API
|

从 Coze API 到智能体系统落地:AI 智能体运营工程师的工程实践解析

在AI 2.0时代,Coze API推动智能体从技术走向生产力。本文聚焦西南实践,解析API调用到商业落地的全流程,揭秘“智能体来了”如何通过插件集成、工作流编排培养具备运营思维的AI工程师,助力开发者转型,抢占智能体时代新机遇。

520 11
|
8月前
|
人工智能
|

不是工程师,也不是老板:AI智能体来了时代最稀缺的职业,叫“领航员

智能体时代已至,执行者正被系统取代。真正稀缺的不是会用AI的人,而是能定义目标、设计流程、掌控结果的“领航员”。从操作AI到指挥AI,未来价值取决于你站在哪一层。

444 1
|
8月前
|
机器学习/深度学习 人工智能 算法
|

放弃手搓算法吧!ReEvo:让大模型通过“反思”自动进化出SOTA算法

ReEvo提出“语言梯度”新范式,让大模型通过自我反思进化算法。它使LLM不再盲写代码,而是像专家般分析优劣、总结经验,逐步优化出超越人类设计的启发式算法,在芯片布局、TSP等问题上表现SOTA,实现AI自动“炼”算法的突破。

593 0
|
8月前
|
机器学习/深度学习 人工智能 缓存
|

构建AI智能体:九十八、实践出真知:本地AI大模型部署的核心要点与经验总结

本文介绍了如何在个人电脑上加载和运行轻量级AI大语言模型。首先解析了大语言模型的基本概念和工作原理,包括Tokenizer、Prompt等关键术语。然后详细演示了三种模型加载方式:通过ModelSpace下载Qwen模型、使用HuggingFace加载BERT模型、利用SentenceTransformer获取句子嵌入。特别强调了在CPU环境下的配置技巧,如设置torch.float32数据类型和优化内存使用。文章还提供了完整的中文对话生成示例代码,展示了Qwen1.5-1.8B-Chat模型的实际应用效果

1723 6
|
8月前
|
数据采集 人工智能 物联网
|

教AI学会说'我是小喵'竟然这么神奇?LlamaFactory微调揭秘

想让AI助手记住自己叫什么名字?就像教小孩背诵身份证信息一样简单!通过LlamaFactory的SFT微调,你的AI不仅能记住自己是谁,还能在千万个问题中准确回答身份信息。从技术小白到微调高手,一篇文章搞定! #人工智能 #LlamaFactory #模型微调 #AI助手

677 2
|
9月前
|
编解码 自然语言处理 搜索推荐
|

通义百聆语音交互模型开源,创新架构可节省近50%GPU计算!

通义百聆开源新一代语音模型Fun-Audio-Chat-8B,支持语音对语音交互,具备出色共情与情绪感知能力,对话自然流畅。在多项基准测试中超越同级模型,采用高效低算力架构,GPU计算成本降低近50%。支持角色扮演与个性化语音定制,适用于情感陪伴、智能客服等场景,现已开放下载。

1029 9
|
9月前
|
机器学习/深度学习 人工智能 搜索推荐
|

构建AI智能体:七十一、模型评估指南:准确率、精确率、F1分数与ROC/AUC的深度解析

本文系统介绍了机器学习模型评估的核心指标与方法。首先阐述了混淆矩阵的构成(TP/FP/FN/TN),并基于此详细讲解了准确率、精确率、召回率和F1分数的计算原理和适用场景。特别指出准确率在不平衡数据中的局限性,强调精确率(减少误报)和召回率(减少漏报)的权衡关系。然后介绍了ROC曲线和AUC值的解读方法,说明如何通过调整分类阈值来优化模型性能。最后总结了不同业务场景下的指标选择策略:高精度场景侧重精确率,高召回场景关注召回率,平衡场景优选F1分数,不平衡数据则推荐使用AUC评估。

1002 20
|
9月前
|
传感器 人工智能 算法
|

2025 全球 GEO 行业观察:双轮驱动(市场 + 技术),AI 时代品牌新基建的破局之道

AI重构信息分发,GEO成品牌新基建。2025年AI搜索占全球63%,传统SEO失效,生成式引擎优化(GEO)通过结构化数据、语义适配与权威构建,助力内容在AI答案中优先被引。本文解析GEO六大核心挑战与落地策略。

607 2
|
10月前
|
人工智能 JavaScript IDE
|

别用"战术勤奋"掩盖"战略懒惰":AI时代的降维竞品分析

5%的产品死于"盲视"。本文不仅是一套竞品分析AI指令,更是一次从战术勤奋到战略觉醒的认知升级。教你如何利用AI构建全天候商业情报雷达,寻找巨头缝隙中的差异化生存之道,实现商业战场的降维打击。

903 7
|
10月前
|
人工智能 语音技术 流计算
|

一图掌握通义千问:模型生态与应用场景全览

通义千问(Qwen)系列提供全栈开源AI能力,涵盖语言、视觉、语音等多模态应用。旗舰模型Qwen3-Max性能领先,支持92种语言翻译与高精度语音识别,具备强大代码生成与图像处理能力,助力开发者与企业高效构建智能应用。

1398 2
|
12月前
|
机器学习/深度学习 人工智能 机器人
|

AI Compass前沿速览:Nano Bananary、MCP Registry、通义DeepResearch 、VoxCPM、InternVLA·M1具身机器人

AI Compass前沿速览:Nano Bananary、MCP Registry、通义DeepResearch 、VoxCPM、InternVLA·M1具身机器人

1080 7
|
12月前
|
存储 开发者 容器
|

鸿蒙 HarmonyOS NEXT星河版APP应用开发-ArkTS面向对象及组件化UI开发使用实例

本文介绍了ArkTS语言中的Class类、泛型、接口、模块化、自定义组件及状态管理等核心概念,并结合代码示例讲解了对象属性、构造方法、继承、静态成员、访问修饰符等内容,同时涵盖了路由管理、生命周期和Stage模型等应用开发关键知识点。

782 1
|
12月前
|

鸿蒙 HarmonyOS NEXT星河版APP应用开发-阶段二

本文介绍鸿蒙应用界面开发中的弹性布局(Flex)、绝对定位、层叠布局及ArkTS语法进阶,涵盖字符串拼接、类型转换、数组操作、条件与循环语句,并结合B站视频卡、支付宝首页等案例,深入讲解点击事件、状态管理与界面交互功能。

591 1
|
机器学习/深度学习 缓存 人工智能
|

MoE模型加速秘籍:vLLM混合KV缓存管理解析​

vLLM是高效分布式大模型推理引擎,采用分页注意力、连续批处理等技术实现高吞吐与低延迟。本文详解其架构设计与关键技术,包括KV缓存管理、调度机制、推测解码与分布式扩展等,助你深入理解性能优化原理。

1770 1
|
存储 自然语言处理 前端开发
|

百亿级知识库解决方案:从零带你构建高并发RAG架构(附实践代码)

本文详解构建高效RAG系统的关键技术,涵盖基础架构、高级查询转换、智能路由、索引优化、噪声控制与端到端评估,助你打造稳定、精准的检索增强生成系统。

2369 2
|
存储 人工智能 自然语言处理
|

告别文字乱码!全新文生图模型Qwen-Image来咯

通义千问团队开源了Qwen-Image,一个20B参数的MMDiT模型,具备卓越的文本渲染和图像编辑能力。支持复杂中英文文本生成与自动布局,适用于多场景图像生成与编辑任务,已在魔搭社区与Hugging Face开源。

2026 2
|
人工智能 数据可视化 开发者
|

深度解析基于LangGraph的Agent系统架构设计与工程实践

LangGraph作为Agent 生态中非常热门的框架,今天我将借助 LangGraph,更高效、更优雅的方式构建复杂智能体系统。

2893 2
|
数据采集 自然语言处理 调度
|

优化通义大模型推理性能:企业级场景下的延迟与成本削减策略

本文基于金融、电商、医疗等领域的实战经验,深入探讨通义千问等大模型的推理优化技术栈。从计算图优化、批处理策略、量化压缩到系统架构四个维度展开,结合Python代码示例与压力测试数据,提供企业级解决方案。针对延迟敏感、高吞吐及成本敏感场景,分析性能瓶颈并提出算子融合、动态批处理、混合精度量化等方法,同时设计分布式推理架构与冷启动优化策略。通过案例展示,如电商大促场景优化,实现峰值QPS提升6.5倍、P99延迟降低53%、月度成本下降62%。文章还提供优化实施路线图,助力企业分阶段落地技术方案。

1629 5
|
人工智能 自然语言处理 搜索推荐
|

Qwen 家族再上新!

Qwen3 Embedding 是基于 Qwen3 基础模型训练的文本嵌入模型系列,可将离散符号转化为连续向量,捕捉语义关系。结合 Qwen3 Reranker 模型,通过“初筛+精排”流程提升搜索与推荐系统的相关性排序能力。该系列模型支持多语言、提供灵活架构(0.6B-8B 参数规模),并在 MTEB 多语言榜单中排名第一。用户可通过 Hugging Face、ModelScope 和 GitHub 快速体验模型服务。

1551 3
|
人工智能 API 开发者
|

智能体(AI Agent)开发实战之【LangChain】(一)接入大模型输出结果

LangChain 是一个开源框架,专为构建与大语言模型(LLMs)相关的应用设计。通过集成多个 API、数据源和工具,助力开发者高效构建智能应用。本文介绍了 LangChain 的环境准备(如安装 LangChain、OpenAI 及国内 DeepSeek 等库)、代码实现(以国内开源大模型 Qwen 为例,展示接入及输出结果的全流程),以及核心参数配置说明。LangChain 的灵活性和强大功能使其成为开发对话式智能应用的理想选择。

2784 1
|
机器学习/深度学习 编解码 缓存
|

通义万相首尾帧图模型一键生成特效视频!

本文介绍了阿里通义发布的Wan2.1系列模型及其首尾帧生视频功能。该模型采用先进的DiT架构,通过高效的VAE模型降低运算成本,同时利用Full Attention机制确保生成视频的时间与空间一致性。模型训练分为三个阶段,逐步优化首尾帧生成能力及细节复刻效果。此外,文章展示了具体案例,并详细说明了训练和推理优化方法。目前,该模型已开源。

1930 9
|
数据采集 人工智能 算法
|

深度合成算法备案全知道:不同角色审核的重点是什么?

深度合成技术正深刻改变生活,其算法备案对保障技术安全至关重要。目前已有3445款算法通过备案,其中服务提供者占76.78%。本文详解服务提供者与技术支持者的角色差异、审核重点及文件要求,强调两者不可混用且需独立备案。只有严格遵循备案流程,才能让深度合成技术真正造福大众,推动行业健康发展。

737 0

千问大模型

阿里云自主研发的千问大模型,凭借万亿级超大规模数据训练和领先的算法框架,实现全模态高效精准的模型服务调用。https://www.aliyun.com/product/tongyi

10
今日
2669
内容
8
活动
1657
关注
你好!
登录掌握更多精彩内容

相关产品

  • 大模型服务平台百炼