调度

首页 标签 调度
# 调度 #
关注
32526内容
落地之道丨突破效率桎梏,系统性构建 Agentic 组织
智能体组织的本质,不在于部署了多少 AI 工具,而在于是否将 AI 能力系统性地写入了组织的架构、流程、知识体系与文化基因。
创新场景丨盗火者的新火种:EOA 范式下,中国一汽点燃企业智能体生命力
在 EOA 范式下,中国一汽基于数据形成认知体系,让企业智能体围绕经营目标高效协同,并在运行反馈中不断进化,重塑企业的进化路径。
|
1天前
| |
大模型Skills与Toolchain深度拆解:吃透插件化工具链架构,掌握大模型函数注册原理22.4
本文详解大模型“Skills+Toolchain”工程化落地体系:Skills作为原子化、可复用的外部实操能力,弥补原生模型实时查询、数据处理等短板;Toolchain则提供注册、调度、执行、异常管控等全链路工具管理,通过插件化设计实现能力动态拓展与模型业务解耦,推动大模型从对话演示迈向产业级智能体应用。
|
1天前
|
智能体开发平台架构全解析:拆解生产级 Agent 的四大核心模块
随着大模型能力逐渐同质化,企业 AI 落地的竞争重心,正从「模型谁更强」转向「谁能把模型变成能干活的数字员工」。本文从架构视角,拆解一个能真正接入业务系统的智能体开发平台(Agent Development Platform,ADP)由哪些模块组成,并给出自研与采购的实战决策框架。
把IT 运维的重复劳动交给智能体:巡检、专利年费与权限审计实战
运维自动化核心价值:将工程师从“必做但无聊”的重复性高危任务(如巡检、专利缴费、行为审计)中解放,专注需判断力的工作。通过执行层机器人+桌面行为分析,实现100%时效保障、零漏检、全留痕、强审计,真正构建可信、可控、可追溯的智能运维体系。
阿里云qwen-max、qwen-plus、qwen-flash、qwen-long热门模型解析与模型选择指南
本文全面解析阿里云百炼通义千问四大产品线:qwen-max旗舰、qwen-plus均衡、qwen-flash轻量、qwen-long长文本专用,覆盖全代际版本特性、适用场景、能力参数与价格体系。文章给出四步选型逻辑与生产环境分层调度策略,搭配当前限时折扣、夜间错峰优惠、新人免费额度等活动,帮助开发者精准匹配业务需求,在保障推理效果的同时最大化控制调用成本。
|
1天前
|
HarnessDev:让 LLM 自己创建并迭代 Agent Harness
字节跳动Seed团队联合多机构发布HarnessDev,探索LLM能否自主构建并持续优化Agent执行框架(Harness)。研究分Creation(从弱种子补全六大控制能力)与Evolution(基于任务反馈迭代优化)两阶段,强调真实运行验证、executor适配与泛化能力评估。
|
1天前
|
SparDA:把 KV 选择提前一层,长上下文推理还能这样优化
SparDA是一种面向长上下文大模型推理的新型稀疏注意力机制,通过解耦“选块”与“计算”,用Forecast模块提前一层预测下一层KV访问范围,实现稀疏选择轻量化与跨层KV预取,显著降低显存占用与延迟,在128K上下文下解码加速达1.69倍,精度基本无损。
自动化从10到1000个流程:机器人全生命周期管控与规模化治理
企业自动化从10个流程扩至1000个,常陷质量失控、权限混乱、调度冲突与故障难溯困境。本文提出全生命周期管控框架——覆盖开发、发布、调度、监控、审计、运维六环节,以统一平台实现“管得住、看得清、用得上”,助力RPA规模化稳健落地。
阿里云qwen3.8-max、qwen3.8-flash与qwen3.7-max、qwen3.7-flash模型选择指南:模型能力与价格对比及最新活动
本文全面解析和对比阿里云通义千问在售四款核心模型,覆盖qwen3.8-max、qwen3.8-flash、qwen3.7-max、qwen3.7-flash,从基础能力、适用场景、价格体系、限时活动、选型指南及新人免费额度多维度对比,给出分层调度策略,帮助开发者精准匹配业务需求,兼顾效果与调用成本。
免费试用