AI 提示词模板相关的架构设计

简介: 现在很多企业纷纷研发大语言模型以解决业务问题。提示词在与模型交互中起到关键作用。为优化提示词模板的修改、提高渲染效率及确保安全性,架构设计注重可修改性、安全性、可靠性和性能。设计包括:将提示词存储在OSS以方便修改和版本控制;使用本地缓存提升读取性能;模板引擎增强灵活性;秘钥安全存储在加密系统中;并通过配置中心动态调整。此设计旨在提供高效、安全且可靠的AI交互体验等。

一、前言

去年 GPT-3.5 的问世,让很多国内外企业看到了大模型的强大能力和巨大价值,都在纷纷自研自己的大语言模型或者探索如何将大语言模型应用到解决业务难题、提高工作和生产效率上来。

现在,我们通过自然语言编写提示词就可以和大语言模型进行交互,实现自己想要的功能。提示词对大语言模型的性能和输出质量起着至关重要的作用。
AI提示词模板架构设计.png

在实际的 AI 业务落地过程中,提示词通常需要经历多轮调优,而且在调用大语言模型之前,通常需要动态构造提示词。如何让提示词模板更易于修改,如何让提示词模板渲染的效率更高,如何避免提示词的误修改对线上程序产生负面影响很关键。

二、架构设计考量

基于上述背景,在做架构设计时,我们重点考虑以下几个软件质量属性:
image.png

1 可修改性 。可修改性是指能够快速地以较高的性能价格比对系统进行变更的能力。由于提示词需要多轮调优,上线以后经常需要根据 Bad Case 不断优化提示词,因此需要采用更易于修改的方式。
2 安全性。安全性是指系统向合法用户提供服务的同时能够阻止非授权用户使用的企图或拒绝服务的能力。如果提示词模板需要存储在云端,需要通过鉴权进行访问,那么秘钥的安全存储非常关键。良好的安全性可以避免秘钥泄露,从而对系统安全造成负面影响。
3 可靠性。 可靠性是指系统能够处理错误和异常情况,并继续运行或安全地停机。通过合理的错误处理机制和冗余设计,系统能够避免单点故障导致的整体崩溃。在设计软件架构时,我们还应该考虑可靠性,任何在预发布环境中发现的问题都可以在不影响生产系统的情况下进行修复,从而减少了线上环境出现问题的概率,提高了系统的可靠性。
4 性能。性能是指系统的响应能力,处理任务所需时间或单位时间内的处理量。如果提示词模板存储在远端,提示词模板的读取性能也很重要,高性能达成良好的用户体验的关键因素。

三、架构设计描述

为了满足上述软件质量属性,如性能、可修改性、安全性、可靠性。设计如下图所示的架构:
Xnip2024-06-16_17-00-11.png

将提示词存储在 OSS 文件中,以便更方便地修改提示词,提高系统的可修改性。可以通过 Git 将不同的版本进行保存,方便分析和恢复到特定版本。

Xnip2024-06-16_16-40-49.png

同时存储在 OSS 中时,可以通过不同的文件夹进行环境区分,可以现在 pre 环境编辑和测试好提示词后再覆盖 gray 和 prod 避免因错误的提示词修改对线上环境造成负面影响,以提高系统的可靠性。

Xnip2024-06-16_17-02-33.png

同时,我们一个提示词可能无法适应所有场景,因此我们可以设计提示词模板路由器,根据不同的情况使用不同的提示词模板。

由于读取提示词模板相对频率较高,为了提高读取提示词模板性能,可以使用本地缓存,对提示词模板进行缓存。

同时,使用 Git 提交提示词时或者 使用 OSS Browser 工具直接修改 OSS 文本时,有 Diff 效果,可以很大程度上避免对提示词的误修改。
Xnip2024-06-16_17-01-04.png

同时为了提高提示词模板的灵活性,我们可以采用模板引擎来编写提示词模板,使用时只需要构造好模板所需的数据进行渲染即可。

在调用 OSS 客户端或者大语言模型时,通常需要在请求头或参数中传入秘钥信息进行鉴权,我们可以将秘钥信息存储在机密信息加密系统中,避免将密钥信息存储在代码仓库中造成秘钥泄露。
4.png

可以在配置中心中配置模板本地缓存的时间,配置当前使用的模型列表等,方便动态调整。
调用大语言模型后,我们可以将相关信息起来用户展示和分析。

四、总结

本文讲述在 AI 应用中常见的 AI 提示词相关的架构设计,该架构设计中重点考虑性能、可修改性、安全性和可靠性,希望对大家能够有帮助。

如果大家想系统学习提示词技巧,可以阅读我的相关文章:《一文掌握大模型提示词技巧:从战略到战术》


如果本文对你有帮助,可以点赞、收藏一下。

麻烦帮我在活动页 的“投稿作品”部分帮我点赞投你的宝贵一票:
image.png

相关实践学习
借助OSS搭建在线教育视频课程分享网站
本教程介绍如何基于云服务器ECS和对象存储OSS,搭建一个在线教育视频课程分享网站。
相关文章
|
2月前
|
人工智能 运维 安全
AI 安全架构概述
AI 安全架构涵盖数据采集、模型训练、推理部署等阶段,确保安全性、隐私与合规。其核心组件包括数据层、模型层、推理层、应用层和运维层,针对数据安全威胁(如数据投毒)、模型窃取、对抗攻击及系统漏洞等风险,提出数据加密、对抗训练、联邦学习等防御策略,并强调开发前、开发中和部署后的最佳实践,以降低 AI 解决方案的安全风险。
227 13
|
1月前
|
人工智能 Cloud Native Serverless
从理论到落地:MCP 实战解锁 AI 应用架构新范式
本文旨在从 MCP 的技术原理、降低 MCP Server 构建复杂度、提升 Server 运行稳定性等方面出发,分享我们的一些实践心得。
913 100
|
1月前
|
机器学习/深度学习 人工智能 并行计算
AI部署架构:A100、H100、A800、H800、H20的差异以及如何选型?开发、测试、生产环境如何进行AI大模型部署架构?
AI部署架构:A100、H100、A800、H800、H20的差异以及如何选型?开发、测试、生产环境如何进行AI大模型部署架构?
AI部署架构:A100、H100、A800、H800、H20的差异以及如何选型?开发、测试、生产环境如何进行AI大模型部署架构?
|
2天前
|
人工智能 负载均衡 API
长连接网关技术专题(十二):大模型时代多模型AI网关的架构设计与实现
随着 AI 技术快速发展,业务对 AI 能力的渴求日益增长。当 AI 服务面对处理大规模请求和高并发流量时,AI 网关从中扮演着至关重要的角色。AI 服务通常涉及大量的计算任务和设备资源占用,此时需要一个 AI 网关负责协调这些请求来确保系统的稳定性与高效性。因此,与传统微服务架构类似,我们将相关 API 管理的功能(如流量控制、用户鉴权、配额计费、负载均衡、API 路由等)集中放置在 AI 网关层,可以降低系统整体复杂度并提升可维护性。 本文要分享的是B站在大模型时代基于多模型AI的网关架构设计和实践总结,希望能带给你启发。
28 4
|
3月前
|
人工智能 自然语言处理 Java
IDEA + 通义灵码AI程序员:快速构建DDD后端工程模板
本文介绍如何使用 IntelliJ IDEA 和阿里云的通义灵码 AI 程序员,快速搭建基于 DDD 领域驱动设计的后端工程模板。通过安装和配置 IDEA、JDK、Maven 及通义灵码插件,用户可以借助 AI 自动生成项目结构和代码。然而,测试发现 AI 生成的代码存在依赖问题,需手动修正才能成功运行。最终,项目包括 Spring Boot、Maven 和 Deepseek API 集成,可调用大模型进行预测。尽管 AI 工具提高了开发效率,但目前仍需人工干预确保项目顺利运行。
433 62
 IDEA + 通义灵码AI程序员:快速构建DDD后端工程模板
|
1月前
|
人工智能 计算机视觉 开发者
Meta开源多模态AI新王炸!Llama 4:MoE架构仅用17B参数碾压Gemma 3,支持1000万token上下文
Meta最新开源的Llama 4系列多模态AI模型,采用混合专家架构,支持200种语言处理,最高达2万亿参数规模,在语言理解、图像分析和代码生成等任务中展现突破性性能。
130 0
Meta开源多模态AI新王炸!Llama 4:MoE架构仅用17B参数碾压Gemma 3,支持1000万token上下文
|
2月前
|
人工智能 架构师 前端开发
手把手体验通义灵码2.0:AI程序员如何让我从“调参侠”进阶“架构师”?
通义灵码2.0是一款强大的AI编程工具,帮助开发者从“调参侠”进阶为“架构师”。它通过跨语言开发支持、智能单元测试生成和图生代码等功能,大幅提升开发效率。例如,将Python数据处理函数一键转为React+ECharts组件,自动生成单元测试用例,甚至通过草图生成前端布局代码。此外,新增的QwQ模型具备“代码脑补”能力,可推荐性能优化策略。尽管功能强大,但仍需注意环境隔离与代码审查,避免过度依赖。通义灵码2.0不仅是工具,更是开发者的“外接大脑”。
123 8
|
2月前
|
机器学习/深度学习 人工智能 自然语言处理
AI训练师入行指南(三):机器学习算法和模型架构选择
从淘金到雕琢,将原始数据炼成智能珠宝!本文带您走进数字珠宝工坊,用算法工具打磨数据金砂。从基础的经典算法到精密的深度学习模型,结合电商、医疗、金融等场景实战,手把手教您选择合适工具,打造价值连城的智能应用。掌握AutoML改装套件与模型蒸馏术,让复杂问题迎刃而解。握紧算法刻刀,为数字世界雕刻文明!
107 6
|
2月前
|
机器学习/深度学习 人工智能 自然语言处理
VidSketch:手残党逆袭!浙大AI神器草图秒变4K动画,三连提示词玩转影视级特效
VidSketch 是浙江大学推出的创新视频生成框架,通过手绘草图和简单文本提示生成高质量视频动画,降低视频创作的技术门槛,满足多样化的艺术需求。
136 6
VidSketch:手残党逆袭!浙大AI神器草图秒变4K动画,三连提示词玩转影视级特效
|
3月前
|
存储 人工智能 API
SPO:如何优化提示词?大模型最懂如何优化自己!开源自监督提示词优化工具,让AI自主优化提示词
本文介绍由DeepWisdom与香港科技大学联合研发的SPO框架,通过自我监督机制实现大语言模型提示优化,仅需3个样本即可达到SOTA效果,优化成本降低至传统方法的1.1%-5.6%。
500 0
SPO:如何优化提示词?大模型最懂如何优化自己!开源自监督提示词优化工具,让AI自主优化提示词