一段 JavaScript 代码,集成网站AI语音助手

简介: 根据本教程,只需通过白屏化的界面操作,即可快速构建一个专属的AI智能体。

一、引言

添加一段 JavaScript 代码,就能轻松将 AI 语音助手集成到现有网站?


根据本文的教程,只需通过白屏化的界面操作,即可快速构建一个专属的AI智能体,并通过视频云 ARTC 网络与终端用户进行实时交互,从而获得实时语音通话 AI 智能体,拥有即时、自然的 AI 语音交互体验。


为什么选择使用 AI 实时语音互动?


1、超拟人化体验:

  • 延时仅 1.5 秒,语音交互更流畅。
  • 支持智能环境音消除、智能语义识别、断句优化、高拟真音色与数字人形象。


2、灵活的智能体编排:

  • 控制台支持白屏化操作,轻松集成 AI 组件(ASR/TTS/数字人/LLM…)。
  • 快速构建企业专属云上 AI 智能体。


3、开放的 AI 生态:

  • 内置阿里百炼平台 AI 能力,支持接入第三方 AI 插件及客户自研模型。


4、高质量低延时通话:

  • 依托 ARTC 全球节点和 QoS 策略,保障音视频通话质量,覆盖全球用户需求。

该助手还支持移动端扫码快速访问H5页面上的AI语音助手、支持定制智能体的人设,接入个人的私有知识库等功能,提供更加个性化和专业的服务。


点击文末“阅读原文”,深入了解方案详情,还可参与活动赢取精美礼品!


打造高效 AI 语音交互,从这里开始!


二、整体架构

AI 实时互动是用户与 AI 的端到端交互,用户通过终端发起与云端 AI 智能体的实时音视频通话。


整体按以下步骤运行:


1、用户发起音视频通话请求。

2、AI 智能体接收音视频输入,启动工作流处理用户请求。

3、AI 智能体生成音视频响应流,通过 ARTC 网络推送给用户终端。

4、用户接收并播放响应流,与 AI 智能体完成自然互动。


AI 智能体是本方案的核心组件之一,能够在云端模拟高度拟真的用户交互。用户可以根据需求自行创建智能体。通过灵活的插件式和拖拽式方式,用户可以编排各个 AI 组件,如语音转文字、大语言模型、语音合成和自研向量数据库等,从而实现 AI 智能体的实时工作流。实时音视频通信技术(ARTC)为用户与AI智能体之间的音频通话提供了高可用、高品质、超低延时的保障。


AI 智能体接收到用户的音视频输入后,开始运转工作流,输出AI响应结果的音视频流并推送到 ARTC 网络,用户可以订阅该音视频流进行播放,从而完成用户与 AI 智能体的对话。智能媒体服务 IMS 用来创建 AI 智能体和实时工作流,实时音视频 ARTC 用来创建实时音视频应用,提供 AI 智能体和用户的实时音视频通话能力。当前方案中 Web 服务通过函数计算FC进行部署。


技术架构核心模块

  • 智能媒体服务(IMS): 用于创建 AI 智能体及工作流。
  • 实时音视频(ARTC): 提供全球 3200+ 节点支持,实现高质量低延时的实时音视频通信能力。
  • 函数计算(FC): 负责 Web 服务的轻量化部署。

技术总体架构图:

image.png

三、体验教程

1.创建实时音视频通信应用

实时音视频 ARTC 是智能体和用户之间建立起实时音频通信的基础,实现 AI 实时互动需要准备一个 ARTC 应用


2.创建AI智能体

(1)编排实时工作流

实时工作流是一种预先定义的流程模板,用于自动化处理 ARTC 音频流。支持创建语音通话并且预设了多种功能节点,包括语音转文字 (STT)、文字转语音 (TTS)、文生文大语言模型(LLM)等。

(2)创建智能体

AI 智能体是在 AI 实时互动解决方案中定义的高仿真用户,用户可以根据自身需求创建智能体,并将其集成到自己的应用中,使其能够按照既定工作流程在实时音频环境中运行,从而实现实时音频交互功能。


3.通过函数计算部署应用

4.应用体验

(1)实时语音对话

  1. 单击拨打按钮,即可开始与智能体对话。

image.png

  1. 浏览器弹窗请求使用麦克风,点击访问该网站时允许。

image.png

  1. 用户可以与智能体进行实时语音对话,页面上会同步展示当前对话的文字信息,以便用户查阅对话内容。

image.png

  1. 单击右上角的 image.png ,可以开启/关闭智能打断,以及选择切换音色。

image.png

(2)如何在已有网站中快速集成 AI 语音助手

  1. 已经拥有网站和域名,并且部署了SSL证书,可以在需要集成AI语音助手的网页中通过嵌入一段JavaScript代码来实现相应的功能。
  2. 请复制并粘贴以下代码段到您的网页代码中相应的位置。

image.png

<!-- 创建一个用于渲染 ARTC AI Call UI 的容器 -->
    <div id="root"></div>

    <!-- 引入 ARTC AI Call UI 的 JavaScript 文件 -->
    <script src="https://g.alicdn.com/apsara-media-aui/amaui-web-aicall/1.6.2/aicall-ui.js"></script>

    <!-- 初始化并渲染 ARTC AI Call UI -->
    <script>
      new ARTCAICallUI({
        userId: 'id',                          
        root: document.getElementById('root'),  
        appServer: 'https://<url>',             
        agentType: 0,                       
        userToken: 'token'                    
      }).render();
    </script>

参数说明:

  1. userId:字符串类型,按照业务需要传入,不能为空。
  2. root:页面渲染到的节点,画面完整填充整个区域。
  3. appServer:AI实时语音互动应用服务地址,当前即为函数计算 FC 中的访问域名。
  4. agentType:通话类型界面 0:语音通话,1:数字人通话,2:视频理解通话。
  5. userToken:用于应用鉴权,如果应用场景不需要鉴权,可以不传递此参数,但如果传递,则其值不能为空字符串。

(3)如何在移动端快速集成 AI 语音助手

  1. 当前DEMO提供了移动端扫码体验,支持使用微信/钉钉扫码,或复制链接后在手机浏览器中打开。

image.png

  1. 在移动端浏览器打开后,点击显示详细信息。

image.png

  1. 在展开的详细信息中,点击访问此网站。

image.png

  1. 接下来,即可在移动端体验AI实时语音对话。

image.png

(4)个性化定制智能体人设

可以修改现有的工作流模板,预设不同的场景和智能体人设,从而实现个性化定制,优化体验。

(5)接入私有知识库

如果希望智能体增强某些领域的专业知识,可以通过百炼平台创建知识库和 RAG 应用,并进行配置接入。







来源  |  阿里云开发者公众号




相关实践学习
【AI破次元壁合照】少年白马醉春风,函数计算一键部署AI绘画平台
本次实验基于阿里云函数计算产品能力开发AI绘画平台,可让您实现“破次元壁”与角色合照,为角色换背景效果,用AI绘图技术绘出属于自己的少年江湖。
从 0 入门函数计算
在函数计算的架构中,开发者只需要编写业务代码,并监控业务运行情况就可以了。这将开发者从繁重的运维工作中解放出来,将精力投入到更有意义的开发任务上。
相关文章
|
4月前
|
云安全 人工智能 安全
Dify平台集成阿里云AI安全护栏,构建AI Runtime安全防线
阿里云 AI 安全护栏加入Dify平台,打造可信赖的 AI
3120 166
|
4月前
|
人工智能 IDE Java
AI Coding实践:CodeFuse + prompt 从系分到代码
在蚂蚁国际信贷业务系统建设过程中,技术团队始终面临双重考验:一方面需应对日益加速的需求迭代周期,满足严苛的代码质量规范与金融安全合规要求;另一方面,跨地域研发团队的协同效率与代码标准统一性,在传统开发模式下逐渐显现瓶颈。为突破效率制约、提升交付质量,我们积极探索人工智能辅助代码生成技术(AI Coding)的应用实践。本文基于蚂蚁国际信贷技术团队近期的实际项目经验,梳理AI辅助开发在金融级系统快速迭代场景中的实施要点并分享阶段性实践心得。
1015 25
AI Coding实践:CodeFuse + prompt 从系分到代码
|
4月前
|
人工智能 自然语言处理 安全
氛围编程陷阱:为什么AI生成代码正在制造大量"伪开发者"
AI兴起催生“氛围编程”——用自然语言生成代码,看似高效实则陷阱。它让人跳过编程基本功,沦为只会提示、不懂原理的“中间商”。真实案例显示,此类项目易崩溃、难维护,安全漏洞频出。AI是技能倍增器,非替代品;真正强大的开发者,永远是那些基础扎实、能独立解决问题的人。
424 11
氛围编程陷阱:为什么AI生成代码正在制造大量"伪开发者"
|
4月前
|
人工智能 机器人 测试技术
AI写的代码为何金玉其外败絮其中
本文分析AI编码看着好看其实很烂的现象、原因,探索行之有效的的解决方案。并从理论上延伸到如何更好的与AI协作的方式上。
193 3
|
5月前
|
人工智能 测试技术 开发工具
如何将 AI 代码采纳率从30%提升到80%?
AI编码采纳率低的根本原因在于人类期望其独立完成模糊需求,本文提出了解决之道,讲解如何通过结构化文档和任务拆解提高AI的基础可靠性。
1398 24
|
5月前
|
人工智能 数据可视化 定位技术
不会编程也能体验的 AI 魔法,外滩大会代码原生地等你解锁
不会编程也能体验的 AI 魔法,外滩大会代码原生地等你解锁
495 39
|
4月前
|
人工智能 监控 Java
零代码改造 + 全链路追踪!Spring AI 最新可观测性详细解读
Spring AI Alibaba 通过集成 OpenTelemetry 实现可观测性,支持框架原生和无侵入探针两种方式。原生方案依赖 Micrometer 自动埋点,适用于快速接入;无侵入探针基于 LoongSuite 商业版,无需修改代码即可采集标准 OTLP 数据,解决了原生方案扩展性差、调用链易断链等问题。未来将开源无侵入探针方案,整合至 AgentScope Studio,并进一步增强多 Agent 场景下的观测能力。
2188 66
|
5月前
|
人工智能 自然语言处理 API
快速集成GPT-4o:下一代多模态AI实战指南
快速集成GPT-4o:下一代多模态AI实战指南
497 101
|
4月前
|
人工智能 安全 开发工具
C3仓库AI代码门禁通用实践:基于Qwen3-Coder+RAG的代码评审
本文介绍基于Qwen3-Coder、RAG与Iflow在C3级代码仓库落地LLM代码评审的实践,实现AI辅助人工评审。通过CI流水线自动触发,结合私域知识库与生产代码同仓管理,已成功拦截数十次高危缺陷,显著提升评审效率与质量,具备向各类代码门禁平台复用推广的价值。(239字)
946 24