Agora Agents SDK:极速构建你的第一个语音智能体

今天,Agora Agents SDK 正式发布,支持 Python、Node.jsGo——让开发者用更少的代码、更短的时间,在声网对话式 AI 引擎上构建语音智能体。

声网对话式 AI 引擎为实时语音智能体提供底层基础设施:依托全球边缘网络实现低延迟音频传输,并内置轮次检测、打断处理等实时对话能力。

Agora Agents SDK 则让接入这一切变得前所未有地简单——强类型、可链式调用的构建器,内置鉴权,约十行代码、15 分钟,就能构建出一个可投入使用的语音智能体。

Agora Agents SDK 构建在现有 REST API 之上。REST API 会继续获得完整支持,你可以按自己的习惯选择使用 SDK,或直接调用 API。

Agora Agents SDK 的核心能力

SDK 负责打通代码与声网对话式 AI 引擎之间的集成,让开发者得以专注于智能体本身的业务逻辑,无需关注底层的衔接细节。

1、强类型、可链式调用的构建器 API

通过链式调用 .with_stt() 、 .with_llm() 、 .with_tts() 组装智能体,并在编辑器中获得自动补全与类型检查。

2、内置鉴权与 Token 管理

app_id 与 app_certificate 仅需传入一次,SDK 即自动生成对话式 AI 引擎 鉴权 Token 与 RTC 频道 Token,并内置指数退避重试与合理的超时设置。当你为 Web 或移动端应用暴露 Agent 管理接口时,SDK 还能帮你配置客户端加入声网频道所用的 Token 服务。

3. 会话生命周期管理

通过 SDK 对象直接启动、停止、查询与恢复会话,无需再把原始的 Agent ID、状态值和重试逻辑散落在后端各处。

4、Python、Node.js、Go 三端同发

三种语言同步发布,采用统一的构建器模式,并分别贴合各自的语言习惯。

快速上手:使用 Agora Agents SDK 构建语音智能体

三种语言同步发布,采用统一的构建器模式,并分别贴合各自的语言习惯。

以下示例演示如何使用 Agora Agents SDK 构建一个最简的语音智能体链路(STT → LLM → TTS)。

这段代码已经完成了一个可运行语音 Agent 的核心配置。构建器采用强类型设计,编辑器会实时提示每个参数该怎么填;轮次检测(turn detection)、会话超时、历史记录上限这些进阶选项都挂在同一个构建器上,需要时再配置即可,起步阶段无需处理。

如果你已在使用 REST API

对于已经基于 REST API 构建应用的开发者,现有集成不会受到影响。REST API 仍然是 Agora Agents SDK 的底层基础,也会继续获得完整支持和服务。

不过,对于新的语音 Agent 项目,SDK 会是更推荐的接入方式。相比直接调用原始 APISDK 可以显著减少初始化配置和工程集成的复杂度

  • 无需再手动进行 Token 签名;

  • 冗长的配置代码被精简为数次构建器调用;

  • 此前需手写的错误处理已内置其中;

  • 过往需要持续维护的大量集成代码就此省去。

这意味着开发者可以更快验证 Agent 逻辑本身,而不是把时间消耗在基础设施接入上。

关键部分由你掌控 基础设施由我们提供

Agora Agents SDK 并不限定开发者使用某一种模型或固定 pipeline。开发者可以使用自己的 STT、LLM、TTS 供应商,也可以在不想自行管理模型服务时,直接使用由声网托管的模型。

模型、密钥和业务 pipeline 仍由开发者控制;我们负责提供低延迟、可扩展的全球实时音频基础设施。对于多数正在构建语音智能体的团队来说,这是一种更具性价比的选择。

这也是 Agora Agents SDK 的核心目标:让开发者在接入的第一小时,就能感受到平台是否足够清晰、直接和可用。开发者选择一个平台,往往不是从功能矩阵开始,而是从第一次构建体验开始

安装 Agora Agents SDK

开发者可以根据自己的技术栈安装对应版本:

了解更多,请查看官网文档:

https://doc.shengwang.cn/doc/convoai/restful/get-started/quick-start-agent

动手搭一个你自己的语音智能体,把它放进真实对话里跑跑看,然后告诉我们哪儿还让你觉得麻烦——你的反馈会直接决定下一版的方向。

免责声明:上述内容仅代表发帖人个人观点,不构成本平台的任何投资建议。

举报

评论

  • 推荐
  • 最新
empty
暂无评论