声网公司

声网成立于2014年,是全球实时音视频云服务开创者,为人与人和人与智能体的音视频互动提供最佳体验。

IP属地:上海
    • 声网公司声网公司
      ·2024-02-28

      声网母公司发布2023 Q4及全年财报,实现3年来首次盈利

      北京时间2月27日,声网母公司 Agora, Inc.(NASDAQ: API) 公布了2023年第四季度及全年财报。财报显示,第四季度 Agora, Inc. 实现营收3604万美元,环比增长3%,全年总营收1.42亿美元。 其中,业务聚焦中国市场的声网第四季度实现营收1.48亿人民币,环比增长5%;聚焦非中国市场的 Agora 第四季度实现营收1530万美元,环比持平。 值得一提的是,得益于多元实时互动应用场景的增长和行业扩展,Agora, Inc. 2023年第四季度调整后净利润为140万美元,实现三年以来首次季度盈利。 对此,Agora, Inc.创始人兼CEO赵斌表示,“我们在2023年四季度取得了强劲的财务业绩,实现了连续的收入环比增长,并实现了140万美元调整后净利润,这是三年以来首次季度盈利。这反映了我们在极具挑战的经营环境下的业务韧性,以及我们不断优化成本结构的努力。” Agora, Inc.在2023年第四季度完成股票回购350万ADS,总金额1000万美元。赵斌表示,“在过去的两年中,我们通过回购方式向股东返还了超过1亿美元,我们的总股本也相应降低了约18%。我们非常高兴地宣布,董事会已经授权将2亿美元的股份回购计划延长12个月,这体现了董事会对我们的财务实力和长期增长前景的信心。” 在客户规模方面,截至2023年12月31日,声网活跃客户数量达4144个,同比增长12%,Agora活跃客户数量达1683个,同比增长18%。
      9.08万评论
      举报
      声网母公司发布2023 Q4及全年财报,实现3年来首次盈利
    • 声网公司声网公司
      ·09-14

      声网Agora同步支持OpenAI GPT-Live-1 接入,实时语音应用加速落地

      9月10日,OpenAI 宣布 GPT-Live-1 在 API 中开放,为开发者带来更自然的全双工语音交互体验。Agora 作为 OpenAI 合作伙伴,已同步支持 GPT-Live-1 接入。开发者可结合 Agora的实时音视频与对话式 AI 能力,在自己的应用中快速落地实时语音交互。 GPT-Live-1 的核心是“同时听说”:用户可在模型回答过程中插话、补充条件或改变问题,模型也能处理停顿,以及“嗯”、“对”等简短附和,判断应继续听还是停止当前回答。它支持轮次检测,并改进了背景噪声、静默处理和长会话上下文保持。 同时,GPT-Live-1 可将深度推理和工具调用委派给后端文本模型,包括第三方模型,语音对话可继续进行。开发者可按任务选择后端:高频简单任务优先考虑速度与成本,复杂任务则使用推理能力更强的模型。该模型还涉及文本输出、关键词偏置和语音风格等转写与表达控制。 借助 Agora 与 OpenAI 的合作,开发者能够以更低门槛构建稳定、低延迟且更具“真人感”的实时语音 AI 应用,让每一次对话不仅能听懂,更能及时响应并真正完成任务。
      5.75万评论
      举报
      声网Agora同步支持OpenAI GPT-Live-1 接入,实时语音应用加速落地
    • 声网公司声网公司
      ·09-10

      为什么 RTE 大会今年多了一个“i”?

      今年10月23-24日,一年一度的声网 RTE 大会将迎来第十二届,并从 RTE 实时互联网大会升级为 “iRTE2026实时智能大会”,这其中多出的字母 i 代表着声网对于实时互动(RTE)边界不断延伸的释义:RTE 正从传递信息走向承载智能。 这也不是大会第一次随着产业发展升级。2020年,RTC 大会升级为 RTE 大会,关注点从实时音视频技术,延伸到更丰富的实时互动场景化体验。如今,从 RTE 实时互联网到 iRTE 实时智能,大会将进一步聚焦实时互动与生成式 AI 融合带来的新技术、新场景、新体验。 升级背后,还有一个更直接的变化,你我皆已参与其中: 从人与人到人与 Agent,实时互动迎来了新的参与者。 过去,我们熟悉的实时互动,大多发生在人与人之间:通过视频会议协同工作,通过在线课堂传授知识,通过语音和视频连麦建立社交连接。 如今,Agent 开始进入这些场景。在线课堂里,老师与学生身边多了 AI 助教;社交与娱乐场景中,人与 AI 角色开始实时对话;企业服务中,Agent 开始参与咨询、沟通与业务办理。 从 RTE 到 iRTE,意味着在“人与人”互动的基础上,实时互动的边界进一步拓展到“人与 Agent”共同参与的互动。 面对 Agent,我们也提出了更高的要求:它能否听懂停顿和犹豫?能否在被打断时及时停下?能否跟上对话,而不是始终慢半拍?实时互动由此打开了更大的发展空间,也迎来了新的技术命题。 从 RTC 到RTE,再从 RTE 到 iRTE,变化的是大会关注的产业边界,不变的是对实时互动技术与场景创新的持续探索。 10月23—24日,iRTE2026实时智能大会,期待与开发者、技术创新者和行业实践者一起,探索实时智能的无限可能。 图片底部可扫码报名👇
      5.92万评论
      举报
      为什么 RTE 大会今年多了一个“i”?
    • 声网公司声网公司
      ·09-04

      面向轻量级智能硬件的 RTC 解决方案: 声网为信人智能 AI 决策机器人提供关键能力

      过去两年,AI 录音笔、录音纽扣、智能耳机等轻量化智能硬件集中爆发。形态各异,但面临同一个工程化难题:如何在存储、Flash、算力、功耗都受限的硬件上,跑通稳定、连续、低延时的实时音视频能力? 声网针对这一场景推出的实时音视频解决方案,以百 KB 级 SDK、60%抗丢包、端到端优质传输率超99%以及可灵活部署的 3A 音频处理为核心,帮助硬件产品快速接入实时音视频能力,大幅减少芯片适配、音频采集、网络传输等环节的开发工作。 信人智能的 NBBOSS R1 是这一方案的典型落地案例。其自研产品 NBBOSS 以“AI 决策外脑”定位,精准切中企业管理者在复杂商业环境中的决策焦虑。区别于传统 CRM 或 OA 系统,NBBOSS 要求具备实时介入、情绪感知、长记忆关联等能力,这对底层算法、硬件集成与场景适配提出了极高门槛。R1 决策机器人主打“实时介入”——搭载360°旋转基座与主动对话引擎,并内置自研情绪感知系统,可在谈判或面试等关键决策节点进行主动提示与智能交互,辅助决策者规避非理性判断。R1 通过云端实时归集数据,支持多会议并行参与,预售首日订单突破10800台。产品搭载商业决策专属大模型,支持11种语言实时翻译,天然适配跨境电商、连锁经营等跨国场景。 AI 决策产品在企业办公场景中要发挥价值,绕不开一个基础前提:语音交互的实时性、连续性和稳定性。会议讨论、经营沟通、人机对话中的声音,需要稳定传给 AI ,才能完成识别、理解和响应。信人智能的选择是,在底层音频能力上依托声网来构建 RTC 与 RTM 技术基座。 百 KB 级轻量集成,不增加硬件负担 NBBOSS R1 作为桌面 AI 交互终端,需要在不同硬件条件下稳定运行,兼顾接入效率、功耗、存储和后续迭代成本。声网支持 R1 适配不同芯片和嵌入式系统,帮助设备快速接入实时媒体传输能力,减少产品团队在芯片适配、音频采集
      5.85万评论
      举报
      面向轻量级智能硬件的 RTC 解决方案: 声网为信人智能 AI 决策机器人提供关键能力
    • 声网公司声网公司
      ·09-02

      声网获得 ISO/IEC 42001人工智能管理体系认证

      近期,声网母公司 Agora,Inc 正式获得国际权威认证机构 DNV 颁发的 ISO/IEC 42001:2023 人工智能管理体系认证,标志着声网在人工智能治理领域的风险管理、安全合规以及技术开发与产品应用等,均达到了国际认可的标准。声网也是全球化 RTC 厂商中首个获得 ISO/IEC 42001 认证的企业。 AI 进入真实业务,安全治理成为必选项 ISO/IEC 42001:2023 是全球首个面向人工智能管理体系的国际标准,重点关注组织如何围绕 AI 建立系统化的治理机制,包括风险识别、责任管理、持续改进等多个方面。相比单纯关注模型效果或某一项安全技术,ISO 42001 更强调 AI 从规划、开发、部署到运营全生命周期的管理能力。 随着 AI 加速进入真实业务,这套体系的重要性正日益凸显。 过去,企业使用 AI 更多集中在内容生成、知识问答等相对独立的场景;如今,AI Agent、Voice Agent、AI 客服、智能硬件等应用正在快速进入真实业务流程,AI 不仅要理解和生成内容,还开始直接与用户实时交互、调用业务系统并处理企业数据。 特别是在对话式 AI 场景中,一次自然的人机对话往往涉及实时音视频传输、语音识别、大模型推理、语音合成以及业务系统调用等多个环节。AI 越深入业务,企业对数据安全、隐私保护、系统稳定性以及风险治理的要求也越高。 声网对话式 AI 引擎正是连接实时互动能力、大模型与具体应用场景的重要基础设施。基于这一引擎,开发者和企业可以进一步构建 AI 客服、Voice Agent、AI 陪伴、智能硬件、企业服务等多种对话式 AI 应用,让 AI 真正进入业务流程并与用户进行实时交互。 这也意味着,对话式 AI 产品不能只追求“听得清、听得懂、说得自然、接得住打断”,还必须系统应对数据保护、权限控制、第三方服务管理、业务安全以及潜在滥用等问题
      5.66万评论
      举报
      声网获得 ISO/IEC 42001人工智能管理体系认证
    • 声网公司声网公司
      ·08-31

      让 AI 听懂高燃赛场:Agora × Gemini Transcribe 电竞解说实时字幕开发实践

      Google 昨日正式发布了 Gemini 3.5 Transcribe。和 Gemini 系列之前的产品定位不同,这不是一个通用多模态模型,而是一个独立的专用转写模型,只负责语音转文字。 目前 Gemini 3.5 Transcribe 已经在 Google 自己的多个产品中上线,包括 Gboard 上的 Rambler 语音输入、macOS 版 Gemini 应用的 Speak to Window 功能,以及 Chrome 浏览器的语音输入中。开发者可以通过 Gemini API 和 Google AI Studio 使用。 Agora 作为本次发布的官方合作伙伴之一,已经完成了对 Gemini 3.5 Transcribe 的集成支持,开发者也可以在 Agora Conversational AI 中直接进行调用 两个模型,两种用法 Gemini 3.5 Transcribe 包含两个模型,对应不同的使用场景: gemini-3.5-transcribe-live走 Live API,做实时流式转写。音频边输入,文字边输出,延迟在亚秒级。适合直播字幕、语音 Agent、实时会议纪要这类需要即时响应的场景。 gemini-3.5-transcribe 走 Interactions API,处理预录音频。支持说话人分离(最多 3 人,3 人以上为实验性支持)和词级时间戳,适合会议录音整理、通话质检、播客转录这类对实时性要求不高但需要结构化输出的场景。 转写模式:VERBATIM 和 SMART 两个模型都支持 VERBATIM 和 SMART 两种转写模式,通过 mode 参数切换。 VERBATIM 是逐字转写。用户说了什么就输出什么,对 “嗯”“那个”“啊不对”等语气词和口头禅都会进行保留。该模式适合需要保留原始发言的场景,比如
      5.68万评论
      举报
      让 AI 听懂高燃赛场:Agora × Gemini Transcribe 电竞解说实时字幕开发实践
    • 声网公司声网公司
      ·08-31

      Agora 携手 Google Gemini 3.5 Transcribe,共同加速对话式 AI 应用落地

      Agora 与 Gemini 达成合作,发布 Gemini 3.5 Transcribe 与 Agora Conversational AI 集成方案。此次合作将 Gemini 最新的实时语音转写能力与 Agora 面向全球的 RTC 和对话式 AI 能力相结合,帮助企业更高效地打造自然、实时且可规模化落地的语音智能体。 此前,我们已与 OpenAI 合作推出了全球首个Realtime API,旨在为开发者提供超低延迟、高保真、拟人化的 AI 实时语音交互能力。 强强联合,连接“智能”与“实时互动” 随着生成式 AI 从文本交互加速走向语音交互,模型能否在真实场景中及时听懂用户、准确理解表达,并持续保持自然流畅的交流体验,正成为对话式 AI 落地的关键。 Gemini 3.5 Transcribe 是 Google 面向智能语音交互推出的新一代实时语音转写模型,可以更好地应对背景噪声、专业词汇、口语停顿和表达修正等复杂情况。 Agora Conversational AI 则为语音智能体提供稳定的实时音频传输、会话连接和交互基础设施。 双方的合作,连接了前沿模型能力与面向全球用户的实时互动体验,让语音智能不再停留在模型演示阶段,而是能够更快进入真实的产品与业务场景。 开放灵活,降低企业构建对话式 AI 的门槛 通过此次集成,开发者可以在 Agora Agents SDK 中使用 Gemini 3.5 Transcribe,并根据自身业务需求灵活组合大语言模型与语音合成服务。 这种开放、可组合的方式,有助于企业避免被单一技术方案绑定,也能随着模型能力和业务需求变化持续迭代。对已经拥有 AI 技术栈的团队而言,可以在保留原有能力的基础上补齐实时交互环节;对刚刚进入对话式 AI 的企业而言,也可以更快完成从原型
      5.70万评论
      举报
      Agora 携手 Google Gemini 3.5 Transcribe,共同加速对话式 AI 应用落地
    • 声网公司声网公司
      ·08-24

      声网发布 DeepSeek Harness 插件,让 Agent 更懂实时互动开发

      AI 编码 Agent 正在从“写代码”走向“理解任务、交付工程”。但在 RTC、RTM、语音 Agent 这类横跨客户端、服务端和鉴权的场景里,难点从来不是模型会不会写。 直接让 Agent 写一段实时通话代码,给出的往往是结构完整、细节过时的实现:方法名对了大半,初始化顺序错了,包名是旧的,Token 凭印象填写。这只是在复述训练数据里那个被平均过的版本,而 SDK 的迭代远比模型的训练快。 DeepSeek Harness(下称 DSH)是 DeepSeek 开源的 Agent Harness,采用插件化架构,模型、工具、运行能力都按 profile 组合。 声网现已推出面向 DSH 的 dsh-agora 插件:装上之后,你在 DSH 里用自然语言描述声网开发任务,Agent 会自己找到对应的产品路径、官方 Quickstart 和接入说明。 一个插件,覆盖声网全线 dsh-agora 覆盖了常见的声网开发场景: • 对话式 AI / 语音 Agent:AI 语音助手、AI 口语陪练、语音客服等 • 音视频 RTC:一对一与多人通话、直播、屏幕共享 • 消息与信令 RTM:实时消息、在线状态、通知 • 云端录制:服务端录制会话 • 服务端与鉴权:生产环境 Token 生成、跨产品协同 • 声网 CLI:登录、建项目、环境写入、就绪检查、自动化 开发者不需要先判断应该从哪一套产品文档开始,Agent 会帮忙进行快速选择,让开发体验更加丝滑。 快速安装 前置条件 • 本地已安装并可以运行 DeepSeek Harness,终端能够执行  dsh ; • 真正运行声网项目时,需要声网账号,以及对应项目的 App ID、Token 等配置; • 以下命令以 DSH 的 web profile 为
      5.95万评论
      举报
      声网发布 DeepSeek Harness 插件,让 Agent 更懂实时互动开发
    • 声网公司声网公司
      ·08-18

      声网实时转录翻译支持联合国驻华系统2026年国际青年日纪念活动

      8月12日国际青年日当天,联合国驻华系统及合作伙伴在北京联合国大楼举办高级别对话活动,共同纪念这一属于青年的重要节日。活动汇聚青年代表,以及来自政府部门、社会组织、学术界、私营部门和发展机构的伙伴代表,共话青年发展与可持续未来。 每年8月12日的国际青年日,旨在关注青年面临的挑战与机遇,以及青年在可持续发展进程中发挥的重要作用。2026年国际青年日全球主题为“多元语境,共同志向”,反映了不同背景下的青年对于尊严、机遇、参与和可持续未来的共同追求。 围绕这一主题,与会嘉宾深入探讨了政策支持、多方伙伴关系和青年主导的创新,如何帮助青年实现人生愿景,并为可持续发展贡献力量。活动由联合国人口基金、联合国开发计划署、国际劳工组织、联合国难民署、联合国世界粮食计划署及联合国驻华青年主题小组联合主办。 在这场汇聚多元背景与多方观点的对话中,语言既是表达思想的载体,也是相互理解的重要桥梁。声网为活动提供全程实时转录翻译支持,将现场发言实时完成中英互译,帮助与会者跨越语言障碍,聆听和理解重要内容,更充分地参与现场交流与讨论。 808毫秒背后,让重要观点被实时理解 此次技术保障背后,是声网自研实时转录翻译解决方案的一体化能力。 依托声网行业领先的实时互动技术,该解决方案在相关测试环境下实现中文转录首字延时低至 808 毫秒,整体语音识别错误率(WER)低至 3.34%。在跨语种发言切换频繁、内容持续输出的活动场景中,低延时与高准确率能够显著减少字幕等待与信息错位,让参会者紧跟发言节奏。 在多语种能力方面,声网实时转录翻译目前可支持150+ 种语言及方言的实时转录与 150+ 种语言的实时翻译,能够覆盖国际会议、跨境直播、在线教育、企业协作等不同场景下的跨语言沟通需求。 同时,声网将高清转录、实时字幕、云端录制、多语翻译及实时音视频能力深度整合,对外仅提供 2 个核心 API 接口,且不受 SD
      5.68万评论
      举报
      声网实时转录翻译支持联合国驻华系统2026年国际青年日纪念活动
    • 声网公司声网公司
      ·08-14

      模型越来越强,为什么 AI 硬件反而更难做了?

      过去两年,大模型快速进入智能眼镜、机器人、AI 陪伴、AI 教育、智能家居等终端。到了 2026 年,“接入 AI ”已经不新鲜了。行业真正开始较量的,不再是 Demo 能不能跑起来,而是一个更传统、也更难的问题:这款产品为什么存在,能不能稳定量产,用户会不会长期使用。 8 月 9 日,声网携手人人都是产品经理,在 RTE 2026 春夏巡游北京站举办「AI 硬件多模态交互的产品化破局」专场沙龙。浙江湃启科技 CEO 孙思宁、声网 AI 产品线负责人姚光华、灵宇宙产品负责人刘翠涛、阿里云百炼应用高级产品经理司红江,以及移远通信北区技术总监武风停,从产品、交互、端侧与供应链等不同位置,围绕 AI 硬件从 Demo 走向真实产品展开讨论。 现场还展示了盈迪曼德陪伴机器人、萌友ropet、灵宇宙小方机、移远拍学机、Lookee口语侠、赋之EBO、芙崽、青橙眼镜等多款客户产品。现场氛围轻松融洽,大家一边畅谈一边体验。相比 PPT 上的能力数据,这些被真正拿在手里的产品,也让当天的讨论变得更具体:技术最终要落到一台设备、一套成本和一次真实使用里。 01 先定义产品,再谈模型能力 硬件行业有一个反复出现的陷阱:手里有什么技术,就想往产品里加什么能力。到了 AI 时代,这个问题并没有消失,反而因为模型能力越来越丰富而更加突出。能力越多,产品越需要克制。 孙思宁将产品定义进一步拆成六个问题:谁,在什么场景,使用什么核心功能,解决什么刚性痛点,愿意为此付多少钱,以及这份价值能否覆盖产品成本。硬件后期很多看似属于结构、电路、供应链的问题,往往在产品定义阶段就已经埋下了。 孙思宁还提出,可以把深圳成熟的硬件产业链理解成“硬件 API ”:先调用成熟方案验证功能、场景、商业模式和付费逻辑,跑通之后再自主开模量产。对于今天大量从软件、AI 团队跨进硬件的创业者来说,这是一种更现实的 0 到 1 路径
      5.59万评论
      举报
      模型越来越强,为什么 AI 硬件反而更难做了?
    • 声网公司声网公司
      ·08-14

      声网母公司发布2026Q2财报:营收增长持续加速,连续七个季度GAAP盈利

      北京时间8月14日,声网母公司 Agora, Inc.(NASDAQ:API)公布2026年第二季度财报。财报显示,第二季度 Agora, Inc. 总营收4042万美元,同比增长18%,超过指引区间高端;公司指引第三季度营收区间为4100万至4200万美元,同比增长15.8%至18.6%。 在美国通用会计准则(GAAP)下,Agora, Inc. 第二季度净利润为220万美元,净利润率为5.4 %,同比增长50.3 %,并已连续七个季度实现 GAAP 盈利。 Agora, Inc. 创始人兼 CEO 赵斌表示: “我们欣然宣布,本季度实时互动与对话式 AI 两大业务板块均保持强劲增长势头,推动公司营收增速进一步提升。同时,我们已连续七个季度实现美国通用会计准则(GAAP)下盈利。 我们的语音 Agent 应用场景正在快速拓展,已覆盖市场调研、意向收集、客户服务等多个领域,并在越来越多的任务中展现出比肩甚至超越人类的表现。我们坚信,随着 AI Agent 解决方案持续迭代,其商业价值将进一步释放,并推动呼叫中心加速向 AI 驱动的工作流演进。 展望未来,我们将继续加大对实时互动基础设施的投入,并深化开发者生态建设,为人与人、人与 AI 之间更加自然、高效、可靠的实时互动提供坚实支撑。” 在现金储备方面,截至2026年6月30日,公司现金、现金等价物、银行存款及银行理财产品为3.62 亿美元。 RTE+AI 产品持续升级,降低场景落地门槛 2026年第二季度,声网围绕 RTE+AI 产品体验、开发效率等持续完善产品和解决方案,进一步降低企业与开发者在语音智能体开发、社交娱乐等实时互动场景中的接入门槛。 推出 Agora Agents SDK,支持 Python、Node.js 和 Go,帮助开发者用更少代码、更短时间,在声网对话式 AI 引擎上构建语音智能体。该引擎依托全球边
      5.47万评论
      举报
      声网母公司发布2026Q2财报:营收增长持续加速,连续七个季度GAAP盈利
       
       
       
       

      热议股票