声网公司

声网成立于2014年,是全球实时音视频云服务开创者,为人与人和人与智能体的音视频互动提供最佳体验。

IP属地:上海
    • 声网公司声网公司
      ·2024-02-28

      声网母公司发布2023 Q4及全年财报,实现3年来首次盈利

      北京时间2月27日,声网母公司 Agora, Inc.(NASDAQ: API) 公布了2023年第四季度及全年财报。财报显示,第四季度 Agora, Inc. 实现营收3604万美元,环比增长3%,全年总营收1.42亿美元。 其中,业务聚焦中国市场的声网第四季度实现营收1.48亿人民币,环比增长5%;聚焦非中国市场的 Agora 第四季度实现营收1530万美元,环比持平。 值得一提的是,得益于多元实时互动应用场景的增长和行业扩展,Agora, Inc. 2023年第四季度调整后净利润为140万美元,实现三年以来首次季度盈利。 对此,Agora, Inc.创始人兼CEO赵斌表示,“我们在2023年四季度取得了强劲的财务业绩,实现了连续的收入环比增长,并实现了140万美元调整后净利润,这是三年以来首次季度盈利。这反映了我们在极具挑战的经营环境下的业务韧性,以及我们不断优化成本结构的努力。” Agora, Inc.在2023年第四季度完成股票回购350万ADS,总金额1000万美元。赵斌表示,“在过去的两年中,我们通过回购方式向股东返还了超过1亿美元,我们的总股本也相应降低了约18%。我们非常高兴地宣布,董事会已经授权将2亿美元的股份回购计划延长12个月,这体现了董事会对我们的财务实力和长期增长前景的信心。” 在客户规模方面,截至2023年12月31日,声网活跃客户数量达4144个,同比增长12%,Agora活跃客户数量达1683个,同比增长18%。
      8.87万评论
      举报
      声网母公司发布2023 Q4及全年财报,实现3年来首次盈利
    • 声网公司声网公司
      ·08-05

      声网联合爱芯元智推出机器人实时互动方案,打通“视控一体”技术闭环

      近日,声网与全球领先的 AI 系统芯片(SoC)供应商爱芯元智联合宣布,基于爱芯元智 AX8850N SoC 完成声网面向机器人场景的实时互动方案适配。双方将 AX8850N 强大的 AI 视频处理能力与声网全球实时通信网络深度融合,打造出集实时视频、远程操控、可靠信令于一体的机器人实时互动解决方案,为机器人行业提供了更完整、更稳定、更低门槛的技术底座。 在具身智能、大模型与边缘 AI 的驱动下,机器人正加速进入工业巡检、物流配送、农业植保、家庭陪护等真实场景。但要让机器人跨越地域与网络限制、实现高效人机协同,仅靠感知和推理远远不够——它还必须拥有稳定的实时视频回传、可靠的远程控制,以及在复杂网络下持续在线的通信能力。 AX8850N 高算力高能效,筑牢机器人视觉基座 作为方案的核心计算平台,爱芯元智 AX8850N 是一款高算力、高能效比的 AI 视觉 SoC芯片。它集成了八核 A55 CPU,NPU 算力高达 72.0TOPs(INT4)或 18.0TOPs(INT8),并内置 8K@30fps 的 ISP 图像处理引擎及支持 H.264、H.265 编解码的 VPU。同时,芯片提供 64bit LPDDR4x 内存接口、多路 MIPI 视频输入、双路千兆以太网、USB 3.0及双路 HDMI 2.0b 输出等丰富外设,能够从容应对机器人多路高清视频采集、实时 AI 推理与复杂交互需求。强劲的本地算力与出色的能效表现,为上层实时视频处理和远程精准控制构筑了坚实基座。 从“看见”到“控制”,实时闭环是关键 此次方案围绕“视觉+控制”两大核心链路,形成“AX8850N + 声网 RTC + RTM”的实时互动闭环。 在视觉侧,机器人摄像头画面经 AX8850N 完成视频处理和 AI 分析后,通过声网软件定义实时网络(SD-RTN™)将高清视频实时传输至 PC、手机、平板等终
      5.24万评论
      举报
      声网联合爱芯元智推出机器人实时互动方案,打通“视控一体”技术闭环
    • 声网公司声网公司
      ·07-28

      声网 K 歌解决方案焕新,版权曲库自服务上线

      在语聊房、直播间等实时互动场景持续增长的今天,K歌已成为泛娱乐社交场景中的核心玩法之一。对于平台和开发者而言,除了音质、延迟等底层技术体验外,版权曲库的接入效率,也正在成为影响业务上线速度和运营效率的关键变量。 近日,声网围绕 K 歌解决方案完成重要升级,版权曲库自服务功能正式上线。该服务帮助企业与开发者以更清晰、高效的方式完成版权曲库接入与开通,进一步降低合规门槛,加速业务落地进程。 优质版权曲库,夯实内容供给与合规能力 声网版权曲库在内容供给与版权合规方面具备核心优势。 一方面,曲库来源清晰、版权链条完整,能够帮助平台更安心地开展语聊房、直播互动等业务,降低潜在版权风险。 另一方面,曲库覆盖丰富,包含大量热门华语歌手与经典华语歌曲,能够更好满足用户演唱需求。更重要的是,曲库内歌曲均为正版授权内容,而非用户翻唱上传,整体内容质量和可用性更高。 同时,针对不良艺人的相关歌曲,声网建立了及时下架处理机制,帮助平台进一步规避潜在的品牌负面影响与运营风险。 四步完成版权曲库接入,全程线上化操作 此次上线的版权曲库自服务,将整个接入流程精简为清晰的四个步骤: 第一步:提交报备并完成审核 企业与开发者需先提交业务报备信息,由版权方审核。通过后即可获得版权曲库接入资格。该环节帮助客户前置完成版权合规确认,为后续购买、开通和使用打下基础。 第二步:购买套餐包 企业与开发者登录 声网 Console 后,可直接查看版权曲库套餐包的价格与额度。套餐包支持按月续费、自动续订,同时支持溢出使用:当使用量超出套餐包额度时,服务也不会立即中断,帮助客户更平稳地保障线上业务连续性。 第三步:开启曲库权限 完成套餐包购买后,企业与开发者可直接在 Console 中开启曲库权限,无需复杂配置或额外部署,即可完成版权能力开通,快速进入接入阶段,进一步缩短整体上线链路。 第四步:测试并上线
      5.19万评论
      举报
      声网 K 歌解决方案焕新,版权曲库自服务上线
    • 声网公司声网公司
      ·07-21

      能听会说、能看会动,在 WAIC 现场,亲历一场有温度的“ AI 交互”

      2026 世界人工智能大会(WAIC) 今日圆满落幕,作为杨浦区人工智能重点企业代表,声网携对话式 AI 引擎、对话式 AI 开发套件、实时转录翻译等多款 AI 产品亮相本次大会 H2 - D516 杨浦区展位,并重点展示了声网对话式 AI 在智能家居、教育硬件、智能穿戴设备等 AI 硬件领域的落地案例。用一场“可听、可看、可聊、还懂你”的沉浸式互动展位,向行业和观众展示了对话式 AI 技术如何走向商业化落地。 一场“触手可及”的 AI 交互盛宴 在声网展台上,没有枯燥的参数墙,也没有只可远观的产品展示。观众可以随手拿起展台上的硬件设备,亲自开口和它们“聊”上一会儿: • 具备养成属性口袋 AI 毛绒宠物——芙崽 Fuzozo,会用毛茸茸的身体抖动与萌萌的语音回应你的情绪; • 拥有多模态感知系统的 AI 宠物机器人——KATA Friends,能“看懂”你的手势并自主走到你面前打个招呼; • 戴上 HeyCyan AI 眼镜,即刻体验高清拍摄、语音交互与视觉识别的无缝融合; • 具备全屋移动、AI 对话与双向音视频通话功能的 EBO Air 2 Plus,能随时与家人视频连线,用 AI 和实时监控守护家的安全; •专为儿童设计的便携式 AI 学伴——灵宇宙小方机,能通过趣味问答和互动学习,让知识探索变成一场奇妙的冒险…… 这些真实可感的互动,让每一位体验者都直观感受到:AI 不再是纯粹一问一答的机械工具,而正在成为能够主动感知、理解并回应你的“智能伙伴”。 正如声网在 WAIC 现场接受央视财经采访时所说,人机交互正在从“你说我听”的指令模式,走向“自然对话”的无感模式—— AI 不再需要你适应它,而是它来适应你。 声网业务与战略副总裁陈宝金在采访中表示,客户的核心需求是让智能体与人的交互做到“无感知”。围绕这一目标,声网提供了低延迟响应、智能打断、智
      5.24万评论
      举报
      能听会说、能看会动,在 WAIC 现场,亲历一场有温度的“ AI 交互”
    • 声网公司声网公司
      ·07-16

      声网对话式 AI 引擎入选中国互联网协会第一期《智能体产业供需对接手册》

      7月9日,2026(第二十五届)中国互联网大会第三届智能体创新推进论坛在京举办。论坛以“开启智能体规模化应用与高质量发展新征程” 为主题,汇聚了来自政产学研用各界的领导、专家、企业代表,聚焦产业发展趋势、落地实践、生态协同、安全治理等核心议题展开深度研讨,发布了多项产业成果,并启动系列生态活动,为智能体产业从自由探索走向规范化发展、规模化应用凝聚共识、汇聚力量。 中国互联网协会副理事长卢卫,中国互联网协会专咨委副主任、中国移动科技委副主任、GTI 主席高同庆,中国互联网协会副秘书长裴玮,中国互联网协会专家咨询委员会委员、人民邮电报社原总编辑武锁宁,北京大学国家发展研究院副院长、教授黄卓等嘉宾出席论坛。此外,来自三大运营商、科技企业、央国企及产业链配套服务商的众多代表齐聚一堂,共同探讨智能体产业应用的未来方向。 为解决信息不对称这一智能体规模化落地的最大卡点,中国互联网协会智能体互联网发展和治理工作组牵头梳理了全产业链优质供给与真实行业需求,正式汇编完成并发布了第一期《智能体产业供需对接手册》。该手册涵盖 22 家产业链单位,是行业第一批务实、可落地的产业供需名录。协会后续将持续动态更新、季度迭代,将其打造成行业可查、可用、可合作的常态化对接工具。 凭借在行业内的差异化落地成果,声网对话式 AI 引擎入选第一期《智能体产业供需对接手册》。此外,声网以供方代表身份参与圆桌交流环节,分享了对话式 AI 引擎的核心优势、技术亮点及落地场景。 1) 超低延迟:依托声网自研在全球部署的软件定义实时网络 SD-RTN™ 为核心,具备超低延迟、高并发、弱网对抗与全球覆盖能力,为语音智能体提供稳定、实时、可全球互通的音频通道对话,全链路深度优化,端到端响应延迟低至 650ms,80% 丢包率下仍能稳定流畅对话,断网 3-5s 依旧流畅对话; 2) 选择性注意力锁
      5.21万评论
      举报
      声网对话式 AI 引擎入选中国互联网协会第一期《智能体产业供需对接手册》
    • 声网公司声网公司
      ·07-15

      声网积极参与第六届“全社会反诈 青年在行动”宣传活动

      根据中央宣传部、公安部2026年“全民反诈在行动”集中宣传月活动安排,7月10日,公安部刑侦局在京举办第六届“全社会反诈青年在行动”宣传活动。公安部新闻宣传局、中央宣传部新闻局、中央网信办网络综合治理局、工业和信息化部网络安全管理局、中国人民银行支付结算司、最高人民法院刑三庭、最高人民检察院第四检察厅、共青团中央青年发展部、全国妇联权益部、中国人权发展基金会、中国人寿慈善基金会等相关单位负责同志及青年党员、中国人民公安大学和30余家互联网公司的反诈青年志愿者共计500余人参加活动。 公安部刑侦局相关负责同志在致辞中指出,当前电信网络诈骗犯罪手段不断翻新,严重侵害群众利益,要坚持专群结合,充分调动广大群众参与反诈的积极性,切实营造全民反诈、全社会反诈的浓厚氛围,这既是践行以人民为中心发展思想的必然要求,也是从源头上遏制电诈高发的治本之策。今年集中宣传月以“不听不信不贪恋,构筑反诈‘心’防线”为活动主题,旨在帮助群众提升反诈意识和防骗能力,构筑坚实的反诈“心防”。根据活动安排,参与本次宣传活动的各部门、各企业将立足本系统、本行业实际,针对社区群众、高校师生、企业职工及老年群体等不同受众特点,开展分众化、精准化宣传,进一步提升人民群众的防骗意识和识骗能力。 在活动现场,反诈民警与志愿者联手打造沉浸式互动体验区,通过反诈知识问答、AI诈骗情景模拟体验、脱口秀以案说法等新形式,生动揭露诈骗套路。同时,各大互联网公司结合自身平台优势,借助线上有奖问答、反诈直播课堂、反诈小游戏等互动形式,激发群众参与热情,吸引网民云端打卡,推动反诈知识在指尖传播,共同营造全民参与、实时互动的浓厚氛围。 作为全球领先的对话式 AI 和实时互动云服务商,声网已连续三年参加“全社会反诈 青年在行动”主题宣传活动。活动现场,声网通过宣传新型电信网络诈骗的特征和防范技巧,并通过寓教于乐的游戏互动方式,激发了现场青
      5.20万评论
      举报
      声网积极参与第六届“全社会反诈 青年在行动”宣传活动
    • 声网公司声网公司
      ·07-13

      声网联合网易智企-易盾推出内容审核解决方案,助力平台高效构建内容安全体系

      随着直播、语聊、社交、游戏等实时互动场景持续火热,内容安全已经成为平台稳定运营的基础能力。对于此类场景而言,内容审核不仅是“能否识别风险”的问题,更关系到平台能否在业务运行中,以更低接入门槛、更优成本和更快处置链路,完成从风险发现到业务治理的闭环。以某社交平台为例,接入内容审核能力后仅10% 的存疑数据需要人工二次确认,综合准确率达 99.99%,审核成本显著下降。 在实际业务中,平台接入内容审核能力时往往会面临多重挑战: • 审核能力与实时音视频系统通常分属不同平台,开发者需要在多个控制台之间切换,完成账号开通、服务配置、接口接入和结果管理,整体链路较长。 • 如果为审核单独搭建额外处理链路,也会增加系统复杂度和资源成本。 • 更关键的是,审核结果如果不能及时联动业务系统完成告警、禁言、下麦、封禁等动作,内容治理就很难形成真正闭环。 基于此,声网与网易智企-易盾联合共建面向实时互动场景的内容审核解决方案,围绕接入便捷、成本优化和治理闭环三大方向,帮助直播、语聊、社交、游戏等平台更高效地构建内容安全能力,降低业务运营和内容合规风险。 网易智企-易盾在内容安全领域拥有20余年的技术积累和行业实践,是生成式AI安全国标(GB/T 45654-2025)核心编写单位。其内容安全能力覆盖文本、图片、音频、视频等多模态风险识别,支持 L1-L4 四级风险分级管控,兼顾合规与用户体验,并面向社交、游戏、金融等垂直行业沉淀了专项策略,同时在 AIGC 内容安全等新兴领域构建了全链路安全围栏能力。此次联合方案将声网的实时音视频能力与易盾的内容安全能力深度结合,让开发者可以更轻量地在实时互动业务中接入音频与视频审核能力。 在接入便捷方面,开发者可直接通过声网控制台完成易盾审核能力开通与账号创建,无需在多套控制台之间频繁切换。完成开通后,开发者调用声网音频审核接口、视频截图接口,即可实现直播间
      5.17万评论
      举报
      声网联合网易智企-易盾推出内容审核解决方案,助力平台高效构建内容安全体系
    • 声网公司声网公司
      ·07-10

      声网联手瑞芯微推出机器人平行操控解决方案,基于RK3588/RK3576平台实现端到端低延迟实时操控

      近日,声网与国内知名 AIoT SoC芯片厂商瑞芯微(Rockchip)基于瑞芯微 RK3588、RK3576 两款机器人“小脑”核心芯片平台,联合推出面向全品类机器人的平行操控解决方案。该方案深度融合瑞芯微 Rockit 音视频开发框架,在 4G/5G 及 Wi-Fi 网络下实现端到端延迟稳定低于 200ms,网络延时中位数仅 76ms,为家庭陪伴、农业、工业、割草等场景的机器人提供标准化、高可靠、开箱即用的远程操控与实时图传能力。 行业数据显示,机器人市场正迎来高速增长期。去年中国服务机器人产量同比增长16.1%,割草机器人、四足机器人等细分赛道更是出现翻倍甚至200%以上的爆发式增长。平行操控作为机器人从“自主单机”走向“人机共融”的关键能力,正在成为产业规模化落地的核心刚需。声网与瑞芯微的此次合作,直击长期困扰行业的通信方案碎片化、适配周期长、弱网环境下操控失效等痛点,为机器人产业铺就了一条从芯片到云端的“高速公路”。 直击行业痛点:平行操控是“安全绳”,也是“信任锚” 自主导航、避障、路径规划是机器人的看家本领,但真实世界从不按剧本走。花园里突如其来的陡坡、工厂中临时堆放的物料、家庭里孩子的突发举动——这些边缘场景,都需要人类远程接管与实时干预。这种能力被业内定义为“平行操控”——在机器人自主运行之上叠加一层可靠的人类实时干预通道,确保“看得清、听得懂、做得准”。 业界曾有一种声音:平行操控是不是只是机器人在“不够聪明”时的过渡方案?声网的判断恰恰相反——越是复杂的现实世界,越需要人类做终极决策。人机共融不是权宜之计,而是长期状态。平行操控不是过渡,而是机器人大规模进入人类环境的“安全绳”和“信任锚”——它让用户敢于放手让机器人去跑,又能在关键时刻稳稳接住。 而,这条通道过去一直是行业的“暗礁”。厂商各自为战、自研协议,通信方案像一盘散沙,适配周期动辄数月;弱网环
      5.10万评论
      举报
      声网联手瑞芯微推出机器人平行操控解决方案,基于RK3588/RK3576平台实现端到端低延迟实时操控
    • 声网公司声网公司
      ·07-03

      Agora Agents SDK:极速构建你的第一个语音智能体

      今天,Agora Agents SDK 正式发布,支持 Python、Node.js 和 Go——让开发者用更少的代码、更短的时间,在声网对话式 AI 引擎上构建语音智能体。 声网对话式 AI 引擎为实时语音智能体提供底层基础设施:依托全球边缘网络实现低延迟音频传输,并内置轮次检测、打断处理等实时对话能力。 Agora Agents SDK 则让接入这一切变得前所未有地简单——强类型、可链式调用的构建器,内置鉴权,约十行代码、15 分钟,就能构建出一个可投入使用的语音智能体。 Agora Agents SDK 构建在现有 REST API 之上。REST API 会继续获得完整支持,你可以按自己的习惯选择使用 SDK,或直接调用 API。 Agora Agents SDK 的核心能力 SDK 负责打通代码与声网对话式 AI 引擎之间的集成,让开发者得以专注于智能体本身的业务逻辑,无需关注底层的衔接细节。 1、强类型、可链式调用的构建器 API 通过链式调用 .with_stt() 、 .with_llm() 、 .with_tts() 组装智能体,并在编辑器中获得自动补全与类型检查。 2、内置鉴权与 Token 管理 app_id 与 app_certificate 仅需传入一次,SDK 即自动生成对话式 AI 引擎 鉴权 Token 与 RTC 频道 Token,并内置指数退避重试与合理的超时设置。当你为 Web 或移动端应用暴露 Agent 管理接口时,SDK 还能帮你配置客户端加入声网频道所用的 Token 服务。 3. 会话生命周期管理 通过 SDK 对象直接启动、停止、查询与恢复会话,无需再把原始的 Agent ID、状态值和重试逻辑散落在后端各处。 4、Python、Node.js、Go 三端同发 三种语言同步发布,采用统一的构建器模式,并分别贴合各自的语言习惯
      5.06万评论
      举报
      Agora Agents SDK:极速构建你的第一个语音智能体
    • 声网公司声网公司
      ·06-30

      声网参编《移动 AI 愿景与发展建议书》,构筑移动 AI 实时交互新生态

      6月25日,2026上海世界移动通信大会(MWC上海)——移动 AI 产业生态大会上,中国信息通信研究院王志勤副院长现场发布了行业重磅成果《移动 AI 愿景与发展建议书》。声网作为核心参编单位,携手中国信通院、三大运营商、**、中兴、MTK、OPPO、Vivo、小米等20余家产学研用代表共同参与报告编制。该报告从产业视角凝聚了移动 AI “连接启智,知意即达”的核心愿景,系统梳理了典型场景与核心需求,并提出了面向未来的发展建议。 作为全球领先的对话式 AI 与实时音视频云服务商,声网深度参与了该报告编写工作。在报告中,以 AI 眼镜、智能助手、桌面陪伴机器人为代表的“随身智能助理”场景,被列为移动 AI 的典型场景,服务方式从传统的以 App 的“被动指令响应”式服务,转变为具备拟人化特征的“数字伙伴”式服务。这些场景的实现,要求在复杂网络环境(如高丢包、弱网)下仍能保持始终在线、流畅对话。声网将真实场景中积累的“全双工连续交互、跨语种实时响应、具备“始终在线”的能力、构建类人的自然交互体验等关键特征能力,转化为移动 AI 典型行业建议方向,为移动 AI 产业向“体验驱动”转型贡献了最佳实践。 声网在去年推出了全球首个对话式 AI 引擎,旨在赋能开发者基于任意大语言模型(LLM)构建实时语音对话体验,让大模型得以实现“开口说话”的原生交互能力,显著提升了人机对话的流畅度与自然度。声网已与MiniMax、智谱、商汤、通义千问等国内头部大模型厂商建立了深度合作关系;在场景落地层面,该引擎已成功赋能 AI 陪伴玩具、AI 语音助手、AI 眼镜、AI 机器人、AI 客服等一系列创新应用。这不仅验证了声网实时交互技术底座的领先性,更以实际行动践行了《报告》中“场景驱动技术演进”的核心理念。 未来,声网将携手产业各方,与移动 AI 产业推进方阵一道,面向 AI 新终
      4.88万评论
      举报
      声网参编《移动 AI 愿景与发展建议书》,构筑移动 AI 实时交互新生态
    • 声网公司声网公司
      ·06-11

      本届世界杯的第一张“红牌”:延迟、并发与同步的极限博弈

      美加墨世界杯即将开赛。48支球队,104场比赛,16座城市,三个时区。国际足联预计全球累计观看人次超过60亿,峰值并发可能突破一亿。 世界杯是目前人类体育史上收视体量最大的系列直播赛事。它不会给任何平台预演的机会——带宽峰值在进球瞬间被打穿,卡顿投诉在点球大战期间爆发,弹幕剧透让延迟过高的平台成为众矢之的。延迟、并发、同步——这三个技术命题中的任何一个失守,都足以让一届赛事直播变成一场灾难。 世界杯所代表的极端场景,是检验赛事直播技术能力的终极考卷。 一、传统直播方案在赛事场景下的三道坎 第一道坎:延迟。 基于 HLS 协议的直播,端到端延迟普遍在20到30秒;FLV 或 RTMP 协议在3到8秒。这个延迟量级下,弹幕剧透无法避免,实时互动——云解说、一起看、同步投票——缺乏成立的前提。延迟不是众多指标中的一个,它是决定其他功能能否存在的先决条件。 第二道坎:弱网稳定性。 大型赛事的观众分布全球,网络条件差异巨大。传统 CDN 在面对网络抖动时通常降低画质或直接卡顿。对于一场90分钟的比赛,用户对短暂画质下降的容忍度远高于中断。 第三道坎:互动缺失。 传统直播是单向推流。“一起看”正在从增值功能变成标配体验,要求直播架构从“广播模式”转向“实时交互模式”。 这三道坎指向同一个结论:赛事直播需要的不是传统方案的修补,而是一套围绕低延迟、高并发、强互动重新构建的技术架构。声网赛事直播解决方案以此为起点,覆盖从内容生产到用户消费的完整链路,归纳为四个核心场景。 二、四大核心场景 场景一:赛事观看 这是基础场景,也是技术压力最大的环节——数百万乃至数千万同时在线观众,要求延迟极低、画质稳定。底层传输建立在 SD-RTN™(软件定义实时网络)之上。这是一张覆盖全球200多个国家和地区的软件定义网络,设计逻辑与 CDN 有本质区别:CDN 是“先
      5.31万评论
      举报
      本届世界杯的第一张“红牌”:延迟、并发与同步的极限博弈
       
       
       
       

      热议股票