商汤科技
商汤科技官方号
老虎认证: 商汤科技是一家赋能百业、行业领先的人工智能软件公司
IP属地:北京
0关注
1445粉丝
商汤科技是一家赋能百业、行业领先的人工智能软件公司
avatar商汤科技
07-13 16:31

超越 Vision Banana!商汤开源 SenseNova-Vision:视觉任务大统一,经典视觉并入大模型

今天,我们正式发布并全面开源日日新 SenseNova-Vision理解生成统一视觉大模型,这是商汤日日新大模型体系的重要视觉能力升级。 行业以往的 "统一视觉" 多是把检测、分割、深度预测等多个专家模型打包封装,本质还是割裂的。 SenseNova-Vision 的核心变革是:让视觉成为通用基础模型的原生能力,彻底融入大模型体系。所有经典视觉任务如目标检测、图像分割、深度预测、3D重建等,由此都实现了原生统一。 GitHub: https://github.com/OpenSenseNova/SenseNova-Vision 这种 "原生融入" 带来了双向增益: 数据反哺:视觉领域几十年的高质量数据直接提升大模型底座的视觉理解能力。 思维赋能:大语言模型的推理能力反过来让视觉任务融会贯通,甚至能用语言直接定义新视觉任务。 在视觉 AI 领域,商汤已连续十年蝉联中国视觉AI市场份额第一,并在2025年首次登顶视频分析赛道全球市场份额第一,及亚太地区市场份额第一。SenseNova-Vision将这种行业领先的视觉能力,融入统一多模态大模型体系,代表了视觉 AI 能力的跨越式演进。依托原生统一的技术路线,模型实现了从“执行工具”向“世界理解模型”的本质蜕变,不仅真正看懂物理世界的逻辑,更为AI在物理世界的广泛应用与深度交互构建全新的通用底座。 商汤日日新SenseNova-Vision能够原生统一地实现结构化视觉理解、稠密几何预测、图像分割以及多视角视觉几何等多项核心任务能力。 01 复杂场景实测: 自由指令下的“视觉读心术” 传统的视觉模型往往只能“各司其职”,而且遇到复杂、有干扰的场景就会“抓瞎”。得益于原生通用底座带来的智能涌现,SenseNova-Vision在面对人类视觉都容易犯错的极端场景时,展现出了惊人的泛化能力: 1、零样本泛化:未知游戏“一秒读懂”
超越 Vision Banana!商汤开源 SenseNova-Vision:视觉任务大统一,经典视觉并入大模型

剧透!图灵奖得主开讲,"模型先锋"们论道 | WAIC 2026

今天,我们正式揭晓这场论坛的首批嘉宾阵容——全球顶尖学者已就位,一场关于大模型架构的思想盛宴即将上演。 7月18日上午,商汤科技“基座大模型架构创新与生态合作论坛”将在上海世博中心重磅开启! 本次论坛由全国工商联人工智能委员会及世界人工智能大会组委会主办、商汤科技承办,作为WAIC大会的重要主题论坛之一,汇聚学术界、业界及政府机构的顶尖人士,聚焦前沿AI技术,深入探讨大模型研发与产业落地实践。
剧透!图灵奖得主开讲,"模型先锋"们论道 | WAIC 2026

官宣!WAIC 2026,和商汤一起探索技术边界

7月18日上午,商汤科技“基座大模型架构创新与生态合作论坛” 将在上海世博中心重磅开启!本次论坛由全国工商联人工智能委员会及世界人工智能大会组委会主办、商汤科技承办,作为WAIC大会的重要主题论坛之一,汇聚学术界、业界及政府机构的顶尖人士,聚焦前沿AI技术,深入探讨大模型研发与产业落地实践。精彩环节抢先看👇💡 大咖齐聚,共探智能分水岭2024年图灵奖得主 Richard Sutton 将带来最前沿的技术分享。全球产学顶尖专家代表齐聚 “首席科学家圆桌”,他们将从多模态大模型的技术范式与未来突破出发,围绕范式重构、边界破局、智能分水岭与商业重构等核心议题展开巅峰对话。🚀 模型首发,重塑生产力边界商汤科技将正式发布下一代旗舰多模态基座模型——商汤日日新 SenseNova-U1 Pro!U1 Pro定位为业界首个以“理解·生成·行动”原生统一为内核的多模态智能体基座,对标GPT-Image-2,将为行业带来全新的应用可能。从原生统一架构到8K超高清输出,再到东方美学的精准还原,U1 Pro正在重新定义多模态大模型的应用边界。🔗 国产算力,共筑生态闭环论坛将正式发布商汤大装置国产AI基础设施"技术-生态-商业"闭环布局,与20家国产化核心伙伴一起打造全栈国产AI生态,推动国产算力规模化商用落地。商汤大装置还将达成多项重磅合作,合力开启Agentic时代AI基础设施新篇章。🌏 科技出海,共话中国创新全球发展圆桌汇聚日本、韩国、新加坡、马来西亚等多国AI产业领军者,探讨跨区域技术合作、产业出海新路径。中国式创新的全球化实践,在这里碰撞火花。更多惊喜敬请期待~👉扫描海报二维码预约直播,不见不散!
官宣!WAIC 2026,和商汤一起探索技术边界

SenseNova U1信息图增强版V2来了!小字更清晰、排版质感向专业设计师看齐

商汤日日新SenseNova U1信息图增强版上线后,得到很多创作者和开发者的积极反馈。 随着 GPT-Image-2 等新一代商业图像生成模型的出现,行业期待也在快速提高:模型不只要“画得像”,还要能处理更长文本、更复杂的版式结构,以及更稳定的图文对应关系。   基于这一技术趋势,我们对SenseNova U1信息图增强版进行了专项迭代,推出SenseNova U1信息图增强版V2(SenseNova-U1-8B-MoT-Infographic-V2),希望把这类高信息密度图像生成能力,以更开放、更轻量的 8B-MoT 模型形式持续推进,让开源模型在小字清晰度、复杂排版和视觉质感上不断向行业前沿靠近。 该模型权重已在 Hugging Face 和魔搭社区开放,相关代码、文档与示例已同步至 GitHub。 开源地址(点击阅读原文即可跳转): https://huggingface.co/sensenova/SenseNova-U1-8B-MoT-Infographic-V2 小字清晰度和复杂版式升级 回应真实创作场景 如果说前一个版本——SenseNova U1信息图增强版(SenseNova U1-8B-MoT-Infographic)能做到的是:文字准确、图表可靠、背景稳定; 信息图增强版V2的跨越式突破,就是让AI真正懂得如何把信息图“做得更美”——小字更清晰,排版疏密有致,整体质感向专业设计师看齐。 V2模型进行的关键升级包括: 1、小文本更清晰,信息细节更好读 信息图中的脚注、数据来源、表格注释、坐标轴标签及免责声明等小字,往往承载着关键的辅助信息。过去模型生成的图片边缘极易模糊、笔画粘连,导致用户需要放大数倍去“猜字”,作品也显得专业度欠缺。 V2版本显著提升了小字文本的边缘锐利度和清晰度。以下报纸版面设计的渲染图,无需反复放大,在正常阅读距离下即可
SenseNova U1信息图增强版V2来了!小字更清晰、排版质感向专业设计师看齐

硬核破圈!商汤AI讲解大脑亮相浙江科学传播中心党日活动,探索“AI+科普”新范式

6月28日,浙江省科学传播中心主题党日活动在杭州市余杭区沈家店社区举行,搭载了商汤科技“商量AI讲解大脑”的具身机器人“汤汤”作为首席科普官亮相活动,通过知识科普、现场答疑、互动体验等形式,将科技知识以全新的方式送到基层群众身边。 这是商汤“AI开讲了·智见未来”全国巡展的第二站。继首站在杭州低碳科技馆以智慧讲解员身份完成真实场馆讲解服务后,商量AI讲解大脑又走进社区,从“展项讲解员”变身“科普传播家”,持续探索AI讲解在社区科普、公益宣传和群众服务等多场景中的应用价值。 会讲、能聊、善记,AI讲解员“落户”社区 活动现场,“汤汤”不仅完成了生动开场,还化身为“科普讲师”,让原本晦涩的科技知识变得通俗易懂。在科普宣讲环节,“汤汤”以流畅自然、富有感染力的表达向社区居民解释了人工智能的发展历程、核心技术及未来趋势。社区居民尤其是青少年群体被这位科普达人深深吸引,纷纷驻足聆听、提问学习。 相较于展示跳舞技能的机器人,基于日日新SenseNova多模态大模型打造的“商量AI讲解大脑”,能驱动机器人以通俗易懂的方式进行AI科普。不同于传统语音播放的机械感,“商量AI讲解大脑”赋予了机器人多模态理解、实时语言交互等能力,能够对语义理解、表达节奏与讲解内容进行精细调控,让机器人的讲解真正做到节奏自然、断句精准、重点突出。 如果说“会讲”是AI讲解机器人的基本功,那么“能聊”才是它真正打动人心的地方。“商量AI讲解大脑”的免唤醒自由对话能力,让互动变得前所未有的自然。观众无需说“你好”或按下任何按钮,走近即可自然发问,机器人随时接住话头,实时作答,且不会打断正式讲解的节奏。这种交互方式降低了使用门槛,尤其对老年人和低龄儿童更为友好,使科普不再局限于单向输出。 在热闹的活动中,观众提问络绎不绝,但“汤汤”的讲解从未因此“断档”。这得益于“商量AI讲解大脑”的另一项核心能力——智能断点续讲。
硬核破圈!商汤AI讲解大脑亮相浙江科学传播中心党日活动,探索“AI+科普”新范式

韩国总理出席中国创新企业座谈会,商汤董事长兼CEO徐立受邀参会

近日,韩国总理金民锡访华并与中国企业界人士进行座谈,商汤科技董事长兼首席执行官徐立作为中方企业代表受邀出席。 此次座谈会。徐立表示,韩国是商汤科技非常重要的全球合作伙伴之一,希望双方未来能深化互惠互利,共同打造绿色AI基础设施和可信赖AI。 绿色AI基础设施旨在让同样电力产出更多有效智能。徐立指出,韩国有半导体、存储和能源工程优势,商汤有 AIDC 运营、调度和模型平台经验,双方可以共同把更绿色、更高效的 AI 基础设施带到全球市场。他称:“未来国家间 AI 合作,不一定从共同做一个模型开始,也可以从共同提高 AI 基础设施效率开始。” 徐立还阐释了打造可信赖AI的重要性。他表示,AI 治理不是限制创新,而是让 AI 进入金融、公共服务和全球市场的通行证。“中韩都拥有高度数字化社会和强产业基础,可以先在身份核验、深伪检测、内容标识和高影响 AI评测上形成共同方法,再把这种可信能力带到第三方市场。” 商汤科技2019年进入韩国市场,坚持“Powered by SenseTime”理念,已与超50家韩国客户建立长期稳定的合作关系,覆盖智能硬件、工厂安全、银行 eKYC 和消费机器人等多个领域。商汤目前已形成“AI基础设施-基础模型-应用-治理”全栈能力,面向全球,商汤在15个国家和地区开展业务,相关产品与解决方案深受各地客户与合作伙伴好评。 未来,商汤将继续秉持开放合作、互惠互利的初心,与全球伙伴共筑AI生态,以技术创新驱动产业升级,以协同共创迎接智能时代的共赢。
韩国总理出席中国创新企业座谈会,商汤董事长兼CEO徐立受邀参会

业界首个!商汤大装置算电协同平台通过信通院能力测试

近日,由中国信息通信研究院举办的算电织网・AI+能源双向赋能研讨会在北京成功召开。会上,商汤大装置算电协同平台通过《算电协同平台能力测试方法》测试,成为业界首个通过该项测试的算电协同平台。 此次测评涵盖智能查询问答、负荷功耗预测、电量电价分析、储能策略管理四大能力方向共16项测试内容,商汤大装置算电协同平台各项指标表现优异,充分验证了其在算力-电力实时协同、AIDC降本增效、AI智能决策与调度等方面的行业领先性。 01 数据驱动+AI赋能 行业领先的算电协同平台 商汤大装置认为,AI时代的AIDC是传统IDC向智能基础设施演进的升级形态,本质上是一座持续产出Token的“智能工厂”。而未来AI产业竞争的关键,不再只是拥有多少算力,而是谁能够更高效地将电力、算力和数据转化为有价值的Token。 基于这一判断,商汤大装置打造了算电协同平台,将Agent理念引入智算中心运营场景,构建一个会感知、能思考、可决策、可执行并持续进化的AI调度系统。 商汤大装置算电协同平台,以“数据驱动、AI赋能”为核心,实现了从算力负载到电力供应的全链路协同优化,面向智算产业链各类参与方开放服务能力,包括机房持有方、算力云服务商以及能源提供方,并在以下四大核心能力维度,展现出行业领先水平: 智能查询问答:内置大语言模型驱动的智能问答引擎,运维人员不需要培训即可用自然语言查询各类信息,包括“当前 PUE 趋势怎么样”“本月预估电费多少”“储能今天套利空间多大”等等。系统还能自动完成意图识别、模块路由、数据聚合和图表化答案生成。 负荷与功耗预测:融合算力任务队列、历史用电曲线和气象数据,实现IT负荷预测精度MAPE仅1.1%,24小时超前滚动输出,支持5min/15min粒度的可配置输出。 电量电价分析:可动态接入电力市场分时电价信号,按集群、按时段精细化核算用电成本,自动校验电费申报数据,标记峰谷价差窗
业界首个!商汤大装置算电协同平台通过信通院能力测试

单月10倍增长、2000万用户的背后,商汤小浣熊的反精英叙事

在科技产业,那些被奉为圭臬的宏大叙事,往往会占据最 20% 精英关注的主流媒体的发声渠道。 但有时候,一个时代里最大的机遇,反而在于如何服务好那些看不见的,占据 80% 的沉默大多数。 2026 年 4 月下旬,商汤科技旗下办公 Agent 小浣熊桌面客户端悄然开启内测;5 月中下旬,正式转入公测。在短短一个月的时间里,小浣熊 C 端周活跃用户增长了 200 万,并仍在持续增长,总服务人数超过 2000 万。 而在企业端,小浣熊也已经在中国移动、中国电信、平安科技、麒麟软件、宁波银行、联想、360、零跑科技等数千家领军企业中实现落地。 那么,问题来了:当所有玩家都在卷千亿参数、万亿 token、大 Agent 概念的时候,一个没有秀各种指标与夸张展示效果的产品,凭什么让千万用户与上千家企业留下来? 答案,可能藏在一个被所有人忽视的角落里——商汤没有想过要做「精英」产品。 01 商汤,没有完美用户幻觉 要理解小浣熊的产品哲学,得先理解从 CV 时代一路走来的商汤。 2018 年,中国的人工智能行业正处在 CV(计算机视觉)最烈火烹油的顶峰。当时的学术界和资本圈,开口闭口都是算法精度和高深莫测的数学公式。但就在那个风头最劲的档口,商汤科技却干了一件让同行颇为惊讶的异类差事——他们带头给高中生、甚至是小学生编起了教科书。 在给小学生写的那本教材里,商汤的「主编」们拿掉了多余的代码和矩阵公式,只剩下一个最原始的问题:我们怎么教机器认识一只猫? 在那个全球视觉算法精度争夺战最惨烈的时刻,这家顶尖的 AI 公司之所以愿意蹲下身子,用最简单的方式去跟十岁的孩子对话,是因为他们在一线落地时发现,那些最高深的技术,在实际应用,总会撞上了一堵无形的墙。 决定一个视觉识别项目成败的,往往不是实验室里最后那 0.1% 的算法提升,而是小区的保安、工厂的质检员能不能弄明白产品怎么用。 教会用户怎么用
单月10倍增长、2000万用户的背后,商汤小浣熊的反精英叙事

Gartner®️全球认可!商汤获评生成式AI计算机视觉前沿技术创新者

视觉 AI 已进入新一轮技术范式变革。 近日,Gartner发布视觉AI专题报告《Emerging Tech: AI Vendor Race: Tech Innovators Shaping AI Vision Intelligence Solutions》(下称“报告”),聚焦生成式AI对计算机视觉市场的重构,报告认为,下一代视觉智能的关键方向,是将传统计算机视觉能力与多模态基础模型、空间模型和边缘原生架构结合,从而实现更强的语义理解、实时推理和高可靠部署。 在此全球趋势下,报告列出了12家2026年生成式人工智能(GenAI)计算机视觉领域的技术创新者。其中,商汤成功入选“前沿技术创新者”类别,也是该维度中仅有的两家中国厂商。 此份认可,是商汤科技继斩获IDC中国视觉AI市场十连冠之后,再度收获的全球认可。对商汤科技而言,这标志着商汤不仅是视觉AI市场的领跑者,更是率先推动视觉AI向具备“感知-理解-规划-执行”能力的视觉智能体演进的底层技术创新者。 以多模态基础模型,重构视觉AI技术范式 作为中国视觉AI领域最早开拓者之一,商汤持续探索视觉智能技术前沿,从专用视觉模型,到视觉语言模型,到视觉语言动作模型,再到世界动作模型,始终参与并推动关键技术方向的演进。 过去十年,计算机视觉的核心价值主要体现在“看见”和“看懂”。随着生成式 AI 、空间智能快速发展,全球视觉AI市场正在被重塑,其价值边界早已突破传统单一的图像、视频智能化分析范畴,逐步进化为连接物理世界与数字世界的智能入口,加速落地于城市治理、企业运营、具身智能和医疗健康等高价值场景。 对商汤而言,此次入选Gartner代表着商汤并不只是传统意义上的视觉AI厂商,而是基于全栈AI能力,率先推动将多模态基模型应用于视觉AI底层技术创新的代表性企业之一。通过算力、模型、平台和场景实践的协同,商汤正在
Gartner®️全球认可!商汤获评生成式AI计算机视觉前沿技术创新者

剧透!商汤日日新全新模型绘制端午新景象

原来我们一直都低估端午节了! 不止吃粽子、赛龙舟这么简单 藏着千年古人的智慧与家国浪漫🌿 全网抢先剧透! 小词拼字图、国风端午时间轴长图、食物拼字图 均出自商汤“日日新”新一代理解生成行动统一模型 把百余首端午诗词情长,一键熔铸成粽形文字图腾! 端午文化意象可视化一步到位 百余首小词经纬交织 将“端午安康”的文化祈愿立体具象 一张图读懂端午的精神内核 让传统文化在字形间鲜活重生 把繁杂千年民俗脉络,一键浓缩成清晰国风长卷! 复杂历史信息可视化一步到位—— 从先秦祭龙到入选世界非遗 完整梳理2500年端午发展脉络 一张图捋清端午完整演变 告别碎片化片面认知 把食材与烟火,一键巧构为可触可感的节日符号! 端午食俗意境可视化一步到位—— 鲜虾、章鱼、时蔬与彩绳粽的创意拼贴 让传统食材跳脱“餐桌”维度 化作节日的鲜活图腾 一张图吃透“端午吃什么”的烟火密码 每一口都是千年文化的味觉回响 岁岁端午,万事安康 不止怀念先贤,更愿无病无灾✨
剧透!商汤日日新全新模型绘制端午新景象

全国巡展,首站告捷!商汤AI讲解大脑入职杭州低碳科技馆

6月13日,中国杭州低碳科技馆的序厅里,一段意想不到的讲解声让整个展厅安静下来。这不是哪位名师,也不是录音广播,而是一台搭载了商汤科技“商量AI讲解大脑”的具身机器人。它昂首站定,抬手指向展板,用流畅、自然、充满感染力的语音,将浙江科学基因的千年脉络娓娓道来。 看到这一幕,不少观众拿起手机拍照,孩子们也都围了过来。 不只是“会动”,更是真的“会讲” 此前,人们对具身机器人的印象,多半停留在“能跑能跳能跳舞”。而这一次,商汤科技的AI讲解大脑让机器人多了一项真本事:讲得了展览,答得了问题,还能和观众聊得来。 当天,机器人共完成三场专场讲解,全程自主推进,覆盖“从科学基因到创新浙江——与时俱进的浙江精神”主题展的四个完整篇章:从远古的“建德人”,到沈括对石油的超时代预见,从浙江科学家的家国情怀,再到当代浙江人的“六个特别”。 它的讲解可不是机械播放,而是真正做到了节奏自然、断句精准、重点突出——这背后离不开基于商汤日日新SenseNova 多模态大模型打造的商量AI讲解大脑,能对语义理解、表达节奏与讲解内容进行精细调控。 这个讲解员是“活的” 商汤AI讲解大脑搭载了两项核心大模型能力: 免唤醒自由对话:观众无需说“你好”或按任何按钮,走近即可自然发问,机器人随时接住话头,实时作答,不打断正式讲解的节奏。 智能断点续讲:中途被观众打断提问?没关系——机器人回答完毕后,能准确记住中断位置,从断点无缝衔接继续讲解,上下文一气呵成,不留痕迹。 现场不少观众在机器人“招手引路”时兴奋地跟上。讲解结束后,机器人主动邀请观众合影打卡,并即兴和每位观众说上几句,现场笑声不断。 全国巡展、招募开启:AI讲解大脑走向全国 “商量AI讲解大脑”是基于商汤日日新SenseNova多模态大模型打造的讲解系统,能赋予机器人多模态理解、实时语言交互等能力,并且每到一处,还能根据场馆的文化主题与讲解需求量身定
全国巡展,首站告捷!商汤AI讲解大脑入职杭州低碳科技馆

冷门迭爆!商汤“两大智能引擎”命中2026世界杯多场赛果

2026年美加墨世界杯已进入第7个比赛日,小组赛战火初燃,冷门与悬念交织。国内外各大AI产品也积极参与到这场全球盛宴中,以数据和算法争夺预言王座。 针对这场变量丛生、悬念迭起的绿茵博弈,商汤科技旗下的全场景 AI 办公助手“办公小浣熊”和技能工具库“SenseNova-Skills”,在赛前对小组赛胜负走向展开了系统预测。 此次预测是在海量历史数据基础上完成体系化、结构化判断。展示了AI在复杂变量场景下数据分析的真实能力边界。 小浣熊稳健预测小组赛胜负,准确率背后是什么 我们使用商汤办公小浣熊对小组赛各场次进行了赛前预测。预测维度覆盖两队FIFA排名差值、近12场胜率、主客场表现、伤停情况及历史交锋记录。 最终赛果显示,办公小浣熊的预测与多场实际赛果一致,在刚刚过去的四场比赛中,小浣熊甚至在胜平负准确率上达到了75%:这得益于办公小浣熊强大的数据分析能力。小浣熊支持强大的数据处理功能,从数据清洗、复杂运算到趋势预测和可视化展示,帮助用户快速洞察数据价值,无需编程基础即可轻松上手,实现专业级的数据驱动决策。 分析精度方面,小浣熊在企业场景实测精度 >95%,为国内最高,时序计算、数据匹配、数理计算、异常检测等垂直专业任务精度达到 100%;此外,小浣熊可支持单轮海量数据分析,覆盖最全的数据分析维度——行业首次支持百万级数据量级分析,单个对话中可上传20个文件,总文件大小可达 200M。 在数据分析之后,小浣熊还会将成功的分析过程保存至“技能模版”,后续同类数据即可使用技能模板一键复用同样的分析逻辑进行数据处理。 预测世界杯是一项复杂的工作,因为每场比赛的结果都受到众多变量影响,只有同时具备海量数据的整合能力、多重维度的精准计算能力以及可复用的分析逻辑沉淀能力,才能在不同赛局中完成对胜负方向的稳健预判。 同时,办公小浣熊桌面端上线世界杯相关Skills——可进行预测,也可
冷门迭爆!商汤“两大智能引擎”命中2026世界杯多场赛果

香港最大国产智算中心!商汤携手香港科技园打造4万P国产算力基建

在国家深入推进“人工智能+”行动、加快算力网等新型基础设施规划建设的背景下,香港科技园公司(科技园公司)今日与商汤科技签订合作备忘录,启动在人工智能(AI)算力基建及AI产业生态方面的战略合作。 双方将携手在香港推进国产AI算力基础设施建设(AI Data Centre, AIDC),目标于2030年前形成40,000P+(PetaFLOPS)算力规模,打造全港最大国产智算中心。 项目将作为支撑大模型时代的核心AI基础设施,为各行各业提供高性能算力支持,加快推动香港AI产业落地,进一步提升香港在全球创科及AI发展中的竞争力。 合作备忘录签署仪式由香港特区政府创新科技及工业局副局长张曼莉女士担任主礼嘉宾,并在香港科技园公司主席查毅超博士、行政总裁黄秉修先生,商汤科技董事长兼首席执行官徐立博士,以及商汤科技联合创始人及董事杨帆先生共同见证下,由香港科技园公司首席创科生态发展总监柯志成先生及商汤科技亚太区业务副总裁邹春慧先生代表双方签署合作备忘录。 香港特区政府创新科技及工业局副局长张曼莉女士致辞时表示:“政府成立了‘AI+与产业发展策略委员会’,推进AI与各行各业的深度融合。上游研发方面,InnoHK创新香港研发平台已有16所与AI相关的研发中心,而香港人工智能研发院也将于今年下半年投入运营,推动应用落地,并提供治理框架及规管建议。香港科技园公司与商汤这次合作,不仅旨在建设智算集群,更是体现‘产、研’的结合,进一步支持香港建设国际创科中心。我相信随着未来沙岭国际数据园区与科学园及商汤国产智能算力集群的落成,将进一步加快推动AI产业化与产业AI化,提升香港在全球AI领域的竞争力,共同支撑香港成为AI创新高地。” 香港科技园公司行政总裁黄秉修先生表示:“人工智能正重塑全球企业格局,而算力建设是推动AI创新落地的核心动力。商汤科技由科学园起步,发展成为在国际上具有领导地位的人工智能企
香港最大国产智算中心!商汤携手香港科技园打造4万P国产算力基建

大晓机器人完成天使+轮融资,已累计融资数亿美元

近日,大晓机器人已完成天使+轮融资。 此次天使+轮吸引达晨财智、深创投、上海科创基金、沐曦股份、盛宇投资、复星锐正、华控基金、临港新片区基金、豫资涨泉等众多知名投资方鼎力支持,老股东商汤国香资本持续增资,告捷资本担任长期财务顾问。 至此,大晓机器人2026年上半年已累计融资数亿美元,集结起蚂蚁、商汤、沐曦股份、联想创投、印尼金景资本等产业力量,启明创投、达晨财智、深创投、弘毅投资、盛宇投资、复星锐正、华控基金等著名财务基金,以及上海科创基金、临港新片区基金、上海交大母基金菡源资产多支知名国资和高校基金的全维度明星阵容。 本轮融资资金将重点投入到世界模型及“软硬一体”商业解决方案打造中,依托 "以人为中心" 的环境式数据采集方案,加速开悟世界模型在大规模具身训练、端侧直驱控制等关键技术环节的突破与落地应用,进一步巩固公司在世界模型领域的全球领先优势;进一步打造面向智慧零售、安防巡检、文旅、酒店等多商业场景的软硬一体全场景解决方案,深化与产业链上下游伙伴的开放合作,共建开放协同的具身智能产业生态。 商汤科技联合创始人、执行董事,大晓机器人董事长王晓刚表示:"感谢各投资机构对大晓机器人的信任与支持。具身智能是人工智能的下一个时代,而以世界模型为核心打造的‘最强大脑’正是开启这个时代的钥匙。大晓机器人将继续坚持底层技术创新,以'让每个机器人拥有聪明的大脑'为使命,将具身智能前沿技术转化为推动行业进步的新质生产力,加速具身智能‘ChatGPT’时代到来。" 作为首个开源且面向量产的世界模型,开悟世界模型 3.0 凭借多项全球首创技术突破,正成为当前最具落地性的具身智能世界模型。开悟世界模型 3.0 于2025年12月发布了全球首个理解-生成-预测一体化架构,将世界认知、场景生成与动作决策深度融合于单一内生骨干网络,实现了从 "认识世界" 到 "预测世界" 再到 "与世界交互" 的全链
大晓机器人完成天使+轮融资,已累计融资数亿美元

共建国内首个OPC人才能力标准!商汤科技成为首批生态试点机构

近日,由杭州电子科技大学人工智能开源生态学院牵头起草的《OPC九级人才能力标准(试行)》正式发布。 商汤科技作为核心生态共建方与首批试点机构,与浙江省经信厅、省教育厅、团省委、杭州市西湖区、Datawhale、魔搭社区、云谷中心、杭州资本、高等教育出版社等十余家单位共同参与标准共建与落地推进。 这也是国内首个面向AI时代"一人全栈"(One Person Capability, OPC)能力、可量化验证的人才评价体系。 01 为什么需要一个"新尺子"? AI正在重塑工作的定义——一个人借助大模型+Agent工具链,可以完成过去需要一个团队才能完成的事。"一人全栈"不再是口号,而是越来越普遍的生产现实。但旧的人才评价体系——学历、简历、学分、纸面考试——根本量不出这种新能力。 正如标准发起方所强调的:"过去很多评价体系,是用旧的尺子去衡量新的能力。今天面向'一人AI全栈能力',必须有一把新的尺子。" OPC九级标准的核心思路正是——不看你说什么,看你做出了什么、交付了什么、带动了什么。 02 OPC九级能力框架:从"认知者"到"生态贡献者" 简单来说:OPC Learner,L1-L3:理解 AI、使用 AI,并识别哪些真实场景适合被 AI 改造。OPC Builder,L4-L6:搭建工作流、构建应用,并完成真实项目交付。OPC Founder,L7-L9:跑通业务闭环,组织多 Agent 协作,并创造更大的生态价值。 如果说得再直白一点: Learner 是“我会用 AI”,Builder 是“我能用 AI 做出东西”,Founder 是“我能用 AI 跑通一件有业务价值的事”。 这套标准真正重要的地方,不是把能力分成了九级,而是它开始把AI 能力从“工具熟练度”推进到“结果交付能力”。这和商汤小浣熊一直在做的事情高度一致。 03 商汤小浣熊的角色:用真实任务定义真实能力
共建国内首个OPC人才能力标准!商汤科技成为首批生态试点机构

商汤SenseNova U1图文交错增强版:支持多页连续创作,角色风格不“跑偏”

商汤日日新 SenseNova U1 系列新成员——U1-8B-MoT-Interleaved 图文交错增强版模型,面向图文交错创作与生成(Interleaved Generation)场景进行了专项强化,更好地支持绘本、故事书、多页 PPT、图文教程等连续内容创作,解决传统多模态模型“多轮生成后角色形象飘移、画风断裂、图文脱节”等痛点。 模型开源地址(点击阅读原文即可跳转): https://huggingface.co/sensenova/SenseNova-U1-8B-MoT-Interleaved 01 核心突破:从“单张高质量”到“连贯图文长序列” SenseNova U1 图文交错增强版的核心能力表现在:能够在长内容场景中,持续输出风格统一、叙事连贯、图文高度对应的多页结果 ——它不再仅仅生成孤立的单张图像 ,而是一套完整的、可直接使用的图文内容序列。 其核心升级主要体现在四个方面: 1、叙事一致性与角色连贯性大幅提升 模型显著提升了长周期创作中的叙事连贯性、角色一致性与画风统一性。故事线在整个生成过程中被严格遵循,人物形象从第一页到最后一页均保持高度一致,彻底解决了此前多轮生成中角色形象“走调”的核心痛点。 2、图文对应关系增强,告别“图文脱节” 经过专项训练,模型大幅改善了图像内容与文字描述之间的语义对齐能力。生成的画面能更准确地呈现文本所描述的复杂场景、动态动作与物体间的空间关系,有效减少了“图文脱节”的现象。 3、视觉质量与Artifact明显改善 针对人物结构、文字渲染、页面排版等高频高难区域进行了定向优化,显著降低了生成物中的视觉瑕疵(Artifact),使复杂图文混排内容更加自然、稳定和可用。 4、全新能力:多页PPT自动生成 新版本首次支持了多页PPT自动生成能力。模型能够智能从输入内容中提取要点,自行完成排版设计与文字渲染。 02 能力对比:四
商汤SenseNova U1图文交错增强版:支持多页连续创作,角色风格不“跑偏”

全球首个!大晓机器人推出全屋三维可交互世界模型 Kairos-HomeWorld

近日,大晓机器人联合香港中文大学多媒体实验室、深圳河套学院发布最新世界模型研究成果 Kairos-HomeWorld,这是全球首个实现全屋生成、个体物体全交互的世界模型统一框架。 该技术突破了现有室内场景生成仅能覆盖单房间、缺乏全局一致性与可操作性的行业瓶颈,能够一键生成结构连贯、物理合理、功能完整的全屋三维场景,为具身人工智能与机器人训练提供了大规模、高保真的中国家庭场景可交互的实训场。 具身智能的终极目标是走进千家万户,但家庭环境的高度复杂性与个性化,要求机器人必须在海量差异化真实场景中训练。为此,研究团队同步开源全球规模最大、首个专为中国家庭打造的全屋 3D 数据集。该数据集包含 30 万套中国真实住宅平面图与 5千个完整带可交互家具和物体的仿真场景,覆盖全国各类典型家居户型,完整还原中国本土家庭居住特征,为具身人工智能的国产化落地提供了核心数据与技术底座。 此前,北美机器人领军企业 Figure AI 与全球最大房地产持有者之一 Brookfield 达成战略合作,依托Brookfield 超10万套的住宅单元,进行机器人导航、交互、家务执行的训练,这与 Kairos-HomeWorld 赋能本土机器人训练的思路形成全球呼应。 与之相比,Kairos—HomeWorld在家庭机器人训练方面成本低、效率高。依托模型就能批量生成多样化中国家庭仿真场景,以及自带物理交互属性的物体。机器人可在虚拟环境完成各类家务训练,新增场景近乎零边际成本,省去场地运维、家具损耗等实景开支;同时不受现实房源总量限制,在训练效率与规模化拓展上优于实地采集路线。 目前 Kairos-HomeWorld 已成功应用于大晓机器人的具身智能日常训练,能够支持机器人完成跨房间导航、多房间物品整理等复杂长程家务任务的全流程仿真训练,大幅缩短了从虚拟仿真到现实落地的迁移周期,显著降低具身智能的研发门槛,加
全球首个!大晓机器人推出全屋三维可交互世界模型 Kairos-HomeWorld

数字人产业有国标了!商汤科技获颁虚拟数字人国家标准工作组副组长单位

近日,全国信标委计算机图形图像处理及环境数据表示分委会(TC28/SC24)2026年第一次标准周活动在北京隆重开幕。中国电子技术标准化研究院副院长于秀明、工业和信息化部电子信息司消费电子处周大铭处长、信息技术发展司软件产业处三级调研员高晓雨及分委会主任委员王涌天教授出席并致辞。商汤科技作为虚拟数字人领域的重要代表,深度参与多项关键环节。 开幕式上,正式宣读了《市场监管总局标准技术司关于调整全国个体防护装备标准化技术委员会等20个技术委员会委员的函》,并颁发增补委员证书。随后,扩展现实(XR)工作组和虚拟数字人工作组新一届成员单位名单公布,商汤科技获颁副组长单位证书。 在标准成果发布环节,首批GB/T 46483-2025《信息技术 客服型虚拟数字人通用技术要求》国家标准符合性测试证书正式颁发,商汤科技与科大讯飞、百度等企业代表上台领取。 此外,商汤科技还在开幕式上发表了《AI数字人——从虚拟走入现实》的主题演讲,展示了公司在AI数字人领域的最新实践。随着AI大模型与具身智能的快速发展,商汤正持续推动数字人技术从“能对话”到“懂协作”的演进,让AI真正走进千行百业。
数字人产业有国标了!商汤科技获颁虚拟数字人国家标准工作组副组长单位

商汤SenseNova-Skills来了,全套办公技能:从凌乱数据到精美PPT直接交付

一堆原始数据,到一份可以直接上会的完整报告,中间有多远?这个问题,用真实案例最能说清楚。 过去用通用大模型做数据分析,大多数时候只能拿到一份“建议清单” —— 比如让AI分析这季度的销售数据,它可能回复:建议从增长率、区域分布、客单价三个维度入手。而要完成剩下的图表排版、数据深挖、落地结论等,还是得自己来。 我们缺的从来不是一个会输出建议的AI助手,而是一个能把工作全流程跑完、直接交付成品的数字化同事。  SenseNova-Skills 是商汤开源的办公技能体系。它依托Agent Skills 将各行各业的知识与办公流程,封装成可快速调用的“工种手册”,让 AI 实现从“给出分析思路”到“自动跑完工作流、直接交付成品”的能力跃迁。  产品体验入口:(点击阅读原文即可挑战) https://xiaohuanxiong.com/ 开源地址:  https://github.com/OpenSenseNova/SenseNova-Skills/ 以下四个真实的高频场景案例与场景,完整拆解从数据→分析→报告→PPT端到端闭环全链路,看商汤 SenseNova-Skills 如何落地办公场景提效。 我们将演示从一条指令或一份数据出发,完整呈现直达可汇报、可落地的交付物的全链路结果。  场景一  办公数据分析 告别万行大表,一键输出“可开会决策报告” 案例:风电事业部月度绩效数据表 → 全维度绩效分析报告 HR 与企业管理者每逢周期考核,就有动辄数十张跨月份考核表格需要分析整理。上万条零散绩效数据,人工汇总、岗位对标、数据筛选耗时极久,传统 AI 仅能提供 Excel 函数操作建议,无法自动出完整报告。 Prompt:根据我上传的风电事业部月度绩效考核表,生成一份员工绩效分析报告,包含总体情况、趋势变化、岗位对比、个人表现和
商汤SenseNova-Skills来了,全套办公技能:从凌乱数据到精美PPT直接交付

把信息图做对、做好,SenseNova-U1啃下这块硬骨头

信息图(infographic)是 AI 图像生成领域公认最难的场景——它要求模型同时做到:文字写准、版式排美、图表画清晰,缺一不可。 商汤日日新SenseNova-U1-8B-MoT-Infographic (信息图增强版),在原生统一模型 SenseNova-U1-8B-MoT 基础上,针对信息图场景专项增强,在文(小)字准确度、版式稳定性、图表数据正确性三个维度上均有显著提升——同时保持视觉理解能力不退化。 模型权重与训练代码现已开源。(点击阅读原文即可跳转) 开源地址: https://huggingface.co/sensenova/SenseNova-U1-8B-MoT-Infographic 能生成什么? 从海报到学术论文页,都能做对 海报、图表、菜谱、明信片……甚至 arXiv 风格的学术论文页——不只是美观好看,而且字和数据正确率极高。 1. 高密度文字信息渲染 大量高密度、小字号文字的渲染,是信息图生成的一大难点。过去模型在密集文字段落、表格注释、脚注等这类小字场景容易「糊成一团」,列表信息编号也容易有错。SenseNova-U1-8B-MoT-Infographic 信息图增强版增强了对小字号密集文本的支持,通过专项数据训练与文字准确率强化学习(RL),显著提升了小字渲染的清晰度与正确率。 信息图增强版还支持 arXiv 风格的学术论文页面渲染,可轻松实现“单栏标题 + 双栏正文 + 脚注 + 页码 + 侧边 arXiv 水印”效果,密集小字都能保持清晰。 2. 复杂图表生成能力 图表生成是信息图里最容易「翻车」的一类。「画一个柱状图」看似容易,但「画一个柱高、刻度、标签、图例全部对得上数据」非常难,这要求模型真正理解数据语义,而不是单纯模仿图表外观。 因此,复杂图表生成能力,特别是数据的正确性,也是信息图增强版提升的关键。依托SenseNova U1
把信息图做对、做好,SenseNova-U1啃下这块硬骨头

去老虎APP查看更多动态