商汤科技
商汤科技官方号
老虎认证: 商汤科技是一家赋能百业、行业领先的人工智能软件公司
IP属地:北京
0关注
1490粉丝
商汤科技是一家赋能百业、行业领先的人工智能软件公司
avatar商汤科技
09-09 17:31

【技术博客】从更大参数到更深计算:Looped MMDiT 的图像生成 Scaling 探索

最近,围绕 GPT-6 的讨论,让“循环 Transformer”、“循环深度”重新成为一个热门话题。Transformer 一定要靠堆更多参数、更多层来获得更强能力吗? 由于具体架构尚未公开,我们不讨论 GPT-6 本身的实现。但有意思的是,类似的计算思想,我们已经在图像生成模型中进行了独立探索。 今年 4 月前后,我们开始推进 Looped MMDiT。 当时我们关注的并不是 GPT-6,而是文生图模型越来越现实的 Scaling 成本:模型越做越大,存储、显存、训练通信和部署成本也随之增长。相比单纯追求“更大的模型”,Looped MMDiT 更想回答的是另一个问题:模型能不能不只是“做大”,还可以“做深”? 01 从“模型更大”到“模型内部算得更深” 过去几年,Scaling 最直观的路径是增加参数:更大的模型、更宽的隐藏维度(Hidden Dimension)、更多 Transformer layers。但参数规模与计算深度是否一定要绑定?Looped Transformer 给出了另一种可能。 图 1|原始 MMDiT 与 Naive Looped MMDiT:中间 Looped Blocks 共享参数并重复执行。 传统 Transformer 增加深度,通常意味着增加新的参数;Looped Transformer 则复用一组 blocks,通过增加 Loop Depth 让隐状态(Hidden States)经历更多轮计算。 围绕这一思路,我们进一步验证了 Looping 在图像生成中的三种潜力: 一是通过参数复用提升参数效率,在较小参数规模下实现更深的计算,获得媲美大参数模型性能; 二是让隐状态在隐空间中持续迭代,实现不依赖显式 CoT 的内部计算; 三是在相同推理计算预算下,将更多计算投入 Loop Depth,相比增加去噪步数获得更高的性能收益。 02
【技术博客】从更大参数到更深计算:Looped MMDiT 的图像生成 Scaling 探索
avatar商汤科技
09-09 11:14

商汤小浣熊Raccoon Work上线银河麒麟,国产AI办公生态与操作系统生态深度融合

近日,商汤小浣熊Raccoon Work正式完成银河麒麟操作系统适配,并上架麒麟软件商店,同步也支持openKylin 开源操作系统。 用户可在软件商店搜索“商汤小浣熊”,一键下载安装,无需额外配置,在熟悉的国产操作系统环境中获得完整流畅的AI 办公体验。 银河麒麟软件商店 01 共创国产AI办公,商汤小浣熊与银河麒麟三年同行 商汤小浣熊与银河麒麟的渊源,远早于此次上架。 2025年9月,双方即在2025中国操作系统产业大会上联合宣布"办公小浣熊·麒麟桌面版",商汤小浣熊作为"麒心伙伴5.0生态成长计划"成员,完成与银河麒麟操作系统V11的深度适配;2026年8月,商汤小浣熊Linux版首发支持openKylin,openKylin社区明确将openKylin定位为"小浣熊桌面端的首选开源操作系统底座"。 与单纯的"上架应用商店"不同,商汤小浣熊与银河麒麟的协作早已深入信创交付层面。2025年4月,双方联合发布全国产化"办公智能助手一体机解决方案",搭载银河麒麟智算操作系统,为政企客户提供"数据不出内网、AI即开即用"的智能办公能力,在政务、金融等关键领域孵化定制化智能应用。此次银河麒麟软件商店上架的版本,同样继承了对企业数据安全与私有化部署的支持能力。 02 办公交付,让AI在国产系统上真正"搞定工作" 此次适配围绕用户的真实工作链路展开。针对账号登录、文件处理、工具调用、任务执行、成果预览等核心环节,小浣熊团队进行了系统适配与体验打磨,保障关键功能在银河麒麟操作系统上稳定、顺畅运行。 安装后,用户可以使用商汤小浣熊完成软件研发、数据分析、任务规划、文档处理等工作。从理解目标、拆解任务,到调用工具、推进执行并交付成果,小浣熊让AI 不止提供建议,更能真正参与工作、完成任务。 此次上架麒麟软件商店的版本同样接入商汤小浣熊统一的积分体系。用户可正常参与平台
商汤小浣熊Raccoon Work上线银河麒麟,国产AI办公生态与操作系统生态深度融合
avatar商汤科技
09-07 18:50

商汤小浣熊,AI编程市场第三!

IDC最新报告显示:🥉 商汤小浣熊在中国AI编程市场份额占比中位居第三 AI编程正从「代码生成工具」走向「软件生产力平台」 商汤小浣熊,正在把AI真正带进工作流: ✅ 中文描述需求,快速生成代码框架 ✅ 辅助代码补全、修改与重构 ✅ 自动生成单元测试和技术文档 ✅ 支持100+主流编程语言 ✅ 适配VS Code、IntelliJ IDEA等开发环境 ✅ 覆盖需求分析、架构设计、编码开发、测试验证等环节 而AI的生产力,远不止于编程 商汤小浣熊作为能搞定工作的 AI 助手 已拓展更多AI 办公能力 📊 数据分析:复杂数据处理,跨文件&跨系统数据整合分析 📑 内容创作:文档、PPT 等办公内容一站式生成 🔗 办公协同:连接常用工具,打通跨应用工作流 🤖 复杂任务:自主规划、多步执行,直接交付成果 💻 应用开发:轻量级 Vibe Coding、企业项目级开发 商汤小浣熊 Raccoon Work 正在探索AI生产力的新边界 今天的工作先交给商汤小浣熊!Let Raccoon Work!
商汤小浣熊,AI编程市场第三!

商汤科技联合创始人王晓刚出席《开物·时代智造——“为国担当 勇为尖兵”先进事迹报告会》

由中共上海市委宣传部、中共上海市经信工作党委、上海市经济信息化委共同主办的“开物·时代智造——为国担当 勇为尖兵”先进事迹报告会(经信专场)于9月1日在中国航发商发闵行基地举行。上海市委宣传部副部长刘琪,上海市经信工作党委书记张伟,中国工程院院士、中国航发集团首席科学家尹泽勇,中国航发商发党委书记、董事长徐庆泽,中微半导体设备(上海)股份有限公司创始人、董事长兼总经理尹志尧,商汤科技联合创始人兼执行董事、大晓机器人董事长王晓刚出席会议。 商汤科技联合创始人兼执行董事、大晓机器人董事长 王晓刚,以《先看见的人》为题,讲述了让机器看见世界、让世界看见中国AI产业兴起、让AI真正理解真实世界的三次“看见”故事,以公司发展缩影见证中国人工智能技术不断突破、走向世界的奋进历程。 以下为王晓刚在报告会上的分享。 尊敬的各位领导、各位来宾: 大家好!我是商汤科技联合创始人王晓刚。 对于商汤来说,“看见”有着特殊的意义。因为我们的起点,是图像识别,是让机器学会看见世界;我们今天的使命,是让世界看见中国AI产业兴起;而我们未来的愿景,是让人工智能真正理解这个真实世界。这三个“看见”,也是中国人工智能一路走来的缩影。 而这“看见”的背后,我想一定要先提到一个人,我的导师——汤晓鸥教授。 第一次看见:让机器看见世界 2001年,汤晓鸥教授创办香港中文大学多媒体实验室。今天回头看,那是中国人工智能发展史上一个重要的起点。在当时,没有人会想到人工智能像今天这样改变世界。 那时候,中国人工智能几乎是一片荒漠。核心论文、核心人才、核心影响力,大多掌握在国外。 即便困难重重,我们一批心怀梦想的年轻人,开始在未知的领域里摸索前行。汤老师鼓励我们要和全球顶尖团队比拼,他说,论剑就要到华山论剑。在这种精神激励和努力下,港中文多媒体实验室成为亚洲唯一入选“世界十大AI先锋实验室”的团队。 97.53%,这是人类肉
商汤科技联合创始人王晓刚出席《开物·时代智造——“为国担当 勇为尖兵”先进事迹报告会》

智象未来×商汤大装置:国产算力跑通视频生成规模化应用

国产算力走向规模商用,如何跨过从“适配验证”到“真实生产”的关键一步,正成为行业面临的新课题。 近期,商汤大装置与智象未来以视频生成业务为切入,跑通了从国产算力适配到规模应用的完整链路。 对于以图像、视频生成模型为核心的AI企业而言,国产化并非简单地将模型从一种GPU迁移到另一种GPU。尤其是视频生成模型,参数规模大、推理链路长、计算密集度高,从底层算力、推理框架到模型性能、生成效果和工具链,每一个环节都可能成为国产化落地的“卡点”。 作为全球领先的多模态生成式人工智能创新企业,智象未来(HiDream.ai)致力于打造下一代原生全模态世界模型。依托自研HiDream系列大模型,智象未来持续布局商业营销、影视创作、内容创作等场景,目前,其产品已覆盖全球100多个国家和地区,服务超过5000万名专业用户及4万余家企业客户。 作为智象未来重要的AI基础设施合作伙伴,商汤大装置持续通过稳定、高效的AI基础设施,支撑其模型快速研发和迭代。此次,双方进一步将合作延伸至国产算力适配验证。 围绕智象未来重点业务,商汤大装置从底层算力替代出发,深入模型推理、性能优化、生成效果等关键环节,通过全栈技术适配与FDE专家服务,帮助智象未来实现在国产算力环境下的平稳运行,为多模态大模型的国产化部署形成可复用样板。 01 依托LightX2V多卡并行,实现视频生成加速比达93% 对于视觉生成应用而言,性能不足不仅会增加用户使用成本,也会影响产品体验和业务规模化应用。因此,此次合作中,智象未来提出了明确的业务指标:在国产算力环境下,实现高清视频的高效生成,并将端到端生成时长优化至业内领先水平。 基于此具体目标,商汤大装置团队基于LightX2V进行了多卡并行优化,并进一步探索多机多卡场景下的扩展能力。首先从模型的优化入手,基于训练-推理联合优化的思路,通过LightX2V步数蒸馏、CFG蒸馏等训练方案
智象未来×商汤大装置:国产算力跑通视频生成规模化应用

商汤首席科学家林达华:多模态的涌现时刻会在一两年内到来

编者按‌ Coding Agent 跑通商业闭环,让行业看到 AI 创造商业价值的清晰路径;而通往 AGI 的空间,远不止 Coding。在本次专访中,商汤联合创始人、首席科学家 林达华提出判断:未来 1–2 年,多模态将迎来类似 Code Agent 爆发的关键节点,跨过能力涌现的时刻。商汤从计算机视觉起家,持续押注原生多模态与空间智能,U系列、SenseNova 6.8及小浣熊等应用贯穿模型与产品。当视觉、语言、推理与行动真正融合,AI才能走进真实场景。‌ 转载自 36氪,期待共同见证多模态的涌现时刻。‌ 文|李炤锋编辑|张雨忻 “没有电脑的年代,也有爱因斯坦和牛顿。我们不会因为他们不写代码,就认为他们不够聪明。” 近日,商汤联合创始人、首席科学家林达华在36氪的专访中,用这句话描述Coding与智能上限的关系,也解释商汤为什么仍把原生多模态作为长期方向。 眼下,Coding Agent已经较早跑通商业闭环。公开信息显示,截至7月底,Anthropic的年化收入已超过650亿美元,约为2025年底的7倍。多模态何时能拿出同样清晰的能力和商业结果,是这次对话反复触及的问题。但从长期看,林达华认为,“AI和AGI的空间远远不止Coding”。 谈到多模态在追求AGI中的位置,DeepSeek创始人梁文锋曾提到,多模态最终会做,但不把它当作智能本身,而是看作一个“组件”。 几乎在同一时间,英伟达创始人兼首席执行官黄仁勋发布了面向机器人和自动驾驶的世界基础模型Cosmos 3。模型将视觉推理、环境模拟和动作预测放在同一套架构中。黄仁勋说,Cosmos 3“能够理解和推理,能够生成,也能进入模拟闭环,甚至可以直接成为策略本身”。 在林达华看来,这并非谁对谁错。每家公司面对的任务、资源和长期愿景不同,选择自然也不同。 商汤从计算机视觉起家,进入大模型阶段后,又把这套技术积累延伸到原
商汤首席科学家林达华:多模态的涌现时刻会在一两年内到来

商汤2026上半年首次盈利,“一套模型+一座Token工厂+一套智能体管控系统”开创优质商业价值

香港,2026年8月26日—商汤集团股份有限公司(“商汤集团”或“公司”,股份代号:0020.HK)发布2026年上半年业绩。报告期内,集团实现收入人民币29.1亿元,同比增长23.4%;毛利12.1亿元,同比增长32.9%;毛利率为41.4%,同比提升2.9个百分点。集团首次披露经常性收入(Recurring Revenue)11.4亿元,占比39.3%,并首次按国际财务报告准则(IFRS)实现盈利人民币6.2亿元。其中,生成式 AI 收入23.3亿元,占集团收入近80%;海外业务收入同比增长127%,远高于集团整体增速。在收入、毛利健康增长的同时,集团持续提升经营效率,主营业务亏损进一步大幅收窄,按非国际财务报告准则(Non-IFRS)计量的调整后净亏损为3.9亿,同比大幅收窄67.3%。集团持续加速AI能力的规模化商用,并以“一套模型、一座Token(词元)工厂、一套智能体管控系统”(“三个一”体系)为核心,推动AI能力迈向完成端对端任务,转化为规模化商业价值。 商汤董事长兼首席执行官徐立表示:“商汤构建的‘一套模型、一座 Token 工厂、一套智能体管控系统’核心能力体系,用一套模型实现持续提升智能上限的路径;持续用基础设施和优化能力降低Token 成本,提高成本定价能力;以智能体深度融入企业与个人工作流,形成结果交付能力。这套体系赋能商汤超越单纯价格竞争,凭借差异化的技术与服务,开创可持续商业价值,同时扩大用户基础,带动经常性收入增长,为集团业务的高质量发展奠定坚实基础。” 一套模型统一多模态架构,持续提升智能上限 模型展现国际领先水平 2026 年,商汤密集发布多款模型,覆盖原生多模态统一、视觉感知与推理、可控生成、长程智能体、空间智能与物理世界模型等方向,包括 NEO-Unify 架构、SenseNova U1、U1.5、U1.5-Lite、SenseNova
商汤2026上半年首次盈利,“一套模型+一座Token工厂+一套智能体管控系统”开创优质商业价值

免费体验、便捷接入!SenseNova U1.5 Lite 接入Token Plan

得益于广大开发者与用户的信任与支持,商汤日日新SenseNova Token Plan日均 Token 调用量已强劲突破 5,000 亿大关,生态繁荣再创新高度! 为持续回馈全球开发者与用户,新一代图片创作模型 SenseNova U1.5 Lite 已正式接入 SenseNova Token Plan,以更便捷、更高效的方式赋能更多创新场景。 SenseNova U1.5 Lite基于 Neo-unify 统一架构,生成与编辑一体,原生支持超长指令遵循与 4K 高分辨率输出;无论在高质量生图还是复杂图像编辑场景下,均具备媲美主流商业模型的卓越性能。我们还将在公测期间提供免费配额: 立即体验:前往商汤SenseNova官网控制台 https://platform.sensenova.cn 获取 API Key! 免费配额:每 5 小时 1,500 次请求,公测期间完全免费! Model ID:sensenova-u1.5-lite 文档:https://platform.sensenova.cn/docs 核心亮点 生成 + 编辑一体化:单个模型打破“生成”与“编辑”的边界,既能实现精准文生图,又能基于参考图进行像素级微调与修改,一个模型覆盖全流程创作。 精准参考图驱动:编辑接口支持传入参考图,轻松应对图生图、局部重绘、风格迁移、人物保持及元素替换等高阶图像编辑场景。 自动 Prompt 智能优化:内置 prompt_extend 引擎,开启后自动对用户的输入描述进行精炼与扩写,大幅提升图像细节与美学质感。 4K 超高清输出:最高支持 4096×4096 超高清分辨率,覆盖 1:1、16:9、9:16、2:3、3:2 等多种比例。 公测免费无水印:公测期间设置 watermark=false 即可免费生成无水印高清
免费体验、便捷接入!SenseNova U1.5 Lite 接入Token Plan

我是全新的商汤小浣熊,今天的工作先交给我!

最近,很多人发现自己住的小区、上班的写字楼,电梯里多了一只小浣熊。 “商汤小浣熊,能搞定工作的AI助手”。这就是商汤小浣熊想对所有人说的话:我们不挑场景,不挑行业,只要你需要搞定工作,我们就在。 今天,我们也想正式向大家介绍这位老朋友的新面孔—— “小浣熊家族”正式升级为“商汤小浣熊 Raccoon Work”。 从今天起,无论是办公小浣熊还是代码小浣熊,它们有了一个共同的名字:商汤小浣熊。与此同时,我们还将推出面向不同行业的产业级版本:小浣熊·教育版、小浣熊·金融版、小浣熊·政数版,更多细节即将公布。 截至目前,商汤小浣熊累计服务用户已超 2000 万,周活跃用户超 300 万,日活用户近期增长达到 10 倍量级。 小浣熊长大了:从办公桌前,走向千行百业;从一个人的桌面,到一群人的工位。 从一份文档,到搞定一切工作 过去一段时间,很多人认识小浣熊,是从一份文档、一段代码、一次会议纪要、一个办公任务开始的。 今年,AI办公的叙事正在从"对话建议"走向"自主执行、任务交付"。行业里一个明显的趋势是:各个公司的产品都想"住进用户的电脑"——读文件、开浏览器、跑代码、整理表格、做PPT,最好再替你把周报发出去。商汤小浣熊正是这条路上的创新者,并早已在AI办公的领域积累了丰富的经验。 它运行在你的桌面端,是一个真正意义上的桌面智能体—— 它可以直接读取和处理你电脑里的本地文件。Excel、PDF、Word、PPT、图片等20多种格式,无需反复上传下载。你授权一个文件夹,它就能在里面完成文件分析、数据整理、结果生成。 它可以一句话操控浏览器。打开网页、读取页面、抓取内容、整理成表。竞品调研、资料查询、信息比对,这些过去需要半小时的手动操作,现在一句话就完成了。 它拥有一个不断生长的"能力中心"。周报生成器、数据分析总结器、会议纪要整理器……你可以直接用,也可以把自己沉淀的工作方法封装
我是全新的商汤小浣熊,今天的工作先交给我!

SenseNova U1.5 Lite正式版发布!支持超长指令,解锁原生4K真实视觉创作流

今天,我们正式开源轻量级、原生统一多模态大模型 SenseNova U1.5 Lite。 与预览版(U1.5 Lite Preview)呈现的原生统一多模态模型能力相比,正式版更关注的是,这些能力能否更准确、更稳定地进入真实视觉创作流程。模型重点围绕真实视觉任务重新完善训练数据、任务设计与后训练流程,强化视觉质量、复杂指令遵循、文字与布局、原生4K、原生图像编辑和精细视觉控制等,提供更高可控性、更高清、更高性价比的能力工具,推动 AI 视觉生成真正跨越到“稳定完成真实视觉交付”的新阶段。 目前模型已面向全球开源,开发者与创作者可直接部署体验。 GitHub:https://github.com/OpenSenseNova/SenseNova-U1 Hugging Face:https://huggingface.co/collections/sensenova/sensenova-u15 魔搭社区:https://modelscope.cn/models/SenseNova/SenseNova-U1.5-8B-MoT SenseNova Studio在线体验:https://unify.light-ai.top/ 更完整的视觉创作能力,告别AI创作瓶颈 “精心写了 25 分钟的详细 Prompt,模型却只能解析 1k 字符,不得不花半小时删减细节”;“只想改掉图里的一只杯子,AI 却把背景和主角的脸一起换了”。 这些几乎是每个创作者都遇到过的“崩溃瞬间”。过往几年,行业往往把重点放在卷“画面美感”和“写实感”上;但在实际生产流程中,真正的核心问题是:模型能否精准执行你的完整意图? SenseNova U1.5 Lite 解决了这一难题: • 3-4k 字符超长复杂指令遵循:打破大多数开源模型在指令超过 1k 字符时易崩溃、遗漏细节的瓶颈。SenseNova U1
SenseNova U1.5 Lite正式版发布!支持超长指令,解锁原生4K真实视觉创作流

大晓首秀世界机器人大会!从世界模型到商业落地,展现具身智能全栈实力

8月19日,大晓机器人重磅亮相2026世界机器人大会,集中展示开悟世界模型(Kairos)3.1、环境式数据采集方案2.0,以及面向即时零售、酒店服务和开放场景的“晓满”、“晓新”、“晓途”三大行业解决方案。 展会期间,大晓机器人展台人山人海,成为最值得打卡的展台之一。开悟世界模型3.1吸引专业参展者、投资人及机器人从业者持续关注,环境式数采方案受到具身智能企业集中咨询,尤其是面向即时零售的“晓满”方案前人潮不断,客户和参观者络绎不绝,现场交流热度持续攀升。 大晓机器人提出的“以人为中心”数据范式引发热议。数据不再只是图像、文本等信息的简单堆叠,而是进一步纳入“以人为中心”的真实动作、环境状态、物理规律及因果关系,构建了开放世界视频—人类交互数据—真机数据的三层“数据金字塔”,帮助模型从“描述世界”走向“理解世界、推演世界”。这意味着,世界模型的能力提升不再依赖真机数据,通过高密度人类数据的输入带来了新的智能涌现。 从开悟世界模型、环境式数采方案到三大行业解决方案,大晓机器人正在构建一条“真实场景落地—高质量数据回流—世界模型能力进化—应用规模复制”的产业飞轮。以真实商业场景检验机器人能力,以高质量具身数据反哺模型进化,再将持续升级的“最强大脑”复制到更多应用环境,推动机器人加速走进零售、酒店、城市治理等真实商业场景。 开悟世界模型3.1亮相,专业观众与投资人持续关注 作为大晓机器人WRC首秀的核心展项,开悟世界模型3.1成为展台现场的重要关注焦点。 该模型融合生成智能、物理智能与认知智能,依托原生统一架构打通理解、生成与预测能力,将视觉观测、语言指令、力触状态、策略轨迹等多源具身数据压缩进统一隐空间,从底层实现世界理解、物理生成、动作预测三大能力的深度融合。同时Kairos 3.1 构建了“理解—推演—执行—反思”全链路自进化闭环,可在执行失败时自主定位问题、迭代优化动
大晓首秀世界机器人大会!从世界模型到商业落地,展现具身智能全栈实力

SenseNova 6.8 Flash Lite Preview开放体验:迈向“委派智能”第一步

今天,商汤日日新全新多模态智能体模型SenseNova 6.8 Flash Lite Preview预览版正式上线SenseNova Token Plan。 这款主打轻量敏捷的模型,具备自主规划、持续执行、多Agent协作、动态纠偏能力,可实现完整端到端结果交付,向着委派智能(Delegated Intelligence)方向演进:用户只需给出目标,AI自主走完全流程,人专注结果验收。正式版6.8 Flash Lite模型以及性能进一步提升的6.8 Flash模型,也将于近期发布。 目前可通过SenseNova Token Plan抢先体验,更有限时免费优惠。 体验平台地址:点击阅读原文即可跳转 https://www.sensenova.cn/token-plan 图片 三大基石构建“委派智能” 围绕长程复杂任务的交付要求,SenseNova 6.8 Flash Lite Preview 在三大关键能力上实现了突破性增强:   长文与长程稳定:支持在数百步、跨阶段、持续数小时的长程任务中保持目标、约束与关键事实,并具备失败时的自主回退与重新规划能力。   Sub-agent 动态协作:主Agent 可动态调度并组织十余个专业Agent,并行完成信息检索、数据分析、数学计算、视觉理解与事实核验。   原生多模态融合:实现文字、图片、图表、文档、视频及应用界面在同一条任务轨迹下的融合规划、推理、工具调用与结果验证。   一个演示:自主操作 & 完成交付 在这个演示中,模型突破了传统“信息获取”的方式,能够自主查阅分析新闻、政策、市场数据及各类多模态信号,识别关键变量,进行深度理解和推理,针对诸如市场动态、体育赛事与事件演化等构建面向未来情景,输出深度分析和预测报告。 此外,新模型还有更多功能、用法等你来体验和解锁。它能帮你轻松制
SenseNova 6.8 Flash Lite Preview开放体验:迈向“委派智能”第一步

商汤斩获沙特千万级教育订单,打造国家级智慧校车运营管理平台

近日,商汤科技联合沙特国家校车运营管理机构达成合作,打造以人工智能为核心的全国智慧校车一体化数字管理平台。 作为覆盖沙特全国的国家级学生出行数字基础设施,该平台将面向全国超过120万名学生,构建贯穿上下学全流程的端到端数字化管理体系,实现校车运营、安全监管、服务协同和数据治理的一体化升级,为沙特教育数字化和公共服务现代化建设提供重要支撑。 此次双方合作,商汤创新研发面向全国学生交通场景的统一数字基础设施,项目依托商汤多模态大模型、大数据及各类应用级AI agent技术能力,打通学生、车辆、司机、线路及运营管理等全生命周期数据,打造集智能运营调度、安全监控预警、多方协同服务、国家级平台支撑及数据驱动决策于一体的教育交通数字平台,推动沙特学生交通服务从传统运营模式向智能化、平台化、数据化转型。 平台以人工智能能力为核心,围绕学生出行全链路构建五大核心能力: 智能运营能力:平台依托人工智能、自动化技术与实时调度统筹能力,实现高效运营。 安全保障能力:平台融合AI视频分析及其他技术机制,实现学生出行全过程可视、可管、可追溯,进一步提升学生交通安全保障能力。 协同服务能力:平台面向教育主管部门、学校、运营企业、家长、司机及监管机构等不同角色,提供一体化服务体验,实现跨部门业务协同和信息互联互通。 平台底座能力:作为国家级数字基础设施,平台采用高可用、可扩展、安全可靠的架构设计,满足国家级业务规模及监管要求,为未来项目持续拓展和创新应用提供坚实基础。 与此同时,在智能决策能力方面,通过高级数据分析、可视化运营驾驶舱及AI智能分析能力,实现教育交通运行态势实时感知、运营效率持续优化及科学决策支持,推动教育交通治理由经验驱动向数据驱动转型,进一步提升公共教育交通服务质量和运营效率。 值得关注的是,该项目不仅服务于全国小学到高中端的120余万名学生,更着眼于构建覆盖全国教育交通体系
商汤斩获沙特千万级教育订单,打造国家级智慧校车运营管理平台

上海市徐汇区委书记曹立强莅临商汤Seko产业基地调研指导

近日,上海市徐汇区委书记曹立强莅临商汤 Seko 产业基地开展实地调研。 商汤科技董事长兼首席执行官徐立、商汤科技上海公司总经理王婷婷全程接待,向到访领导系统介绍玄鸟生态社区建设规划与 Seko 产业基地运营发展情况,并实地参观基地物理空间,察看入驻创业团队的产业孵化场景。 图片 调研中,徐立重点介绍了商汤 “国产化为芯、AI+为翼、西岸为巢” 的核心发展理念,系统解读玄鸟生态社区 “一核三翼” 战略架构与 “1+X” 产业落地逻辑。 依托商汤国产化AI技术底座核心优势,生态布局X生态产业翼、引凤筑巢孵化翼、城市开放协同翼三大支撑体系,通过产业链梯度空间布局,打通算力支撑、智能创作、产业应用、人才培育全链条,构建闭环式AI文创产业发展体系。 Seko 产业基地作为玄鸟生态社区的重要实体载体,是商汤 AI 创编一体化能力落地产业、服务创作者、赋能创新创业的核心阵地。依托商汤 2025 年重磅发布的 Seko AI 视频原生 Agent 技术能力,平台实现从创意灵感到剧本、分镜、美术、配音、成片输出的全流程智能化创作,凭借领先的自然语言交互与角色一致性控制能力,大幅降低 AI 视频创作门槛,已积累百万级注册用户、万级优质创作者社群及千余家企业服务经验,具备成熟的技术底座与创作者生态基础。 围绕AI微短剧产业发展痛点,基地率先搭建沪产芯片 - 国产算力 - 自研 Seko 模型 - 国产云平台 - AI 短剧应用全栈国产化五环闭环体系,针对性解决中小创作团队算力成本高、工具零散、渠道缺失、信息不对称、变现路径弱等核心难题。 同时,基地构建完整创业服务体系,实现国产化算力赋能、全平台发行渠道、资本专项扶持、高校产教融合、零门槛孵化入驻五大服务闭环,叠加徐汇区专项产业政策,为入驻团队提供免租扶持、项目资助、人才配套等全方位红利,打造“创业、协同、安居”一体化的西岸AI文创创业生态。
上海市徐汇区委书记曹立强莅临商汤Seko产业基地调研指导

牵手国家队!商汤科技与教育部教育技术与资源发展中心达成战略合作

近日,商汤科技与教育部教育技术与资源发展中心(中央电化教育馆)正式签署战略合作框架协议。 双方发挥各自优势,计划在推动技术在教育公共服务领域应用、促进教育技术与教育教学资源深度融合、赋能国家级教育服务平台智能化建设等领域开展合作。  签约现场。前排:左为教育部教育技术与资源发展中心(中央电化教育馆)课后服务与活动处处长 刘学,右为商汤科技大模型产品副总裁 贾安亚。后排为见证嘉宾:教育部原副部长刘利民(后排中位)、中国教育部教育技术与资源发展中心(中央电化教育馆)党委书记、主任李萍(后排左二)、联合国教科文组织教育信息技术研究所原所长展涛(后排左一)、深圳点猫科技有限公司创始人兼 CEO 李天驰(后排右一)、上海商汤智能科技有限公司联合创始人马堃先生(后排右二) 教育部教育技术与资源发展中心(中央电化教育馆,以下简称“教育部资源中心”)为教育部直属事业单位,致力于"推动技术在教育公共服务领域的应用,促进教育技术与教育教学资源建设深度融合,搭建国家级教育技术与资源发展统一平台,服务素质教育实施与高质量教育体系建设",并牵头承担国家智慧教育公共服务平台、国家中小学智慧教育平台等重要教育数字化平台的建设任务。 教育数字化正是教育部资源中心近年来持续发力的方向,也是商汤科技多年在教育侧持续深耕与布局的领域。 过去两年,商汤日日新SenseNova 大模型体系与商汤大装置SenseCore算力基础设施持续演进,为大规模教育场景落地提供了成熟的底层支撑。作为日日新体系面向开发者的标准化服务交付形态,SenseNova Token Plan 自2026年5月上线后企业级 Token 单月使用量增长7倍,教育正是其高频调用场景之一。  今年7月,商汤发布日日新SenseNova U1 Pro——面向长程任务的交付级原生多模态智能体基座,其强大的视觉创作能力和交付
牵手国家队!商汤科技与教育部教育技术与资源发展中心达成战略合作

原生统一多模态进阶!SenseNova U1.5-Lite-Preview开源,生成编辑能力再进化

今年4月,商汤科技发布了SenseNova U1,首次完整展示了基于NEO-Unify架构的原生统一多模态路线:在单一模型中联合建模语言、视觉语义与像素生成,让模型能够原生完成视觉理解、推理和生成。 过去几个月中,我们持续强化模型的图像生成与编辑能力,现面向社区开源轻量级统一多模态模型的预览版本SenseNova U1.5-Lite-Preview。SenseNova U1.5-Lite-Preview并非简单的模型规模升级,而是基于U1的一次系统性迭代,不仅在同一架构中贯通视觉理解、推理、生成与编辑,还仅以 8B-MoT 的轻量大小,将能力推进到4K、更精细的真实质感、更复杂的视觉控制和可持续迭代编辑。 相比U1,U1.5-Lite-Preview在以下方向上带来了显著提升: 原生支持4K图像生成; 更精细的局部纹理、细节与真实世界质感; 更准确的中英文文字生成与复杂版式组织; 更稳定的图像编辑和视觉指令遵循; 如果说U1成功验证了“统一架构是否可行”,证明了从像素和语言出发、端到端构建原生统一多模态模型是一条可行的路线,那么U1.5将进一步验证“能力能否持续扩展”,证明统一架构不仅能够同时承载理解和生成,也能够继续扩展到更高分辨率、更复杂的信息表达和更真实的视觉世界。 我们相信,未来的多模态模型不应只是连接不同模态的系统,而应该是一个从一开始就能够跨越语言、视觉与行动进行学习、思考和创造的统一智能体。 长上下文视觉控制:模型能力与创作辅助的协同 U1.5-Lite-Preview在生成能力上做了系统性打磨,我们追求的不仅仅只是4K高像素,更关注的是:模型能否理解超长的自然语言和结构化视觉指令,从而实现精准的视觉控制;超大画幅下细节是否经得起放大、并保持足够的真实世界质感;信息密集的内容里文字和版式是否足够稳定。 更高的视觉控制上限:写得越细,出图越准 在海报、信息图、品
原生统一多模态进阶!SenseNova U1.5-Lite-Preview开源,生成编辑能力再进化

创作者用户突破百万!Seko3.0首创“AI视频梦工厂”

上线一年,用户规模突破100万,用户量增长26倍;服务企业客户1500家,单月营收增长89倍;付费用户日均创作时长超1小时。这是Seko上线一周年,交出的成长答卷。 从1.0行业首发短片创作智能体,到2.0实现百集连续内容稳定生产,Seko用一年时间完成了技术和产品能力的积累。 今日全新升级的Seko 3.0版本,正式从创作工具进化为创作者成长平台,打造行业首个“AI视频梦工厂”。 该平台以商汤自研模型和算力为底座,以Agent、无限画布和Skill生态建立影视级生产能力,并通过OPC线下产业基地及全球市场发行生态,全面打通从内容创意到产业落地的完整路径。 Seko 3.0:定义“视频创作的Codex时刻” 好的创作工具,应当让创作者专注于创意本身,而非繁琐的生产环节。如果说Seko的创作Agent解决了“生产自动化”,画布沉淀了“资产体系”,那么Seko3.0的关键一跃,在于将二者彻底打通——以Agent为智能工作流主轴,向下调用画布沉淀的角色、场景与上下文,向上集成Skill生态封装的专业创作经验,实现从“单点能用”到“体系化创作”的质变。 在Seko 3.0中,画布不再只是静态的素材仓库。创作Agent在生成续集时,会自动读取画布中沉淀的前序剧本、角色设定、场景资产与视觉风格,让后续创作天然承接已有的世界观和人物关系,从根源上杜绝“人设漂移”和重复抽卡。每一次创作都不再是从零开始,画布让角色、场景与上下文永久沉淀,系列内容由此获得真正的叙事连续性。 与此同时,Seko 3.0将“跟着高手学”变成了一种系统能力。Seko联合头部创作者与成熟工作室,将题材判断、叙事节奏、角色设计与分镜经验封装为可直接调用的Skill,这意味着用户使用Seko创作时,Agent能力可根据创作意图自动匹配并调用相应Skill,既可以调用“第一视角催泪短片Skill”获得真实临场感,也可以调用
创作者用户突破百万!Seko3.0首创“AI视频梦工厂”

商汤视觉AI荣膺全球三料第一,海外业务成增长引擎

近日,全球权威科技研究机构Omdia发表《Video Analytics Market Share》报告,商汤科技凭借视觉AI领域11年的深厚积累和扎实技术优势,在蝉联中国市场第一的同时,首次登顶亚太区及全球市场份额冠军,成为这一领域全球首个同时登顶三大市场冠军的企业。 图片 此前,IDC报告已指出商汤在中国视觉AI市场“十连冠”;而Gartner在其2026年最新报告中亦将商汤列为“大模型时代视觉AI全球前沿技术创新者”。 几乎同时获全球三大权威机构的多重认可,反映商汤正在从“技术领先”向“市场领先”跃升。 深耕亚太布局全球 以本地化生态巩固市场优势 首次赢得亚太市场份额冠军,既反映商汤“科学无国界”的战略布局,和不断提升的海外服务能力,亦反映当今世界对“中国式创新”(Chinovation)的认可。 商汤自成立以来便积极布局海外市场,已经在亚太和中东地区12个市场设有办事处,将中国创新和中国应用,通过各个市场的生态体系,引入到海外市场,形成了一套具备规模推广潜力的应用范式。 近年来,商汤更致力于向亚太市场推广“AI共创”战略,透过当地学术机构及龙头企业联手,共同构建AI产业生态,培养AI人才,提供AI升级服务。目前,公司亚太区客户累计超过400家,实现技术输出与生态建设的双赢局面。海外客户对中国技术的兴趣度与日俱增。2025年,到商汤上海总部来访洽谈的海外客户数量比2024年增长了十倍。 技术升级,拥抱大模型 三项市场排名第一的背后,彰显商汤在视觉AI领域长期投入的技术积累,以及商汤大模型与视觉 AI 的融合方案初获市场认可。 在商汤“1+X”战略下,所有视觉AI产品都已经整合在商汤方舟(SenseFoundry)视觉AI产品平台中,并结合商汤日日新(SenseNova)多模态大模型能力,提出“通用+专用”融合架构,实现轻量化、行业化、场景化突破,同
商汤视觉AI荣膺全球三料第一,海外业务成增长引擎

商汤文旅联合南京云锦博物馆将推出AI+VR 《红楼梦》幻境展

近日,商汤科技与南京云锦博物馆、商合一科技正式签署战略合作协议,将围绕经典IP《红楼梦》共同打造VR大空间沉浸展。 南京云锦博物馆是中国唯一的云锦专业博物馆,主要展示以南京云锦为代表的中国民族织锦艺术,南京云锦博物馆承载着千年织造文明的辉煌。 此次合作,旨在借助商汤行业前沿的AI+XR技术,打破静态展陈边界,让云锦文化结合红楼梦,在虚拟空间中“重获新生”,助力中华优秀传统文化在数字时代的焕新表达。 观众只需佩戴上VR头显,便能穿越进“大观园”中,身临其境体验“黛玉葬花”、“宝钗扑蝶”等情节在AI+XR演绎下的全新视觉奇观。 不仅如此,本次项目除了运用 AIGC 与 XR 技术制作内容外,同时还将首次利用 AI 视效与视频技术融入 XR 内容表达,构筑视觉恢弘、审美细腻、趣味交互的红楼虚拟世界,让读者走出书卷文字,亲身步入红楼盛景。 虚拟世界将不再是静态的既定场景,而是随观众行走实时“生长”出来的东方幻境——观众每向前一步,AI便在大观园的画卷上落下一笔,让《红楼梦》中的亭台楼阁、水榭回廊在眼前徐徐展开。 与此同时,商场科技还联合南京云锦博物馆合作推出自助租赁的AI游学机,该设备仅手掌大小,就像给每位观众都配备了一位私人讲解员。 AI游学机对于亲子家庭尤其友好。当孩子手持这款游学机,可以随心所欲漫游在云锦文化的浩瀚图景中。无需导游与家长讲解,也不用逐字阅读展签,该设备具备专家级讲解及AI互动功能:一路拍,一路学,不懂问AI。整场观览结束后,家长还可以收到一份专属长报告,让孩子的每一次文化游学都“有迹可循”。 目前南京云锦博物馆与商场科技的合作项目正在稳步开发中,AI游学机将于2026年10月正式亮相,AI+VR LBE《红楼梦》项目将于2026年年底正式落成。 此次合作不仅是商汤AI技术在文旅场景
商汤文旅联合南京云锦博物馆将推出AI+VR 《红楼梦》幻境展

让机器人从会干活走向会经营,商汤善惠以 SenseMart OS 定义零售物理操作系统

连接异构本体、零售大脑、真实场景数据与门店运营,打通具身智能商业化的最后一公里—— 2026世界人工智能大会(WAIC)期间,在商汤集团“模力共进 向新同行”的整体主题下,商汤善惠集中展示 SenseMart OS 零售物理操作系统。 它连接异构本体、零售大脑、真实场景数据与门店运营,让模型与机器人能力进入真实零售空间。商汤善惠由此明确自身角色:位于上游本体能力与下游零售经营之间,基于不同本体已有的机械结构、运动控制与末端执行能力,叠加零售智能、任务协同、交易履约和运营体系,为运营商、加盟商、品牌商、场地方及零售设施升级企业提供可部署、可经营、可复制的具身零售解决方案。 一套 OS,接管机器人开店所需的零售能力 机器人在实验室完成抓取,只解决了零售任务中的一个动作。进入门店后,它还要认商品、懂顾客、查库存、做推荐、调设备、接支付、完成履约,并应对缺货、客诉和设备异常。SenseMart OS 把这些零售能力接入同一套系统,成为机器人在门店工作的业务底座。本体公司可以继续发挥机械结构、运动控制与末端执行等优势;善惠则在本体能力之上,叠加零售场景感知、多模态交互、任务规划、异构协同、交易履约、经营分析与数据闭环学习,把单点动作能力组织为可以持续履约、经营和进化的系统能力。 作为 SenseMart OS 的重要组成部分,“零售大脑”由四类能力协同工作:感知负责看见商品、环境与顾客需求;执行负责抓取、制作、递送和补货;交互负责多语种沟通、推荐与服务;分析负责选品、库存、异常和经营策略。四类能力围绕同一笔订单运行,现场动作与后台经营由此连成一条链。SenseMart OS 也因此获得清晰的品类占位——它是一套连接零售物理世界的操作系统。 异构本体协同,让不同机器人共享一套零售任务系统 不同机器人擅长的动作并不相同。Sens
让机器人从会干活走向会经营,商汤善惠以 SenseMart OS 定义零售物理操作系统

去老虎APP查看更多动态