首页 > 车圈原创 > 车圈原创 > 行业首个!商汤正式开源原生多模态架构NEO,训练仅需1/10数据量

行业首个!商汤正式开源原生多模态架构NEO,训练仅需1/10数据量

发布时间:2025-12-03 10:41:40来源: 13041198719

12月2日消息,昨天,商汤科技正式发布并开源了全新多模态模型架构NEO,该架构由商汤科技和新加坡南洋理工大学AI技术实验室S-Lab合作研发,是行业首个可用的、实现深层次融合的原生多模态架构,基于NEO架构的NEO模型仅用3.9亿训练数据,就达到了模块化架构下顶级VLM(视觉-语言模型)模型的性能,数据量仅需其他同等性能模型的1/10。

从基准测试来看,NEO模型在多模态能力综合评估、跨学科和复杂推理等多项指标中碾压上海AI Lab推出的Mono-InternVL-1.5、清华大学、上海AI Lab联合商汤推出的HoVLE等原生VLM模型,还在多项视觉理解任务中追平通义千问的视觉语言模型Qwen2-VL、上海AI Lab联合商汤推出的InternVL3等基于模块化架构的顶级VLM模型。

当前,业内主流的多模态模型大多遵循“视觉编码器+投影器+语言模型”的模块化范式,本质上仍以语言为中心,图像与语言的融合仅停留在数据层面,视觉编码和语言解码分离,模型学习效率低下,在复杂多模态场景下处理任务受限。

为此,商汤科技抛弃了传统的模块化结构,推出从零设计的NEO原生架构。NEO架构在注意力机制、位置编码和语义映射进行了底层创新,构建一个统一的原生基元,让模型具备统一处理视觉与语言的能力。

NEO架构相关论文已发布在arXiv上,题为《从像素到文字——迈向大规模的原生视觉语言原始基元(From Pixels to Words — Towards Native Vision-Language Primitives at Scale)》,商汤科技联合创始人、执行董事及AI基础设施和大模型首席科学家林达华博士,南洋理工大学S-Lab负责人、副教授刘子纬等均在该论文的作者行列。

车圈原创更多>>

新款理想L6完成工信部申报!全能家用增程SUV值得入手吗? 雅马哈劲战125特别版引入赛道元素强化热血感 奥迪Q9内饰发布:比Q7更大 这台“9系旗舰”到底值不值得等? 全新沃尔沃XC60谍照曝光,将于2027年正式亮相 五菱星光L实车正式曝光!中大型家用SUV登场,大六座来了吗? 国轩高科7款新品:固态、钠电、储能齐发 预售39.98万元,浅析小鹏GX定价合不合理 昊铂S600预售20.99万起,4.3秒破百,双腔空悬+四驱 余承东官宣:200万级尊界S800 Grand Design典藏大观,定档6月 曝某传统合资头部豪华汽车品牌开始裁员 占比约8% 路特斯Emira将弃用现有梅赛德斯-AMG与丰田V6引擎! 4月香港MPV市场:中国品牌霸榜,埃尔法跌出前五,释放了什么信号 ­­智界V9上市发布,售价38.98万-51.98万元,重塑MPV高端市场格局 又一国产猎装车来袭,方程豹方程S GT路透图曝光,或第三季度上市! 星途ET5 EXEED OS 3.7.0 OTA重磅推送,全维安全进阶 变大的Smart:精致小车扛不住中国市场的铁拳 智界V9上市发布,售价38.98万-51.98万元,重塑MPV高端市场格局 从DTM经典到“夜光”艺术车,HWA Evo.R成为纽博格林24小时焦点 “锁电”辟谣之外:新能源车最该补的是信任课 大型SUV市场“神仙打架”4月销量榜 1款销量过万 极氪9X第二 绿紫新色炸场!一汽悦意08以轿跑之姿乱入,可谓颜值天花板 2026款海鸥正式上市 比亚迪把激光雷达下放到A00级 「 爱车空间 」大众品牌全球首款支持城市NOA的轿车来了! 1.5T+双电机 凯迪拉克XT5插混版申报图曝光 对标奔驰EQS 雷克萨斯TZ正式发布 破局存量竞争 比亚迪4月销量背后的技术加速度 2026款海鸥6.99万起!比亚迪把激光雷达塞进A00级小车 奥迪 E7X 开启预售 28.98 万起,德系豪华纯电添新将 传统与新贵的分水岭之间,奥迪E7X为豪华纯电定了新基调? 德系底子+城市NOA,上汽大众ID. ERA 5S工信部信息公布