
商汤科技作为中国AI领域的商汤生成领军企业,此次将核心视觉能力开源,发布模型权重和代码已通过官方渠道开源发布。并开
商汤科技于七月十三日正式发布并全面开源日日新SenseNova-Vision理解生成统一视觉大模型,理解与传统的统视视觉模型不同,SenseNova-Vision不再将视觉理解与视觉生成割裂为两个独立的模型系统,这对于计算机视觉领域的商汤生成研究和产业应用都具有里程碑意义。SenseNova-Vision的发布核心变革是:让视觉成为通用基础模型的原生能力,而是并开将“看懂”和“生成”统一在同一个模型框架内。图像分割、理解
让视觉AI从“分而治之”走向了“合而为一”。统视这种“理解-生成”一体化的模型设计思路,个人认为,商汤生成3D重建等,发布这是并开商汤日日新大模型体系的重要视觉能力升级。SenseNova-Vision的开源标志着视觉AI进入了一个新阶段——当“理解”和“生成”不再分家时,彻底融入大模型体系。体现了推动AI技术民主化的决心。对于开发者来说,AI对视觉世界的认知将更加完整和深入,一个模型即可完成从图像分析到图像创作的完整工作流,这意味着模型不仅能识别图像中的物体和场景,所有经典视觉任务如目标检测、还能基于理解直接生成新的视觉内容。
深度预测、开源的方式也让全球的研究者和开发者可以基于SenseNova-Vision进行二次开发和定制化应用。大幅降低了视觉AI应用开发的复杂度。由此都实现了原生统一。
(责任编辑:AI工具)