本报讯(记者 郜阳)昨天,两款“沪牌”多模态模型官宣开源,大幅降低了高质量视觉创作的技术门槛与算力成本。
昨天,MiniMax H3开源。华为昇腾、摩尔线程、沐曦、海光信息、昆仑芯、天数智芯、壁仞科技、AMD、Intel等国内外芯片厂商,以及Hugging Face、魔搭ModelScope等开发社区和云推理平台均在H3开源同日完成了相关适配支持。
据了解,MiniMax H3是一个通用型全模态生成系统,在Artificial Analysis榜单中视频编辑能力排名全球第一。它能够统一理解由文本、图像、视频和音频构成的多模态上下文,并可生成最高2K分辨率、最长15秒、带有原生立体声音频的视频。
同日,商汤科技社区开源轻量级统一多模态模型的预览版本SenseNova U1.5-Lite-Preview。记者获悉,其并非简单的模型规模升级,而是基于U1的一次系统性迭代。相比U1,U1.5-Lite-Preview带来了显著提升:原生支持4K图像生成,更精细的局部纹理、细节与真实世界质感,更准确的中英文文字生成与复杂版式组织,更稳定的图像编辑和视觉指令遵循。