跳到正文
北京时间
原文
SenseTime· @SenseTime_AI · X·· 2026-05-13精选AI 评分72
AI 导读

SenseNova-U1 技术报告详尽披露了构建前沿原生多模态模型的方法,核心包括原生多模态统一建模、无损视觉接口、联合自回归与像素空间流匹配训练、以及原生混合专家骨干网络。报告提供了六阶段训练方案、强化学习后训练与蒸馏的完整实践指南。其开源版本 SenseNova-U1-A3B-MoT 基于混合专家架构,仅激活30亿参数,实现了高效快速的性能。相关资源已全面开放,涵盖技术报告、模型权重、代码和演示平台。

推荐理由

商汤把原生多模态模型的训练细节全公开了,无视觉编码器、原生MoE架构,还开源了38B-A3B权重,做多模态模型的可以直接照着技术报告复现。

正文 · 原文

🔥 New week, New 𝗦𝗲𝗻𝘀𝗲𝗡𝗼𝘃𝗮-𝗨𝟭 Drop — and this one goes Deep!🔥

📄 𝗧𝗵𝗲 𝗳𝘂𝗹𝗹 𝗧𝗲𝗰𝗵𝗻𝗶𝗰𝗮𝗹 𝗥𝗲𝗽𝗼𝗿𝘁 𝗶𝘀 𝗢𝗨𝗧 — the most detailed disclosure yet of how to build a frontier Native Multimodal Model.

Inside:
✨ Near-lossless visual interface (no VEs, no VAEs)
✨ Native Multimodal Unified Modeling
✨ Joint AR + pixel-space flow matching training
✨ Native Mixture-of-Transformers backbone
✨ 6-stage training recipe + RL post-training + distillation

If you work on NMM, this is the playbook.

🤗 One more thing: 𝗦𝗲𝗻𝘀𝗲𝗡𝗼𝘃𝗮-𝗨𝟭-𝗔𝟯𝗕-𝗠𝗼𝗧 (𝟯𝟴𝗕-𝗔𝟯𝗕 𝗠𝗼𝗘) 𝘄𝗲𝗶𝗴𝗵𝘁𝘀 𝗮𝗿𝗲 𝗻𝗼𝘄 𝗼𝗽𝗲𝗻-𝘀𝗼𝘂𝗿𝗰𝗲𝗱 — a RARE native unified model on an MoE backbone (Only 3B active! Lightning Fast⚡)

📄 Tech Report: https://arxiv.org/abs/2605.12500
🤗 Daily Papers (Vote & Discuss): https://huggingface.co/papers/2605.12500
🤗 Models: https://huggingface.co/collections/sensenova/sensenova-u1
💻 Code: https://github.com/OpenSenseNova/SenseNova-U1
🎮 Demo: https://unify.light-ai.top
👾 Discord: https://discord.com/invite/BuTXPHmQub

来源:SenseTime · x.com