SenseNova U1.5 Lite有哪些核心亮点?
支持3-4k字符超长指令遵循、更高质量的视觉生成、可靠的原生图像编辑、更好的文字与复杂布局、精细的视觉控制以及原生4K高分辨率输出。
SenseNova U1.5 Lite
商汤科技正式开源8B参数生图模型SenseNova U1.5 Lite,距预览版发布仅三周。该模型支持3-4k字符长指令遵循、原生4K输出和精准的图像编辑,在复杂排版与编辑场景下比肩闭源GPT-Image-2。训练上采用先拆分专项Expert再通过MOPD蒸馏融合的策略,保持统一轻量架构,强调理解与生成双向反哺。
支持3-4k字符超长指令遵循、更高质量的视觉生成、可靠的原生图像编辑、更好的文字与复杂布局、精细的视觉控制以及原生4K高分辨率输出。
先对文字渲染、美学表达、图像编辑等目标分别训练专项Expert,再通过多教师在线策略蒸馏技术MOPD将能力融合回同一个8B模型中,无额外路由。
在复杂排版与精准编辑等核心场景上,SenseNova U1.5 Lite可以比肩闭源的GPT-Image-2,且模型仅有8B参数并保持开源。
物理 AI 的大结果何时到来?
王强宇履新百望:从发票SaaS工具,到财税垂直大模型,再到企业的Palantir
字节跳动CEO梁汝波:豆包、飞书与火山引擎整合后 将加大企业市场投入
上市前交易市场:永续合约化的Pre-IPO资产
我和我的 AI 手机吃了 3 顿饭企业案例分享:坤煜量子|36氪2026产业未来大会清华稳准智能联合发布LimiX-2,结构化数据基础模型登顶国际评测榜单芯视界创始人、董事长兼首席科学家鲍捷:十年产业实践,量子感知芯片为物理AI打开物质世界 "感知入口" | 2026年36氪产业未来大会
飞书与豆包工作合体后首亮相:Agent 能进群,还能帮你写周报、做PPT
阶跃发布 StepAudio 3 ,多款语音模型登顶 Artificial Analysis 全球榜单
金色Web3.0日报 | 黄仁勋批驳「AI末日论」
自主团队被捧过头了?Simon Rohrer 直言:你们交付的根本不是产品
一边喊停一边敲钟:硅谷AI巨头到底在怕什么
Robinhood的财富效应
“阿宝”交新朋友:携手比亚迪“迪迪虾”,实现车机端一句话办事
黄仁勋正演讲遇特朗普突然来电:通话全程直播
DeepSeek-V4.1-Flash 的最佳 Harness 搭档,我觉得可能是 Claude Code
当AI能解千禧难题,再次证明答案不再是门槛
具透 | Liquid Glass 设计改进、性能提升……iPadOS 27 中值得一瞥的新特性高通技术公司携手中兴努比亚和豆包手机助手,共同推动智能手机迈入个人AI新时代
产品定义意义上的一级场景:四维模型
129亿美元卖身英伟达之后,是时候重新理解Hugging Face了
清华稳准智能联合发布LimiX-2,结构化数据基础模型登顶国际评测榜单
缓存不该困在一台服务器里7名博士生仅用3个月从零训练7B大模型:代码+数据+训练日志全公开
Anew Labs已完成 2.9 亿美元融资,红杉中国、高瓴、IDG、五源、高榕等参与
CLARITY闯关失败 加密市场闻声而动 政策空白谁填补
豆包工作还想反超WorkBuddy?
GPT-6 Sol要来了?OpenAI本周或迎“发布狂潮”