LAMAE 与常见多模态模型的做法有何不同?
常见医学基础模型多为单一模态,仅在微调或后训练阶段组合模态;LAMAE 在自监督预训练阶段就通过共享潜在注意力模块在潜在空间直接交换信息。
(翻译)阅读完整心脏:用于多模态心脏表示学习的潜在注意力掩码自编码器
Abstract page for arXiv paper 2609.12035: Reading the Whole Heart: Latent-Attention Masked Autoencoders for Multimodal Cardiac Representation Learning
论文提出潜在注意力掩码自编码器(LAMAE),在自监督预训练阶段直接学习患者级多模态表征。模型通过共享潜在注意力模块在潜在空间交换信息,基于检查-视图-实体层级聚合变量观测,并可处理模态缺失。基于超120万条MIMIC-IV住院数据预训练后,其在院内死亡预测、ICD-10与DRG编码、住院时长等多模态任务上优于单模态预训练及对比学习、视觉语言基线,即使在测试时仅有单一模态也能保持优势。
常见医学基础模型多为单一模态,仅在微调或后训练阶段组合模态;LAMAE 在自监督预训练阶段就通过共享潜在注意力模块在潜在空间直接交换信息。
在院内死亡预测、ICD-10 与 DRG 编码、住院时长等多模态住院任务上表现优于单模态预训练以及对比学习、视觉语言基线。
预训练使用了超过 120 万条 MIMIC-IV 住院记录。
vivo Buds Clip 体验:42 小时续航的无感佩戴,音质好也舒服
Uniswap v4上的恶意Hooks8点1氪丨8月一线城市房价上涨;携程上架510万一张的太空旅行船票;字节跳动上半年净利润出现下滑,但海外收入占比再创新高
AI 减速还是不减速:一场周末点燃的行业与政府对垒
Building AI to accelerate science and improve lives
AI风口之下,明星们又想“挤上”牌桌了
字节将发布独立智能网盘“ADrive”,腾讯网盘先已布局,网盘AI大战打响
New insights from Google’s AI & Economy ATLAS
豆包工作还想反超WorkBuddy?
美国加密新规又黄了
Anew Labs已完成 2.9 亿美元融资,红杉中国、高瓴、IDG、五源、高榕等参与
实习生1天消耗1亿Token被约谈:如何衡量Token的ROIWindows 11 的 9 月例行安全更新再次引发了大量故障主题演讲:破界·量子计算迈向产业深水区——量子计算的下一公里|36氪2026产业未来大会
亚太唯一!腾讯云首次入选IDC MarketScape 全球托管边缘服务领导者类别
实测豆包新模型2.1-pro,这次审美和长时间Agent任务都追上第一档了
别闹,几粒盐就能立起高脚杯?你是不是用胶水了?
超越代币化:让RWA在链上真正有用
王强宇履新百望:从发票SaaS工具,到财税垂直大模型,再到企业的Palantir基元律动与无问芯穹达成战略合作,推进高质量Token供给与应用
微信桌面端变“三折叠”,可能是在给小微腾位置
510万一张!携程上架太空旅行船票:已有681人购买,还得自己买保险;娃哈哈因拖欠员工公积金被查封办公楼;华为放权!问界将由赛力斯主导
豆包 2.1 Pro模型更新,已接入豆包工作
“阿宝”交新朋友:携手比亚迪“迪迪虾”,实现车机端一句话办事
从200亿收购失败到650亿IPO:Figma如何用“协作”颠覆设计帝国8点1氪丨选手赛中失禁污染赛道,HYROX中国宣布整改;机构预计美股明年将暴跌21%;苹果推出Siri人工智能
BTC电力消耗可能已经见顶 2025年12月或为历史峰值
一边喊停一边敲钟:硅谷AI巨头到底在怕什么量子位2026人工智能年度榜单,正式启动!圆桌:生长·资方投资的新方程——穿越周期的耐心与价值 | 36氪 2026产业未来大会