小米AI手机折叠屏原型机本地运行大模型的生成速度是多少?
实测生成速度约 303 tokens/s,峰值可达 330 tokens/s。

#欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。
小米发布玄戒 O3、O100 和 D100 三颗自研芯片,并在技术沟通会上展示了搭载这些芯片的原型机。实测中,折叠屏原型机断网状态下本地运行 MiMo 3B 模型,生成速度可达 303 tokens/s,响应迅速;桌面计算终端 AI Cube 则配备 80GB 内存,本地部署 120B 大模型,可完成代码生成等复杂任务,并支持 3B 和 120B 双模型切换。
实测生成速度约 303 tokens/s,峰值可达 330 tokens/s。
AI Cube 内置 80GB 内存,本地部署 120B 参数大模型,并支持 3B + 120B 的快慢双模型切换。
Scaling Federated Learning Across Docker, Kubernetes, and Slurm with NVIDIA FLARE企业案例分享:坤煜量子|36氪2026产业未来大会
亚太唯一!腾讯云首次入选IDC MarketScape 全球托管边缘服务领导者类别
王强宇履新百望:从发票SaaS工具,到财税垂直大模型,再到企业的PalantirFedora 45 Beta 释出
派早报:豆包发布手机助手消费者版,绿联发布首款雷电 5 显卡坞等科学家演示水下太阳能电池
美国加密新规又黄了
读完斯坦福116页AI实施手册,我最大的感受是:别再盯着模型了AI大模型工场2026 AI产业生态大会今日举办,大咖同台共探智能生长与产业共生
微信桌面端变“三折叠”,可能是在给小微腾位置
工作流可以自我进化了,英伟达开源 SoL-Pi,每小时省13.5刀!
2nm天玑9600 Pro,把旗舰SoC竞争推向「融合计算」
AI攻克世纪数学难题,顶尖数学家抱团抵制,而他们担心的并不是丢了工作产品观察丨xTool做了一台3000元起步的激光雕刻机,难的不只是价格
这种国民鱼一直被低估、被当廉价鱼!现在才知道钙和 DHA 这么多!快试试
飞书与豆包工作合体后首亮相:Agent 能进群,还能帮你写周报、做PPT
129亿美元卖身英伟达之后,是时候重新理解Hugging Face了
担心代码被拿去训练!英伟达:限制员工使用 Claude;一汽将成广汽第二大股东!南北丰田拟合并;苹果回应「iPhone 18 Pro破发」
BTC电力消耗可能已经见顶 2025年12月或为历史峰值
苹果Siri AI上线;豆包手机助手消费版正式发布;塔克拉玛干沙漠发现两处大型地下水水源
牛市的钱:是熊市里守出来的廉价太阳能改变世界能源格局地平线第1500万颗征程芯片搭载大众 ID. AURA T6,HSD V2.1 即将推出
现在参与以太坊原生质押为什么要先排队一个月?
早报|iOS27正式推送/比亚迪高管:燃油车在中国没有未来/iPhone 18 Pro渠道降价900元,苹果称不干预
Agent开始调用基础设施,Kubernetes准备好了吗?
超越代币化:让RWA在链上发挥实用价值
川普让步了 为何Clarity法案还遭到全体民主党人反对企业案例分享:伊辛智能|36氪2026产业未来大会