小米玄戒 O3 刷新 522 万安兔兔跑分,O100 突破 1.
10 核全大核狂暴,但 O3 没止损续航
Geekbench 6.5 单核 3400+ 多核 15000+,安兔兔 522 万——这些数字可能只是小米拿来当靓仔的噱头。更吓人的是 O3 塞了 10 根全大核进 3nm 板子里,6 颗超大核 + 4 大核,最高 4.35GHz。单核再狂也得有多核并发命条,小米显然已经吃够了“追极限频”的苦头。
但是寸土寸金的手机 SoC,要塞 10 颗全大核还得掏出 133mm² 大胆——晶体管直接从 190 亿怼到 240 亿。这笔钱最后得从功耗和发热买单。小米答的答案是:在 80% 日常中低负载下,功耗降 25%。也就是说,刷抖音看网页的时候,O3 比 O1 省电不少。

GPU 部分换了 16 核 G2-Ultra NX,官方吹图形性能涨 85%,光追直接翻了 1.8 倍。更硬核的是在相同功耗下,O3 比 O1 省 64% 能耗,暴打 A19 Pro 的同时还不烫手掌。
影像这块,O3 直接把第五代旗舰 ISP 丢进去,支持 4.32 亿像素单摄、24bit 位宽,还有 64M+64M+50M 三摄并发。4K 60FPS AINR 夜景视频也被拧进芯片底层,把计算摄影的天花板往上拉了好几层。
手机快的没地方去,内存带宽先挂了

但是算力拉满了,数据搬运的速度立马就跟不上——这就像厨师越快但配送太慢一样,最终还是堵在内存通道。
O3 面对这个硬玻璃,直接掏出 LPDDR6 记忆战略:4×24bit 位宽、10667Mbps,带宽怼到 113.8GB/s——屋里 LPDDR5X 翻了将近一倍。芯片内部把常用缓存往死塞:12MB L2 + 16MB L3 + 16MB SLC,总计 60MB。
更绝的是物理走线优化,静态访存延迟砍到 82ns,后台动态 177ns——直接干爆 A19 Pro 的 92ns / 211ns。

这种“懒得等”优化在端侧大模型场景下更关键。MiMo 5 值量化模型专门定制霍夫曼压缩,省 30% 带宽。28MB NPU 近存,MiMo 3B 首词响应快 40%,推理快 45%,功耗降 26%。
O100:把 Ai 专用卡扔去桌子上
说完手机 SoC,小米掏出 One More Thing——O100,纯衣大模型推理用的怪兽。
6nm 工艺但用上了 Wafer-on-Wafer 3D 叠加上 Hybrid Bonding,垒起两层专用 DRAM + 一层 NPU。258 万物理键合点,0.7μm 超细 TSV,1.4μm 键合间距——数据直通计算核心,带宽直接飞到惊人的 1.22TB/s,屋里旗舰机 LPDDR5X 的 16 倍。
14 核心 NPU 分 Ring 网跟 All-to-All 广播,Prefill 走环形 Decode 走全连。实验室跑出 330Tokens/s,本地推理速度已经能吊打不少服务器。
D100 去车里干智驾了
玄戒 D100 面向智驾,3nm 工艺 + 20 核 CPU + 16 核 NPU,丧心病狂的 160GB 统一内存。本地就能干掉 200B 参数模型,在隧道弱网下也能直接推理。
新品来了:桌面 AI 盒子跟「阔折叠」
小米 AI Cube Prototype 类似 DGX Spark,33874 个 CNC 蜂窝散热孔,120B + 3B 双模型本地混合部署,小模型毫秒响应大模型深度推理。
小米 18 Fold 跟平板 9 Pro Max 9 月登台,前者就是传闻中的「阔折叠」,搭载 O3 全家桶。
TAGS: 玄戒O3, 玄戒O100, 玄戒D100, Xiaomi 18 Fold, 小米AI Cube
