
A | Renee 编译 据1News报道,新西兰全国交易数据显示,今年Boxing Day,新西兰人在食品和酒类上的支出有所增加,但总体支出较去年有所下降。 8月24日消息,今天下午,小米除了发布玄戒O3之外,还带来了玄戒O100,一款大模型专用的AI加速芯片,更是全球首款6nm 3D晶圆级堆叠的AI加速芯片。 玄戒O100通过先进的3D堆叠工艺,实现了1.22TB/s的超高带宽,这一速度是目前主流旗舰手机的16倍之多,可以让移动端设备的AI性能实现质的突破。玄戒O100与玄戒O3是AI终端的“最佳CP”,最高可以实现本地AI推理速度高达330Tokens/s。 传统计算架构下,计算单元与存储单元物理分离,数据必须在两者之间反复搬运。但内存数据通路受限于物理引脚数量,遇到了增长瓶颈。

B | Advertise with us 该数据由Worldline NZ(前Paymark)发布,该公司表示,这一结果与过去六个月的趋势一致。 周二(12月26日),消费者在核心零售商家(不包括酒店业)的支出为9830万纽币,比去年同期下降0.6%,但比2019年增长2.4%。

C | 当AI算力以指数级增长时,内存访问速度与算力之间已经严重脱节,成为性能的关键阻碍,业界称之为“内存墙”。玄戒O100,则是小米“推倒内存墙”的破局之法。 不过,食品和酒类商店(包括咖啡馆、外卖、酒吧等)的平均消费比去年增长了14.1%,达到1460万纽币。

D | 区别于以往晶圆→切割为裸片(Die)→逐片封装互联的方式,玄戒O100采用先进的Wafer on Wafer封装技术,也就是将多片完整的晶圆直接高精度对准与键合,继而再切割成独立的3D芯片。 Worldline销售主管Bruce Proffit表示,消费者支出的下降将令零售商感到失望,但这与半年趋势相符。 这彻底摆脱了传统引脚数量对带宽的物理限制,将数据通路从“平面走线”变为“垂直穿透”,实现真正的近存计算(Near-Memory Computing)。 了解大体逻辑后,我们看看玄戒O100到底如何做的。

E | Boxing Day当天的交易高峰是下午12点34分,当时通过供应商网络处理了6074笔交易。这一数字比上周五低44%,上周五(12月22日)是官方公布的一年中最繁忙的购物日。 Worldline称,这些数字主要反映的是实体店内的交易,但也包括一些网上交易。 总体而言,年度支出增长最高的地区是在Otago(增长9.4%)和Wairarapa(增长8.5%),而惠灵顿的跌幅最大(下降10.8%)。

F | 首先将两层AI专用高速DRAM晶圆与一层高性能NPU晶圆垂直堆叠,然后在垂直方向“钻隧道”让数据可以高速流转。 在怀卡托、Whanganui、Palmerston North、Wairarapa、Nelson、Marlborough、West Coast、Canterbury、Otago和Southland消费者的支出有所增长,而其他地区则有所下降。

G | 所以,只要隧道越多,也就可以实现越高的带宽。为此,玄戒O100采用了先进的Hybrid Bonding混合键合工艺,摒弃了传统微凸点(Micro Bump)结构,直接将物理通路的间隔缩短至1.4μm,让数据通路密度大幅提升。 相关阅读: Boxing Day购物真的更优惠吗?商场一早就挤满了人 遭遇通胀 多国民众圣诞消费“缩手缩脚” 打破纪录!新西兰人Boxing Day消费了1个亿 黑五一派繁荣,销售额有望再次超过节礼日,消协发布购物警示 消协警示:下周“黑五”,商家误导型“假折扣”不要信! “黑五”虚假促销现象严重,这类商品价格涨幅最大 黑五购物请注意:这些产品的价格可能不降反升 黑色星期五来了!如何在新西兰安全地“剁手”?指南在此 节礼日魅力不再?新西兰人更爱在“黑五”花钱 注:本文为编译/原创,欢迎转发分享;但严禁复制等未经授权的非法使用。

H | 违反上述声明者,本网将追究其相关法律责任。 为了进一步缩短DRAM与NPU计算层的物理距离,玄戒O100还采用了 Face to Face(简称F2F)金属层直连结构。使用授权请联系[email protected]。 chineseherald.co.nz All Rights Reserved 版权所有 (责编:twinkle) 来源 - 相关内容 奥克兰一处房屋发生火灾,一人丧生 圣诞假期道路死亡人数升至6人 Boxing Day购物真的更优惠吗?商场一早就挤满了人 快讯:Newmarket Westfield遭紧急疏散 奥克兰北岸发生“不明原因”死亡事件 恶劣天气持续,部分地区或遭暴雨雷暴袭击,最高温近30度 北部开始下雨了 奥克兰的圣诞节可能有阵雨 今天奥克兰高速接连车祸 一特斯拉撞毁。 简单来说,每一层晶圆内部,其实底部是逻辑晶体管,上层有密布多层的金属走线层。F2F,就是让DRAM与NPU的金属走线“面面相对”,如此可以实现更短的物理互联距离,实现更快的信号传输。 当然,这说起来简单,在6nm如此高工艺节点下,要解决散热、电磁干扰等诸多难题,玄戒团队逐一攻坚,实现最终量产,并申请了15项专利,其中已获批4项发明专利。 与此同时,玄戒O100配备了14颗高算力NPU,通过玄戒高带宽矩阵总线,让数据可以在NPU与内存、与其他NPU核心之间等高速流转。 创新的矩阵总线支持拓扑动态切换,Prefill阶段采用环形拓扑,数据逐核流转、顺序同步;Decode阶段切换为广播拓扑,所有结果统一汇聚到指定核心。总线控制上的灵活拓扑,让片上计算资源得以充分应用。

I | 最终,玄戒O100的带宽达到了惊人的1.22TB/s。大家对这个数字可能没什么概念,以目前主流旗舰手机LPDDR5X内存作为对比,它的带宽76.8GB/s,而玄戒O100是其16倍之多,彻底释放端侧AI性能。

J |
为了验证玄戒O100的高带宽表现,小米工程师还做了一款原型机,搭载玄戒O3和O100,双芯协同计算。小米还引入了风冷主动散热,充分发挥芯片的全部性能。配合Xiaomi MiMo端侧模型,实现了超高速端侧推理性能。
Current article:http://7hmlyh.shengyaodanrongchui.buzz/1cam8/20260826/59882.html
Published on:07:03:54