苹果在新款 Mac Studio 中推出了 M5 Ultra。这颗芯片的关键并不只是核心数量继续增加,而是苹果把统一内存带宽、GPU 并行规模以及专用 AI 加速能力进一步集中到同一颗系统级芯片上,让原本更依赖数据中心的专业计算与本地大模型推理,开始在桌面设备上获得更高的可行性。
M5 Ultra 最多提供 36 核 CPU 和 80 核 GPU,统一内存带宽达到 1.2 TB/s,并支持最高 512GB 统一内存。苹果称这是其有史以来性能最强的芯片,主要面向复杂 3D 渲染、视觉特效、科学分析,以及在本地设备上运行计算密集型 AI 模型等需求。对开发者而言,这类规格的意义在于:更多模型参数可以留在本地内存中,推理过程中的数据搬运成本也能进一步降低。
四芯片架构,核心是把多个芯片连成一个整体
M5 Ultra 并不是一颗传统意义上的单芯片。苹果采用新一代 UltraFusion 技术,将两颗双芯片 M5 Max 连接起来,组成四芯片架构。这也是苹果首次在 M 系列 SoC 中采用这一规模的设计。
UltraFusion 的重点在于互连。苹果给出的数据是,芯片间互连带宽超过 4.4 TB/s,连接密度提升超过 6 倍。这样的低延迟、高带宽互连,目的是让多个芯片在系统层面协同工作,对外表现为一个统一处理器。
这一设计对 AI 工作负载尤为关键。大模型推理并不只是单纯比拼算力,显存容量、内存带宽、调度效率以及模型权重加载速度都会影响实际体验。通过更高带宽的互连架构,苹果可以减少多个计算单元之间的数据等待时间,让 CPU、GPU 和神经引擎更充分地参与任务处理。
36 核 CPU 与 80 核 GPU:不只是提升峰值性能
M5 Ultra 的 CPU 最多包含 36 个核心,由 12 个超级核心和 24 个性能核心组成。苹果称,其单线程性能比 M3 Ultra 高出至多 1.25 倍,多线程性能高出至多 1.3 倍。
GPU 部分则是这次升级的重点。M5 Ultra 搭载最多 80 核新一代 GPU,每个 GPU 核心都集成了神经网络加速器。苹果表示,与 M3 Ultra 相比,其 AI 峰值 GPU 计算性能最高可提升 4.5 倍;与 M1 Ultra 相比,提升超过 6 倍。
图形能力方面,M5 Ultra GPU 采用苹果最新着色器核心,支持第二代动态缓存、硬件加速网格着色和第三代光线追踪。苹果称其图形性能比 M3 Ultra 高出最多 40%。这部分能力首先服务的仍是 3D 渲染、视觉特效和科学可视化等传统专业场景,但 GPU 核心中内置神经加速器的做法,也说明苹果正在把图形计算与 AI 推理能力更紧密地结合起来。
- 最多 36 核 CPU:12 个超级核心加 24 个性能核心
- 最多 80 核 GPU,每个核心集成神经网络加速器
- AI 峰值 GPU 计算性能较 M3 Ultra 最高提升 4.5 倍
- 图形性能较 M3 Ultra 最高提升 40%
1.2 TB/s 统一内存带宽,指向本地大模型推理
对本地 AI 来说,M5 Ultra 最值得关注的指标之一是内存系统。苹果为其配备最高 512GB 统一内存,统一内存带宽达到 1.2 TB/s,比 M3 Ultra 高出 50%。
大语言模型在本地运行时,模型权重、上下文缓存和推理中间状态都会占用大量内存。如果统一内存容量不足,模型可能被迫拆分到更慢的存储层级;如果内存带宽不足,GPU 和神经引擎即使有更高算力,也可能因等待数据而无法充分释放。M5 Ultra 的高带宽和大容量统一内存,正是针对这类问题而来。
苹果表示,这一内存架构可以让用户把大型数据集完全保存在本地内存中,提升每秒 tokens 的处理速度,并在设备端完全运行参数量达数千亿的大型语言模型。对于需要隐私保护、离线环境或快速迭代的开发者和研究人员来说,本地运行大模型的价值不仅在于减少云端依赖,也在于降低敏感数据离开设备的风险。
此外,M5 Ultra 还搭载 32 核神经引擎。苹果称其可在设备端安全执行复杂 AI 任务,并保持较高的能效表现。相比依赖云端服务器,本地 AI 推理还能减少网络延迟和服务费用,适合需要频繁调用模型的应用场景。
苹果想做的,是把 Mac 变成本地 AI 工作站
除了硬件规格,苹果也在强调软件生态的配合。M5 Ultra 可以被 Core AI、Core ML、Metal 和 Xcode 等开发者工具调用。苹果表示,这些框架能够自动优化 CPU、GPU 和神经引擎的资源分配,让开发者在 Mac 上本地运行和微调大型 AI 模型。
这意味着 M5 Ultra 并不是单纯为某一个应用提速,而是试图建立一套本地 AI 开发环境:开发者可以在同一台设备上完成模型部署、测试、调优和应用集成。对于独立开发者、研究团队以及需要处理私有数据的企业用户来说,这种本地化能力的吸引力会比较直接。
M5 Ultra 还配备了更强的媒体引擎,包括专为硬件优化的 H.264、HEVC、四路 ProRes 编解码引擎,以及硬件加速 AV1 解码引擎。这使新款 Mac Studio 在高分辨率视频编辑领域仍具备优势,而视频生成、视觉理解和多模态模型等 AI 任务,也可能从视频处理与 GPU 计算结合中受益。
从 M 系列芯片近几代的发展来看,苹果正在把 Mac 从传统创意工具平台,逐步推向本地 AI 计算平台。M5 Ultra 的 36 核 CPU、80 核 GPU 和 1.2 TB/s 统一内存带宽,是这一方向上的又一次集中升级。它能否真正改变本地大模型工作流,还要看后续应用生态和实际模型适配情况,但至少从硬件设计上看,苹果已经把目标对准了专业用户最需要的大内存、高带宽和本地推理能力。
原创文章,作者:点点,如若转载,请注明出处:https://www.dian8dian.com/ping-guo-ba-m5-ultra-zhuang-jin-mac-studio-36-he-cpu-80-he