应用与产品

苹果发布 M6 与 M5 Ultra 芯片,强化本地 AI 计算

苹果在 2026 年 8 月 25 日发布 M6 与 M5 Ultra 芯片,并同步更新 Mac mini 与 Mac Studio,强调将更大规模的本地模型推理与 Agent 工作流带到桌面设备。M6 采用 2nm 制程面向 Mac mini,提升能效与 AI 推理性能;M5 Ultra 采用四芯片封装与高达 512GB 统一内存,面向本地大模型与专业工作站。

苹果发布 M6 与 M5 Ultra 芯片,强化本地 AI 计算

苹果在 2026 年 8 月 25 日发布 M6 与 M5 Ultra 芯片,并同步更新 Mac mini 与 Mac Studio,强调将更大规模的本地模型推理与 Agent 工作流带到桌面设备。M6 采用 2nm 制程面向 Mac mini,提升能效与 AI 推理性能;M5 Ultra 采用四芯片封装与高达 512GB 统一内存,面向本地大模型与专业工作站。

苹果于 2026 年 8 月 25 日发布 M6 与 M5 Ultra 两款 Apple 芯片,并同步更新 Mac mini 和 Mac Studio。M6 首次采用 2 纳米制程,面向 Mac mini;M5 Ultra 则首次采用四芯片封装架构,面向 Mac Studio。两款芯片的共同卖点,是把更大规模的模型推理和 Agent 工作流继续带到桌面设备上。

苹果表示,新款 Mac mini 和 Mac Studio均可用于运行本地大语言模型与 Agent 工作流。Mac mini 将于 9 月 22 日开始供货,Mac Studio也将在同日上市。产品目前已开启预订。

M6 把重点放在更高效的桌面级推理

根据苹果的官方芯片发布公告,M6 是苹果首款采用 2 纳米制程的芯片,配备 12 核 CPU、12 核 GPU,以及由两个 16 核引擎组成的 Dual 16 核 Neural Engine。芯片支持最高 32GB 统一内存,内存带宽最高为 170GB/s。

M6 的 GPU 每个核心都加入 Neural Accelerator。苹果称,与 M5 相比,M6 的峰值 AI GPU 计算性能提高近 30%;与 M1 相比则超过 8 倍。苹果还表示,双 Neural Engine 的峰值计算能力最高是上一代的两倍。

这些数字来自苹果在特定硬件、软件和测试项目下进行的测试,不能直接等同于所有模型或工作负载的实际速度。真实表现仍会受到模型规模、量化方式、推理框架、上下文长度以及并发任务的影响。

M6 首发搭载于新款 Mac mini。苹果称,配备 M6 的 Mac mini 相比上一代 M4 机型,AI 性能最高提升 4 倍,图形和存储性能最高提升 2 倍,CPU 性能提升 40%。Mac mini M6 的美国起售价为 899 美元,最高支持 32GB 统一内存;配备 M5 Pro 的版本起售价为 1699 美元,最高支持 64GB 统一内存。

M5 Ultra通过四芯片封装扩大内存规模

M5 Ultra 的定位更偏向专业工作站和大型本地模型。它通过 UltraFusion 将两颗双芯片 M5 Max 连接起来,形成苹果芯片首次采用的四芯片封装架构。最高配置包括 36 核 CPU、80 核 GPU、32 核 Neural Engine,以及 512GB 统一内存。

M5 Ultra 的统一内存带宽最高达到 1.2TB/s,比 M3 Ultra 高 50%。苹果称,新芯片的峰值 AI GPU 计算性能最高是 M3 Ultra 的 4.5 倍,图形性能最高提升 40%。更大的统一内存也使 Mac Studio能够在本地加载参数规模更大的模型,而不必把模型权重完全交给云端服务。

新款 Mac Studio 公告中,苹果称 M5 Ultra 版本最高可提供 4.3 倍的 AI 性能、1.8 倍的图形性能和 1.3 倍的 CPU 性能。Mac Studio还支持最多四台设备通过 Thunderbolt 5 和 RDMA 组成集群,苹果称四机集群的 AI 推理速度最高可达到单机的 3 倍。

Mac Studio M5 Ultra 的美国起售价为 5499 美元,整条 Mac Studio产品线起售价为 2499 美元。设备支持最高 512GB 统一内存,配备最高 120Gb/s 的 Thunderbolt 5,并首次加入 Wi-Fi 7 和 Bluetooth 6。苹果宣布新款 Mac Studio将于 9 月 22 日开始供货。

苹果正在把本地 AI 从功能变成设备定位

这次发布的重点并不只是芯片制程或核心数量。苹果在两份公告中反复提到本地运行大语言模型、图像生成和 Agent 工作流,说明本地 AI 已经从 Mac 的附加能力,逐渐变成桌面产品的主要叙事。

Mac mini 的定位更接近低功耗、长时间运行的桌面节点。苹果直接将其描述为可用于“always-on”的 Agent 设备,用户可以在桌面上持续运行自动化任务,同时保留 Mac 的显示器、存储和外设生态。Mac Studio则面向需要更大内存池的开发者、研究人员、数据科学家和创意专业人士。

不过,统一内存容量并不等于全部容量都能用于模型。操作系统、应用程序、上下文缓存和图形任务都会占用资源。对于本地 Agent来说,能否稳定完成工具调用、文件处理和多轮验证,也不只取决于峰值算力,还取决于 macOS、模型框架和具体应用是否能够有效利用这些硬件。

苹果在开发者侧强调 Core AI、Core ML、Metal、Xcode 以及面向 Apple silicon 优化的 MLX。相关工具可以调用 CPU、GPU、统一内存和 Neural Engine,让开发者在本地运行、微调和部署自己的模型。新款 Mac Studio还支持通过多机集群共享更大的内存空间,这为实验性本地推理提供了比单台消费级电脑更大的余量。

本地运行并不意味着完全离线

苹果把本地推理与隐私、成本和响应速度联系在一起,但这并不表示所有 AI 任务都会脱离云端。更大的模型、最新信息、跨服务连接和部分系统能力,仍可能依赖远程服务。用户体验最终取决于哪些请求在设备上处理,哪些请求会被转发,以及系统是否能够清楚地提示数据流向。

这也是当前个人 Agent 硬件竞争的共同问题。近期,英伟达与微软推出面向本地个人 Agent 的 RTX Spark也把统一内存、本地模型和 Agent 权限控制放在同一套产品叙事中;Perplexity则尝试通过本地优先的Portable Computer把模型、编排器、沙箱与云端升级机制组合起来。

苹果的差异在于,它可以同时控制芯片、操作系统和开发者框架。理论上,这有利于减少软硬件之间的适配损耗;但它也意味着真正的竞争结果要等到设备上市后才能判断,包括模型支持范围、实际推理速度、功耗、噪音、价格以及 Agent 的权限和审计能力。

苹果在中国市场还面临另一项本地化问题。AIFlux此前报道,苹果已经为中国大陆符合条件的 Mac 用户提供将阿里巴巴通义千问接入 Siri 和写作工具的路径,但公开说明尚未明确具体模型版本和所有设备的开放时间。由此看,M6 和 M5 Ultra提供的是本地计算基础,真正面向用户的 AI 能力仍取决于地区服务、模型生态和系统软件的落地。

供货日期临近,实际价值仍待验证

从产品规格看,M6主要解决更小型 Mac 上的 AI 加速和能效问题,M5 Ultra则通过更大的统一内存和更高带宽,把 Mac Studio推向本地大模型和专业计算工作站。苹果也试图以 Agent 工作流重新解释 Mac mini 和 Mac Studio的用途,而不只是把它们视为传统桌面电脑。

但厂商公布的峰值数据尚不能回答几个实际问题:普通用户能否在合理成本下运行多轮 Agent 任务;512GB 统一内存能否转化为稳定的模型吞吐;多机集群是否需要额外的软件配置;以及本地处理与云端服务之间的切换是否足够透明。

这些问题要等 9 月 22 日产品正式供货、开发者和用户进行独立测试后才会更清晰。目前能够确认的是,苹果已经把下一代 Apple silicon 的技术路线与本地 AI、专业工作流和 Agent 计算明确绑定在一起。

来源:

不错过任何一条 AI 大事

订阅 AIFlux 早报,每天 3 分钟看懂产业动态。

相关阅读