Mac mini M5 Pro × Qwen3.8 × MiniMax H3|核验报告
一台 Mac mini,两种 AI 工作。验证 M5 Pro · 64GB · 1TB 能否胜任 Qwen3.8-27B 本地推理与 MiniMax H3 视频生成。把官网事实、开发者实测、演算假设分开。
一台 Mac mini,
两种 AI 工作。
M5 Pro · 64GB · 1TB 能否胜任 Qwen3.8-27B 的 4/6-bit 推理,以及 MiniMax H3 视频生成?将官网事实、开发者实测、演算假设分开,不把能加载等同于高效生产。
先认清是哪台机器
苹果当前 Mac mini 页面同时列 M6 与 M5 Pro;所问配置可选 18 核 CPU / 20 核 GPU。M5 Pro 入门 15/16 核的速度不能直接代表它。[1][2]
Qwen3.8-27B:精度与余量
型号确为 Qwen3.8-27B,不是“Qwen3.5”的笔误。官方卡片称稠密视觉语言模型,原生 262,144 tokens;它支持的上下文上限不等于这台机器都能无交换内存跑满。[3]
权重大小 ≠ 运行内存
均为 bartowski 文件表,量化名中的 4/6 不等于整个 GGUF 文件恰好每参数 4/6 bit;还需考虑 KV 缓存、视觉投影文件、系统与其他应用。Q6 占更多内存,但没有找到同配置同上下文的 Mac mini Q4/Q6 双测来断言速度差。[4]
Q4:日常对话与多应用共存优先;先把上下文设为 8K–32K 再逐步加大,监测内存压力,而非一开始开满 262K。
能期待怎样的文本速度?
另有 oMLX 社区记录:M5 Pro 20 核 GPU、64GB,8-bit 在 32K 上下文输出 16.6 tok/s、峰值模型内存 41.6GB;64K 为 13.3 tok/s、49.0GB。日期早于 Mac mini 上市,不能写成“这台 mini 的成绩”。[5]
MiniMax H3:开放权重 ≠ 开箱即用
MiniMax 于 2026-08-03 正式公布 H3 开放权重。官方完整系统 4–15 秒、24FPS、立体声;基础开放路径默认短边 768 像素。网页/API 产品与本地权重不是同一交付体验。[7][20]
另有 24GB M4 Pro MacBook Pro 用 MLX 权重流式加载生成 1344×768、5.17 秒立体声片段,耗时 47分58.7秒。流程、芯片、采样与画幅均不同,不能与上条做硬件快慢排名。[11]
许可证地理限制是实际门槛
H3 Community License 明确将美国、欧盟、英国、韩国列为排除地区;在这些地区使用开放权重及其输出,不能仅凭下载权限推断已有授权。中国大陆不在这份排除清单;仍须遵守协议与适用法律。若机器实际位于美国,应先走单独许可申请或使用官方托管 API。[10]
每月花多少钱?
把电费、硬件摊销、视频 API 账单分开;硬件摊销只是经济成本,不是已经付款后每月再次扣款。选择用电价格、时长与视频条数,即时重算。
按 30 天、¥0.617/kWh 演算;6W 来自 Apple 对 64GB/8TB 样机的待机表,60W 为明确假设,155W 是整机最大持续功率规格而非推理平均值。实际电费以你所在地、年累计阶梯和时段为准;显示器、路由器、外设不在内。[1][17][13]
整机推算,30 天
输入电价 × 用电量
非月度扣费;首月购机须另付设备价
摊销 + 电费;不含软件/屏幕
条数 × 秒数 × 官方按秒定价
只有填写汇率才合并币种
实际怎么买、怎么用
本地文字 / 图片理解
- 选购时确认是 18/20 核、64GB/1TB 还是较低的 15/16 核;苹果选购页面存在该配置,但本次未取得普通零售购物车最终价。[2]
- 先下载同一量化发布者的 Q4_K_M、以 8K–32K 上下文在 llama.cpp/Ollama/LM Studio 跑自己的任务;记录输出 tok/s、峰值内存、墙插功率。
- 只有在自己的任务确实因量化损失受影响时再试 Q6_K,保持同一提示词、上下文、采样设置比较;别先假定 Q6 必然更划算。
证据与不确定性
所有截图来自当日实际在线页面,嵌入本文件的位图,没有 AI 生成或重绘。截图只证明其可见区域;计算假设与第三方样本均有显著标注。点击页内 [n] 可跳转原始链接。
截图采集日期:2026-09-28;文中没有目标 Mac mini 的 Qwen Q4/Q6、H3 完整 2K、及推理墙插功率三项直接实测。Apple 普通零售具体选配价格在本次抓取中未可核实;计算器的 ¥24,999 为第三方 10Gb 版本示例,结账前请按苹果购物车改写。Hailuo 消费端套餐和积分以支付页面实际显示为准。