ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

MTPLX 安装指南:Homebrew、pip 与 Mac 原生应用的 3 种方式完整对比

MTPLX 安装指南:Homebrew、pip 与 Mac 原生应用的 3 种方式完整对比 MTPLX 安装指南:Homebrew、pip 与 Mac 原生应用的 3 种方式完整对比【免费下载链接】MTPLXThe fastest way to run Qwen 3.8 Flash Next, Qwen 3.8 27B and Ternary Bonsai 2 27B on a Mac: 125 tok/s in OpenCode on an M5 Max, and a 27B model on 16 GB Macs. Native MTP speculative decoding on Apple Silicon, exact at any temperature. OpenAI and Anthropic compatible local server.项目地址: https://gitcode.com/gh_mirrors/mt/MTPLXMTPLX 是 Apple Silicon 上最快的本地大模型推理工具之一它用模型自带的 MTPMulti-Token Prediction头做精确投机解码让 Qwen 3.8 27B 在 32 GB 的 Mac 上流畅运行、125B 的 Flash Next 在 M5 Max 上跑出 125 tok/s并提供 OpenAI / Anthropic 兼容的本地服务。本文对比 MTPLX 的 3 种安装方式——Homebrew、pip、Mac 原生应用帮你选对路径10 分钟内完成 MTPLX 安装并跑起第一个模型。三种安装方式一览方式适合人群核心操作上手难度 HomebrewmacOS 用户官方推荐brew install youssofal/mtplx/mtplx⭐ 最简单 pipPyPIPython 用户、想隔离环境的人python3 -m pip install -U mtplx⭐⭐️ Mac 原生应用DMG完全不碰终端的用户下载 DMG 拖入「应用程序」⭐ 全图形化三种方式安装后共享同一个mtplx命令体系和模型缓存装哪种都不会互相冲突甚至可以混用。安装前准备系统要求与内存对照MTPLX 是 Apple Silicon 优先的原生软件安装前先确认 INSTALL.md 中的要求芯片Apple SiliconM1 或更新系统macOS 14.0 或更新Pythonpip 方式需要原生 arm64 的 Python 3.11磁盘模型下载大小 5 GiB 空闲空间MTPLX 下载前会自动检查内存决定你能跑什么模型docs/install.md 的推荐策略你的 Mac 内存MTPLX 首推模型8–16 GBQwen 3.5 4B最快的小模型16 GBTernary Bonsai 2 27B三值 27B约一半内存32 GBQwen 3.8 27B Optimized Speed编码首选128–256 GBQwen 3.8 Flash Next125B 旗舰 MoE 不确定自己的配置安装完成后mtplx start会自动按上述策略推荐选错也无所谓——显式指定模型永远优先。方式一:Homebrew 一键安装(macOS 官方推荐)Homebrew 是 MTPLX 推荐的 macOS 安装路径一条命令搞定后续升级也最省心brew install youssofal/mtplx/mtplx mtplx startmtplx start是交互式入口选模型、选模式、选界面然后直接开聊升级只需brew upgrade mtplx版本管理完全交给 Homebrew完整新手路径见 docs/quickstart.md适合谁大多数 macOS 用户的首选零配置负担。方式二:pip 从 PyPI 安装如果你习惯用 Python 工具链管理环境pip 是最直接的方式安装说明见 INSTALL.mdpython3 -m pip install -U mtplx mtplx help两个进阶技巧1️⃣ 一键安装脚本隔离环境仓库提供了 scripts/install_macos.sh它会把 MTPLX 装进~/.mtplx/venv独立虚拟环境并在~/.local/bin/mtplx写一个持久启动器——完全不碰 Homebrew 目录适合不想污染系统 Python 的用户。2️⃣ 源码开发安装需要参与开发或调试时先获取源码再装 editable 包git clone https://gitcode.com/gh_mirrors/mt/MTPLX cd MTPLX python -m pip install -e .[dev,server]依赖与版本信息定义在 pyproject.toml当前版本 2.12.0。适合谁Python 开发者、需要固定版本或从源码构建的用户。方式三:Mac 原生应用最省心的全图形化路线从 MTPLX 官方下载页获取签名的 DMG下载后拖入「应用程序」文件夹应用会自动完成全部后续工作✅ 检查你的硬件配置✅ 推荐一个真正装得进你内存的模型✅ 下载模型✅ 搭建自己的 Python 引擎无需 Homebrew✅ 安装风扇控制把mtplx放上 PATH✅ 实测你的机器自动挑出最快的解码深度主界面是一个实时仪表盘解码速度、上下文长度、内存占用一目了然应用源码位于 apps/MTPLXApp/️适合谁不想碰终端、想拖进去就能用的用户。安装后验证:mtplx doctor 与第一次运行无论用哪种方式安装建议先跑一次体检命令——它甚至在 MLX 未装好时也能工作缺失依赖会以可操作的提示呈现而不是报错堆栈mtplx doctor --summary # 安装与环境健康检查 mtplx start # 交互式启动,推荐模型 mtplx models # 查看已缓存的模型与大小启动后你会得到两个入口内置聊天原生流式输出支持思考卡片、文件附件和网页搜索还可以一键把 OpenCode、Hermes、Open WebUI 等客户端指到本地服务本地 API 服务127.0.0.1:8000提供 OpenAI 兼容的/v1/chat/completions和 Anthropic 兼容的/v1/messages详见 docs/server.md任何说这两种 API 的客户端都能直接对接想手动验证服务可以参考示例脚本 examples/curl-chat-completions.sh。自动调优:让 MTPLX 在你的 Mac 上跑到最快MTPLX 的 MTP 投机解码深度一次草稿几个 token最优值因芯片、内存带宽和散热而异。一条命令就能在你的机器上实测mtplx tune --model 模型名或路径 --retune它会在固定风扇下用真实模型逐个深度测速只保存确实比纯自回归解码更快的深度如果没有更快的就如实告诉你CLI 实现见 mtplx/cli.py比如在 16 GB 的 M4 Mac mini 上9B 模型调优后从 14.4 tok/s 提升到 23.0 tok/s落在 depth 1。三种方式怎么选完全不想碰终端→ ️ 原生应用拖入即用习惯 Homebrew 管理工具→ brew install升级最省心Python 工作流 / 需要隔离环境 / 源码开发→ pip 或一键脚本混用无压力应用和 CLI 共享同一个服务器mtplx start会直接接管应用正在运行的模型不会加载第二份放心组合使用常见问题FAQ❓ pip 安装报错或装不上确认 Python 是 3.11 且为原生 arm64 版本公司网络下下载报CERTIFICATE_VERIFY_FAILED通常是代理做了 HTTPS 检查安装truststore包让 Python 使用 macOS 钥匙串即可。❓ 如何升级到最新版Homebrew 用户brew upgrade mtplxpip 用户python3 -m pip install -U mtplx。注意 Ternary Bonsai 2 27B 等新模型需要 2.12.0。❓ 磁盘不够了怎么清理mtplx models查看已缓存模型mtplx remove hf-repo删除指定模型及其文件。❓ 风扇策略可以控制吗mtplx max --on / --max / --off切换性能档位--max是显式开启的高性能模式接受风扇噪音换持续吞吐mtplx max --status查看当前状态。MTPLX 的完整安装文档见 INSTALL.md进阶配置模型库目录、检索端点、并发模式可继续阅读 docs/install.md 与 README.md。装好之后剩下的就是感受 125 tok/s 的本地模型有多快了 【免费下载链接】MTPLXThe fastest way to run Qwen 3.8 Flash Next, Qwen 3.8 27B and Ternary Bonsai 2 27B on a Mac: 125 tok/s in OpenCode on an M5 Max, and a 27B model on 16 GB Macs. Native MTP speculative decoding on Apple Silicon, exact at any temperature. OpenAI and Anthropic compatible local server.项目地址: https://gitcode.com/gh_mirrors/mt/MTPLX创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表