AMD GAIA 與 Mac Studio M3 Ultra 在落地部署大型語言模型推理中的比較分析
日期:2025 年 3 月 24 日
摘要:本文比較了 AMD GAIA(混合模式與通用模式)與 Mac Studio M3 Ultra(512GB 統一記憶體 + MLX 框架)在落地部署大型語言模型(LLM)的性能,聚焦推理速度、模型規模支援及應用場景。基準測試顯示,Mac Studio M3 Ultra 運行 671B 4-bit DeepSeek R1 模型的速度為 17-18 tokens/s,而 GAIA 受記憶體限制,混合模式上限為 13B,通用模式上限為 70B。研究表明,GAIA 在中小型模型上具靈活性,Mac Studio 則適合專業級超大模型應用。
1. 引言
隨著生成式人工智慧(AI)的發展,落地部署大型語言模型(LLM)的需求日益增長。AMD 於 2025 年 3 月推出的 GAIA 開源項目與 Apple 的 Mac Studio M3 Ultra 分別代表了不同的解決方案。本文全面比較兩者的硬體規格、軟體生態、推理速度及應用場景,並針對 671B 4-bit DeepSeek R1 模型的推理速度引用實際測量數據,確保所有資訊均有可靠來源。

