DFlash團隊進軍Mac,27B模型跑出144Token/s
2026-09-19 16:25:47
幣界網消息,DFlash團隊宣佈進軍Mac平臺,27B模型在M5 Max MacBook Pro上達到了144 token /s的最高性能。該團隊推出的開源本地推理引擎Splash,已接入LM Studio 0.4.25版本,支持Qwen3.8-27B和Qwen3.6-35B-a3b模型。DFlash通過並行處理多個token,減少了逐個生成的計算,提升了整體性能。在使用48GB M5 Pro進行橫向測試時,Qwen3.8-27B單路短上下文達到74 token /s,四路併發時總吞吐量達到170 token /s,是第二名的3.9倍。Splash開源,不綁定LM Studio,需M3或更新的Mac、macOS 26.4以上、至少36GB統一內存。
來源:互聯網
本內容只為提供市場資訊,不構成投資建議。
關注WalletJYS官方帳號,及時關注最新動態









