slotstream

在 48 GB Mac 上執行 105 GB AI 模型。Qwen3.8-Flash-Next(125B 專家混合模型)透過插槽快取從 SSD 串流專家。原生 Swift 搭配 MLX 與 Metal

slotstream 是什麼?

在 48 GB Mac 上執行 105 GB AI 模型。Qwen3.8-Flash-Next(125B 專家混合模型)透過插槽快取從 SSD 串流專家。原生 Swift 搭配 MLX 與 Metal:單一二進位檔,無需 Python,相容 Ollama 與 OpenAI API。