# antirez 开源了 DeepSeek 4 Flash 的本地推理引擎，专跑在苹果芯片的 Metal 上

> 原标题：DeepSeek 4：适用于 Metal 的 Flash 本地推理引擎

- 来源：AI HOT 精选
- 发布时间：2026-05-07T18:45:55.507Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/16358
- 原文：https://github.com/antirez/ds4

## 摘要

Redis 作者 antirez 在 GitHub 上放出了一个叫 ds4 的项目，是一个让 DeepSeek 4 Flash 模型在 Mac 上本地跑的推理引擎。它直接调用苹果的 Metal Performance Shaders 来降低延迟和内存占用，相当于给模型配了个更底层的加速驱动，而不是简单套个壳。不过项目页面没给出具体的跑分数据，实际快多少...

## 推荐理由

我会先打个折：正文没给任何延迟或内存占用的实测数字，所以性能到底多好现在说不准。但值得盯的不是又一个模型壳，而是这套 Metal 本地推理栈——它把推理引擎直接做进苹果的图形加速框架里，思路比多数套壳方案更底层。对想在 Mac 上离线跑模型的人来说，这是个能省钱的路线，只是验证还得等社区跑出数据。

## 锐评

antirez 放出的 ds4 项目，说白了就是给 DeepSeek 4 Flash 模型在苹果芯片 Mac 上配了个更底层的加速驱动。它直接调用 Metal Performance Shaders，不走通用框架那层套壳，理论上延迟和内存占用都会更低。

但项目页面没披露任何基准测试数据。没对比 llama.cpp、没对比 MLX，也没说在 M1 到 M4 不同芯片上跑多快、占多少内存。这点先别太激动，实际效果得自己编译跑一遍才知道。

另外，项目只针对 DeepSeek 4 Flash 这一个模型，不是通用推理框架。如果你正好要在 Mac 上本地跑这个模型，值得试试；如果用的是其他模型，这个项目暂时用不上。
