# 法国 AI 创业公司 ZML 发布免费推理加速工具，支持多种芯片

> 原标题：Hot French startup ZML releases free product to speed inference across lots of AI chips

- 来源：TechCrunch · AI
- 发布时间：2026-07-08T08:00:00.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/43221
- 原文：https://techcrunch.com/2026/07/08/hot-french-startup-zml-releases-free-product-to-speed-inference-across-lots-of-ai-chips/

## 摘要

ZML 推出了开源软件 ZML/LLMD，能让 Llama、DeepSeek 这类模型在 Nvidia、AMD、Google TPU、Apple Metal 和 Intel Arc 等不同芯片上跑得更快。创始人 Steeve Morin 说目标就是降低推理成本，目前免费。图灵奖得主 Yann LeCun 之前公开推荐过这家公司。不过正文没披露融资细节，...

## 推荐理由

跨芯片推理加速确实是刚需，ZML/LLMD 免费开源，又有 LeCun 背书，吸引力不低。但正文没给性能对比数据，也没披露融资情况，所以分数只能打到 72，不能更高。

## 锐评

法国创业公司 ZML 把他们的推理加速软件 ZML/LLMD 开源了，说能让 Llama、DeepSeek 这类模型在不同品牌的芯片上都跑得更快，目标是帮用户省推理成本。创始人 Steeve Morin 强调目前完全免费，图灵奖得主 Yann LeCun 之前也公开推荐过这家公司，这些背书让这个工具值得关注。
但文章最大的问题是没给硬数据。它没披露任何基准测试对比，比如在英伟达 A100 上跑 Llama 3 到底能快多少、省多少钱，也没提融资规模和团队背景。没有这些，我们没法判断它比现有的 vLLM 或 TensorRT-LLM 强在哪。另外，免费策略能持续多久、后续会不会收费，正文也没交代。
如果你正好在用多种芯片跑模型，可以拿它试试水，但别急着把生产环境迁过去。等社区跑出真实场景的延迟和吞吐数据再说。
