# InstinctFlash：在 Jetson Thor 上实时跑 5B 参数的机器人世界-动作模型

> 原标题：Show HN: InstinctFlash – Run 5B world-action models in real time on Jetson Thor

- 来源：Hacker News 首页
- 发布时间：2026-09-22T15:20:06.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/58177
- 原文：https://github.com/General-Instinct/InstinctFlash

## 摘要

General-Instinct 开源了一个叫 InstinctFlash 的推理引擎，专门给机器人模型用。它能在 NVIDIA Jetson Thor 这种边缘设备上，把一个 50 亿参数、负责从感知直接输出动作的模型跑到实时——从看到画面到算出动作，延迟压到了 11 毫秒。仓库目前是早期公开状态，代码和文档还在整理。正文没提支持哪些机器人平台、模型...

## 推荐理由

50 亿参数在 Jetson Thor 上跑出 11 毫秒，这个数字够硬，H 和 K 都站得住。但仓库刚公开，文档没跟上，支持的机器人平台也没提，R 只到机器人圈子，整体卡在 featured 门槛上，给 72 分。

## 锐评

General-Instinct 把 InstinctFlash 开源了，这是一个专门给机器人模型用的推理引擎，能在 NVIDIA Jetson Thor 这种边缘小盒子上，把一个 50 亿参数、直接从画面算出动作的模型跑到实时。他们给出的数字是感知到动作的延迟压到了 11 毫秒，这个速度对于需要快速反应的机器人任务来说确实够用，比很多云端方案少了网络来回的延迟。

不过现在点进仓库，代码和文档都还在整理，属于早期公开状态。最关键的两样东西没给：一是模型权重去哪下载，二是到底支持哪些机器人平台。正文只提了 Jetson Thor，其他硬件能不能跑、要不要改代码，都没说。所以这个 11 毫秒目前只能看作在特定硬件上的单点测试，换到别的板子上表现怎么样还不清楚。

我会先打个折来看这件事——推理引擎的思路是对的，把大模型塞进机器人本体里跑，省掉联网的麻烦。但缺了模型和适配清单，现在能复现的东西有限。想上手试的人，得等他们把权重放出来，或者自己拿别的模型去适配。
