# 有人把 Transformer 语言模型塞进了原装 Game Boy Color 里跑

> 原标题：I got a real transformer language model running locally on a stock Game Boy Color!

- 来源：r/LocalLLaMA
- 发布时间：2026-05-12T23:15:42.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/19080
- 原文：https://www.reddit.com/r/LocalLLaMA/comments/1tbi2n3/i_got_a_real_transformer_language_model_running/

## 摘要

maddiedreese 把 Andrej Karpathy 的 TinyStories-260K 模型成功跑在了一台没改过硬件的 Game Boy Color 上。他用 INT8 量化权重、定点数运算，把模型和 KV 缓存塞进 MBC5 卡带的 bank-switched ROM 和 SRAM 里，全程不靠手机、电脑、Wi-Fi 或云端推理。不过输出...

## 推荐理由

一个 Reddit 硬件 hack，把 TinyStories-260K 塞进原装 Game Boy Color，用 INT8 和定点数学跑推理，KV cache 放在卡带 SRAM 里。输出慢到没法用，而且基本是乱码，所以别当产品看。但能在这种老设备上把 transformer 跑起来，本身就挺酷，技术细节也给得实在，适合当一条有趣的行业花絮。

## 锐评

这条新闻的趣味性远大于实用性，但技术思路挺有意思。作者 maddiedreese 把 TinyStories-260K 这个极小的语言模型，通过 INT8 量化和定点数运算，硬塞进了 Game Boy Color 的 MBC5 卡带里。模型权重和推理时需要的 KV 缓存，分别存在卡带的 ROM 和 SRAM 上，全程不依赖任何外部设备，是真正的本地运行。

不过，先别激动。正文明确说了，输出“极慢”且“基本是乱码”。这很正常，Game Boy Color 的 CPU 主频只有 8MHz 左右，内存也极小，能跑起来已经是极限了，生成质量完全没保障。这更像一个“能跑”的概念验证，而不是一个“能用”的工具。

这条信息最大的缺口是没披露具体的推理延迟，比如生成一个 token 要多少秒。另外，也没说这个“乱码”是完全随机，还是偶尔能蹦出几个有意义的词。如果后续能给出哪怕一个勉强通顺的输出样例，说服力会强很多。
