# 用100道斑马谜题微调Qwen 3 4B，MATH-500得分涨了31%

> 原标题：Fine-tuning Qwen 3 4B Base on 100 zebra puzzles yielded +31% on MATH-500. 6.5-min (Single H100/H200) reproduction notebook included.

- 来源：r/LocalLLaMA
- 发布时间：2026-09-11T14:06:50.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/55920
- 原文：https://www.reddit.com/r/LocalLLaMA/comments/1wdhb24/finetuning_qwen_3_4b_base_on_100_zebra_puzzles/

## 摘要

一个6.5分钟的单卡H100/H200微调实验，拿100道斑马谜题（逻辑推理题）去训Qwen 3 4B基础模型，让它在MATH-500数学基准上的得分提升了31个百分点。作者附了可复现的notebook，但Reddit把帖子正文拦了，训练超参、数据格式和评测细节都没放出来，这点先别太激动。
