# Claude 和本地模型写代码的差距有多大？有人用 4090 跑了一遍

> 原标题：The Gap Between Claude and Local: Can a Self-Hosted Coding Agent Compete?

- 来源：r/LocalLLaMA
- 发布时间：2026-06-06T11:49:21.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/34874
- 原文：https://www.reddit.com/r/LocalLLaMA/comments/1tyf5x8/the_gap_between_claude_and_local_can_a_selfhosted/

## 摘要

这篇 Reddit 帖子正文被屏蔽了，只能从标题和摘要反推。作者拿一个 Laravel 12 + Livewire 的端到端测试任务，比了五套写代码的 agent 配置。Claude Opus 4.7 配 1M 上下文窗口，一口气生成了 203 个测试；本地最强的方案是 OpenCode 跑在一张 24GB 显存的 RTX 4090 上，产出 140 ...

## 推荐理由

正文被屏蔽了，只能从标题和摘要反推。作者拿一个 Laravel 12 + Livewire 的端到端测试任务，比了五套写代码 agent。Claude Opus 4.7 配 1M 上下文窗口一口气生成 203 个测试；本地最强方案 OpenCode 跑在 24GB 显存的 RTX 4090 上，产出 140 个，中间还压了 4 次上下文。差距摆在那，但本地方案不用把代码往外传，这点对隐私敏感的场景有吸引力。帖子本身是一次个人实验，不是标准化基准测试，结论别直接当采购依据。

## 锐评

这篇帖子本身被 Reddit 屏蔽了，我们只能从标题和摘要反推内容，所以细节没法核实，先打个折。作者拿一个 Laravel 12 + Livewire 的端到端测试任务当擂台，比了五套写代码 agent 的配置。云端这边，Claude Opus 4.7 配 1M 上下文窗口，直接生成 203 个测试，基本不用人插手。本地最强方案是 OpenCode 跑在一张 24GB 显存的 RTX 4090 上，产出 140 个测试，但中间上下文压缩了四次，还得手动推 7 次才跑完。

数字说明的不是本地模型写代码不行，而是自主干活的能力还差一截。1M 上下文窗口让 Claude 可以一口气吞下整个项目结构，本地方案受显存限制，得反复压缩上下文，相当于干一会儿活就得翻一遍笔记，效率自然打折。140 对 203 的差距，更多是流程被打断造成的，不是单次生成质量差。

正文没披露用的什么本地模型、具体 prompt 怎么写的、测试通过率多少，也没说那 7 次手动干预到底改了啥。这些信息缺口让结论只能当参考，不能当基准。如果是真的，说明本地 agent 在长任务自主性上还有明显短板，但 4090 能跑到这个程度，对个人开发者来说已经挺能打了。
