Claude 和本地模型写代码的差距有多大?有人用 4090 跑了一遍
The Gap Between Claude and Local: Can a Self-Hosted Coding Agent Compete?
这篇 Reddit 帖子正文被屏蔽了,只能从标题和摘要反推。作者拿一个 Laravel 12 + Livewire 的端到端测试任务,比了五套写代码的 agent 配置。Claude Opus 4.7 配 1M 上下文窗口,一口气生成了 203 个测试;本地最强的方案是 OpenCode 跑在一张 24GB 显存的 RTX 4090 上,产出 140 ...
推荐理由:正文被屏蔽了,只能从标题和摘要反推。作者拿一个 Laravel 12 + Livewire 的端到端测试任务,比了五套写代码 agent。Claude Opus 4.7 配 1M 上下文窗口一口气生成 203 个测试;本地最强方案 OpenCode 跑在 24GB 显存的 RTX 4090 上,产出 140 个,中间还压了 4 次上下文。差距摆在那,但本地方案不用把代码往外传,这点对隐私敏感的场景有吸引力。帖子本身是一次个人实验,不是标准化基准测试,结论别直接当采购依据。