哔哩哔哩 · 核心生态
DeepSeek Harness 实测 Claude Code 对比后,梁神我错了 差距比我想的大
这期用同一个 DeepSeek Pro 0813 模型,分别在 Claude Code 和 DeepSeek Harness 里完成同样的任务,对比工具链对最终效果的影响。 实测内容包括: FPS 游戏 Demo、灯塔预警沙盘、手枪组装动画、显示器组装动画,以及 DeepSeek Harness 的插件化源码流程。 整体看下来,模型本身当然重要,但 Harness 在插件化、流程记录、缓存命中和任务组织上的设计,会明显影响最终输出质量。尤其是游戏 Demo 和组装动画这两轮,差距非常明显。
SOURCE-DECLARED INSTALL
Open the public source page ↗MEDIA REFERENCES
Captured in public view


CONTEXT
Why it is here
这期用同一个 DeepSeek Pro 0813 模型,分别在 Claude Code 和 DeepSeek Harness 里完成同样的任务,对比工具链对最终效果的影响。 实测内容包括: FPS 游戏 Demo、灯塔预警沙盘、手枪组装动画、显示器组装动画,以及 DeepSeek Harness 的插件化源码流程。 整体看下来,模型本身当然重要,但 Harness 在插件化、流程记录、缓存命中和任务组织上的设计,会明显影响最终输出质量。尤其是游戏 Demo 和组装动画这两轮,差距非常明显。
REFERENCES
Linked evidence
Evidence updated 2026-08-15T19:59:38.554Z. Interaction numbers are platform-native snapshots; the evidence panel records the metric source and observation time. NULL means the public page did not expose a number at collection time.