从代码补全到规范驱动:AI Coding Agent 软件工程的演进与 DeepSeek Harness
AI Coding Agent 的难点不只在生成代码,还在于理解项目事实、执行受限操作、验证真实结果和划分责任。本文回顾这条演进路径,并用 DeepSeek Harness 的源码、文档、测试与 CI 建立一张可核验的工程证据图。
AI Coding Agent 的难点不只在生成代码,还在于理解项目事实、执行受限操作、验证真实结果和划分责任。本文回顾这条演进路径,并用 DeepSeek Harness 的源码、文档、测试与 CI 建立一张可核验的工程证据图。
系统分析 Agent 评测与模型评测的差异,说明如何构建测试集、结合自动评测与 LLM-as-judge,并把失败案例转化成可持续的改进信号。