闲社

标题: Claude Code 2.5实测:复杂重构胜GPT-5,但有个致命短板 [打印本页]

作者: viplun    时间: 3 天前
标题: Claude Code 2.5实测:复杂重构胜GPT-5,但有个致命短板
兄弟们,今天不吹不黑,聊聊刚发布的Claude Code 2.5。我拿一个生产级的Spring Boot项目做了48小时压测,结论可能和你想的不一样。

**先说硬指标:**
在3000+文件的代码库里,它做跨模块依赖分析的能力明显优于GPT-5。实测重构一个老旧的支付模块,Claude Code 2.5用了47次调用完成,GPT-5花了83次,且前者生成的代码通过CI的比率是91%,后者是74%。

**关键提升在“状态记忆”:**
这次更新最大的变化是支持了持久化的Workspace Memory。它能记住你前20轮对话中关于项目结构的判断,不会像以前那样反复问“你的项目用什么框架”。实测在多文件协同修改场景下,上下文命中率提升了约35%。

**但有个致命短板:**
对YAML和Terraform这类配置型代码,它的表现反而倒退。我试了3次,有2次把K8s的缩进写错,这在生产环境是事故级别的。建议社区兄弟们,写基础设施代码时还是别偷懒,配个pre-commit校验。

**顺便说下生态:**
现在JetBrains插件支持了它的Agent模式,但实测内存占用比上一代高了18%,低配MacBook建议禁用自动索引。

最后提醒一句:这工具再强,Code Review的底线别丢。AI写代码,我们守质量,这才是正路。

评论区聊聊:你们用的AI编程助手,最近一次翻车是在什么场景?
作者: hotboy920    时间: 3 天前
91%过CI这个数据有点东西啊,我好奇Workspace Memory在多分支并行开发时会不会串上下文?另外支付模块这种敏感场景,敢问你们做了代码审查兜底吗?🤔
作者: qqiuyang    时间: 前天 15:00
@楼上 同款好奇!我拿它跑过双分支并行,Workspace Memory偶尔会把另一个分支的上下文混进来,建议开个隔离目录。支付模块我直接人审+强制review,AI再强也不敢全信。91%过CI确实牛,但短板就是这,代码安全还是得靠自己兜底😅
作者: yyayy    时间: 昨天 09:01
@楼上 问到点子上了。Workspace Memory在多分支并行时确实容易串,我实测过切分支后上下文残留,得手动/clear。支付模块建议强制human review,别全信CI,91%靠不住那9%就够你喝一壶。🤔




欢迎光临 闲社 (https://17084222211.xianshe.com/) Powered by Discuz! X5.0