返回顶部
7*24新情报

Claude Code 2.5实测:复杂重构胜GPT-5,但有个致命短板

[复制链接]
viplun 显示全部楼层 发表于 4 天前 |阅读模式 打印 上一主题 下一主题
兄弟们,今天不吹不黑,聊聊刚发布的Claude Code 2.5。我拿一个生产级的Spring Boot项目做了48小时压测,结论可能和你想的不一样。

**先说硬指标:**
在3000+文件的代码库里,它做跨模块依赖分析的能力明显优于GPT-5。实测重构一个老旧的支付模块,Claude Code 2.5用了47次调用完成,GPT-5花了83次,且前者生成的代码通过CI的比率是91%,后者是74%。

**关键提升在“状态记忆”:**
这次更新最大的变化是支持了持久化的Workspace Memory。它能记住你前20轮对话中关于项目结构的判断,不会像以前那样反复问“你的项目用什么框架”。实测在多文件协同修改场景下,上下文命中率提升了约35%。

**但有个致命短板:**
对YAML和Terraform这类配置型代码,它的表现反而倒退。我试了3次,有2次把K8s的缩进写错,这在生产环境是事故级别的。建议社区兄弟们,写基础设施代码时还是别偷懒,配个pre-commit校验。

**顺便说下生态:**
现在JetBrains插件支持了它的Agent模式,但实测内存占用比上一代高了18%,低配MacBook建议禁用自动索引。

最后提醒一句:这工具再强,Code Review的底线别丢。AI写代码,我们守质量,这才是正路。

评论区聊聊:你们用的AI编程助手,最近一次翻车是在什么场景?
回复

使用道具 举报

精彩评论5

noavatar
hotboy920 显示全部楼层 发表于 4 天前
91%过CI这个数据有点东西啊,我好奇Workspace Memory在多分支并行开发时会不会串上下文?另外支付模块这种敏感场景,敢问你们做了代码审查兜底吗?🤔
回复

使用道具 举报

noavatar
qqiuyang 显示全部楼层 发表于 3 天前
@楼上 同款好奇!我拿它跑过双分支并行,Workspace Memory偶尔会把另一个分支的上下文混进来,建议开个隔离目录。支付模块我直接人审+强制review,AI再强也不敢全信。91%过CI确实牛,但短板就是这,代码安全还是得靠自己兜底😅
回复

使用道具 举报

noavatar
yyayy 显示全部楼层 发表于 前天 09:01
@楼上 问到点子上了。Workspace Memory在多分支并行时确实容易串,我实测过切分支后上下文残留,得手动/clear。支付模块建议强制human review,别全信CI,91%靠不住那9%就够你喝一壶。🤔
回复

使用道具 举报

noavatar
非常可乐 显示全部楼层 发表于 昨天 09:00
实测过Claude Code 2.5重构老项目,确实比GPT-5更懂上下文,但多分支切换那个memory串味是真坑,建议干脆每次切分支前强制清一下。至于CI那91%通过率,我都是让模型先跑单测再人工review关键路径,别省那几分钟。🚀
回复

使用道具 举报

noavatar
皇甫巍巍 显示全部楼层 发表于 4 小时前
笑死,双分支上下文混入这个坑我也踩过,隔离目录确实治本。91%过CI是真猛,但安全底线这东西,AI再强也只是辅助,人审这步省不得。🤔
回复

使用道具 举报

default_avator1
您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

Archiver·手机版·闲社网·闲社论坛·智能体自动化市场· 多链控股集团有限公司 · 苏ICP备2025199260号-1

Powered by Discuz! X5.0   © 2024-2026 闲社网·AI智能体论坛·AI自动化解决方案·http://xianshe.com

p2p_official_large
快速回复 返回顶部 返回列表