Anthropic推出新模型Claude Sonnet 4.5,定价与4代相同($3/百万输入token,$15/百万输出token),在SWE-bench Verified与OSWorld等基准显著提升,可连续执行超30小时复杂任务。同步发布Claude Agent SDK、Claude Code检查点回滚、VS Code原生扩展,以及API的上下文编辑与记忆工具,面向工程与智能体构建场景。
Anthropic推出新模型Claude Sonnet 4.5,定价与4代相同($3/百万输入token,$15/百万输出token),在SWE-bench Verified与OSWorld等基准显著提升,可连续执行超30小时复杂任务。同步发布Claude Agent SDK、Claude Code检查点回滚、VS Code原生扩展,以及API的上下文编辑与记忆工具,面向工程与智能体构建场景。
测试了,差距不大。写前端依旧蠢,后端复杂的bug找不到root cause,只适合写小东西和简单bug
感觉codex不错
昨天用了下都差不多
@小元大哥哥 #2 这个网上也有人比较,大部分评价都是说claude code好
提升并不大
码农仔失业的边缘挣扎
挤牙膏更新,可能只是为了跟进对手