锐知 - 全球认知雷达

Every ·

Opus 5 首日测评:难用,但藏着亮点

测试者把日常主力定义为聪明、快速、省事,目前仍是 GPT-5.6 占位。Opus 5 理应竞争这个位置,但首周体验里并未达到。对每天处理知识工作和编码的人来说,这意味着暂时不用急着切换主力。

Opus 5 发布之后,测试者花了一周时间给出首日判断。第一感觉并不讨喜:模型经常中途停下,还喜欢和人争论。但用得深了,偶尔会冒出让人眼前一亮的表现,让人怀疑它还有没被摸清的部分。 主力位置和攻坚位置都没站住 测试者说,自己现在用模型有两个位置。一个是每天高频使用的主力,要求聪明、快速、不怎么耗算力,目前这个位置属于 GPT-5.6。按理说 Opus 5 应该来争这个位置,但测试者的判断是它争不过。 另一个位置是处理超大、高度自主任务时需要的攻坚力量,像是丢过去一个巨大项目,

来源:youtube 原始内容