Claude Opus 5.5 擅长制作讲解视频
Claude Opus 5.5 本周发布后获得积极评价,凭借讲解视频表现迅速成为社交平台讨论焦点。它在 SimpleBench 取得 88.4%,并被评价为 Anthropic 迄今最佳视觉模型;视觉表现优于 Fable 5 和 GPT-6 Sol,但不及 GPT-6 Astra。
Claude Opus 5.5 本周发布后获得积极评价,凭借讲解视频表现迅速成为社交平台讨论焦点。它在 SimpleBench 取得 88.4%,并被评价为 Anthropic 迄今最佳视觉模型;视觉表现优于 Fable 5 和 GPT-6 Sol,但不及 GPT-6 Astra。
GPT-6 Astra 完成一份包含 50 个工作表标签页(tab)的税务工作簿的速度比 GPT-5.6 Sol 快 2 倍。该模型具备更强的用户意图理解能力,让 Basis 在实际业务场景的使用中更具信心。
Anthropic 与 OpenAI 分别推出 Claude Opus 5.5 以及 GPT-6 Sol 和 Luna,带动前沿与高性价比模型迎来大幅降价。GPT-6 系列定价相比 GPT-5.6 对标型号直接减半,Opus 5.5 定价降低 20% 且缓存读取价格下调 60%。
推荐理由:原文对比了新一代模型的定价降幅与实测表现,并指出 Opus 5.5 在极高思考配置下可能因推理过长触发输出上限。
Microsoft Research 发布 Skala-1.1,并扩大 Skala 在计算化学软件中的可用范围。Skala-1.1 使用比首个公开版本多 2.5 倍的数据训练,在 GMTKN55 的 55 个类别中有 32 个排名第一,加权平均误差为 2.8 kcal/mol。