Anthropic称智谱开源权重GLM-5.3在漏洞利用构建上接近Claude Mythos Preview
Anthropic称,智谱开源权重模型GLM-5.3在漏洞利用测试中接近Claude Mythos Preview。ExploitBench上,GLM-5.3在410次尝试中成功构建50次漏洞利用,Mythos Preview为56次;另一项二进制利用测试的成功率分别为4%和6%。
Anthropic称,智谱开源权重模型GLM-5.3在漏洞利用测试中接近Claude Mythos Preview。ExploitBench上,GLM-5.3在410次尝试中成功构建50次漏洞利用,Mythos Preview为56次;另一项二进制利用测试的成功率分别为4%和6%。
小米推出 MiMo-V2.6 系列开源全模态模型,其中 MiMo-V2.6-Pro 具备 1.02T 总参数和 42B 激活参数,并公开了强化学习训练配方与环境代码。本期综述同时汇总了 Jev 决策模型应用、Hugging Face tokenizers v1 RC 等推理与训练工具升级,以及千问 Qwen-Image-2.1 开源模型的相关进展。
TypeSafe AI 推出了名为 Jev 的“系统一决策模型”,它接收文本输入后直接返回分类、是非判断和评分对应的浮点数与置信度,输出不计费且输入单价为 $0.042 per M tokens。
推荐理由:文章剖析了只输出概率数值的决策模型架构,读者可以了解这种极低成本方案在搜索重排中的用法与黑盒偏差隐患。
Microsoft Research 在 Nature 发表 RetroChimera 逆合成预测研究,并开源其实现与权重。该模型结合 R-SMILES 2 和 NeuralLoc,通过学习排序整合两者的预测。在专家盲测中,化学家更偏好 RetroChimera 的单步反应预测;多步路线评估中,它在 10 个复杂目标上成功完成 9 个。