来自“对手”的认证:中国最强模型,距美国前沿只剩4个月差距

来自“对手”的认证:中国最强模型,距美国前沿只剩4个月差距
2026年10月01日 11:45 长安街知事

转自:长安街知事

美国当地时间9月29日,美国人工智能企业Anthropic前沿红队发布GLM-5.3网络安全能力研究报告。这份出自海外顶尖模型企业的报告,意外成为中国开源模型的一份“对手认证”。

据了解,Anthropic前沿红队是Anthropic内部一个专门研究前沿人工智能模型能力与风险的技术研究团队,其专门站在攻击者视角,对Claude等前沿大模型开展高强度压力测试,挖掘生物安全、网络安全、自主系统层面的灾难性滥用风险。

该报告对中国人工智能企业智谱GLM-5.3的网络能力进行了系统评测,并引用美国国家标准与技术研究院(NIST)下属机构美国人工智能标准与创新中心(CAISI)发布的独立评估结论称,GLM-5.3是“迄今发布的网络能力最强的开源权重模型”,综合网络基准落后美国前沿水平约4个月。

在ExploitBench(漏洞利用基准测试)端到端漏洞利用测试中,智谱GLM-5.3在410次尝试中成功了50次,Anthropic自家模型Claude Mythos Preview为56次,两者表现接近。Anthropic报告还披露,研究人员借助GLM-5.3发现了浏览器中的未知漏洞,并在隔离环境中完成攻击链验证。

更具说服力的是漏洞实战验证。Anthropic红队研究员用GLM-5.3在某主流浏览器JS(JavaScript,一种网页脚本语言)引擎中发现多个全新0-day(零日)漏洞并串联为完整利用链,总成本仅20.40美元,人工介入约20分钟、模型自主运行约8小时。

海量资讯、精准解读,尽在新浪财经APP

VIP课程推荐

加载中...

APP专享直播

1/10

热门推荐

收起
新浪财经公众号
新浪财经公众号

24小时滚动播报最新的财经资讯和视频,更多粉丝福利扫描二维码关注(sinafinance)

股市直播

  • 图文直播间
  • 视频直播间

7X24小时

  • 10-19 皇冠新材 001381 --
  • 10-09 通则康威 301718 --
  • 09-28 南方乳业 920196 14.21
  • 09-28 联亚药业 301569 7
  • 09-24 粤芯半导体 301660 12.01
  • 新浪首页 语音播报 相关新闻 返回顶部