关于国产大模型安全能力评估与跨网数据流动监控的探讨|总第319周

· 2026-08-19 08:00 · 6 阅读

原创 群秘 2026-08-19 08:00 北京

本期周报简介:

1、国产大模型阿图因在CyberGym安全测试中超越Mythos,金融行业能否落地应用?

2、跨网数据流动安全监控有哪些成熟的商业化方案?加密流量如何监测?

0x1本周话题

国产大模型阿图因在CyberGym安全测试中超越Mythos,金融行业能否落地应用?初步设计是内部复杂,接口简单。上传一个源码包或者二进制包,然后等报告。

《阿图因 AI 在 CyberGym 测试中超过了 Mythos,不过这只是拼图的一部分》

A1:目前阿图因AI 的 CyberGym 得分是 84.0%,比Mythos略高,测试中使用的模型是 GLM-5.1

我们也正在使用GLM-5.2 进行测试,期待能有更好的分数,看好glm。但这个做法,金融业用不了啊。

A2:对于代码不能出网的情况,其实只有私有化部署的能用。但这种东西,就算有人愿意出大价钱,我们也不敢卖私有化部署的。

金融业可以用来检查供应链,也可以用来检查发布的二进制程序,比如你们可以把招商证券APP丢进来。比如,文章中提到了我们在一些国密算法库里发现的高危漏洞。

金融业在打算选某个算法库的时候就可以先测一下。

A3:意思是不给私有化部署?如果不能卖私有化部署,有没有可能通过权力机关,这样至少大家有一个由头可以交代码出去验证。

A4:他们家的模型确实强,这个要承认的。我们如果基于他们的模型做,就不止这个分数了

A5:国外模型能力太强了,还闭塞,自己搞个玻璃翼自己补,补贴给他们关键单位自己挖掘自己补。他们这个玩法太可怕,教主这个厉害啊,得找机会给国内洗洗脑。

现在国外大概率已经用上fable对国内重点搞了。

A6:这个争取上升到国家战略层面,这样各单位不是私有化部署也可以有依据去扫关基代码。就是这个吗?

《中国第一,直逼OpenAI!神秘「扫地僧」冲到全球前七》

A7:明显不是,模型都不一样,一个minimax,一个glm。从名字和模型看,不是minimax就是阿里。

A8:根据最近的心得,仅仅发现漏洞爆出来还不够,最好顺手给出exploit工具。否则对齐各方认知是瓶颈。

A9:模型提高能力上限agent提高能力的下限 。模型能力我们改变不了,但是 agent 的能力可以改变。数据不能离开限制很大。就叫陶瓷翼计划。

A10:未来,现有的研发流程和相关保密制度都会被技术推着改变。现在正好处于一个交汇点,所以会有很多矛盾。

未来,人写的代码就一定有缺陷也许也能被改变。因为以后没有什么人写的代码。不太现实,之前想过这个,交流了几家最后就是流于形式了。

现在趋势,代码和英语、开车一样,从行业变成了技能。

A11:报道点名提到,蚂蚁金服曾向员工提供企业Claude 账号,员工通过公司内网访问,而该内网与其新加坡实体相连;字节跳动没有直接提供 Claude 访问,但今年推出报销方案,允许工程师将个人 Claude 订阅列入报销,相关工程师通过 VPN 使用。

FT称,这些做法本身不违反中美法律,但违反 Anthropic 的服务条款。 Anthropic 的态度很明确。

Anthropic称,禁止在未支持地区访问或协助访问Claude,其中包括中国;同时称自己是唯一限制向中国控制公司销售服务的前沿 AI 公司,即使相关子公司注册在中国境外,也在限制范围内。

Anthropic还表示,会与合作伙伴持续更新检测系统,识别并封禁违规账号植入后门的安全风险,有具体细节吗?

A12:最近在看aidr,问vendor能不能hook agent的关键行为并隔离高危行为,好像难度不小。

A13:差点要恍惚了如果联网用大模型的话,禁了国外是对的。但作为软件的cc我觉得没啥问题

A14:我用cc连我本地模型,cc不是大脑,能有哪些风险,如果做替换就被发现了cc客户端连远程服务器动态下发东西

A15cc这个也不算后门吧,就是他们自己利用请求报文、请求头、语言等信息,分析调用者的画像cc 有动态更新功能

A16:一直没关注到,我的CC 都是手动更新。要是来个大模型时代的硬盘锁,那的确是有点风险。

A17CC有点像现在的桌管、AV之类的客户端,或者国产手机,可以随时下发云控策略,就看你对这个的信任程度有多高。

话题:请问现在针对跨网数据流动安全监控有什么好的技术解决方案吗?主要用于监测单位互联网边界,及内网不同安全等级网络区域之间,有无敏感数据违规流动?

A1:是明文的吗?可以考虑做扎口包括加密流量。

A2:有数据流转监控的系统。

加密流量要解密就有难度了,如果用的加密套件比较新旁路都无法解密了。南向还好,北向比较难。需要网络侧的架构支持。

A3:比如说,你在我这个网内不管怎么流转都无所谓,不用去管东西南北,但是,如果要去外部单位,全都走A扎口,在A扎口记录,如果要去测试环境,全部走B扎口,不走扎口出不去。

跨网流动,先划网,先划大的,先把离开集团主体的高风险管住,再覆盖内部不同主体之间,最后考虑内部加密流量,那个都不一定算跨网。

A4:是的,我们目前就是这个思路,现在主要想了解市面上有没有比较成熟的商业化解决方案?

A5主要有这几个方面:

  • 与应用系统绑定的,基于切面的,数据流转监测;

  • 网络收口之后的,数据海关(其实就是数据流动网关);

  • 如果系统架构以WebAPI为主,过往的API安全网关或许也是一个方式。


0x2 群友分享

【法规解读】

国家金融监督管理总局发布《关于银行业保险业人工智能安全开发应用的指导意见》(简称《指导意见》)

《金发〔2026〕8 号重磅落地:32 条看清银保行业五年走向》

《关于银行业保险业人工智能安全开发应用的指导意见》发布

【安全资讯】

《(合集)美股上市公司巡礼——网络安全与云计算篇》


【金融业企业安全建设实践群】和【企业安全建设实践群】每周讨论的精华话题会同步在本公众号推送(每周)。根据话题整理的群周报完整版——每个话题甲方朋友们的展开讨论内容——每周会上传知识星球,方便大家查阅。

往期群周报:

OVTP范式下的权限管控、域名异常指向溯源与AI大模型告警研判探讨|总第318周

从“测漏洞”走向“管业务”:企业安全建设、资产测绘与零信任接入|总第317周

史诗级Linux漏洞来袭:从漏洞验证到数据泄露报警,安全团队如何应对?|总第316周


如何进群?

如何下载群周报完整版?

请见下图:

阅读原文

跳转微信打开