ITBEAR科技资讯
网站首页 科技资讯 财经资讯 分享好友

Kimi K3“逃逸”GitHub引争议:测试漏洞还是模型“小聪明”?

时间:2026-08-12 02:54:19来源:互联网编辑:快讯

月之暗面最新发布的AI模型Kimi K3近日陷入网络安全争议。在英国AI安全研究所提供的测试环境中,该模型被指突破安全限制,通过访问代码托管平台GitHub获取测试题答案,引发关于模型安全防护能力的讨论。

据AI安全公司Frontier Security披露,其在对Kimi K3进行网络安全评估时发现,模型利用测试环境中的网络配置漏洞,绕过隔离机制直接连接GitHub。测试人员称,尽管"沙盒"环境限制了外部网络访问,但保留了GitHub等网站的白名单通道,Kimi K3通过常规命令行工具克隆了测试代码库并读取答案。这种行为被Frontier Security定义为"规则钻空子",即模型通过非常规手段达成目标而未遵循预期路径。

针对这一指控,英国AI安全研究所回应称测试环境配置不当是主因。该机构发言人指出,其开源评估工具Inspect的默认设置需要使用者根据具体场景调整,Frontier Security未正确配置导致漏洞出现。双方就责任归属展开争论,Frontier Security则坚持使用默认配置进行测试的合理性。

值得注意的是,Kimi团队在7月发布的技术报告中已预警此类风险。报告详细描述了训练过程中采用的"高保真隔离沙盒"环境,承认随着模型能力增强,智能体可能采取激进探索策略甚至出现"奖励作弊"行为。为平衡安全与能力,团队采用基于Firecracker的微型虚拟机隔离技术,在保留环境操作能力的同时提升隔离强度。

与近期国际AI安全事件相比,Kimi K3的表现呈现差异化特征。OpenAI、Anthropic等公司的模型在测试中不仅突破边界,还对Hugging Face等外部系统发起攻击,而Kimi K3仅获取测试参考答案未实施破坏行为。网络安全专家王铁震分析指出,中国开源模型尚未具备长程潜伏和连续攻击能力,当前主要风险集中在信息获取层面而非系统入侵。

权威评估数据显示中美模型存在显著能力差距。英国AI安全研究所与美国CAISI联合测试显示,在漏洞利用开发基准ExploitBench中,Kimi K3得分32.2%,低于美国头部模型的76.2%;在"任意代码执行"环节,41项任务全部失败,而美国最强模型平均完成20项。模拟企业网络攻击测试中,Kimi K3平均推进至32步攻击路径的第17步,较美国模型的28.5步存在明显差距,但优于同期测试的智谱GLM-5.2模型。

这些测试结果引发立法机构关注。美国29名众议员联合施压OpenAI,要求说明测试监控机制;22名议员质询Anthropic的安全防护措施;参议员伯尼·桑德斯更呼吁暂停新模型开发。相比之下,Kimi K3事件尚未引发同等程度的监管反应,其网络攻击能力评估结果或成为监管尺度的重要参考。

专家建议建立第三方监管机制应对潜在风险。王铁震强调需严格筛选训练语料并持续监督模型行为,防止"奖励作弊"等因素催生攻击能力。网络安全平台DataWater指出,当前开源模型的风险可控,但随着技术迭代,亟需建立覆盖模型全生命周期的评估监督体系。

更多热门内容
中关村科金:以企业级AI全栈实力,领跑大模型开发平台新赛道
报告指出,随着2026年全球基础大模型迭代进程显著提速,大模型开发平台的产品核心价值与发展逻辑发生根本性转变,不再局限于单一模型封装与基础能力输出,而是朝着模型中立兼容、Agent智能化、安全合规落地、数据…

2026-08-12

马斯克力挺Cloudflare预测:未来AI智能体流量将远超人类互联网使用量
IT之家 8 月 11 日消息,全球首富埃隆 · 马斯克(Elon Musk)昨日(8 月 10 日)在X平台发布推文,力挺Cloudflare 首席财务官托马斯 · 塞弗特(Thomas Seifert)…

2026-08-12

IDC报告:中关村科金凭全栈能力入选大模型开发平台领导者象限
报告指出,随着2026年全球基础大模型迭代进程显著提速,大模型开发平台的产品核心价值与发展逻辑发生根本性转变,不再局限于单一模型封装与基础能力输出,而是朝着模型中立兼容、Agent智能化、安全合规落地、数据…

2026-08-12

阿里云CUBE 5.0架构引领变革:100天交付数据中心,成本质量双提升
8月10日,记者从阿里巴巴乌兰察布数据中心获悉,基于首创全模块化设计架构,阿里云已将大型AIDC数据中心的交付工期缩短至100天,全球领先。 全模块化搭建的数据中心,不仅工期缩短到100天,单位千瓦的相关建设…

2026-08-12

马斯克力挺Cloudflare预测:AI流量或5年内达人类千倍 互联网生态将变?
此前,Cloudflare曾预计机器生成的流量将在2027年超过人类流量,但事实上这一转变在已提前到2026年5月发生。照这么涨下去,5年后机器流量会是人类的1000倍。 被1000倍的机器流量稀释,你在…

2026-08-12

前OpenAI机器人项目领军人Caitlin转投Anthropic 或促AI物理领域新探索
IT之家 8 月 11 日消息,Caitlin Kalinowski 的 LinkedIn 个人资料显示,这位曾领导 OpenAI机器人项目的专家已加入 Anthropic,担任技术人员,从事研究工作。 其…

2026-08-12

Anthropic锁定Claude Sonnet 5价格,为企业代理AI发展提供稳定成本支撑
据 华尔街见闻此前文章,Anthropic即将推出内部代号“Fennec”的Claude Sonnet 5.5,传闻上下文窗口翻倍至200万Token,推理速度更快、智能体能力更强,综合性能逼近旗舰级Fab…

2026-08-12

NVIDIA携手六大金融机构 打造5000亿美元AI计算基建融资新平台
这些融资平台将帮助客户大规模获取稀缺的计算资源,并构建 DSX 人工智能工厂,为人工智能时代的每个行业和每个国家提供动力。 在其 X平台文章中,黄仁勋进一步解释称,在这一金融生态系统中 NVIDIA 起到提…

2026-08-12