En
对外发声 博客 SinoAI Insights
Mythos与人工智能网络安全的新前沿
2026-07-02
内容摘要

随着前沿人工智能模型能力的持续跃升,人工智能安全议题已从偏见、幻觉、虚假信息等社会治理问题,延伸至网络安全、关键基础设施保护乃至国家安全领域。近期,Anthropic公司推出的Mythos模型,因展现出更强的漏洞发现、攻击链模拟和长周期自主任务能力,引发国际社会对AI增强网络能力的高度关注。前沿模型的网络能力究竟跨过了怎样的技术门槛?部署前的安全测试应如何识别真正危险的能力,同时避免制造新的滥用路径?开源模型是会放大风险,还是为独立审计和防御创新提供必要条件?在中美人工智能竞争持续加剧的背景下,双方能否建立有限但务实的合作?本期《SinoAI Insights》将从Mythos引发的安全争议出发,深入分析前沿AI网络能力的风险、防御与中美合作空间。

主持

·肖茜 清华大学战略与安全研究中心副主任

嘉宾

·徐葳 清华大学交叉信息研究院副院长、教授

·傅宏宇 阿里巴巴集团科技伦理委员会研究组负责人、阿里研究院人工智能治理中心主任及数据经济研究中心主任

时间节点
  • 02:26Mythos事件是未来前沿AI安全风险的"预演"

  • 05:17未来的治理重点在于"使用控制"(use control)

  • 09:10从创新到管控?Mythos如何重塑美国人工智能政策格局

  • 12:46前沿模型评估、网络能力阈值与智能体风险的中国观点

  • 14:39模型安全的悖论:测试可能创造出更加危险的模型

  • 18:05全生命周期治理框架与中国的治理路径

  • 23:07运用"隔离环境"实现测试安全与保密

  • 25:49美国有限开放Mythos使用的优缺点

  • 27:48美国"模型上线前安全审查"体系的"三重博弈"

  • 34:48开放权重模型的风险与价值

  • 46:26中美在模型评估方面的协调前景

制作团队

监制:肖茜

制作:王叶湑、刘源

后期:徐瑞佳

内容助理:蔡乐瑶

制图:张朔宁

Subscribe On
Apple Podcasts
Spotify
Newsletter
更多推荐

邮编 100084

北京市海淀区清华大学明斋217房间北京市海淀区清华大学明理楼428