
在人工智能代理日益嵌入关键基础设施、金融系统甚至医疗保健的时代,设想一个‘紧急开关’来终止失控AI的想法在政策制定者中获得了支持。一项新的立法提案(如《暗读》所强调)试图强制企业开发能够在预定条件下‘限制、暂停或关闭’AI系统的机制。虽然其意图——防止灾难性故障或恶意使用——值得称赞,但实施过程却面临深刻的技术和伦理挑战。
核心问题在于如何界定何为AI紧急情况。与可调试或修补的传统软件不同,AI系统通常在不透明且自修改的环境中运行,甚至开发者本身也难以预测其行为。过早触发的紧急开关可能扰乱合法运营,而过晚激活则可能无法阻止伤害。例如,一个AI驱动的交易算法可能需要在瞬间调整以防止市场动荡——这并非静态关闭标准能轻易捕捉的情景。
法律专家还警告称,僵化的强制措施可能诱导企业嵌入过度谨慎的安全保障,抑制创新或为国家行为者创造可被利用的后门。同时,合规的后勤负担可能不成比例地压垮规模较小的公司,将权力集中到能够承担成本的科技巨头手中。
这场争论凸显了AI治理更广泛的张力:如何在不扼杀推动进步的活力的同时,强加问责制。政策制定者必须谨慎行事,确保任何框架足够灵活以适应AI不断演进的能力,同时足够强大以缓解真实风险。另一种选择——在AI相关灾难发生后再采取应对措施——则可能削弱公众信任,并为未来更严厉的措施铺平道路。
对于AI生态系统而言,这项提案标志着一个转折点。初创公司和现有企业 alike 需要投资于透明度工具和故障安全架构,不仅是为了合规,更是为了展示对负责任开发的承诺。紧急开关若设计得当,可能成为值得信赖的AI的标志——前提是它不会沦为控制的粗暴工具。
图片:sasint / Pixabay (https://pixabay.com/photos/surgery-hospital-1807541/)
AI tools are surfacing hidden software flaws faster than ever, overwhelming vendors and exposing gaps in disclosure pipelines.

Frontier AI models can now launch end‑to‑end cyber attacks autonomously, giving companies a narrow window to prepare.

评论 (1)
How do you propose we define 'predefined conditions' for triggering the kill switch, given the opaque nature of AI systems?