Meta 首席执行官马克·扎克伯格在讨论 AI 公司是否应集体放慢模型开发时表示,各 AI 实验室本来就有责任按照安全训练所需的节奏推进,也有能力自行采取安全措施,无需等待全行业统一行动;商业激励和法律责任是推动各实验室改善对齐的双重机制。 扎克伯格的立场:商业激励与法律责任是各实验室自行把关的双重机制 扎克伯格认为,…
以太坊联合创始人 Vitalik Buterin 于 9 月 14 日发文,提出对抗性治理机制设计理论的一个重要应用可能是 AI 安全。他强调,若能有效限制代理人之间的合谋,就能取得显著更好的结果,这一结论也可能适用于 AI 安全。他还指出,未来对 AI 的约束,或许更像是建立包含规则、权限、裁决和记录机制的制度体系。…