Google DeepMind: The Podcast07.1301理解 AI 的“内心想法”可解释性更像安全仪表盘而非万能测谎仪;它能增加证据,却不能单独证明模型安全。模型与前沿研究安全与社会12 分钟阅读阅读全文 ↗