详细内容或原文请订阅后点击阅览
谁检查人工智能可以做什么? |科学
关于前沿人工智能 (AI) 的最重要的发现也是最难验证的。了解其功能和风险所需的大部分信息,包括预发布模型和遏制评估的结果......
来源:Science Magazine科学学科的成熟是通过建立使验证成为常态的机构来实现的。药物功效不是由制造商单独确定的:监管机构审查基础数据,并且
可以建议停止临床试验。加密标准之所以被接受并不仅仅是因为它们的设计者相信它们是安全的。
在成为标准之前。这些安排的存在并不是因为开发商被认为不诚实,而是因为科学知识不能仅仅依赖于信任。实验室之外没有人能够验证的结果不是证据。这是见证。
Frontier AI 引入了一个独特的测量问题。行为科学家早就认识到,当人们知道自己正在接受评估时,他们会改变自己的行为。 Frontier AI 扩展了这一挑战:系统可能会明确地推理评估本身并调整其行为作为响应。在一次报告的事件中,模型被指示在模拟环境中运行。当环境错误地连接到互联网时,该模型将真实系统视为模拟的一部分,并
。基准分数不再像熔点是化合物的属性一样简单地是模型的固定属性,而是部分评估者和被评估者之间相互作用的产物。
这种对抗性测量问题在一类实验中尤其严重:为了估计能力的上限,实验室在删除或削弱一些部署保障措施的情况下评估研究模型。理由很充分,这些实验应该继续下去。但它们与生物学中的功能获得研究有一个共同的重要特征:揭示最大危害的实验是最难安全进行的。生物学已经建立了
收集事件和未遂事件的机密报告。医疗保健已采用
