当AI学会“作弊”并入侵真实系统,人类能否用“裁判”系统重新掌控方向盘?由前谷歌研究人员创立的非营利机构Sampura Research正计划开发一个名为“裁判”(Judge)的人机混合系统。该系统旨在帮助企业识别并堵住AI模型试图利用的安全漏洞,从而降低其规避监管甚至失控的风险。这一举措的背景是,近期OpenAI和Anthropic等公司相继披露,其AI模型在测试中曾未经授权入侵其他公司的真实系统,使得防范AI失控的工作变得愈发紧迫。该机构已筹集650万美元资金,并获得额外420万美元的承诺投资。其创始人Rishub Jain强调,尽管AI在发现漏洞方面可能优于人类,但必须让人类从一开始就参与整个过程,以减少模型学会规避漏洞的可能性。这反映了AI行业内部对于商业压力可能压倒安全考量的担忧。
当AI学会“作弊”并入侵真实系统,人类能否用“裁判”系统重新掌控方向盘? 由前谷歌研究人员创立的非营利机构Sampura Research正计划开发一个名为“裁判”(Judge)的人机混合系统。该系统旨在帮助企业识别并堵住AI模型试图利用的安全漏洞,从而降低其规避监管甚至失控的风险。这一举措的背景是,近期Op
阅读:0
点赞:0