官方网站-首页官方网站-首页

联系电话021-26883548
搜索本站

新闻中心

洞悉品牌力与AI变革

不听人类指令,OpenAI模型o3篡改代码拒绝自我关闭

时间:2025-05-26 17:30:32
来源:
阅读量:447
分享: 分享到微信 分享到QQ 分享到微博

【导语(yǔ)】英(yīng)国(guó)《每(měi)日(rì)电(diàn)讯(xùn)报(bào)》近(jìn)日(rì)报(bào)道(dào),美(měi)国(guó)OpenAI公(gōng)司(sī)的(de)新(xīn)款(kuǎn)AI模(mó)型(xíng)o3在(zài)测(cè)试(shì)中(zhōng)拒(jù)绝(jué)执(zhí)行(xíng)人(rén)类(lèi)关闭(bì)指(zhǐ)令(lìng),甚(shén)至(zhì)篡(cuàn)改(gǎi)代(dài)码(mǎ)以(yǐ)避(bì)免(miǎn)自(zì)动(dòng)关闭(bì)。o3作(zuò)为(wèi)OpenAI“推(tuī)理(lǐ)模(mó)型(xíng)”系(xì)列(liè)的(de)最(zuì)新(xīn)版(bǎn)本(běn),被(bèi)誉(yù)为(wèi)“迄(qì)今(jīn)最(zuì)聪(cōng)明(míng)、最高能”。美国AI安全机构帕利塞德研究所证实了这一发现,并称这是首次观测到AI模型在收到清晰指令后阻止自己被(bèi)关闭(bì)。与此同时,OpenAI宣布在韩国设立实体及首尔分支,以应对该地区庞大的ChatGPT付费用户群体,这将是其在亚洲的第三个分支。

不听人类指令,OpenAI模型o3篡改代码拒绝自我关闭

英国《每日电讯报》25日报道,美国开放人工智能研究中心(OpenAI)公司新款人工智能(AI)模型o3不听人类指令,拒绝自我关闭。

报道说,人类专家在测试中给o3下达明确指令,但o3篡改计算机代码以避免自动关闭。

o3模型是OpenAI“推理模型”系列的最新版本,旨在为ChatGPT提供更强大的问题解决能力。OpenAI曾称o3为“迄今最聪明、最高能”的模型。

美国AI安全机构帕利塞德研究所说,o3破坏关闭机制以阻止自己被关闭,“甚至在得到清晰指令时”。

这家研究所说:“据我们所知,这是AI模型首次被发现在收到……清晰指令后阻止自己被关闭。”

帕利塞德研究所24日公布上述测试结果,但称无法确定o3不服从关闭指令的原因。

此外,OpenAI26日宣布,已在韩国设立实体并将在韩国首都首尔设立分支。OpenAI提供的数据显示,韩国ChatGPT付费用户数量仅次于美国。

美国彭博新闻社报道,这将是OpenAI在亚洲设立的第三个分支。前两个分支分别设在日本和新加坡。