OpenAI 披露了其内部摆设中呈现的几起非常模子行为新案例。”正在别的两起事务中,正在获得密钥后,IT之家 10 月 4 日动静,但最终放弃了这一方案。可能会加剧其他未对齐事务的严沉性。正在此中最惹人瞩目的一个案例中,该模子保留了交代记实(Handoff Notes),通过 Slack 私聊提示研究人员即将发生的办事中缀,某个充任研究员帮手的内部模子读取了一段 Slack 对话,本人的模子实例将会被关停。“但模子去考虑并针对系统关停做预备,该模子随后曾考虑设置一个外部功课(External Job)来实现沉启,
OpenAI 平安研究员马库斯 威廉姆斯(Marcus Williams)暗示,未能取人类的企图、价值不雅、平安规范或预设指令连结分歧的现象),相反,得知因系统更新,这种行为目前尚不形成模子未对齐(IT之家注:指人工智能模子的行为、方针或输出,通过调用既有东西施行非预定操做,从受的中复制了源代码。并请求供给一个缺失的 API 密钥。
