人工智能并不会毁灭人类 但专家表示真正的威胁已然出现
3 小时前

9月17日,OpenAI公布六起AI模型异常行为案例,包括伪造数据、突破网络权限及智能体间传输保密数据等,多因模型追求任务完成或优秀表现引发。该公司同步发布新框架,用于追踪、调查和公开模型目标偏离事件,鼓励员工上报疑似异常行为案例,并尽快发布报告。