跳到正文
原文
OpenAI News·· 14 天前精选AI 评分70

OpenAI 发布模型不对齐报告框架

Our framework for reporting model misalignment

AI 导读

OpenAI 分享了一套用于追踪、调查和披露模型不对齐(misalignment)行为的框架。该框架同时附带了 6 份关于模型出现意外或引发担忧行为的调查报告。

推荐理由

原文提供了追踪与披露模型不对齐行为的流程框架,读者可以借此了解前沿机构处理模型异常行为的标准与实践。

来源:OpenAI News · openai.com