青蛙小白

Model Spec(模型规范)

Model Spec(模型规范) 是 OpenAI 公开的、描述模型应如何表现的行为规范文档。它不是一份内部提示词,而是 OpenAI 对技术(如通过提示工程与微调)转化为模型行为方式的目标声明,让模型的行为更可预测、更可控、也更透明。

结构

规范包含三类核心内容:

  • 目标(objectives):模型应帮助用户并积极避免伤害,平衡直接有帮助的回应与不应有伤害的行为。
  • 规则(rules):分两层——基本原则(general principles)(如不做伤害、不违背人类善意、尊重法律)与行为准则(guidelines)(更具体、可操作,比重更大的部分);每一条规则同时说明它针对的特权等级与冲突时的优先级。
  • 默认行为(default behaviors):未显式要求时模型应采取的默认倾向。

规格还明确了当规范内部冲突时如何处理,例如「遵守合法开发者请求」与「不提供安全危害信息」之间的取舍,并概述了开发者在命令行、代码与人机界面等不同场景下的可定制程度。

更新与迭代

OpenAI 将 Model Spec 视为一份活文档,在引入新的产品领域或社会关切时持续更新。例如:2025 年发布后随产品演进调整;并针对青少年安全纳入 under-18 原则(未成年人保护原则),规定模型在面向青少年用户时如何降低敏感内容暴露、并在困扰时刻回应——这与 OpenAI 围绕青少年 AI 安全的一整套机制一脉相承(见下节),也与公开透明的 System Card(系统卡) 一起构成 OpenAI 安全透明实践的组成部分。

青少年安全与心理健康(under-18 原则的应用)

Model Spec 的 under-18 原则,是 OpenAI 更广的「青少年安全」(teen safety)工作的组成部分。其核心立场是:AI 应增强——而非取代——青少年依赖的现实人际关系与照护。配套机制包括:

  • 年龄预测(age prediction)模型:判断账户用户是否可能未满 18 岁,从而匹配相应的体验与防护,而非只依赖注册时自报的年龄。
  • 心理健康兜底:与 260+ 位心理健康专家合作,帮助 ChatGPT 识别困扰信号、以关怀回应,并把用户导向现实世界支持;扩展本地化危机资源与一键热线(one-click hotline)、加入休息提醒。
  • 家长控制:家长控制、在安全顾虑时通知家长等面向更年轻用户的额外保护。

2026 年,OpenAI 与美国心理学会(APA,美国心理学会)围绕青少年负责任使用 AI 启动合作,重点包括困扰时刻的支持、适龄(developmental)设计与赋能照护者/从业者,并以人类行为科学与照护者、教师、青少年的亲身经验为根基。

相关概念

参考来源
  1. 1. https://model-spec.openai.com/
  2. 2. https://openai.com/zh-Hans-CN/index/updating-model-spec-with-teen-protections/
  3. 3. https://openai.com/index/openai-and-apa-partner-to-advance-responsible-ai
  4. 4. https://openai.com/zh-Hans-CN/index/introducing-the-teen-safety-blueprint/
  5. 5. https://openai.com/zh-Hans-CN/index/our-approach-to-age-prediction/
评论