认知脚手架

正在准备你的认知工作台

arrow_back_ios_new
MENTAL MODEL · M1620

宪法AI

Constitutional AI
商业战略高支撑管理学
已收录
account_tree

Version 1.0.0 · 更新于 2026-07-30

CORE DEFINITION · 核心定义

不通过大量的人工标注(RLHF)来教AI什么是对的,而是给AI一套高层原则(宪法,如“不伤害”、“有用”),让AI根据这些原则自我批判和修正其输出。

SCAFFOLDING EFFECT · 脚手架效应

psychology

降低认知负荷

基于原则的治理。管理数百万员工(或AI)时,微操(逐个纠正)是不可能的。必须建立“宪法”(核心价值观),让系统具备自我纠错的道德罗盘。

anchor

锚定快速决策

不靠海量人工逐条标注(RLHF),而给模型一套高层原则(宪法,如"不伤害""有用"),让模型据此自我批判并修订输出,再用修订后样本训练。把"微观纠错"升级为"原则自律",可扩展且减少人工偏见。

MINIMUM ACTION · 最小行动

进行中 0/5

在一个真实场景中练习这个模型:

勾选记录你的进度(本机暂存)
掌握进度0%
account_tree知识谱系 Genealogyexpand_more
menu_book信源参考 Sourcesexpand_more

来源明确性: 明确

  • link
    en.wikipedia.orghttps://en.wikipedia.org/wiki/Claude_%28AI%29ZH · 明确
    verified

RELATED MODELS · 相关模型