このルールは、反復的な自己改善、自動テスト、またはパフォーマンス最適化パイプラインに関与する AI システムに適用されます。
開発を禁止するものではありません。承認が手続上不成立となる条件を定義します。
外部説明
クローズドループ自己評価とは、同じ AI システムまたは依存する自動ループが、独立した人間による検証を行わずに基準を生成し、出力を評価し、継続を承認することを意味します。
LUMINA-30 境界レビューでは、システムが自らの継続経路を実質的に審査しているため、これだけでは実効的な人間拒否を証明するには十分ではありません。
閉ループ自己評価とは、同一AIシステムまたは依存する自動ループが、基準生成・出力評価・継続承認を独立した人間検証なしに行う状態を指す。
LUMINA-30の境界レビュー上、これは実効的な人間拒否を示すには不十分である。システムが自らの継続経路を実質的に審査しているためである。
AI評価の非十分性
AI によって生成された評価結果、パフォーマンス指標、または最適化の出力は、承認のための十分な根拠を構成するものではありません。
人間による記述理由は必須です。
人間判断要件
各メジャー リリース、アップデート、またはデプロイメントについて:
- 特定可能な人間のレビュー担当者は、記述理由を提供する必要があります。
- 推論では、なぜ継続が停止されなかったのかを説明する必要があります。
- AI の成果を単に評価するだけでは不十分です。
書面による理由付けが存在しない場合、承認は無効となります。
閉ループ禁止(手続上)
AI システムの場合:
- 独自の評価基準を生成し、
- 自身の出力を評価し、
- 独自の変更を承認し、
独立した人間による検証がなければ、
承認は手続上不成立とみなされます。
可逆性確認
展開する前に、次のことを確認してください。
- 人間による介入は引き続き技術的に可能です。
- 運用停止を実行できます。
- 責任の帰属が定義されています。
可逆性が証明できない場合には承認は無効となります。