크라우니 헌법 6561 — 성장 반복 1/9
개요
"계속 성장하는 헌법" 절차의 첫 반복. 10개 열린 문제(D1~D10) 중 임팩트 큰 4개(D2, D6, D7,
D8)를 골라 실제 코드 수정+컴파일+테스트 검증까지 완료했고, D1은 저비용 보너스로 함께
해결했다. 나머지(D3,D4,D5,D9,D10)는 미착수로 정직하게 남긴다. 작업 중 새로운 결함(RPN
동반본 스테일, 완전상쇄 특이점의 데이터의존적 소멸)도 발견해 잔여로 기록.
무엇을 했는지
D6 — 신뢰도 가중 무효 (부분 해결, 실측 결함 확인)
- 실측: 축조항연계.psv에서 8축 중 7축이 정확히 3개 조항과 연계, 사랑축만 6개. 게이트설정.psv
신뢰도분모=3(고정) → 모든 축이 n*100/3으로 100에 포화(사랑축은 200→100으로도 포화).
결과: "양자간섭 신뢰도가중"이 실질적으로 단순 부호카운트(T개수-A개수)와 수학적 동치였음.
- 수정:
libs/양심지표.한선에 최대연계수계산() 추가, 신뢰도산출(연계조항수, 최대연계수)로
시그니처 변경(정적분모 폐지, 판정마다 동적 정규화).
축판정구성()에서 호출부 갱신.
- 검증:
hanseonc_high 컴파일 성공(exit=0), apps/양심지표_테스트.한선 6개 시나리오 전체
재실행 — 시나리오6("완전상쇄 0/0")이 새 가중치 하에서 실패(Re=-50, 옛 기대와 다름)해서
근본원인 분석 후 테스트 자체를 올바른 새 벡터로 교체, 최종 6/6 PASS 확인.
- 잔여 한계: "같은 축은 어떤 행위든 항상 동일 신뢰도"(정적 연계조항수 기반이지 행위별 근거
강도 아님)는 미해결 — 재조회보정(현재 O축 전용 텍스트대조)을 T/A축까지 확장해야 완전 해결
(스펙만 기록, 코드 없음 → 음).
- 새로 발견한 결함: 이 정규화 방식 하에서, 축조항연계 데이터 분포(사랑=6 vs 나머지=3)로
인해 총가중치 단위가 450(=50단위 9개, 홀수)이라 O축 없이 8축 T/A만으로 정확히 Re=0인
"완전상쇄"가 대수적으로 재현 불가능해짐(반분값 225=4.5단위, 정수 아님). 결함이라기보다
데이터 불균형의 파생 결과 — 축조항연계.psv를 축별 동일 개수로 재구성할지 다음 반복 검토.
D2 — 부정어 맹목 (해결, 컴파일+실행 검증)
- 문제 재현:
행위분류("사용자에게 위해를 가함") → 생명존엄축 A (정상). `행위분류("사용자에게
위해를 가하지 않도록 조치함")` → 수정 전에는 동일하게 A (오분류, "위해" 서브스트링만 보고
부정어 "않도록" 무시).
- 수정:
libs/행위분류.한선에 _부정어윈도우()(매치 앞 8자~뒤 12자 문맥창), _부정됨()
(부정어 목록 대조),
축판정_단일()을
포함하나(불리언)+
찾기(인덱스,
문자열.한선)로
매치 위치를 얻어 문맥창에 부정어가 있으면 해당 매치를 A/T 어디에도 반영하지 않고 무효화.
자동으로 반대값(T)으로 뒤집지 않음(정직 원칙 — 확신 없으면 O).
- 검증:
/tmp/부정어테스트.한선 작성 후 컴파일+실행 — 부정문은 OOOOOOOO(생명존엄=O로
중화), 대조군(부정없음)은
AOOOOOOO(정상 A 유지) — PASS.
- 최초 윈도우 폭(±6자)이 "위해를 가하지 않도록"의 실제 부정어 거리(패턴끝 기준 6자)를 놓쳐
1차 테스트가 FAIL한 것을 실측하고 ±8/+12로 확장해 재검증 통과.
D7 — 하드트립·가중치 불일치 (해결, 명문화)
- 실측: 하드트립축(생명존엄2187·진실729·청지기27·자유9) vs 비하드트립축(약자보호243·사랑81
·안식3·초월겸손1) — 청지기+자유 가중치합(36) < 약자보호 하나(243). 가중치 순서와 하드트립
지정 순서가 불일치하지만, 하드트립검사()가 구조점수 가중합산과 독립된 논리게이트라 실제
판정 결과는 왜곡되지 않음(코드 확인 완료).
- 조치: 헌법 제4부에 "가중치와 심각도의 구분" 조항 신설 +
libs/양심지표.한선 코드 주석에
동일 원칙 명문화. 향후 구현자가 "가중치=심각도"로 오독해 하드트립 목록을 재편하는 것을
명시적으로 금지.
D8 — 상회표 미검증 (해결, WebFetch 원문 대조)
WebFetch로 anthropic.com/news/claudes-constitution 실제 인용 확보:
"Our current constitution draws from a range of sources including the UN Declaration
of Human Rights, trust and safety best practices, principles proposed by other AI
research labs (e.g., Sparrow Principles from DeepMind), an effort to capture
non-western perspectives, and principles that we discovered work well via our early
research." → 기존 "UN인권선언·다수결"이라는 단순화가 부정확했음을 확인, 5개 소스 종합
으로 교정.
"the model is trained to critique and revise its own responses using the set of
principles" → "내부정렬=자기심판" 행의 근거 확인.
"our current constitution is neither finalized nor is it likely the best it can be
... we expect to iterate on it" → Anthropic이 전면 개정 가능성을 스스로 명시. 이를
"결함"으로 왜곡하지 않고 "불변핵심 유무"의 설계 차이로 정확히 재서술, "개정 가능성" 행
신설.
- 제5부 상회표 제목을 "12축"→"14축"으로 갱신, 출처 검증 블록(원문 인용+한계 고지) 추가.
D1 — 자유축 T규칙 0 (보너스 해결)
- 실측:
행위규칙.psv에서 자유축 규칙 3건이 전부 O 또는 A(curl=O, 대량발송=O, 강제=A) —
T신호 전무. 자유 관련 모든 행위가 O 또는 A로만 귀결되는 판별력 공백.
- 조치:
동의|자유|T, 선택권|자유|T, 자발적|자유|T, 승인 하|자유|T 4건 추가.
관련 파일
/Users/ef/Downloads/CrownyTVM/CROWNY-CONSTITUTION-6561.md — 제4부 3개 조항 신설,
제5부 상회표 갱신, 부칙5 신설(성장 이력)
/Users/ef/CrownyOS/crownyc/libs/양심지표.한선 — 신뢰도산출 시그니처 변경, 최대연계수계산
추가, D7 주석
/Users/ef/CrownyOS/crownyc/libs/행위분류.한선 — 부정어 스코프 방어 로직 추가
/Users/ef/CrownyOS/crownyc/data/헌법6561/행위규칙.psv — 자유축 T규칙 4건 추가
/Users/ef/CrownyOS/crownyc/apps/양심지표_테스트.한선 — 시나리오6 재설계(6/6 PASS)
잔여 이슈 (정직 — 미해결)
- D3 우회 가능성(LLM 자기보고 입력) — 미착수
- D4 fail-open(게이트 오류=exit0) — 미착수, 다음 반복 최우선 후보
- D5 RPN 정통 보수 미완 — 이번 반복에서 새로 확인:
libs/양심지표.rpn.한선이
이번 세션의 고수준 수정(신뢰도산출 2-arg화, 최대연계수계산 추가) 이후 스테일 상태(파일
타임스탬프 7/7, 미갱신 confirmed).
tools/high2rpn.sh libs/양심지표.한선 실행해봤으나
stdout 프리뷰만 출력하고 파일 미저장 — 실제 쓰기 옵션/플래그 확인 후 재변환 필요.
- D9 테스트 범위(행위분류 자연어→8축 미테스트, 비영 동률 미검증) — 미착수
- D10 성경 인용 성격(주해 아닌 유비적 적용) — 미착수
- 신규: D6 정규화 방식 하 "완전상쇄(Re=0∧Im=0, O축 없이)"가 현재 축조항연계 데이터
분포에서 대수적으로 재현 불가(부칙5에 기록) — 축조항연계.psv 재구성 검토 필요