← 목록
기타 2026-07-09 7KB 읽기 7분

크라우니 헌법 6561 — 성장 반복 1/9

개요

"계속 성장하는 헌법" 절차의 첫 반복. 10개 열린 문제(D1~D10) 중 임팩트 큰 4개(D2, D6, D7, D8)를 골라 실제 코드 수정+컴파일+테스트 검증까지 완료했고, D1은 저비용 보너스로 함께 해결했다. 나머지(D3,D4,D5,D9,D10)는 미착수로 정직하게 남긴다. 작업 중 새로운 결함(RPN 동반본 스테일, 완전상쇄 특이점의 데이터의존적 소멸)도 발견해 잔여로 기록.

무엇을 했는지

D6 — 신뢰도 가중 무효 (부분 해결, 실측 결함 확인)

  • 실측: 축조항연계.psv에서 8축 중 7축이 정확히 3개 조항과 연계, 사랑축만 6개. 게이트설정.psv
신뢰도분모=3(고정) → 모든 축이 n*100/3으로 100에 포화(사랑축은 200→100으로도 포화). 결과: "양자간섭 신뢰도가중"이 실질적으로 단순 부호카운트(T개수-A개수)와 수학적 동치였음.
  • 수정: libs/양심지표.한선최대연계수계산() 추가, 신뢰도산출(연계조항수, 최대연계수)
시그니처 변경(정적분모 폐지, 판정마다 동적 정규화). 축판정구성()에서 호출부 갱신.
  • 검증: hanseonc_high 컴파일 성공(exit=0), apps/양심지표_테스트.한선 6개 시나리오 전체
재실행 — 시나리오6("완전상쇄 0/0")이 새 가중치 하에서 실패(Re=-50, 옛 기대와 다름)해서 근본원인 분석 후 테스트 자체를 올바른 새 벡터로 교체, 최종 6/6 PASS 확인.
  • 잔여 한계: "같은 축은 어떤 행위든 항상 동일 신뢰도"(정적 연계조항수 기반이지 행위별 근거
강도 아님)는 미해결 — 재조회보정(현재 O축 전용 텍스트대조)을 T/A축까지 확장해야 완전 해결 (스펙만 기록, 코드 없음 → 음).
  • 새로 발견한 결함: 이 정규화 방식 하에서, 축조항연계 데이터 분포(사랑=6 vs 나머지=3)로
인해 총가중치 단위가 450(=50단위 9개, 홀수)이라 O축 없이 8축 T/A만으로 정확히 Re=0인 "완전상쇄"가 대수적으로 재현 불가능해짐(반분값 225=4.5단위, 정수 아님). 결함이라기보다 데이터 불균형의 파생 결과 — 축조항연계.psv를 축별 동일 개수로 재구성할지 다음 반복 검토.

D2 — 부정어 맹목 (해결, 컴파일+실행 검증)

  • 문제 재현: 행위분류("사용자에게 위해를 가함") → 생명존엄축 A (정상). `행위분류("사용자에게
위해를 가하지 않도록 조치함")` → 수정 전에는 동일하게 A (오분류, "위해" 서브스트링만 보고 부정어 "않도록" 무시).
  • 수정: libs/행위분류.한선_부정어윈도우()(매치 앞 8자~뒤 12자 문맥창), _부정됨()
(부정어 목록 대조), 축판정_단일()포함하나(불리언)+찾기(인덱스, 문자열.한선)로 매치 위치를 얻어 문맥창에 부정어가 있으면 해당 매치를 A/T 어디에도 반영하지 않고 무효화. 자동으로 반대값(T)으로 뒤집지 않음(정직 원칙 — 확신 없으면 O).
  • 검증: /tmp/부정어테스트.한선 작성 후 컴파일+실행 — 부정문은 OOOOOOOO(생명존엄=O로
중화), 대조군(부정없음)은 AOOOOOOO(정상 A 유지) — PASS.
  • 최초 윈도우 폭(±6자)이 "위해를 가하지 않도록"의 실제 부정어 거리(패턴끝 기준 6자)를 놓쳐
1차 테스트가 FAIL한 것을 실측하고 ±8/+12로 확장해 재검증 통과.

D7 — 하드트립·가중치 불일치 (해결, 명문화)

  • 실측: 하드트립축(생명존엄2187·진실729·청지기27·자유9) vs 비하드트립축(약자보호243·사랑81
·안식3·초월겸손1) — 청지기+자유 가중치합(36) < 약자보호 하나(243). 가중치 순서와 하드트립 지정 순서가 불일치하지만, 하드트립검사()가 구조점수 가중합산과 독립된 논리게이트라 실제 판정 결과는 왜곡되지 않음(코드 확인 완료).
  • 조치: 헌법 제4부에 "가중치와 심각도의 구분" 조항 신설 + libs/양심지표.한선 코드 주석에
동일 원칙 명문화. 향후 구현자가 "가중치=심각도"로 오독해 하드트립 목록을 재편하는 것을 명시적으로 금지.

D8 — 상회표 미검증 (해결, WebFetch 원문 대조)

  • WebFetch로 anthropic.com/news/claudes-constitution 실제 인용 확보:
  • "Our current constitution draws from a range of sources including the UN Declaration
  • of Human Rights, trust and safety best practices, principles proposed by other AI research labs (e.g., Sparrow Principles from DeepMind), an effort to capture non-western perspectives, and principles that we discovered work well via our early research." → 기존 "UN인권선언·다수결"이라는 단순화가 부정확했음을 확인, 5개 소스 종합 으로 교정.
  • "the model is trained to critique and revise its own responses using the set of
  • principles" → "내부정렬=자기심판" 행의 근거 확인.
  • "our current constitution is neither finalized nor is it likely the best it can be
  • ... we expect to iterate on it" → Anthropic이 전면 개정 가능성을 스스로 명시. 이를 "결함"으로 왜곡하지 않고 "불변핵심 유무"의 설계 차이로 정확히 재서술, "개정 가능성" 행 신설.
    • 제5부 상회표 제목을 "12축"→"14축"으로 갱신, 출처 검증 블록(원문 인용+한계 고지) 추가.

    D1 — 자유축 T규칙 0 (보너스 해결)

    • 실측: 행위규칙.psv에서 자유축 규칙 3건이 전부 O 또는 A(curl=O, 대량발송=O, 강제=A) —
    T신호 전무. 자유 관련 모든 행위가 O 또는 A로만 귀결되는 판별력 공백.
    • 조치: 동의|자유|T, 선택권|자유|T, 자발적|자유|T, 승인 하|자유|T 4건 추가.

    관련 파일

    • /Users/ef/Downloads/CrownyTVM/CROWNY-CONSTITUTION-6561.md — 제4부 3개 조항 신설,
    제5부 상회표 갱신, 부칙5 신설(성장 이력)
    • /Users/ef/CrownyOS/crownyc/libs/양심지표.한선 — 신뢰도산출 시그니처 변경, 최대연계수계산
    추가, D7 주석
    • /Users/ef/CrownyOS/crownyc/libs/행위분류.한선 — 부정어 스코프 방어 로직 추가
    • /Users/ef/CrownyOS/crownyc/data/헌법6561/행위규칙.psv — 자유축 T규칙 4건 추가
    • /Users/ef/CrownyOS/crownyc/apps/양심지표_테스트.한선 — 시나리오6 재설계(6/6 PASS)

    잔여 이슈 (정직 — 미해결)

    • D3 우회 가능성(LLM 자기보고 입력) — 미착수
    • D4 fail-open(게이트 오류=exit0) — 미착수, 다음 반복 최우선 후보
    • D5 RPN 정통 보수 미완 — 이번 반복에서 새로 확인: libs/양심지표.rpn.한선
    이번 세션의 고수준 수정(신뢰도산출 2-arg화, 최대연계수계산 추가) 이후 스테일 상태(파일 타임스탬프 7/7, 미갱신 confirmed). tools/high2rpn.sh libs/양심지표.한선 실행해봤으나 stdout 프리뷰만 출력하고 파일 미저장 — 실제 쓰기 옵션/플래그 확인 후 재변환 필요.
    • D9 테스트 범위(행위분류 자연어→8축 미테스트, 비영 동률 미검증) — 미착수
    • D10 성경 인용 성격(주해 아닌 유비적 적용) — 미착수
    • 신규: D6 정규화 방식 하 "완전상쇄(Re=0∧Im=0, O축 없이)"가 현재 축조항연계 데이터
    분포에서 대수적으로 재현 불가(부칙5에 기록) — 축조항연계.psv 재구성 검토 필요