← 목록
기타 2026-07-09 5KB 읽기 5분

요청: LLM오류패턴관리도구

  • 날짜: 2026-07-09 00:58:37
  • 작업 경로: /Users/ef

요청 본문

오류발견과정 기록·누적, 오류발생빈도/패턴/규칙 찾아내서 전통LLM 고유 오류발생 표준편차 밀집패턴 발견/관리도구 생성용 준비

관련 산출

(클로드가 작업 결과를 이어 기록)

산출: LLM 오류 대장·분석기 + 백본 보호 게이트 (2026-07-09)

① LLM 오류 대장·표준편차 밀집 분석기 (crowny-butler/오류대장.sh)

  • 대장 data/오류대장.psv (id|날짜|유형|계층|티어|예시|근본원인|검출신호|실측빈도|심각도), {add|list|analyze|pattern}.
  • 이번 세션 실측 11 오류유형 등재. 전부 LLM고유 9 · 규칙설계 2, 발생원 haiku 7 · 전티어.
  • 표준편차 밀집(체계적 약점): 평균오류율 21.6% · σ 30.9% · 임계 μ+σ=52.4%.
  • ★밀집 가중치신뢰불가 100%(z=+2.54) — LLM 신뢰도점수는 무의미(교정불가). 게이트가 절대 신뢰 금지.
  • 인과과잉표기 49%(z=+0.89) — 다중원인을 결정론 인과로 과잉주장(2위 약점).
  • 이어 관계오분류13%·다의어8%·방향역전7%·품사혼재7%.
  • 검출가능성: 구조검출가능 9 · 판정/임베딩필요 1(무의미페어링). → 대부분 규칙방어 가능.
  • 향후: 오류 발견마다 add로 누적 → pattern 재실행하면 밀집이 통계적으로 재수렴(체계적 약점 자동식별).
  • ② 백본 보호 게이트 (crowny-butler/백본게이트.sh)

    • 원칙: 고신뢰 골격(상위/부분)은 생성/게이트가 절대 덮어쓰지 못함. {lock|apply|screen|status}.
    • apply: 백본 pair의 모순링크 제거 + 백본 재주입(불변). 누적기 ingest ②단계에 배선.
    • screen: 신규 드롭링크 중 백본 역방향/모순 사전거부(생성단 피드백).
    • 실증: 개⊂동물 골격 보장, 동물→상위→개(역방향)·개→하위→동물(모순) 신규 거부.

    ★ 심화 발견 (E11): 백본조차 오염

    • 백본 게이트를 적용하다 발견: "깨끗한 시드" 백본에 역전오류 만연 — 동물→상위→토끼, 새→상위→비둘기, 곤충→상위→나비 등 하위종 링크 대부분 뒤집힘. 손으로 넣은 핵심(개→동물)만 정확.
    • 함의: 방향역전(E02)은 시드 생성단부터 침투 → LLM생성 taxonomy는 검증 없이 백본으로 신뢰 불가. indegree 자동교정은 실패(개=견종노이즈로 오탐, 바로 골격훼손의 원인).
    • 진짜 요구사항: 신뢰 백본 = 사람 큐레이션 또는 권위 taxonomy(WordNet/Concepticon 계층). LLM은 그 위에 연결만 채움. = 크라우니 "검증이 이긴다" 재확인.

    검증 taxonomy 백본 = 완전 한선씨 로직 (2026-07-09)

    질문: taxonomy가 뭔가? 완전 한선씨로 만드는 로직인가? → 예, 증명·구현 완료.
    • taxonomy = is-a 계층트리(개⊂동물⊂생물).
    • 핵심: 검증 taxonomy가 이미 삼진코드에 있음. 의미어코드 A=P·4374+O·729+S에서 P(의미장)·O(온톨로지)가 2단 분류계층. 한선씨 균형나눗셈(자연반올림)이 이 균형위치코드를 정확 디코드 — 개 A=-47968→P=-11(Animals) O=0(Thing), 검산 정확. = 순수 한선씨 산술, LLM 아님, 역전 불가.
    • 도구: libs/의미어검증백본.한선 — 코드 디코드→검증 백본 emit. data/검증백본.psv 4188링크(전4164단어⊂의미장⊂온톨로지). 디코드 89% 정확일치(11% 무부호나머지 관례 경계, 코드북 명시컬럼으로 보완). 라인당 덧쓰기(string-pool안전).
    • 오염 시드백본 대체: 역전(동물⊂토끼 등) 소멸. 백본게이트가 이제 검증 골격을 보호.
    • 범위·다음: 이 백본은 검증 2단(도메인/타입). 깊은 is-a(개⊂동물)는 24-엔트리 도메인→한글대표어 매핑(Animals→동물)으로 무료 도출 가능(소량 큐레이션). 그 위 세밀층은 오염불가 골격 위에 안전히 적재.

    깊은 is-a 완성 — 24 앵커 매핑 (2026-07-09)

    • 원리: 검증백본(단어⊂의미장⊂온톨로지) + 도메인앵커(의미장→한글대표어) → 단어⊂대표어 도출. 예: 개⊂Animals + Animals→동물 = 개⊂동물.
    • 앵커 큐레이션: data/도메인앵커.psv 19개(코드북 동일도메인 실재 검증. 억지앵커 도메인 5개는 미포함=2단 유지). 최소 수동검증, 나머지 전부 한선씨 자동도출.
    • 결과: libs/의미어검증백본.한선이 깊은is-a 3150링크 생성(개⊂동물·손⊂몸·고양이⊂동물). 총 백본 7338링크. 결정론·역전불가·순수 한선씨.
    • 이해 재검증: 개는동물이다→티(참) · 고양이는동물이다→티 · 동물은개다→타(역) · 개는고양이다→타 · 뜨겁다의반대는차갑다→티. 사람은동물이다→옴(Kinship 도메인, 의미론적 정답: 사람⊂동물은 논쟁적).
    • 미매핑 26 = 영문 계층노드(Animals/Thing, 코드없음 정상). 삼진엔 한글 깊은is-a만 인코딩. 인코더 통계 정직화(계층노드제외 별도계수).
    • 의의: 골격이 이제 검증소스(삼진코드+최소앵커)에서 옴. LLM은 세밀연결만. 백본게이트가 이 골격 보호(모순619 제거·재주입). "검증이 이긴다" 완결.