크라우니AI 수준평가 · 배포현황 · 개선도구 리스트 (2026-07-07)
모든 수치는 실측 검증(거짓말필터 규율). 미검증은 "미검증" 명시.
1. 현 기능/수준 (검증됨)
| 항목 | 실측값 | 검증 |
|---|
| 규모 | 개념 2758·관계 14741·밀도 5.34 | wc |
| 추론기 | 10종·opcode 961-967 | ls |
| 자연어입력 | "자유란?"→접지응답 | 실행 |
| 도메인밖거절 | "날씨"→음게이트 | 실행 |
| 속도 | 38ms·토큰0·오프라인 | 계측 |
| 논리무결성 | ISA순환0·반의비대칭0 | 스크립트 |
| 재현율 | 83%(홀드아웃 링크예측) | gauge |
| MCP | 15도구 | list |
정직한 수준: 철학 도메인 규칙기반 지식그래프 + 자연어 프론트엔드 + 10추론기.
아님(과장 정정): 진짜 SemCode 주소화(단어매칭임)·범용LLM·자유생성·문장구조 이해.
2. 배포용 규칙기반 SLM 현황
준비됨
- footprint ~1MB (Ollama 4.7GB의 1/수백) — 실측
- 서빙: 크라우니MCP.py(15도구)·자연어질의.한선·거짓말필터.sh
- 구조우위: 무환각(도메인내)·결정론·감사·토큰0·<40ms·오프라인
결격(배포 전 필요)
| 결격 | 필요작업 |
|---|
| 상주서버 없음(매질의 컴파일+로드) | crownyc_big TCP대기 상주 루프 |
| 도메인 철학단일 | 도메인 확장 or 복합AI 라우팅 명시 |
| 문장구조 이해 없음(개념추출 의존) | 형태소 경계 추출 |
| 기존 SemCode사전(4138) 미통합 | 사전 통합 or 순번인덱스 명시 |
| 생성 템플릿한정 | 삼진생성 자연어질의 연결 |
| 벤치 손큐레이션(24질의) | 표준 질의셋 |
3. 세션 유의미 작업 + 시행착오
유의미(검증된 성과)
- opcode961-966: 추론 9.6s→35ms(275배), 진폭증폭4.4배, BFS5.3배 — 네이티브 hot loop.
- 자연어프론트엔드: 위임100%→13%(86%p), 철학질의 처리 0→100%.
- 논리무결성: ISA순환50→0, 반의비대칭535→0.
- 거짓말필터: 거짓률93%→0%, <1% 게이트.
시행착오(교훈)
- O(n²) 분리 라이브러리=9.6s 진범(라이브러리 뒤 숨은 이차식)→네이티브 opcode.
- "하이젠버그"=엔진아님, 테스트하니스(zsh 워드스플릿+동시세션 바이너리레이스).
- SemCode 십진스칼라 드리프트→벡터삼진, 그러나 NEGATE=반의는 1:1페어링만(다대다 반의 부적합)=근본결함, 인덱스조회가 정답.
- edges open(cp)가 SSOT(개념.psv) 덮어씀→개념 5개 증발, 복구.
- 단어매칭인데 "SemCode 온톨로지"라 과장, 기존 SemCode사전 미사용.
- bash 한글변수명·「$VAR」멀티바이트 반복 함정.
4. 개선 도구화 리스트 (우선순위)
- ★거짓말필터 확대 — 전 크라우니 엔진 보고에 적용(현재 철학만). CI 게이트화.
- 상주서버 — crownyc_big 그래프 1회로드 후 질의서빙(지연 제거, 배포 필수).
- 정합성 자동검사 — ISA순환·반의대칭·고아개념·코드유일성 회귀게이트(edges에 편입).
- SemCode 사전 통합기 — 기존 실어휘코드북 매핑, 진짜 주소화 or 순번인덱스 명시.
- 형태소 개념추출 — 조사/어미 경계로 1음절개념 복원+문장구조.
- 표준 벤치셋 — 손큐레이션 대신 정규 철학질의 100+ 셋, 대체율 신뢰측정.
- 별칭 자동축적 — 실패질의 로그→별칭후보(토큰0 데이터파이프).