- src: phase_z2 composition/mapper/pipeline/placement_planner/retry, ai_fallback(prompts/schema/validate), mdx_text_atoms 신규 - Front: PipelineTracePanel 신규, FramePanel/SlideCanvas/Home/designAgentApi 등 갱신 + 테스트 4종 추가 - templates/phase_z2: catalog(component_expansion_registry, node_slot_mapping 신규), frames, families, slide_base 갱신 - tests/matching: phase2~26 매칭 실험 스크립트·리포트·온톨로지 전체 (미커밋 진행분) - tests: b4_v4 evidence, task5~28.5 시리즈, regression(imp95 baseline) 등 신규 테스트 대량 추가 - docs/reference: MDX 구조 인벤토리, MDX→Frame 구조 계약 문서 - scripts: mdx 계약/parity/coverage/viewport 체크, gitea comment, run sync 유틸 - .gitignore: tmp*.json, chromedriver, .orchestrator, *.pkl, Front_test* 등 임시/스냅샷 제외 미완성 작업의 보존용 스냅샷 커밋 (2026-07-02) Co-Authored-By: Claude Opus 4.8 (1M context) <noreply@anthropic.com>
4.9 KiB
4.9 KiB
Phase 5 — Case 2. 세부 단위(팝업·표) 매칭 통합표
비교 대상: 7개 방법 (키워드 3 + 구조 1 + 의미 3)
- 의미 매칭은 SBERT 한 모델에 3가지 전처리 전략 적용 (원본/축약/청크)
- 세부 단위(팝업·표)가 키워드 vs 의미 매칭 성능 차이를 드러내는지 확인용
정답 프레임은 ⭐로 표시했습니다.
관찰 포인트
- 세부 단위에서는 키워드 > 의미: 팝업·표처럼 구체적 텍스트가 많은 유닛에서는 TF-IDF/Char/Kiwi+BM25 모두 1위 정답. 직접 단어 겹침이 크기 때문.
- 구조 메타는 두 유닛 모두 동일 결과 (17/01/05) — 세부 단위는 구조적 특징이 거의 같아서 변별력 없음.
- 축약+srobert 전략은 세부 단위에 부적합: 제목/볼드만 뽑으면 팝업·표의 핵심 내용이 날아감. 두 유닛 모두 실패.
- 청킹+srobert: 블릿·섹션 구조가 명확한 팝업(6번)은 성공, 표만 있는 12번은 청크 나누기가 애매해 실패.
- ko-srobert 원본: 의미 방법 중 세부 단위에 가장 적합. 두 유닛 모두 1위 정답.

















