NextGen4-NextGen5 하이브리드 작업 실험 정리
문서 목적
이 문서는 메디사이트 전환 작업을 진행하면서 NextGen4 + NextGen5를 조합해 개인적으로 시험해보고 있는 하이브리드 작업 방식을 정리한 문서입니다.
팀 공용 운영 기준을 확정해 공유하는 문서라기보다, 실제 작업을 진행하면서 어떤 방식이 더 안정적인지 확인해보기 위해 정리한 작업 실험 메모에 가깝습니다.
한 줄 요약
기본 변환은 NextGen5 방식으로 안정성을 가져가고, NextGen4의 OCR/crop 자동화는 개인적으로 시험 중인 이미지 후보 추출 보조 흐름으로 활용해보는 구조입니다.
현재 작업 방향
현재 방향은 NextGen4를 기준 프로젝트로 유 지하면서, NextGen5의 안정화 흐름을 이식한 하이브리드 구조를 직접 만들어보고 작업에 적용해보는 방식입니다.
작업 기준 폴더
- 기준 프로젝트:
C:\Users\User\Downloads\Homepage NextGen4 - 비교/참조 대상:
C:\Users\User\Downloads\Homepage NextGen5
핵심 판단
- 기본 작업 흐름은 일단 NextGen5 방식을 중심으로 가져가본다.
- 일반 페이지와 통이미지 페이지를 분리해서 처리하는 방식이 더 안정적인지 확인해본다.
- crop이 필요한 영역은 한 번에 자동 반영하지 않고 후처리와 검수 중심으로 다뤄본다.
- 기존 NextGen4 OCR/crop 도구는 제거하지 않고 개인적으로 이미지 후보 추출용 보조 엔진처럼 사용해본다.
현재 시도 중인 방식
아직 팀 공용 운영 방식으로 확정한 것은 아니고, 현재는 아래 흐름이 실제 작업에서 더 안정적인지 직접 적용해보는 단계입니다.
- 일반 HTML 페이지 는
새 병원 이전 시작훅을 사용해본다. - 통이미지 또는 혼합 페이지는 통이미지 캡처 후
새 병원 이전 시작 (통이미지 변환)훅을 사용해본다. - 변환 중 crop이 필요한 영역은 placeholder와 주석으로 남긴 뒤
이미지 crop 필요 영역 정리훅으로 정리해본다. - 기존 NextGen4의 OCR/crop 자동화 도구는 삭제하지 않고, 현재는 저만 통이미지 후보 및 visual asset 후보 추출용 보조 흐름으로 시험 사용하고 있다.
즉, 안정성은 NextGen5에서 가져오고, 자동화 재료 수집은 NextGen4에서 개인적으로 시험해보는 방식입니다.
페이지 유형별 처리 기준
1. 일반 HTML 페이지
사용 흐름:
새 병원 이전 시작main_prompt_base.mdscripts/pre_prompt_base.js
적용 기준:
- 구조가 비교적 명확한 HTML 페이지
- 텍스트와 섹션 구성이 중심인 페이지
- 통이미지 의존도가 낮은 페이지
2. 통이미지 또는 혼합 페이지
사용 흐름:
- 통이미지 캡처
새 병원 이전 시작 (통이미지 변환)main_prompt_vision.mdscripts/pre_prompt_vision.js
적용 기준:
- 이미지 안에 주요 정보가 많이 들어간 페이지
- HTML과 이미지가 섞여 있는 페이지
- 구조 분리가 어려운 레거시 페이지
3. crop 필요 영역
처리 기준:
- 변환 결과 HTML에는 placeholder 또는 주석으로 남깁니다.
- 후속 훅에서 crop 필요 영역을 정리합니다.
- 사람이 확인해야 할 항목은 자동 반영하지 않고 검수 대상으로 남깁니다.
NextGen4와 NextGen5의 역할 분리
NextGen5 역할
- 기본 변환 흐름 담당
- 일반 페이지와 통이미지 페이지 분기 담당
- 변환 안정성 확보
- 실제 작업에 바로 적용해보기 쉬운 기준 제공
NextGen4 역할
- OCR/crop 자동화 자산 유지
- 통이미지 후보 추출 보조
- visual asset 후보 탐지 보조
- 완전 자동 반영이 아닌 개인 실험용 후보 생성 엔진 역할
왜 하이브리드 구조가 필요한가
NextGen4만 사용할 때의 한계
- 자동화 자산은 있지만 결과 안정성이 흔들릴 수 있습니다.
- OCR/crop 결과를 바로 반영하면 오탐이나 품질 이슈가 발생할 수 있습니다.
NextGen5만 사용할 때의 한계
- 분기 구조와 안 정성은 좋지만, 기존 자동화 자산 활용도가 낮아집니다.
- 이미지 후보 자동 수집 측면에서는 아쉬움이 있습니다.
그래서 현재 보고 있는 방향
- 기본 작업 기준은 NextGen5 쪽으로 가져가본다
- 자동화 후보 수집은 NextGen4 자산으로 개인적으로 시험해본다
아직 팀 공용 기준으로 확정했다기보다, 이렇게 나누는 방식이 실제 작업에서 더 현실적인지 확인해보는 단계입니다.
다음 개선 작업
1. crop manifest 생성 기능 추가
placeholder와 crop 후보를 연결하는 manifest를 생성합니다.
예시 구조:
{
"page": "02_intro",
"items": [
{
"placeholder": 1,
"sourceCapture": "02_intro_part1.png",
"cropFile": "02_intro_crop_01.png",
"confidence": "high",
"candidateQuality": "recommended",
"remainingTextCount": 0,
"needsReview": false
}
]
}
2. 자동 crop 후보 생성 훅 추가
통이미지 캡처 후 기존 NextGen4의 extract-visual-assets.py 또는 관련 OCR/crop 스크립트를 실행해 crop 후보를 생성합니다.
권장 출력 위치 예시:
out/{도메인명}/crop-candidates/{순번}_{페이지식별자}/- 또는
out/whole-image-ocr/{page-key}/
3. 자동 src 교체는 안전 조건에서만 수행
다음 조건을 모두 만족할 때만 placeholder src를 자동 교체합니다.
remainingTextCount === 0candidateQuality === "recommended"confidence === "high"- source capture와 placeholder의 매칭이 명확함
조건을 만족하지 않으면:
- 기존 placeholder를 유지합니다.
[수동 확인 필요]주석을 남깁니다.
4. 검수 리포트 생성
crop 처리 후 아래 내용을 리포트로 남깁니다.
- 자동 교체 수
- 수동 확인 필요 수
- 텍스트 인식 불가 수
- crop 불가 수
- 삭제/무시한 장식 이미지 수
예시:
- 자동 교체: 3개
- 수동 확인 필요: 2개
- 텍스트 인식 불가: 1개
- crop 불가: 1개
- 삭제/무시한 장식 이미지: 4개