본문으로 건너뛰기

문서 번역 결과

px.DocumentTranslation은 원본 PDF·분석 참조, 번역 엔진·모델·설정 참조, 언어쌍과 번역 구간을 담는 불변 값입니다. 원문과 페이지·영역·신뢰도는 원본 DocumentAnalysis에 유지합니다. 번역 실행, 원본 읽기 권한, 검토 승인이나 Report 반영을 뜻하지 않습니다.

저장 bytes 열기

python
translation = px.DocumentTranslation(data)

Core가 버전과 닫힌 형식, 구간 key, 언어 태그와 신뢰도를 검증합니다. canonical_bytes를 파일에 저장하고 다시 열 수 있으며, content_ref는 정규화된 bytes의 정확한 digest입니다.

dict 검증

python
translation = px.DocumentTranslation.from_wire(engine_translation)

문서 형식은 document-translation.v1.schema.json에 정의합니다. 구문이 올바른 언어 태그는 설치 엔진이나 출시 언어 목록과 독립적으로 저장·열기 가능합니다. 실제 실행 지원은 Runtime이 엔진의 정확한 언어쌍·모델·설정 참조로 별도 판단합니다.

복사본 읽기

python
data = translation.to_dict()

segments 배열은 번역문의 논리적 읽기 순서입니다. 각 구간의 sourceSegmentKeys는 원본 분석의 구간을 가리킵니다. 여러 원문 구간을 하나로 합치거나 한 원문 구간을 여러 번역 구간으로 나눌 수 있고, 번역문의 구간 순서를 바꿀 수 있습니다. 한 구간 안의 원본 key들은 중복 없이 원본 읽기 순서를 유지해야 합니다. dict 수정은 저장된 값을 바꾸지 않습니다.

원문과 연결

python
segments = translation.resolve(analysis)

정확한 analysisRefsourceContentRef, 존재하는 원본 key와 그룹 내 순서를 확인합니다. 반환 dict의 segments에는 번역 구간과 sourceSegmentKeys가 있고, sourceSegments에는 참조된 원문 구간이 원본 순서대로 한 번씩 들어 있습니다. analysisRefsourceContentRef도 함께 반환합니다. 같은 원문을 여러 번역 구간이 참조해도 원문 텍스트를 반복 복제하지 않습니다. 원문을 재추출하거나 엔진·원본을 바꾸면 이전 번역을 새 분석에 암묵적으로 연결하지 않습니다.

형식과 연결 거절은 px.ErrorValueError 모두로 처리할 수 있습니다. .diagnostics에는 구조화된 진단이 있고, native 거절의 .diagnostic.original_bytes도 유지됩니다. 값의 검증은 엔진이 실제로 실행됐다는 인증이 아닙니다. 번역 PDF 렌더링은 별도 산출물이며 원본 PDF를 덮어쓰지 않습니다.

DocumentTranslatedPdf는 번역 PDF bytes와 분리된 출처 기록을 검증합니다. 파일과 출처 기록의 Project 보존은 client.retain_translated_pdf로 수행하고, 실제 PDF 생성은 별도 단계입니다.