Data Extractor
Data Extractor는 파일 내에 포함된 희소 형식의 데이터를 추출하여 내부 구조화된 테이블에 수집할 수 있습니다.
소개
Data Extractor는 파일 내에 포함된 희소 형식의 데이터를 추출하여 내부 구조화된 테이블에 수집할 수 있습니다. 수집된 데이터는 언제든지 다양한 형식(CSV, TSV, HTML, 사용자 정의 형식)으로 내보낼 수 있습니다. Data Extractor는 수천 개의 파일을 몇 초 만에 파싱하여 그 안에 포함된 모든 원시 데이터를 수집할 수 있습니다. 이 도구는 데이터를 어떻게 인식하고, 어떻게 추출하며, 구조화된 테이블 내 어디에 배치할지를 지정하는 간단한 지시문을 사용합니다.
추출하려는 데이터가 텍스트 내에서 시작 라벨로 식별되고, 다른 라벨 또는 줄 바꿈, 복귀, 탭 문자로 끝나는 경우, Data Extractor는 이를 몇 초 만에 추출할 수 있으며, 수주, 수개월 또는 심지어 수년이 걸릴 수 있는 수작업 작업을 즉시 완료할 수 있습니다. Data Extractor는 이러한 특정 작업을 빠르고 스마트하게 수행하기 위한 모든 지식을, 아름답고 세련된 맥 전용 네이티브 애플리케이션 내에 통합하여 제공합니다. Data Extractor는 사용자가 원하는 만큼 열을 생성할 수 있는 내장 데이터베이스 테이블을 제공하며, 여기에 데이터를 수집할 수 있습니다.
데이터는 항상 디스크에 CSV(쉼표 구분 값), TSV(탭 구분 값) 또는 HTML 테이블 형식으로 내보낼 수 있습니다. 사용자 정의 필드 이름은 내보내기 시 첫 번째 레코드로 사용할 수 있어(후속 스마트 임포트를 위해) 유용합니다. Data Extractor는 문서 기반으로 설계되어, 각 문서를 특정 데이터 소스, 추출 규칙 및 사용자 정의 대상 필드에 맞게 맞춤 설정하여 대량 데이터의 고속 일괄 처리를 지원합니다. 여러 문서를 생성함으로써 사용자는 서로 다른 파일과 다양한 추출 규칙에 따라 필요한 만큼의 사용자 정의 ‘추출 세트’를 만들 수 있습니다.
이 애플리케이션에는 PDF 사용자 가이드가 포함되어 있으며, 여기에는 텍스트 파일에서 데이터를 추출하여 사용자가 직접 만든 맞춤 테이블에 삽입하는 방법을 설명하는 4개의 실습 강의와 데모 문서(당사 웹사이트에서 제공)가 포함되어 있습니다. 작업의 복잡성을 고려할 때, 일반적인 관점에서 기능을 설명하기보다는 먼저 사용자에게 실제 활용 사례를 보여주는 것이 훨씬 더 효과적임을 잘 알고 있습니다.