바이너리 데이터 파일을 Ubuntu 서버에서 실행되는 PostgreSQL 데이터베이스에 저장해야합니다. 처음에는 각각 약 250kb 크기의 수십 개의 파일이 있습니다. 그러나 파일 수는 시간이 지남에 따라 증가합니다. 다른 다운 스트림 분석을 위해 파일에서 데이터를 추출해야 할 수도 있습니다.
이진 데이터를 BLOB 또는 참조로 저장해야한다는 오래된 질문에 대해 조사했습니다. 둘 다 분명히 장단점이 있습니다. PostgreSQL과 관련하여 알아야 할 특정 문제가 있습니까? PostgreSQL 함수 또는 외부 Python 프로그램을 통해 파일에서 데이터를 추출하려는 경우 하나의 방법 또는 다른 방법이 선호됩니까?
데이터 파일을 데이터베이스에 직접 저장하려면 다른 모든 필드가 포함 된 테이블이 아니라 "주"테이블을 참조하는 외래 키를 사용하여 별도의 테이블에 저장하는 것이 더 낫습니까?
나는 여기 에서 질문과 답변을 읽었습니다 . 주석은 리눅스에서 (파일 시스템에서) 참조로 바이너리 파일을 저장하는 것이 좋습니다. 내 질문은 구체적으로 PostgreSQL과 관련이 있으며 다양한 분석을 위해 파일에서 데이터를 추출하는 것과 관련이 있습니다.
업데이트 : 비슷한 질문 .