40만 편 중국 고전 시가를 API로: 오픈소스 chinese-poetry-api
당시·송사·원곡과 시경·초사 등 약 40만 편의 중국 고전 시가 데이터를 REST와 GraphQL 인터페이스로 제공하는 Go 기반 오픈소스 API입니다. Docker로 셀프 호스팅할 수 있다고 소개되었습니다.
X 사용자 Gk(@0xGky)가 2026년 10월 8일, 약 40만 편 규모의 중국 고전 시가 데이터를 바로 호출할 수 있는 형태로 묶은 오픈소스 프로젝트 chinese-poetry-api를 소개했습니다. 직접 데이터를 수집·정제·구축하지 않고도 인터페이스 호출만으로 시가 텍스트를 가져올 수 있다는 것이 핵심 제안입니다.

이미지 출처: @0xGky (X)
소개 글에 따르면, 이 프로젝트는 중국 당나라 시(당시), 송나라 사(송사), 원나라 곡(원곡)을 비롯해 『시경』과 『초사』 같은 오래된 고전까지 폭넓게 담고 있습니다. 한국 독자에게 익숙한 표현으로 풀면, 중국 고전문학의 대표 장르별 선집을 하나의 데이터 묶음으로 정리해 둔 셈입니다.
무엇을 할 수 있나
소개된 기능은 조회 중심으로 단순합니다. 시대(조대)·작가·유형별 분류 조회, 전문 검색, 무작위 1수 반환, 간체·번체 전환이 제공된다고 합니다. 교육용 작은 도구나 챗봇처럼 "고전 시가 한 수"가 필요한 쪽에서 가져다 쓰기 쉬운 구성입니다.
기술적으로는 Go 언어로 작성되었으며, REST와 GraphQL 두 가지 인터페이스를 함께 제공하고, Docker로 한 번에 실행할 수 있는 셀프 호스팅 방식이라고 소개되었습니다. 다만 원 게시물에 공개된 정보는 이 소개 글과 첨부 이미지뿐이며, 저장소 주소·실제 엔드포인트 명세·라이선스 같은 세부 사항은 이번 게시물 증거만으로는 확인할 수 없습니다.
누구에게 유용한가
중국 고전 텍스트를 다루는 학습용 앱, 읽기 도구, 실험용 챗봇을 만드는 개발자에게 출발점으로 쓸 만합니다. 40만 건 규모의 말뭉치를 직접 모으는 과정을 건너뛰고 바로 조회 기능부터 붙일 수 있기 때문입니다.
다만 유의할 점도 있습니다. 자체 호스팅으로 올릴 경우 약 40만 건 데이터의 인덱싱과 메모리 요구량을 먼저 점검해야 하며, 중국 고전 텍스트 특성상 간체·번체 변환과 인코딩 처리에 따라 검색 정확도가 달라질 수 있습니다. 도입 전에는 실제 저장소에서 데이터 출처와 갱신 상태, 라이선스를 직접 확인하는 것이 좋습니다.
출처
- Gk(@0xGky) 원문 게시물: 40만 수 중국 고전 시가 API 소개