KSL Pose Dictionary (PoC) 한국수어(KSL) text to pose 시제품용 keypoint 데이터셋. docent AI sign research 02 프로젝트에서 생성. Neural Sign Actors (CVPR 2024) 접근법을 KSL에 적용하는 Path B (Dictionary based) 시제품의 핵심 데이터셋. 개요 자산 갯수 키포인트 sldict keypoint (국립국어원 한국수어사전) 1,444 단어 OpenPose 137 (RTMW DW L M 추출) NIASL2021 gloss segmentation keypoint (재난 안전 도메인) 2,287 base gloss OpenPose 137 (NIASL 원본) Hybrid sign index 4,511 unique signs 단어 → keypoint 경로 매핑 Stage 1 학습 corpus 20,085 samples (train 18,067 / val 986 / test 1,032) (한국어 문장, KSL gloss 시퀀스) KSL vocab 2,984 unique base lemma gloss frequency table Coverage: NIASL2021 raw gloss interval의 93.3% 가 본 index로 직접 매핑 가능. 디렉토리 구조 Keypoint JSON 형식 (OpenPose 137) 각 keypoint JSON 파일: 총 137 keypoint × frames. 좌표는 픽셀 단위. Stage 1 학습 corpus 형식 각 line (jsonl): korean text → gloss seq base 매핑이 KLUE BERT seq2seq fine tune의 (input, target) 쌍. 원본 데이터 출처 데이터 출처 라이선스 sldict 1,444 mp4 https://sldict.korean.go.kr (국립국어원) 정부 공공 (출처 표기) NIASL2021 영상·JSON AI Hub 114 (dataSetSn=636) — EQ4ALL + KETI + KAIST + 강남대 AI Hub 연구용 Stage 1 corpus NIASL2021 derivative (korean text + sign script 추출) AI Hub 연구용 원본 video는 본 dataset에 포함 안 됨. 다음으로 직접 다운로드: sldict: scripts/sldict bulk download.py (정부 공공…
We use cookies for essential functionality and analytics. You can accept or reject analytics cookies.Cookie policy