TECHNOLOGY
기술 · 데이터
랑구스토리의 핵심 자산은 AI가 바로 학습할 수 있는 형태로 정규화된 한국어 교육 데이터입니다. 이 데이터가 쌓이는 과정을 따라가 보세요.
THE PROBLEM
처음에는 GPT-4o로 교안을 만들었습니다
그런데 만들수록 학습자 급수와 어긋났습니다. 국립국어원 표준 교육과정 정답셋으로 직접 재봤습니다.
급수를 아는 데이터가 없었기 때문입니다. 그래서 직접 만들기로 했습니다.
SOURCE
논문, 한국어 교재, 표준 교육과정.
여기서 시작했습니다
한국어교육 전공 연구진이 직접 영역별로 구성했습니다
STEP 1 · VOCABULARY
0표제어어휘
1~6급 전 급수 · 인스턴스 26,586 · 의미부류 26,586
STEP 2 · GRAMMAR
0행문법
표준 문법 755 + 활용형 24,452 · 특허 기술로 자동 검증
STEP 3 · TOPIC
0범주주제
단원 매핑 2,775 · 급수 순서 343
STEP 4 · FUNCTION
0범주기능
의사소통 기능 범주 · 단원 매핑 5,610 · 급수 순서 205
STEP 5 · CROSS MAPPING
0행크로스 매핑
어휘×문법 · 어휘×기능 · 어휘×주제 · 기능×문법 등. 낱개 리스트가 하나의 그래프로 연결됩니다
TOTAL
0행정규화 한국어 교육 데이터
INTELLECTUAL PROPERTY
지식재산권
등록
한국어 음소 유사도 기반 발음 정확도 평가 방법
제 10-2966195 호
등록 2026.05.13
등록
한국어 문법 데이터의 자동 검증 방법 및 시스템
제 10-2999681 호
등록 2026.07.30
MCP SERVER
연결된 데이터를 서비스로 내보냅니다
도메인이 전부 이어져 있어야 실제 학습자에게 통하는 한국어 데이터가 나옵니다. 이 데이터를 MCP 서버로 공급해 비원어민 한국어 화자를 위한 서비스를 만듭니다.

