TECHNOLOGY

기술 · 데이터

랑구스토리의 핵심 자산은 AI가 바로 학습할 수 있는 형태로 정규화된 한국어 교육 데이터입니다. 이 데이터가 쌓이는 과정을 따라가 보세요.

THE PROBLEM

처음에는 GPT-4o로 교안을 만들었습니다

그런데 만들수록 학습자 급수와 어긋났습니다. 국립국어원 표준 교육과정 정답셋으로 직접 재봤습니다.

1급
0.00%
2급
0.00%96.6%
3급
0.00%
4급
0.00%

측정 모델 GPT-4o · 국립국어원 표준 교육과정 정답셋 기준 급수 일치율(mIoU) · 자사 실측

급수를 아는 데이터가 없었기 때문입니다. 그래서 직접 만들기로 했습니다.

SOURCE

논문, 한국어 교재, 표준 교육과정.
여기서 시작했습니다

한국어교육 전공 연구진이 직접 영역별로 구성했습니다

STEP 1 · VOCABULARY

0표제어

어휘

1~6급 전 급수 · 인스턴스 26,586 · 의미부류 26,586

STEP 2 · GRAMMAR

0

문법

표준 문법 755 + 활용형 24,452 · 특허 기술로 자동 검증

STEP 3 · TOPIC

0범주

주제

단원 매핑 2,775 · 급수 순서 343

STEP 4 · FUNCTION

0범주

기능

의사소통 기능 범주 · 단원 매핑 5,610 · 급수 순서 205

STEP 5 · CROSS MAPPING

0

크로스 매핑

어휘×문법 · 어휘×기능 · 어휘×주제 · 기능×문법 등. 낱개 리스트가 하나의 그래프로 연결됩니다

TOTAL

0

정규화 한국어 교육 데이터

INTELLECTUAL PROPERTY

지식재산권

등록

한국어 음소 유사도 기반 발음 정확도 평가 방법

제 10-2966195 호
등록 2026.05.13

등록

한국어 문법 데이터의 자동 검증 방법 및 시스템

제 10-2999681 호
등록 2026.07.30

MCP SERVER

연결된 데이터를 서비스로 내보냅니다

도메인이 전부 이어져 있어야 실제 학습자에게 통하는 한국어 데이터가 나옵니다. 이 데이터를 MCP 서버로 공급해 비원어민 한국어 화자를 위한 서비스를 만듭니다.

더 궁금한 점이 있으신가요?

협력과 도입 문의를 받고 있습니다.

문의하기