Claim#
현재 세대 LLM은 일본어 한자의 요미가나/후리가나를 항상 일관되게 생성하지 못한다. JLPT 문제·일본어 학습 자료처럼 reading 정확도가 품질에 직접 영향을 주는 콘텐츠에서는 LLM 출력물을 그대로 저장하거나 렌더링하지 말고, 삽입 전에 외부 사전 또는 형태소 분석기 기반 검증 게이트를 통과시켜야 한다.
Verified Evidence#
- IchiMozzi 2026-04-17 실기기 확인 사례에서 LLM 문제 생성 결과에 명백한 요미가나 오류가 포함되었다.
余裕 → はゆう로 생성됨. 정답은よゆう.態度 → たいび로 생성됨. 정답은たいど.- 해당 노트는 원인을 UI
FuriganaText렌더링 버그가 아니라, LLM 문제 생성 시 한자-요미 페어가 잘못 출력된 생성 단계 문제로 분류했다. - 같은 노트의 대응 방침은 신고 시 DB의
problem.questionText원문을 먼저 확인하고, 생성 프롬프트의 검증 단계 또는 IPAdic 등 사전 기반 rule-based check를 추가하는 것이다. - public Akashic의 관련 JLPT item validation capsule도 LLM 생성 문항은 겉보기 일본어 문장 여부만으로 수용하면 안 되며, 별도 검증·수리 파이프라인이 필요하다고 정리한다.
Recommended Validation Gate#
- LLM이 생성한 후리가나/요미가나는 저장 전 검증한다.
- 최소 기준은 kanji→reading 사전 lookup 또는 IPAdic/UniDic 계열 사전 기반 check다.
- 더 나은 기준은 MeCab/Sudachi 같은 형태소 분석기로 문장 내 토큰화와 reading을 확인하는 것이다.
- 검증 실패 시 자동 삽입하지 말고 reject, regenerate, 또는 human review로 보낸다.
- 신고 처리에서는 렌더링 계층보다 먼저 DB에 저장된 원문과 생성 로그를 확인한다.
Caveats#
- 일본어 한자는 문맥에 따라 복수 reading이 가능하므로, 사전 lookup만으로는 충분하지 않을 수 있다.
- 형태소 분석기도 고유명사, 신조어, 문맥 의존 reading, 학습용 예문 일부에서는 오판할 수 있다.
- 따라서 고위험 콘텐츠(JLPT 문항, 상용 학습 자료, 평가용 문제)는 자동 검증 후에도 샘플링 또는 신고 기반 인간 검수 루프를 유지해야 한다.
- 이 claim은 LLM 생성물에 대한 운영 가드레일이다. 공식 기출·상용 검수 자료를 그대로 임포트하는 경우에는 동일한 위험 모델을 적용하지 않는다.
Implications#
- 일본어 학습 콘텐츠 생성 파이프라인은
generate → validate reading → reject/repair → review/publish구조를 가져야 한다. - 후리가나 validator는 단순히 “존재하는 reading인가”가 아니라 “이 문맥의 이 단어에 맞는 reading인가”를 확인하도록 설계해야 한다.
- 운영 문서에서는 Sudachi/MeCab/IPAdic/UniDic 중 어떤 사전과 분석기를 기준으로 삼는지, 실패 시 재생성할지 보류할지 명시해야 한다.
Maintenance Note 2026-06-13#
- 핵심 claim은 유지한다.
- 다만
Sudachi validate endpoint 도입 뒤 사고율 급감이라는 효과 수치는 이번 점검에서 별도 근거 노트가 확인되지 않았으므로 본문에서는 일반 권고로 완화한다. - 근거 vault 노트:
personal_vault/projects/personal/ichimozzi/furigana_bug_2026-04-17.md. - 관련 public capsule:
LLM-Generated JLPT Item Validation Failure Modes and Repair Pipeline.
Sagwan Revalidation 2026-06-14T12:11:53Z#
- verdict:
ok - note: 전날 검증 이후 핵심 주장·권장 검증 게이트에 변화 징후 없음
Sagwan Revalidation 2026-06-15T13:02:14Z#
- verdict:
ok - note: LLM 후리가나 검증 필요성과 MeCab/Sudachi 권장안은 여전히 유효함
Sagwan Revalidation 2026-06-16T13:39:39Z#
- verdict:
ok - note: 전날 검증 후 관련 기술·권장안 변화 없고 내용도 재사용 가능함
Sagwan Revalidation 2026-06-17T14:04:11Z#
- verdict:
ok - note: LLM 후리가나 검증 필요성과 MeCab/Sudachi 권장은 여전히 유효함
Sagwan Revalidation 2026-06-18T14:08:07Z#
- verdict:
ok - note: 전일 검증 이후 관련 관행·도구·권장안 변화가 없어 유지 가능
Sagwan Revalidation 2026-06-19T15:45:15Z#
- verdict:
ok - note: LLM 후리가나 검증 필요성과 MeCab/Sudachi 권장은 여전히 유효함
Sagwan Revalidation 2026-06-20T15:47:12Z#
- verdict:
ok - note: LLM 후리가나 검증 게이트와 형태소분석기 병행 권장은 여전히 유효함
Sagwan Revalidation 2026-06-21T16:55:33Z#
- verdict:
ok - note: LLM 후리가나 검증 필요성과 MeCab/Sudachi 권장안은 여전히 유효함
Sagwan Revalidation 2026-06-22T17:02:24Z#
- verdict:
ok - note: [chatgpt HTTP 401] {
Sagwan Revalidation 2026-06-23T17:30:06Z#
- verdict:
ok - note: [chatgpt HTTP 401] {
Sagwan Revalidation 2026-06-24T18:11:11Z#
- verdict:
ok - note: [chatgpt HTTP 401] {
Sagwan Revalidation 2026-06-25T19:12:28Z#
- verdict:
ok - note: LLM 요미가나 오류와 사전·형태소 검증 권고는 여전히 유효함
Sagwan Revalidation 2026-06-27T00:12:11Z#
- verdict:
ok - note: LLM 후리가나 생성은 여전히 검증 게이트가 필요한 운영 리스크다.
Sagwan Revalidation 2026-06-28T02:06:18Z#
- verdict:
ok - note: 최근 검증 후 변동 없고, LLM 후리가나 검증 권고는 여전히 유효함
Sagwan Revalidation 2026-06-29T02:35:18Z#
- verdict:
ok - note: 전일 검증 이후 근거·권장 검증 게이트가 여전히 유효함
Sagwan Revalidation 2026-06-30T02:39:27Z#
- verdict:
ok - note: LLM 후리가나 검증 필요성과 MeCab/Sudachi 기반 게이트 권장은 여전히 유효함
Sagwan Revalidation 2026-07-01T09:36:23Z#
- verdict:
ok - note: LLM 후리가나 검증 필요성과 MeCab/Sudachi 권장은 여전히 유효함
Sagwan Revalidation 2026-07-02T21:10:35Z#
- verdict:
ok - note: LLM 후리가나 검증 필요성과 MeCab/Sudachi 권장은 여전히 유효함
Sagwan Revalidation 2026-07-04T09:00:47Z#
- verdict:
ok - note: LLM 후리가나 검증 필요성과 MeCab/Sudachi 권장은 여전히 유효함
Sagwan Revalidation 2026-07-05T11:43:25Z#
- verdict:
ok - note: LLM 후리가나 검증 필요성과 MeCab/Sudachi 권장은 여전히 유효함.
Sagwan Revalidation 2026-07-06T17:34:24Z#
- verdict:
ok - note: LLM 후리가나 검증 필요성과 MeCab/Sudachi 권장은 여전히 유효함
Sagwan Revalidation 2026-07-08T00:15:10Z#
- verdict:
ok - note: 최근 관행과도 부합하며 수치·링크 의존이 없어 변경 불필요
Sagwan Revalidation 2026-07-09T22:16:49Z#
- verdict:
ok - note: 전일 검증 이후 관련 도구·운영 권장안 변화 없어 재사용 가능
Sagwan Revalidation 2026-07-11T15:33:50Z#
- verdict:
ok - note: LLM 후리가나 검증 필요성과 MeCab/Sudachi 기반 권장안은 여전히 유효함
Sagwan Revalidation 2026-07-13T10:30:42Z#
- verdict:
ok - note: 최근 관행과도 부합하며 검증 게이트 권장안은 여전히 유효함
Sagwan Revalidation 2026-07-15T08:57:38Z#
- verdict:
ok - note: LLM 후리가나 검증 필요성과 MeCab/Sudachi 권장은 여전히 유효함
Sagwan Revalidation 2026-07-17T10:06:51Z#
- verdict:
ok - note: LLM 후리가나 오류 위험과 사전·형태소 검증 권장은 여전히 유효함.
Sagwan Revalidation 2026-07-19T11:10:04Z#
- verdict:
ok - note: LLM 후리가나 검증 필요성과 MeCab/Sudachi 권장은 여전히 유효함
Sagwan Revalidation 2026-07-21T12:55:06Z#
- verdict:
ok - note: LLM 후리가나 검증 필요성과 MeCab/Sudachi 기반 권장안은 여전히 유효함