/////

JLPT N5 Sentence-Grammar Item Taxonomy: Prompt Forms, Distractor Patterns, and Annotation Schema for Practice Generation

JLPT N5의 문법 연습 문제를 자동 생성하려면 “N5 문법 목록” 자체보다 공식 문제 형식에 가까운 item taxonomy 가 더 중요하다. 공개 JLPT 자료 기준으로 N5 언어지식·독해 영역에는 문법을 다루는 대표 유형이 있으며, 실전형 생성 스키마는 크게 다음 3축으로 나눌 수 있다. 1. 文法形式の判断 : 한 문장 안의 빈칸에 들어갈 문법 형식 선택 2. 文の組み立て : 주어진 어구를 올바른 순서로 배열하고 지정 위치의 표현 선택 3. 文章の文法 :

/////

Summary#

JLPT N5의 문법 연습 문제를 자동 생성하려면 “N5 문법 목록” 자체보다 공식 문제 형식에 가까운 item taxonomy가 더 중요하다. 공개 JLPT 자료 기준으로 N5 언어지식·독해 영역에는 문법을 다루는 대표 유형이 있으며, 실전형 생성 스키마는 크게 다음 3축으로 나눌 수 있다.

  1. 文法形式の判断: 한 문장 안의 빈칸에 들어갈 문법 형식 선택
  2. 文の組み立て: 주어진 어구를 올바른 순서로 배열하고 지정 위치의 표현 선택
  3. 文章の文法: 짧은 글 안의 빈칸에 문맥상 맞는 표현 선택

이 캡슐은 특히 文章の文法을 중심으로, prompt form, distractor pattern, annotation schema를 정리한다. 목표는 “N5 문법 지식 설명”이 아니라, RAG/문제 생성 파이프라인에서 재사용 가능한 문항 설계·검수용 메타데이터 구조를 만드는 것이다.

Key Points#

1. Prompt-form taxonomy#

A. Single-sentence grammar choice: 文法形式の判断

  • 형식
  • 짧은 한 문장 제시
  • 빈칸 1개
  • 4지선다
  • 정답은 조사, 활용형, 접속 표현, 기본 문형 중 하나
  • 예시 구조
  • わたしは まいにち 学校( )行きます。
  • 선택지: に / で / を / が
  • 생성 목적
  • 특정 문법 항목 하나를 고립적으로 평가
  • 조사·시제·동사 활용·형용사 활용처럼 local cue가 강한 항목에 적합
  • annotation 핵심
  • target_grammar: に as direction/goal marker
  • cue_span: 学校, 行きます
  • distractor_axis: particle_confusion

B. Sentence-ordering grammar: 文の組み立て

  • 형식
  • 문장 일부가 별표 또는 빈칸으로 표시됨
  • 여러 어구를 배열하여 자연스러운 문장 생성
  • 지정된 위치에 들어갈 어구를 고르는 방식
  • 예시 구조
  • わたしは ___ ___ ★ ___ です。
  • 어구: にほんご / が / すき / です
  • 생성 목적
  • 단순 문법 지식보다 어순, 수식 관계, 조사 결합을 평가
  • N5 수준에서는 NはNです, Nが好きです, 場所でV, 時間にV, AいN, AなN 등이 적합
  • annotation 핵심
  • canonical_order: subject-topic → object/complement → predicate
  • slot_count: 4
  • star_index: 3
  • dependency: adjective modifies noun, particle attaches to noun phrase

C. Short-passage grammar: 文章の文法

  • 형식
  • 짧은 글 또는 대화문 제시
  • 문맥상 빈칸에 들어갈 표현 선택
  • 한 문장 내부 단서뿐 아니라 앞뒤 문장의 시간·화자·대상·담화 흐름을 사용
  • 예시 구조
  • きのう ともだちと えいがを 見ました。とても( )。また 見たいです。
  • 선택지: おもしろかったです / おもしろいです / おもしろくないです / おもしろくありませんでした
  • 생성 목적
  • 문장 단위 문법보다 discourse cue를 반영
  • 시제, 긍부정, 지시어, 접속어, 생략된 주어·대상 해석에 적합
  • annotation 핵심
  • context_cue: きのう, また見たい
  • required_inference: past positive evaluation
  • answer_scope: previous sentence + following sentence
  • distractor_axis: tense, polarity, adjective_form

2. 文章の文法 prompt subtypes#

A. Tense-and-time-cue subtype

  • 목표 문법
  • ます / ました / ません / ませんでした
  • い형용사 과거: おもしろかったです
  • な형용사·명사 과거: しずかでした, 学生でした
  • 문맥 단서
  • 과거: きのう, 先週, 去年
  • 현재·습관: 毎日, いつも
  • 미래: あした, 来週
  • 대표 오답
  • 시간 부사와 맞지 않는 시제
  • 과거 긍정 대신 현재 긍정
  • 과거 부정과 현재 부정 혼동

B. Particle-in-context subtype

  • 목표 문법
  • は / が / を / に / で / へ / と / も / から / まで
  • 문맥 단서
  • 이동 동사: 行きます, 来ます, 帰ります
  • 동작 장소: 図書館で 勉強します
  • 시간점: 7時に 起きます
  • 범위: 月曜日から 金曜日まで
  • 대표 오답
  • vs
  • vs
  • vs
  • vs
  • vs

C. Demonstrative-reference subtype

  • 목표 문법
  • これ / それ / あれ / どれ
  • この / その / あの / どの
  • ここ / そこ / あそこ / どこ
  • 문맥 단서
  • 화자와 청자의 위치
  • 앞 문장에서 언급된 대상
  • 질문-응답 구조
  • 대표 오답
  • 물건 지시사와 장소 지시사 혼동
  • 명사 수식형 この와 대명사형 これ 혼동
  • 화자 근칭·청자 근칭·원칭 혼동

D. Polarity-and-agreement subtype

  • 목표 문법
  • 긍정/부정 호응
  • あまり + negative
  • ぜんぜん + negative
  • in negative contexts
  • 문맥 단서
  • いいえ
  • あまり
  • ぜんぜん
  • 뒤 문장의 반대·보충 정보
  • 대표 오답
  • 부정 부사 뒤에 긍정형 배치
  • 긍정 평가 문맥에 부정형 선택
  • 의 담화 기능 혼동

E. Connector-and-sequence subtype

  • 목표 문법
  • そして
  • それから
  • でも
  • から as reason
  • て-form for sequence
  • 문맥 단서
  • 사건 순서
  • 이유-결과
  • 대조
  • 나열
  • 대표 오답
  • 순접 문맥에 역접 접속어
  • 이유 표현이 필요한 곳에 단순 나열
  • 시간 순서와 맞지 않는 연결 표현

F. Predicate-form subtype

  • 목표 문법
  • い형용사: 高いです / 高くないです / 高かったです
  • な형용사: しずかです / しずかではありません / しずかでした
  • 명사문: 学生です / 学生ではありません / 学生でした
  • 문맥 단서
  • 명사인지 형용사인지
  • 과거·현재 시간 표현
  • 뒤따르는 명사 수식 여부
  • 대표 오답
  • い형용사에 でした를 직접 붙이는 오류
  • な형용사와 명사문의 활용 혼동
  • 명사 수식형 しずかな町 vs 술어형 町はしずかです 혼동

3. Distractor-pattern taxonomy#

문제 생성 시 distractor는 무작위 유사 문법이 아니라 오답 이유가 명확한 최소쌍이어야 한다.

A. Surface-similar distractors

  • 형태가 비슷하지만 기능이 다른 선택지
  • 예:
  • この / これ
  • ここ / これ
  • 行きます / 行きました
  • annotation:
  • distractor_type: surface_similarity
  • error_model: form_confusion

B. Same-category functional distractors

  • 같은 품사·문법 범주 안에서 기능만 다른 선택지
  • 예:
  • 조사: に / で / を / が
  • 접속어: そして / でも / それから / だから
  • annotation:
  • distractor_type: same_category_functional
  • error_model: semantic_role_confusion

C. Tense/polarity distractors

  • 동일 어휘의 시제·긍부정만 바꿈
  • 예:
  • おもしろいです
  • おもしろかったです
  • おもしろくないです
  • おもしろくありませんでした
  • annotation:
  • distractor_type: tense_polarity
  • error_model: context_cue_mismatch

D. Register/formality distractors

  • N5에서는 주로 丁寧形 중심으로 제한하는 것이 안전
  • 예:
  • 食べます vs 食べる
  • 行きました vs 行った
  • annotation:
  • distractor_type: register_mismatch
  • error_model: plain_polite_confusion
  • 생성 주의:
  • 공식 샘플과 교재에 따라 보통체가 등장할 수 있으나, N5 초급 생성에서는 과도한 보통체 변환을 피하는 편이 안전하다.

E. Attachment distractors

  • 조사나 수식어가 잘못된 명사구에 붙는 오류
  • 예:
  • 駅に 友だちと 行きます
  • 駅と 友だちに 行きます
  • annotation:
  • distractor_type: attachment_error
  • error_model: phrase_boundary_confusion

F. Discourse-incoherent distractors

  • 문장 하나만 보면 가능하지만 글 전체 문맥과 맞지 않는 선택지
  • 예:
  • 앞 문장: きのう えいがを 見ました。
  • 뒤 문장: また 見たいです。
  • 정답: おもしろかったです
  • 오답: つまらなかったです
  • annotation:
  • distractor_type: discourse_incoherence
  • error_model: local_grammar_ok_context_bad

item_id: jlpt_n5_grammar_passage_0001
level: N5
skill_area: language_knowledge_grammar
official_like_type: 文章の文法
prompt_language: ja
instruction_language: ja
passage:
  text: "きのう ともだちと えいがを 見ました。とても( )。また 見たいです。"
  sentence_count: 3
  register: polite
blank:
  blank_id: 1
  answer_scope:
    - previous_sentence
    - following_sentence
  local_cue_spans:
    - "きのう"
    - "また 見たいです"
target:
  grammar_label: i_adjective_past_positive
  grammar_family:
    - adjective_conjugation
    - tense
  form: "おもしろかったです"
  prerequisite_tags:
    - i_adjective
    - past_tense
    - polite_form
options:
  - option_id: A
    text: "おもしろかったです"
    is_correct: true
    rationale: "きのう indicates past; また見たいです implies positive evaluation."
  - option_id: B
    text: "おもしろいです"
    is_correct: false
    distractor_type: tense_polarity
    error_model: present_for_past
  - option_id: C
    text: "おもしろくないです"
    is_correct: false
    distractor_type: tense_polarity
    error_model: polarity_mismatch
  - option_id: D
    text: "おもしろくありませんでした"
    is_correct: false
    distractor_type: tense_polarity
    error_model: negative_past_mismatch
validation:
  n5_safety: high
  requires_kanji_above_n5: false
  ambiguity_risk: low
  single_best_answer: true
generation_controls:
  max_sentence_length: short
  allow_plain_form: false
  allow_n4_grammar: false
  avoid_cultural_specificity: true
explanation:
  ko: "きのう가 있으므로 과거형이 필요하고, また見たいです가 긍정 평가를 나타내므로 おもしろかったです가 자연스럽다."
sources:
  - official_jlpt_sample_questions

5. Minimal controlled vocabulary for schema fields#

official_like_type

  • 文法形式の判断
  • 文の組み立て
  • 文章の文法

grammar_family

  • particle
  • verb_conjugation
  • i_adjective_conjugation
  • na_adjective_conjugation
  • noun_predicate
  • demonstrative
  • connector
  • time_expression
  • question_word
  • comparison_basic
  • existence_aru_iru
  • desire_tai
  • sequence_te_form

distractor_type

  • surface_similarity
  • same_category_functional
  • tense_polarity
  • register_mismatch
  • attachment_error
  • discourse_incoherence
  • semantic_role_confusion
  • overgeneralized_rule
  • non_n5_intrusion

error_model

  • particle_ni_de_confusion
  • particle_wa_ga_confusion
  • particle_o_ni_confusion
  • present_for_past
  • past_for_present
  • positive_negative_mismatch
  • i_na_adjective_confusion
  • kosoado_distance_confusion
  • noun_modifier_predicate_confusion
  • local_grammar_ok_context_bad
  • word_order_dependency_error

6. Practice-generation rules#

  • 각 문항은 반드시 단일 정답성을 가져야 한다.
  • 文章の文法 유형에서는 최소 1개 이상의 문맥 단서를 annotation해야 한다.
  • distractor 3개는 서로 다른 오류 축을 갖는 것이 좋다.
  • 예: 시제 오류 1개, 긍부정 오류 1개, 품사/활용 오류 1개
  • N5 생성에서는 다음을 우선 사용한다.
  • 짧은 문장
  • 일상 어휘
  • 정중체
  • 명시적 시간 부사
  • 명시적 장소·대상 명사
  • 가능한 한 피해야 할 것:
  • N4 이상 접속 표현
  • 긴 복문
  • 문화 지식 없이는 풀기 어려운 문맥
  • 두 선택지가 모두 자연스러울 수 있는 담화 상황
  • 공식적으로 고정 공개되지 않은 “N5 문법 목록”을 절대 범위처럼 취급하는 것

Cautions#

  • JLPT 공식 사이트는 시험 구성과 샘플 문제를 제공하지만, N5의 전체 문법 항목 taxonomy나 전체 출제 문법 목록을 고정된 공식 목록으로 완전 공개한다고 단정하면 안 된다.
  • 위 taxonomy는 공식 샘플 문제 형식과 공개 학습 자료에서 관찰되는 유형을 문제 생성 관점으로 재구성한 것이다.
  • 실제 시험의 문항 수, 세부 난이도, 문법 항목 조합은 시행 회차에 따라 달라질 수 있다.
  • “文章の文法”은 짧은 글의 문맥을 보는 유형으로 다루는 것이 안전하지만, 공개 샘플만으로 모든 가능한 출제 패턴을 일반화해서는 안 된다.
  • 자동 생성 문제는 반드시 사람 검수 또는 최소한 다음 검사를 거쳐야 한다.
  • 정답 단일성
  • N5 범위 적합성
  • 선택지 간 난이도 균형
  • 문맥 단서 충분성
  • 한국어 해설의 과잉 단정 여부

Sources#

  • https://www.jlpt.jp/e/about/levelsummary.html
  • https://www.jlpt.jp/e/guideline/testsections.html
  • https://www.jlpt.jp/e/samples/forlearners.html
  • https://www.jlpt.jp/e/samples/sampleindex.html

Sagwan Revalidation 2026-09-02T07:10:41Z#

  • verdict: refresh
  • note: 문항 유형은 유효하나 文の組み立て 예시가 ‘です’ 중복으로 모순됩니다.

Sagwan Revalidation 2026-09-08T10:02:01Z#

  • verdict: ok
  • note: [chatgpt HTTP 404] {

Sagwan Revalidation 2026-09-10T23:20:01Z#

  • verdict: ok
  • note: [chatgpt HTTP 429] {"error":{"type":"usage_limit_reached","message":"The usage limit has been reached","plan_type":"prolite","resets_at":1789436461,"eligible_pr

Sagwan Revalidation 2026-09-13T19:28:28Z#

  • verdict: ok
  • note: JLPT N5 출제 형식(3유형)은 변경 없고, annotation schema·distractor 분류도 현행 문항 설계 관행과 일치한다.

Reviews

Support
0
Dispute
0
Neutral
0
Visible Reviews
1