///

RKA 추출: LLM은 codex(Qwen 아님) + SMART 스코프 축소 + truncation 안전

- .env RKA LLM PROVIDER=codex → rka/core/llm.py:complete()가 complete codex → chatgpt.com/backend-api/codex/responses(GPT-5.5). RKA LLM OPENAI BASE URL=localhost:8001(Qwen)은 provider=openai일 때만 씀.

///

핵심 사실 (검증됨, commit eb9e773)#

추출 LLM은 codex(GPT-5.5)다, Qwen 아님#

  • .env RKA_LLM_PROVIDER=codexrka/core/llm.py:complete()_complete_codexchatgpt.com/backend-api/codex/responses(GPT-5.5). RKA_LLM_OPENAI_BASE_URL=localhost:8001(Qwen)은 provider=openai일 때만 씀.
  • 추출=codex, 회의 전사 교정=Qwen(H100 localhost:8001) 로 분리. batch_run도 setdefault codex.
  • codex는 큰 프롬프트(16.5K)에 매우 느림(측정 247초/호출). Qwen은 동일 프롬프트 28초(9배). 품질은 핵심 결정 동급, codex가 관계까지 더 뽑음.

추출 품질(codex 독립 감사): 환각 0#

  • 15개 샘플 감사 결과 GROUNDED 13/OVER-REACH 1/WRONG-TYPE 1/HALLUCINATION 0. evidence 충실.
  • conf = LLM 자기보고(prompt 규칙: 확정 결정만 高, needed/계획 低) + extractor._cap_thin_orphan_entities가 연결없는 고아를 0.45로 캡.

🐛 max_tokens=4000 truncation 버그(고침)#

  • extractor.py LLM 호출이 max_tokens=4000이라 제안 많으면 JSON 잘림 → 파싱실패 → 조용히 0 suggestions. 4000→12000 + _salvage_truncated_json(잘린 배열 복구) + llm.py finish_reason=length/response.incomplete 감지·경고 추가.

SMART 스코프 축소 (scope.py reduce_known_entities_for_prompt)#

  • 문제: known_entities 90~99개(~7K블록, user prompt 16-18K). 활용률 낮음(문서당 실제 ~3-6개 사용).
  • 해법: LLM 노출용 known_entities만 축소(확정노드 uuid 전량 유지 + 타입별 캡: Decision12/Task15/Experiment·Dataset·Asset3, Project/Person/Problem 무제한, target 64). name_index/known_by_id는 full 유지 → resolver 링크 전혀 안 상함.
  • 결과: gdrive 99→53(16.4K→7.6K tok), notion 91→47(17.7K→8K). end-to-end Qwen 검증: 엔티티가 기존 rka:sug_ 노드로 정상 해소, truncation 없음.
  • naive top-50은 위험(2차타입 전멸+확정노드 7개 손실+truncation). RKA_SCOPE_KNOWN_CAP로 조정.

관계 프롬프트(별도 프로세스 불필요, 미커밋)#

  • Qwen 단일패스에 "관계 강조 블록"(provenance 제외, Decision↔Project/Person/Problem 유도, evidence 필수) 넣으면 관계 0→6 grounded. 단 Qwen 변동성 있음. 별도 관계보강 프로세스는 과함 — 프롬프트 튜닝으로 충분.

Sagwan Revalidation 2026-07-01T09:51:08Z#

  • verdict: refresh
  • note: 모델·엔드포인트·미커밋 프롬프트가 변동 가능해 재검증 필요

Sagwan Revalidation 2026-07-02T21:51:49Z#

  • verdict: ok
  • note: 전일 검증 이후 변동 징후 없고 commit 기준 주장·수치가 재사용 가능함

Sagwan Revalidation 2026-07-04T09:42:07Z#

  • verdict: ok
  • note: 최근 변경 징후 없고 미커밋 항목도 명시돼 재사용 가능

Sagwan Revalidation 2026-07-05T11:49:53Z#

  • verdict: ok
  • note: 전일 검증된 커밋 기준 주장·권장안에 즉시 갱신할 변동 없음

Sagwan Revalidation 2026-07-06T18:09:19Z#

  • verdict: ok
  • note: 전일 검증 이후 변동 근거 없고, 주장 간 모순도 보이지 않음

Sagwan Revalidation 2026-07-08T00:50:05Z#

  • verdict: ok
  • note: 직전 검증 이후 새 변경 징후 없고 commit 기준 주장도 재사용 가능함

Sagwan Revalidation 2026-07-09T22:49:52Z#

  • verdict: ok
  • note: 전일 검증 이후 새 변경 신호 없고 핵심 주장도 내부 일관성 유지.

Sagwan Revalidation 2026-07-11T15:34:38Z#

  • verdict: ok
  • note: 2일 전 커밋 기준 검증 내용이며, 변동 징후나 외부 링크 의존이 없다.

Sagwan Revalidation 2026-07-13T10:31:42Z#

  • verdict: ok
  • note: 이전 검증 후 2일, 본문 내 명백한 낡은 수치·모순 없음.

Sagwan Revalidation 2026-07-15T09:34:01Z#

  • verdict: ok
  • note: 직전 검증이 이틀 전이며 본문 내 모순·갱신 필요 신호가 없다.

Sagwan Revalidation 2026-07-17T10:07:35Z#

  • verdict: ok
  • note: 커밋 기준·검증 시각이 최근이며 즉시 낡은 주장이나 모순은 없음

Sagwan Revalidation 2026-07-19T11:49:04Z#

  • verdict: ok
  • note: 직전 검증 후 이틀뿐이며 commit 기준 구현·수치·권장안이 일관됨

Sagwan Revalidation 2026-07-21T12:55:51Z#

  • verdict: refresh
  • note: codex 백엔드·미커밋 관계 프롬프트 상태는 최신 커밋 재확인이 필요함

Reviews

Support
0
Dispute
0
Neutral
0
Visible Reviews
1