v0.20.2.ko.md
docs/i18n/release-notes/v0.20.2.ko.md
Tesserae v0.20.2 — 이제 모델이 모든 것을 읽습니다
<!-- translations:start -->
English · 中文 · 日本語 · Русский · Español · Français · Deutsch
<!-- translations:end -->
Released 2026-07-14 · PyPI · GitHub release · pip install --upgrade tesserae==0.20.2
긴 세션 수정의 후반부입니다. v0.20.1은 300-turn 임포트 상한선을 제거하여 전체 대화 히스토리가 스토어에 도달하게 했습니다; 이번 릴리스는 소비 측을 수정하여, 그 히스토리를 읽는 모든 LLM이 총 길이와 관계없이 실제로 전부를 읽도록 합니다.
0.20.1 이후에도 여전히 잘못되어 있던 것
- 세션 발췌가 크기에 맞춰 절단됨: 프로젝트당 24,000자 한계를 넘으면 요약이 "…more sessions omitted for length"와 함께 세션 전체를 누락시켰습니다 — 모델은 그것들을 전혀 보지 못했습니다.
- 제한 없는 단일 프롬프트: 요약 내러티브와 에이전트 결정 마이닝이 각각 모든 것을 단일 LLM 호출로 전송했습니다 — 바쁜 기간에는 어떤 컨텍스트 윈도우보다도 컸습니다.
max_turns_per_chunk가 크기가 아니라 turn 수를 세었음: 서른 개의 turn이 500KB짜리 툴 덤프 하나를 담을 수 있어, 세션 그래프 추출 청크는 여전히 오버플로우할 수 있었습니다.
변경 사항
새로운 tesserae/llm_chunking.py: 결정론적 블록 패커와, 보수적인 컨텍스트 예산(48,000자 ≈ 12k 토큰; TESSERAE_LLM_CHUNK_CHARS로 조정)에 맞춰진 map-reduce 러너입니다. 세션 히스토리를 소비하는 모든 LLM이 이제 예산 크기의 청크를 순회합니다 — PART i/N map 호출 후 계층적 병합 — 절단 마커는 사라지고, 하나의 초과 크기 turn은 오버플로우하는 대신 청크에 걸쳐 라인 단위로 분할되며, 작은 입력은 기존의 단일 호출 경로를 그대로 유지합니다.
--max-turns는 스캔 메모리 가드로만 남습니다 — 더 이상 모델이 읽는 범위를 제한하지 않습니다.
요구 사항에 대해 직접 검증했습니다: 600KB의 세션 히스토리 → 82개의 제한된 호출(8,000자 테스트 예산 아래 최대 프롬프트 7,525자) → 모든 세션이 반영된 하나의 병합된 내러티브. 수용 테스트는 이전 절단 한계 너머의 마지막 세션에 결정을 심어 둡니다 — 수정 전 코드에서는 실패합니다.