7d6b8b509f
v2.2.311 — 응답 지연 (실측: 출력 22토큰에 94.7초, 원인은 매 턴 13k+ 토큰 전체 재프리필) - KV 캐시 친화 프롬프트 분리(kvCachePromptSplit, 기본 ON): message[0]을 불변 정적 본문으로 고정, 날짜/RAG/[CONTEXT]/동적 블록을 마지막 user 메시지 직전의 internal system 메시지로 이동 — llama.cpp prompt cache 프리픽스 재사용으로 턴당 재프리필을 "직전 교환 + 동적 컨텍스트"로 축소. truncation 도 tail 적용. - 검색 토큰 예산 현실화(retrievalTokenBudget, 0=자동): 창의 25%(8k~80k) → 12%(2.5k~6k 클램프). - continuation 은 depth-0 memoryCtx 재사용: 라운드당 재검색 3~8초 제거 + 빈 쿼리 재검색으로 청크가 갈리던 문제 제거 + 턴 내 프롬프트 안정화. - 제2뇌 상주 캐시(신규 brainWatch.ts): 재귀 fs.watch 세대 카운터로 변경 없으면 디렉터리 워크·파일별 statSync 전면 생략. 수정 직후 3초 창은 신뢰 제외(이벤트 지연 레이스 가드), 워처 불가 시 종전 폴백, 활성화 시 백그라운드 워밍, 유휴 해제 30분→2시간. v2.2.312 — 보고 품질 (실사례: "## 4."부터 시작하는 7줄 일반론 보고서) - 중간 라운드 본문 표시 버그 수정: 액션과 함께 작성된 섹션(1~3)이 화면에 한 번도 안 나가고 최종 라운드만 표시되던 근본 원인 제거 — stripForDisplay.ts 로 액션 태그만 걷어내고 라운드 순서대로 버블에 표시. - '분석 보고' 업무 유형 신설(requirementGraph): 보고 개요(첫 줄 자기선언)·파일 근거(주장마다 실제 읽은 파일 인용, 일반론 금지)·구조·발견·다음 단계 강제, 유형 감지 시 "최대 3섹션" 규칙보다 필수 요소 커버 우선. - 근거 없는 분석 감지: 파일을 읽고도 인용 2개 미만인 장문 분석에 "근거 인용 없음" footer 경고 (헛조사 감지의 반대 방향). 검증: 전체 테스트 954건 통과(신규 28), tsc 무오류, vsix 패키징·설치 확인. Co-Authored-By: Claude Fable 5 <noreply@anthropic.com>
99 lines
4.3 KiB
TypeScript
99 lines
4.3 KiB
TypeScript
/**
|
|
* [v2.2.311] 제2뇌 상주 캐시 계층 — 워처 세대 기반 stat 생략 + 파일 목록 캐시.
|
|
*
|
|
* 핵심 계약:
|
|
* 1. 워처 세대가 그대로면 getBrainTokenIndex 는 파일별 statSync 를 생략한다.
|
|
* 2. 세대가 바뀌면(파일시스템 변경) 다시 stat 을 거쳐 변경분을 재색인한다.
|
|
* 3. 부분(스코프) 목록으로 검증된 상태에서 전체 목록 질의가 와도, 검증 안 된
|
|
* 파일은 신뢰 경로로 새지 않는다 (파일 단위 검증 장부).
|
|
* 4. 워처 불가 환경(gen === -1)에서는 종전과 동일하게 매번 stat.
|
|
*/
|
|
import * as fs from 'fs';
|
|
import * as os from 'os';
|
|
import * as path from 'path';
|
|
|
|
// brainWatch 를 결정적으로 제어 — 실제 fs.watch 이벤트 타이밍에 의존하지 않는다.
|
|
let mockGen = 0;
|
|
jest.mock('../src/retrieval/brainWatch', () => ({
|
|
ensureBrainWatcher: jest.fn(),
|
|
getBrainGeneration: jest.fn(() => mockGen),
|
|
listBrainFilesCached: jest.fn(),
|
|
warmBrainCache: jest.fn(),
|
|
disposeBrainWatcher: jest.fn(),
|
|
}));
|
|
|
|
import { getBrainTokenIndex } from '../src/retrieval/brainIndex';
|
|
|
|
function makeBrain(files: Record<string, string>): { root: string; paths: string[] } {
|
|
const root = fs.mkdtempSync(path.join(os.tmpdir(), 'astra-brain-'));
|
|
const paths: string[] = [];
|
|
for (const [name, content] of Object.entries(files)) {
|
|
const p = path.join(root, name);
|
|
fs.writeFileSync(p, content, 'utf8');
|
|
// RECENT_MTIME_GUARD(3초): 갓 수정된 파일은 신뢰 명부에 오르지 않으므로,
|
|
// "변경 없음" 시나리오를 테스트하려면 mtime 을 과거로 되돌린다.
|
|
const past = new Date(Date.now() - 60_000);
|
|
fs.utimesSync(p, past, past);
|
|
paths.push(p);
|
|
}
|
|
return { root, paths };
|
|
}
|
|
|
|
function countStatsFor(paths: string[], spy: jest.SpyInstance): number {
|
|
return spy.mock.calls.filter((c) => paths.includes(String(c[0]))).length;
|
|
}
|
|
|
|
describe('getBrainTokenIndex — 워처 세대 기반 stat 생략', () => {
|
|
afterEach(() => jest.restoreAllMocks());
|
|
|
|
test('같은 세대의 2번째 호출은 statSync 0회 (캐시 신뢰)', () => {
|
|
mockGen = 0;
|
|
const { root, paths } = makeBrain({ 'a.md': '알파 내용', 'b.md': '베타 내용' });
|
|
expect(getBrainTokenIndex(root, paths)).toHaveLength(2);
|
|
|
|
const spy = jest.spyOn(fs, 'statSync');
|
|
const r2 = getBrainTokenIndex(root, paths);
|
|
expect(r2).toHaveLength(2);
|
|
expect(countStatsFor(paths, spy)).toBe(0);
|
|
expect(r2.map((d) => d.title).sort()).toEqual(['a', 'b']);
|
|
});
|
|
|
|
test('세대가 바뀌면 재-stat 후 변경 내용을 재색인한다', () => {
|
|
mockGen = 0;
|
|
const { root, paths } = makeBrain({ 'a.md': '원본 토큰들' });
|
|
getBrainTokenIndex(root, paths);
|
|
|
|
// 파일 변경 + 세대 bump (mtime 차이를 보장하기 위해 utimesSync 로 강제)
|
|
fs.writeFileSync(paths[0], '완전히 새로운 내용입니다', 'utf8');
|
|
const future = new Date(Date.now() + 5000);
|
|
fs.utimesSync(paths[0], future, future);
|
|
mockGen = 1;
|
|
|
|
const spy = jest.spyOn(fs, 'statSync');
|
|
const r = getBrainTokenIndex(root, paths);
|
|
expect(countStatsFor(paths, spy)).toBeGreaterThan(0);
|
|
expect(r[0].tokens).toEqual(expect.arrayContaining(['새로운']));
|
|
});
|
|
|
|
test('스코프 검증 후 전체 질의 — 미검증 파일은 신뢰 경로로 새지 않는다', () => {
|
|
mockGen = 0;
|
|
const { root, paths } = makeBrain({ 'in-scope.md': '스코프 안', 'out-scope.md': '스코프 밖' });
|
|
const [inScope, outScope] = paths;
|
|
getBrainTokenIndex(root, [inScope]); // 부분 목록만 검증됨
|
|
|
|
const spy = jest.spyOn(fs, 'statSync');
|
|
getBrainTokenIndex(root, paths); // 전체 질의
|
|
expect(countStatsFor([inScope], spy)).toBe(0); // 검증된 파일은 생략
|
|
expect(countStatsFor([outScope], spy)).toBeGreaterThan(0); // 미검증 파일은 stat
|
|
});
|
|
|
|
test('워처 불가(gen=-1) 환경은 매번 stat (종전 동작)', () => {
|
|
mockGen = -1;
|
|
const { root, paths } = makeBrain({ 'a.md': '내용' });
|
|
getBrainTokenIndex(root, paths);
|
|
const spy = jest.spyOn(fs, 'statSync');
|
|
getBrainTokenIndex(root, paths);
|
|
expect(countStatsFor(paths, spy)).toBeGreaterThan(0);
|
|
});
|
|
});
|