iop/agent-roadmap/phase/knowledge-tool-optimization-extension/milestones
toki 3d10de0652 docs(bench): 단일 평가 기준을 추가한다
별도 채점 하네스를 만들지 않고도 산출물을 재검산 가능하게 비교할 수 있도록 고정 100점 rubric, opaque 평가, 직접 evidence와 단순 총점 규칙을 마지막 작업으로 추가한다.
2026-08-14 06:07:30 +09:00
..
advisor-context-hook-second-wave.md docs(roadmap): 실행 lane과 후속 마일스톤을 정리한다 2026-08-02 13:58:03 +09:00
inference-api-surface-execution-lifecycle-refactor.md fix(edge): agy 도구 연속 호출을 지원한다 2026-08-13 23:25:39 +09:00
knowledge-tool-validation-optimization.md feat(openai): extend Anthropic bridge compatibility 2026-08-06 07:04:03 +09:00
llm-judged-missing-tool-call-retry-gate.md
long-term-memory-rag-second-wave.md docs(roadmap): 실행 lane과 후속 마일스톤을 정리한다 2026-08-02 13:58:03 +09:00
openai-compatible-hybrid-request-execution-routing.md feat(openai): extend Anthropic bridge compatibility 2026-08-06 07:04:03 +09:00
openai-compatible-incomplete-tool-call-syntax-gate.md
openai-compatible-output-validation-filters.md
openai-compatible-runtime-output-integrity-filter.md
rag-local-routing-model-operations.md feat(openai): extend Anthropic bridge compatibility 2026-08-06 07:04:03 +09:00
request-context-assembly-optimization.md docs(roadmap): 실행 lane과 후속 마일스톤을 정리한다 2026-08-02 13:58:03 +09:00
thin-agent-model-comparison-benchmark.md docs(bench): 단일 평가 기준을 추가한다 2026-08-14 06:07:30 +09:00
tool-call-validator-model-gate-review.md