archive: move model-route-queue-policy-alignment to archive

This commit is contained in:
toki 2026-06-17 08:54:52 +09:00
parent 1eda14e8ac
commit 3a0d290ae0
3 changed files with 18 additions and 15 deletions

View file

@ -13,7 +13,7 @@ Edge-owned model group queue의 정책 원천을 OpenAI-compatible `model_routes
## 상태
[진행중]
[완료]
## 승격 조건
@ -23,7 +23,7 @@ Edge-owned model group queue의 정책 원천을 OpenAI-compatible `model_routes
- 상태: 해제
- SDD: 필요
- SDD 문서: `agent-roadmap/sdd/inference-provider-extension/model-route-queue-policy-alignment/SDD.md`
- SDD 문서: `agent-roadmap/archive/sdd/inference-provider-extension/model-route-queue-policy-alignment/SDD.md`
- SDD 사유: OpenAI route config schema와 Edge queue dispatch 계약을 바꾸는 작업이다.
- 잠금 해제 조건:
- [x] SDD 잠금이 해제되어 있다
@ -47,20 +47,23 @@ Edge-owned model group queue의 정책 원천을 OpenAI-compatible `model_routes
OpenAI-compatible model alias가 Edge queue group의 정책 원천이 되도록 config, dispatch DTO, queue admission 경로를 정리한다.
- [ ] [config-schema] `openai.model_routes[]``max_queue`, `queue_timeout_ms`를 받을 수 있고 validation/default/fallback 문서가 정리되어 있다. 검증: `go test -count=1 ./packages/go/config ./apps/edge/internal/openai`
- [ ] [dispatch-contract] OpenAI Chat Completions와 Responses route resolution이 route-level queue policy를 `SubmitRunRequest`로 전달한다. 검증: `go test -count=1 ./apps/edge/internal/openai`
- [ ] [queue-policy] Edge queue admission이 route-level queue policy를 adapter instance fallback보다 우선하고, route policy가 없을 때 기존 fallback을 유지한다. 검증: `go test -count=1 ./apps/edge/internal/service`
- [ ] [docs-example] `configs/edge.yaml` 예시가 model alias queue policy와 Node/provider `capacity`의 책임 경계를 보여준다.
- [x] [config-schema] `openai.model_routes[]``max_queue`, `queue_timeout_ms`를 받을 수 있고 validation/default/fallback 문서가 정리되어 있다. 검증: `go test -count=1 ./packages/go/config ./apps/edge/internal/openai`
- [x] [dispatch-contract] OpenAI Chat Completions와 Responses route resolution이 route-level queue policy를 `SubmitRunRequest`로 전달한다. 검증: `go test -count=1 ./apps/edge/internal/openai`
- [x] [queue-policy] Edge queue admission이 route-level queue policy를 adapter instance fallback보다 우선하고, route policy가 없을 때 기존 fallback을 유지한다. 검증: `go test -count=1 ./apps/edge/internal/service`
- [x] [docs-example] `configs/edge.yaml` 예시가 model alias queue policy와 Node/provider `capacity`의 책임 경계를 보여준다.
## 완료 리뷰
- 상태: 없음
- 요청일: 없음
- 완료 근거: 모든 기능 Task가 아직 충족되지 않았다.
- 상태: 승인됨
- 요청일: 2026-06-17
- 완료 근거:
- `agent-task/archive/2026/06/m-model-route-queue-policy-alignment/01_config_route_policy/complete.log``config-schema`, `dispatch-contract`, `docs-example`과 SDD S01, S02, S04 PASS를 기록했다.
- `agent-task/archive/2026/06/m-model-route-queue-policy-alignment/02+01_service_queue_policy/complete.log``queue-policy`와 SDD S03 PASS를 기록했다.
- 최종 검증으로 `go test -count=1 ./packages/go/config ./apps/edge/internal/openai`, `go test -count=1 ./apps/edge/internal/service`, `git diff --check`가 PASS로 기록되어 있다.
- 리뷰 필요:
- [ ] 사용자가 완료 결과를 확인했다
- [ ] archive 이동을 승인했다
- 리뷰 코멘트: 없음
- [x] 사용자가 완료 결과를 확인했다
- [x] archive 이동을 승인했다
- 리뷰 코멘트: 2026-06-17 코드 레벨 검토와 관련 테스트 재검증 후 종료 승인에 따라 완료 처리했다.
## 범위 제외

View file

@ -2,7 +2,7 @@
## 위치
- Milestone: `agent-roadmap/phase/inference-provider-extension/milestones/model-route-queue-policy-alignment.md`
- Milestone: `agent-roadmap/archive/phase/inference-provider-extension/milestones/model-route-queue-policy-alignment.md`
- Phase: `agent-roadmap/phase/inference-provider-extension/PHASE.md`
## 상태

View file

@ -32,8 +32,8 @@ Ollama 경로가 안정화된 뒤, 그 결과를 기준선으로 삼아 Lemonade
- 경로: `agent-roadmap/archive/phase/inference-provider-extension/milestones/edge-model-group-queue-scheduling.md`
- 요약: OpenAI-compatible 요청의 `model` 값을 queue group key로 사용하고, Node-local admission queue를 Edge-owned model-group FIFO와 node dispatch scheduler로 전환한다.
- [진행중] Model route Queue 정책 정합화
- 경로: `agent-roadmap/phase/inference-provider-extension/milestones/model-route-queue-policy-alignment.md`
- [완료] Model route Queue 정책 정합화
- 경로: `agent-roadmap/archive/phase/inference-provider-extension/milestones/model-route-queue-policy-alignment.md`
- 요약: Edge-owned model group queue의 정책 원천을 `openai.model_routes[]`의 model alias로 정리하고, Node/provider instance에는 per-node capacity 기준만 남긴다.
- [진행중] vLLM provider 서빙 경로 추가