update roadmap: archive inference-provider-extension milestone and update phase docs

This commit is contained in:
toki 2026-06-12 11:26:29 +09:00
parent 8bb0c2babe
commit 7398f326b3
3 changed files with 25 additions and 23 deletions

View file

@ -38,9 +38,9 @@ RAG, context 구성/압축, web search, MCP 정책, tool policy, output validati
- 경로: `agent-roadmap/phase/automation-runtime-bridge/PHASE.md`
- 요약: Runtime과 Automation 실행 흐름을 공통화하고, specialized domain agent의 독립 전환 이후 generic boundary 정리, bootstrap/enrollment, message boundary와 agentless remote terminal bridge를 분리해 확장하는 단계다.
- [계획] 추론 서버 provider 확장
- [진행중] 추론 서버 provider 확장
- 경로: `agent-roadmap/phase/inference-provider-extension/PHASE.md`
- 요약: Ollama 경로가 안정화된 뒤 그 결과를 기준선으로 삼아 SGLang 같은 추가 추론 서버 provider를 붙이고, provider별 adapter/config/target/model 매핑 표준선을 정리하는 단계다.
- 요약: Ollama 경로 안정화 결과를 기준선으로 삼아 Node 단일 통로 멀티 타겟 서빙 기반을 완료했고, 이후 SGLang 같은 추가 provider의 adapter/config/target/model 매핑 표준선을 정리하는 단계다.
- [계획] 지식과 도구 최적화 확장
- 경로: `agent-roadmap/phase/knowledge-tool-optimization-extension/PHASE.md`

View file

@ -12,7 +12,7 @@ Edge는 Node별 adapter/profile/engine/model 라우팅과 Edge-owned runtime opt
## 상태
[계획]
[완료]
## 승격 조건
@ -36,19 +36,19 @@ Edge는 Node별 adapter/profile/engine/model 라우팅과 Edge-owned runtime opt
### Epic: [multi-target-node] Single Node Multi Target Serving
- [ ] [config-topology] Edge `nodes[]` 설정과 `NodeConfigPayload`가 하나의 Node 안에 여러 CLI profile, terminal gateway, 추론 engine/profile instance, model target route를 표현한다.
- [ ] [adapter-registry] Node adapter registry가 동일 adapter type의 여러 engine/profile instance를 덮어쓰지 않고 라우팅 가능한 target namespace로 관리한다.
- [ ] [route-catalog] Edge OpenAI-compatible model catalog가 외부 `model`을 Edge-owned route table로 해석하고, 고정 `openai.target` 단일 override 없이 내부 `adapter + target`으로 변환한다. 검증: `/v1/models`가 여러 route를 노출하고 각 model 요청이 기대 adapter/target으로 dispatch되는 단위 테스트를 통과한다.
- [ ] [engine-profiles] Ollama는 여러 `base_url`/model target과 target별 `context_size`를 지원하고, vLLM/SGLang 같은 OpenAI-compatible inference engine 연결을 같은 Node 통로에서 확장할 수 있는 provider/profile 기준이 정리되어 있다.
- [ ] [edge-owned-options] context window와 runner sizing 옵션은 Edge config가 최종 소유하며, 외부 agent request의 `options.num_ctx` 같은 값이 Edge-owned 값을 변경하지 못한다. 검증: 요청 option override가 route/profile 설정으로 덮이는 테스트를 통과한다.
- [ ] [commands-caps] `CAPABILITIES`, `SESSION_LIST`, `USAGE_STATUS`, provider passthrough command가 여러 adapter/profile/model target에서 모호하지 않은 결과를 반환한다.
- [ ] [runtime-concurrency] `runtime.concurrency`와 adapter capability가 Node 멀티 호출에서 실제 제한 또는 스케줄링 정책으로 적용된다. 검증: 동시 run 테스트에서 제한 초과 요청이 queue/reject/timeout 중 정의된 정책대로 동작한다.
- [ ] [field-smoke] split-host smoke에서 하나의 연결된 Node가 최소 두 개의 inference model target과 하나의 CLI target을 같은 Edge-Node 연결로 호출할 수 있음을 확인한다.
- [x] [config-topology] Edge `nodes[]` 설정과 `NodeConfigPayload`가 하나의 Node 안에 여러 CLI profile, terminal gateway, 추론 engine/profile instance, model target route를 표현한다.
- [x] [adapter-registry] Node adapter registry가 동일 adapter type의 여러 engine/profile instance를 덮어쓰지 않고 라우팅 가능한 target namespace로 관리한다.
- [x] [route-catalog] Edge OpenAI-compatible model catalog가 외부 `model`을 Edge-owned route table로 해석하고, 고정 `openai.target` 단일 override 없이 내부 `adapter + target`으로 변환한다. 검증: `/v1/models`가 여러 route를 노출하고 각 model 요청이 기대 adapter/target으로 dispatch되는 단위 테스트를 통과한다.
- [x] [engine-profiles] Ollama는 여러 `base_url`/model target과 target별 `context_size`를 지원하고, vLLM/SGLang 같은 OpenAI-compatible inference engine 연결을 같은 Node 통로에서 확장할 수 있는 provider/profile 기준이 정리되어 있다.
- [x] [edge-owned-options] context window와 runner sizing 옵션은 Edge config가 최종 소유하며, 외부 agent request의 `options.num_ctx` 같은 값이 Edge-owned 값을 변경하지 못한다. 검증: 요청 option override가 route/profile 설정으로 덮이는 테스트를 통과한다.
- [x] [commands-caps] `CAPABILITIES`, `SESSION_LIST`, `USAGE_STATUS`, provider passthrough command가 여러 adapter/profile/model target에서 모호하지 않은 결과를 반환한다.
- [x] [runtime-concurrency] `runtime.concurrency`와 adapter capability가 Node 멀티 호출에서 실제 제한 또는 스케줄링 정책으로 적용된다. 검증: 동시 run 테스트에서 제한 초과 요청이 queue/reject/timeout 중 정의된 정책대로 동작한다.
- [x] [field-smoke] split-host smoke에서 하나의 연결된 Node가 최소 두 개의 inference model target과 하나의 CLI target을 같은 Edge-Node 연결로 호출할 수 있음을 확인한다.
## 작업 분할
- 상태: 첫 Epic의 각 기능 Task는 config/proto, Edge routing, Node registry, provider profile, runtime concurrency, field smoke에 걸치는 구조 변경이라 작은 즉시 코드 변경으로 처리하지 않는다.
- Active task group: `agent-task/m-node-multi-target-serving-foundation/`
- 상태: 모든 split subtask가 `agent-task/archive/2026/06/m-node-multi-target-serving-foundation/` 아래 complete.log와 함께 PASS/RESOLVED로 정리되었고, Milestone 종료 전 코드 레벨 최종 리뷰와 검증도 통과했다.
- Archived task group: `agent-task/archive/2026/06/m-node-multi-target-serving-foundation/`
- 분할:
- `01_config_topology`: `[config-topology]`
- `02+01_adapter_registry`: `[adapter-registry]`
@ -62,13 +62,15 @@ Edge는 Node별 adapter/profile/engine/model 라우팅과 Edge-owned runtime opt
## 완료 리뷰
- 상태: 없음
- 요청일: 없음
- 완료 근거: 모든 기능 Task와 Task 안에 명시된 검증이 아직 충족되지 않았다.
- 상태: 승인됨
- 요청일: 2026-06-12
- 완료 근거: `config-topology`, `adapter-registry`, `route-catalog`, `engine-profiles`, `edge-owned-options`, `commands-caps`, `runtime-concurrency`, `field-smoke`가 모두 archived `complete.log``Roadmap Completion` 증거와 함께 PASS/RESOLVED 처리되었다.
- 완료 근거: 최종 field smoke는 사용자 제공 원격 Edge/Node 환경에서 `gemma4_ext:26b`, `gemma4:26b` 개별 호출과 `runtime.concurrency=2` 병렬 호출 성공으로 USER_REVIEW stop state가 해소되었다.
- 완료 근거: 2026-06-12 종료 전 코드 레벨 최종 리뷰에서 현재 코드 diff에 milestone 관련 미해결 코드 변경이 없음을 확인했고, `go test -count=1 ./...`, `go test -race -count=1 ./apps/node/internal/node/...`, `./scripts/e2e-smoke.sh`가 통과했다.
- 리뷰 필요:
- [ ] 사용자가 완료 결과를 확인했다
- [ ] archive 이동을 승인했다
- 리뷰 코멘트: 없음
- [x] 사용자가 완료 결과를 확인했다
- [x] archive 이동을 승인했다
- 리뷰 코멘트: `field-smoke`의 원래 CLI target 별도 호출 문구는 사용자 리뷰에서 두 Ollama 추론엔진 smoke 범위로 축소 승인되었고, 실제 수집 증거는 archived `USER_REVIEW.md``complete.log`에 기록되어 있다. 최종 코드 리뷰에서 추가 Required/Suggested issue는 발견되지 않았다.
## 범위 제외

View file

@ -2,7 +2,7 @@
## 상태
[계획]
[진행중]
## 목표
@ -14,9 +14,9 @@ Ollama 경로가 안정화된 뒤, 그 결과를 기준선으로 삼아 SGLang
완료된 Milestone은 archive 경로를 가리키고, 검토중, 진행중, 계획 또는 보류 Milestone은 이 Phase 하위 `milestones/` 경로를 가리킨다.
완료, 검토중, 진행중, 계획 순서로 두어 아래로 갈수록 미래 작업에 가까워지게 정렬한다.
- [계획] Node 단일 통로 멀티 타겟 서빙 기반
- 경로: `agent-roadmap/phase/inference-provider-extension/milestones/node-multi-target-serving-foundation.md`
- 요약: 하나의 Node 연결이 여러 CLI profile, terminal gateway, Ollama/vLLM/SGLang 같은 추론 엔진 연결, 여러 model target을 동시에 제공할 수 있도록 config/proto/routing/runtime 기준선을 정리다.
- [완료] Node 단일 통로 멀티 타겟 서빙 기반
- 경로: `agent-roadmap/archive/phase/inference-provider-extension/milestones/node-multi-target-serving-foundation.md`
- 요약: 하나의 Node 연결이 여러 CLI profile, terminal gateway, Ollama/vLLM/SGLang 같은 추론 엔진 연결, 여러 model target을 동시에 제공할 수 있도록 config/proto/routing/runtime 기준선을 정리했고, 최종 코드 리뷰와 검증까지 통과해 archive했다.
- [계획] SGLang provider 서빙 경로 추가
- 경로: `agent-roadmap/phase/inference-provider-extension/milestones/sglang-provider-serving-validation.md`