← LOOP Run
SelfMend
계획LOOP Run · 자동대응

승인된 범위 안에서 롤백, 스케일, 재기동을 자동으로 실행하도록 계획했습니다.

SelfMend 는 LOOP Run 의 실행 팔입니다. DriftScan 의 인시던트를 받아 위험을 점수로 매기고, 승인 게이트를 거친 뒤에 대응을 실행하는 것을 목표로 합니다. "사람이 판단, 에이전트가 실행" 원칙의 런타임 구현입니다.

앞단 DriftScan뒷단 ITS

PRD v0.1 기준 계획입니다. 착수 스펙과 일정은 정해지지 않았습니다.

탐지는 됐는데 대응은 사람이 손으로 합니다

이상을 탐지해도 롤백, 스케일, 재기동은 사람이 수동으로 실행합니다. 야간이면 초동이 늦습니다.

SelfMend 가 맡을 일을 PRD 는 이렇게 적었습니다. "탐지된 인시던트에 대해, 승인된 범위 안에서 자동으로 완화하고 싶다"

위험 스코어 임계와 승인을 둘 다 충족했을 때만 실행하고, 부작용이 생기면 롤백하거나 사람이 개입하도록 계획했습니다.

실행보다 게이트를 먼저 두었습니다

우선기능 (계획)
필수트리거 수신
필수위험 스코어링
필수대응 실행 (롤백, 스케일, 재기동)
필수승인 게이트 (사람 또는 정책)
필수대응 후 검증과 복구 확인
권장대응 플레이북
권장수동 오버라이드
선택대응 이력 학습

단계마다 계획한 일

단계계획한 일
트리거DriftScan 의 인시던트와 RCA 를 받습니다
위험 스코어링대응의 위험을 점수로 매깁니다. 보수적으로 잡습니다
대응 실행승인 게이트를 통과한 것만 롤백, 스케일, 재기동합니다
검증과 복구대응 뒤 상태를 검증하고 복구를 확인합니다. 결과는 WEVE LOOP 의 Learn 과 Improve 로 돌아갑니다

트리거에서 복구 확인까지

트리거
위험 스코어링
대응 실행
검증과 복구

판단은 앞에서, 승인은 옆에서

상대무엇을링크
DriftScan받음 · 인시던트와 RCA/products/weveloop/driftscan
OpsRadar받음 · 라이브 신호/products/weveloop/opsradar
Deployflow연계 · 롤백 로직/products/weveloop/deployflow
RunGuard받음 · 차단과 위협 이벤트/products/weveloop/runguard
Tactus관통 · 승인 게이트를 공유하고 대응 실행을 감사합니다 (계획)/products/weveloop/tactus
AgentFlow관통 · 대응 조율/products/agentflow
ITS줌 · 대응 결과가 Improve 를 거쳐 다시 접수로 돌아갑니다/products/weveloop/its

무인이 아닙니다

이상을 탐지하거나 원인을 찾지 않습니다. DriftScan 의 일입니다.

배포 롤아웃을 하지 않습니다. Deployflow 의 일이고, 롤백 로직만 연계합니다.

완전 무인 자동복구가 아닙니다. 사람 승인 게이트가 전제입니다.

아직 만들지 않았습니다

SelfMend 는 기획 단계입니다. 착수하지 않았습니다.

같은 역할의 일부가 OpsRadar 로드맵 P4(AI 워크플로)로도 계획돼 있습니다.

연계 규약과 오케스트레이터 API 추상화는 정해지지 않았습니다.

자주 나올 질문

자동으로 롤백해 버리면 더 위험하지 않나요?

그래서 게이트를 실행보다 앞에 두었습니다. 위험 스코어는 보수적으로 잡고, 임계와 승인을 둘 다 충족한 대응만 실행하며, 수동 오버라이드를 남깁니다. 부작용이 생기면 롤백합니다.

사람이 없는 새벽에도 대응하나요?

사람 승인 게이트가 전제라 완전 무인은 아닙니다. 정책으로 미리 승인한 범위는 정책 게이트가 통과시키도록 계획했습니다. 그 범위를 어떻게 정할지는 착수 때 정합니다.

Deployflow 를 안 쓰면 롤백은 어떻게 되나요?

롤백 로직은 Deployflow 와 연계하는 것으로 계획했고, 그 규약은 아직 정해지지 않았습니다. 다른 배포 도구와의 연계는 정해진 것이 없습니다.

계획 단계라 가격도 일정도 없습니다. 자동대응이 목적이면 관측과 이상탐지가 먼저 있어야 합니다.