추석맞이 MyHarness 업데이트 하였습니다.

69

간략히 요약하자면

  • 최신 모델 적용 가능

  • 에이전트 역할에 따라 별도 모델 지정 가능

  • 하네스구성시 인터뷰를 통해 보다 정교한 하네스 구성

https://claude.ai/artifact/NEgL1vj4Dmn1UJYJpuXRWG

릴리스 노트

모델 인지 하네스

1.9.02026-09-25이전 릴리스 1.8.0

하네스를 만들 때 여섯 가지를 묻는다. 그 답이 모델 선택·승인 지점·외부 리뷰어 사용 여부를 정한다.

새 기능

1.9.0 에서 달라진 것

구성 인터뷰에 「외부 반출」 질문이 생겼다

내 코드와 문서를 지금 쓰는 도구 밖의 외부 엔진으로 보내도 되는지 한 번 묻고, 그 답대로 외부 리뷰어를 고른다.

모델 이름을 직접 적지 않는다

역할 한 줄만 주면 알맞은 급과 추론 강도가 정해지고, 에이전트 정의 파일에 그대로 적혔는지 대조까지 한다.

대체 모델을 미리 정해 둔다

주 모델을 쓸 수 없을 때 어떤 순서로 대체할지 하네스 설정에 적어 둘 수 있다.

새 모델이 나와도 따라갈 필요가 없다

세대명 대신 계열 이름으로 부르므로, 모델이 새 판으로 바뀌어도 하네스를 고치지 않는다.

새 하네스를 만들 때

여섯 가지를 묻는다

하네스를 만들어 달라고 하면, 먼저 프로젝트를 살펴본 뒤 이 프로젝트에 해당하는 질문만 골라서 묻는다. 예를 들어 배포나 태그 발행을 하지 않는 프로젝트라면 「릴리스·태그 발행」은 아예 나오지 않는다.

질문마다 추천 답 하나와 그것을 권하는 이유 한 줄이 같이 나온다. 그대로 받아들이거나 다른 답으로 바꾸면 된다.

  1. ①

    무엇이 되면 작업이 끝났다고 보나?

    테스트 통과 · CI green · 산출물 존재 · 사람의 최종 확인

    → 완료 기준이 되고, 하네스가 이 기준으로 끝을 판단한다

  2. ②

    되돌릴 수 없는 것은?

    릴리스·태그 발행 · 패키지 배포 · DB 마이그레이션 · 강제 push · 외부 발송 · 모름 · 없음

    → 여기에 닿는 작업은 자동으로 중대 등급이 된다

  3. ③

    실패했을 때 무엇이 더 아픈가?

    오류가 더 아프다 · 지연이 더 아프다 · 둘 다 비슷하다

    → 검증 강도와 배치되는 모델 급을 정한다

  4. ④

    사람이 반드시 확인해야 하는 지점은?

    ②에서 고른 항목마다 「…직전 승인」이 자동으로 만들어진다 · 중대 작업은 기획→계획→실행 단계마다 승인 · 자율 진행 허용

    → 승인 관문이 된다

  5. ⑤

    이미 있는 에이전트·스킬을 어떻게 다룰까?

    재사용 우선 · 참고만 · 무시

    → 역할이 겹치는 정의가 다른 이름으로 쌓이는 것을 막는다

  6. ⑥

    내용을 외부 API 로 보내도 되나? NEW

    지금 쓰는 도구만 · 허용 목록만(이미 설치해 쓰는 리뷰어 엔진) · 제한 없음

    → 외부 리뷰어를 고를 때마다 이 답을 확인한다. 환경 변수로 임의로 넓힐 수 없다

여섯 가지를 모두 답하지 않아도 된다. 건너뛴 질문은 가장 안전한 쪽으로 채워지고, 하네스는 그대로 만들어진다.

대신 그 값이 내가 정한 것이 아니라 하네스가 가정한 것이라는 표시가 문서에 남는다. 나중에 열어 보면 내가 정한 것과 가정된 것이 구분된다.

- ⚠ 가정(무응답): 완료 기준 = 테스트 게이트 통과 · CI green · 산출물 경로 존재
- ⚠ 가정(무응답): 실패 비용 = 오류가 더 아프다 — 늦더라도 정확하게
- 비가역: 릴리스·태그 발행 · 모름 → 이 목록에 닿는 단계는 중대

가정된 값을 바꾸고 싶으면 그 질문만 다시 답하면 된다. 나머지 답은 그대로 남는다.

모델 인지

모델은 역할을 보고 정해진다

에이전트를 만들 때 모델 이름을 적지 않는다. 역할 설명 한 줄을 주면 그것이 어떤 일인지 분류하고, 거기에 맞는 급과 추론 강도를 정해 정의 파일에 적는다. 한 에이전트가 여러 분류에 걸치면 더 높은 급으로 맞춘다.

깊게판정·검증·보안 · 설계·기획 · 구현추론 강도 높음

표준조율·통합 · 문서·릴리스중간

가볍게수집·탐색·목록낮음

분류가 애매한 역할은 ③ 실패 비용 답으로 정한다. 「지연이 더 아프다」면 가볍게, 그 밖에는 표준으로 간다. 되돌리기 어려운 한 번짜리 구현이라면 「오류가 더 아프다」일 때 깊게로 올라간다.

새 세대 모델이 나와도 고칠 것이 없다. 하네스는 Fable 5.1, GPT-6 Astra 같은 세대명을 지목하지 않고 계열 이름으로 부른다. 계열 이름 뒤에 붙는 실제 모델은 도구 쪽에서 새 판으로 바뀌므로, 하네스 문서나 에이전트 정의를 손볼 일이 없다. 특정 판에 묶어 두고 싶을 때만 모델 ID 를 직접 고정하는 방법이 따로 있다.

Codex·Gemini 는 그 CLI 에 설정해 둔 모델을 그대로 쓴다. 하네스가 모델을 바꿔 끼우지 않는다. 대신 추론 강도만 각 제품의 방식으로 번역해 넘긴다 — 설정 이름과 쓸 수 있는 값이 제품마다 다르고 받지 않는 값도 있어서, 받지 않는 값은 보내지 않고 어차피 무시되는 설정은 빼고 보낸다.

배치한 뒤에는 에이전트 정의 파일을 다시 읽어 그 값이 실제로 적혔는지 대조한다. 어긋나면 바로 알려 준다.

배치: 판정 역할 → 깊게 · 추론 강도 높음
확인: 정의 파일 2곳 일치

기존 하네스

1.8.0 으로 만든 하네스 업그레이드 방법

이미 하네스가 들어가 있는 저장소라면, 팩토리를 1.9.0 으로 올린 뒤 아래 다섯 가지를 한 번 정리한다.

  1. 리뷰 실행 줄을 한 번 고친다. 고치기 전까지 그 하네스의 외부 리뷰는 전부 실패한다. 무엇을 붙여야 하는지 도구가 알려준다.

    $ harness-update.sh plan <하네스> <팩토리>
    LAUNCHER: needs-update(.claude 149행)
      붙일 줄: REVIEW_GRADE=… HARNESS_ORCHESTRATOR=… bash "…/run-review.sh" …
  2. 하네스 문서에 박혀 있는 인터뷰 결과 블록을 다시 만든다. ⑥ 질문이 추가되면서 기존 블록이 모두 옛 버전(stale)으로 표시된다. 순서는 기존과 같다.

  3. Claude 와 Codex 를 함께 쓴다면 갱신을 네 번 돌린다. 런타임 두 곳 × 스킬 두 종. 빠뜨린 곳에는 옛 스크립트가 남는다.

  4. ⑥ 을 한 번 답해 두는 편이 좋다. 답하지 않아도 일상 작업은 그대로지만, 중대 등급 검증을 쓰면 「반출 정책이 가정」이라는 표시가 붙어 리뷰가 마무리되지 않는다.

  5. ⑥ 에서 「지금 쓰는 도구만」을 고르면 외부 리뷰어가 없어진다. 그만큼 중대 단계마다 직접 승인해야 한다.

알아 둘 것

아직 안 되는 것

  • 계열 이름이 없어지는 것은 미리 알려 주지 못한다. 세대 교체에는 강하지만, 계열 자체가 사라지면 실행할 때 오류로 드러난다. 정기적으로 점검해 알려 주는 기능은 아직 없다.

  • 모델 데이터가 낡았는지는 팩토리에서만 점검한다. 만들어진 하네스 쪽에서는 실행 중 오류로만 나타난다.

  • 인터뷰가 결과를 얼마나 좋게 만드는지는 측정하지 않았다. 전후 비교는 1.8.0 때부터 미뤄 둔 상태 그대로다.

  • Windows 에서 확장자 없는 실행 파일만 있는 환경이면 설치한 리뷰어가 목록에서 빠질 수 있다. npm 으로 설치한 도구는 해당되지 않는다.

my_harness 1.9.0릴리스 페이지저장소 문서 경로 docs/v1.8.3/ (개발 코드네임)

▶ 원문 출처: https://claude.ai/artifact/NEgL1vj4Dmn1UJYJpuXRWG

▶ 원문 출처: https://github.com/cookyman74/my_harness/blob/main/README_KO.md

로그인한 회원만 댓글 등록이 가능합니다.

개발한당

KR | ID | EN
  • IDR
  • KOR
7.53 ▲ 0.01

2026.10.09 KEB 하나은행 고시회차 1742회

다가오는 한인 행사일정

  • 등록 된 일정이 없어요!