본문으로 바로가기
리옵트 핸드북
리옵트 핸드북
하네스 엔지니어링

문제 설정·구조

하네스 엔지니어링의 기초Repo-readable 시스템하네스의 5요소하네스의 기술 메커니즘

검증·해석

검증 루프 설계외부 사례 비교

사례별 도입

사례: OpenAI사례: Anthropic사례: Toss사례: gstack사례: revfactory/harness

도메인별 적용

도메인별 적용 지도시나리오: 프론트엔드 팀시나리오: 플랫폼 팀시나리오: 결제·정산 팀시나리오: AI 제품 팀왜 결국 자기 하네스로 가는가

도입·운영

팀 하네스 배포 전략팀 하네스 설계 체크리스트운영: 엔트로피와 가비지 컬렉션

부록

검증 리포트업데이트 내역
핸드북›하네스 엔지니어링›검증 리포트
한국어English

검증 리포트

하네스 엔지니어링 핸드북의 링크·정합성·근거 검증 결과

이 문서는 하네스 엔지니어링 핸드북의 구조, 근거, 교차 링크, handbook 앱 수준 정적 검증 결과를 기록합니다.

검증 기준일

2026년 5월 23일

검증 범위

항목기준
문서 구조meta.json 선언과 실제 MDX 파일 일치 여부
내용 정합성핵심 주장과 장 구성이 서로 충돌하지 않는지
외부 근거OpenAI, Anthropic, Toss, gstack, revfactory/harness를 근거로 삼는 구간 점검
교차 링크관련 핸드북과의 연결성 확인
앱 검증handbook 범위 lint, typecheck, build 결과

검증 방법

  1. apps/handbook/content/books/ko/harness-engineering/meta.json과 실제 MDX 파일 목록을 대조했습니다.
  2. 각 장의 주장을 외부 자료의 핵심 메시지와 비교해 과도한 일반화가 없는지 확인했습니다.
  3. LLMOps·AgentOps, Codex, Claude Code, 오케스트레이션, 문서화 책과의 링크를 확인했습니다.
  4. OpenAI 관련 최신 정보는 OpenAI developer docs MCP와 공식 OpenAI 사이트를 우선 확인했습니다.
  5. Anthropic 최신 항목은 engineering/news 원문과 Claude Code / Managed Agents 공식 문서 검색 결과를 함께 대조했습니다.
  6. GitHub 원본 README와 GitHub API metadata로 gstack, revfactory/harness의 최신 상태를 확인했습니다.
  7. handbook 범위 정적 검증을 실행해 MDX와 앱 빌드 정합성을 확인했습니다.

결과 요약

항목결과
meta.json와 실제 MDX 파일23개 페이지 기준 일치
구조 흐름이상 없음
외부 근거 연결이상 없음
교차 링크이상 없음
pnpm --filter handbook run check:books-registry통과
pnpm --filter handbook run typecheck통과
pnpm --filter handbook run build통과

핵심 근거 목록

자료발행일이 책에서 사용한 포인트
OpenAI, Harness Engineering2026-02-11agent-readable repo, 짧은 AGENTS.md, 구조화된 docs, 관측성, 가비지 컬렉션
OpenAI, The next evolution of the Agents SDK2026-04-15model-native harness, native sandbox execution, MCP/skills/AGENTS.md/shell/apply_patch primitive
OpenAI API Changelog2026-05-06 / 2026-05-19TypeScript sandbox agents와 open-source harness, Secure MCP Tunnel
OpenAI Developers plugin for Codex2026-05-07OpenAI Platform access, API key setup, troubleshooting을 plugin surface로 배포
OpenAI, Work with Codex from anywhere2026-05-14mobile/remote connection, approvals, hooks, enterprise environment 흐름
OpenAI Agents SDK / Sandbox / Codex docs2026-05-23 열람 기준sandbox capability, hooks lifecycle, remote connections
Anthropic, Harness design for long-running application development2026-03-24planner/generator/evaluator, 모델 성능에 따라 바뀌는 load-bearing 구조
Anthropic, Claude Code auto mode2026-03-25prompt-injection probe, transcript classifier, trust boundary, denial fallback
Claude Code permission / auto mode docs2026-05-23 열람 기준permission mode별 자동화 범위, protected path, classifier 평가 순서, trusted infrastructure 설정
Anthropic, Scaling Managed Agents2026-04-08session/harness/sandbox 분리, durable event log, credential vault와 MCP proxy
Claude Managed Agents overview / MCP connector docs2026-05-23 열람 기준agent, environment, session, events 개념과 MCP auth/vault 분리
Anthropic, Agents for financial services2026-05-05domain agent templates, skills/connectors/subagents, per-tool permissions, audit log
Toss, Harness를 통한 조직 생산성 저점 높이기2026-02-26frictionless harness, executable SSOT, domain layer, HITL
gstack README2026-05-23 열람 기준23 specialists, 8 power tools, 10 agent hosts, team mode, browser/iOS QA, checkpoint/learn
revfactory/harness README2026-05-23 열람 기준v1.2.0, L3 Meta-Factory / Team-Architecture Factory, 6 architecture patterns, A/B caveat

추론으로 정리한 구간

아래 내용은 특정 한 문서의 직설적 표현이 아니라 여러 자료를 종합한 해석입니다.

구간해석 근거
"하네스는 프롬프트보다 작업 시스템 설계에 가깝다"OpenAI의 repo/observability 강조 + Anthropic의 구조적 evaluation + Toss의 시스템 해석
"범용 하네스는 출발점, 팀 고유 하네스는 목적지"Toss의 domain layer/HITL + gstack의 make it yours + revfactory의 domain-specific teams
"운영과 cleanup은 하네스의 일부"OpenAI의 entropy/doc gardening 관점
"하네스 primitive는 제품화되지만 도메인 설계는 사라지지 않는다"OpenAI Agents SDK의 표준 primitive + gstack/revfactory의 domain/workflow 확장
"자동 승인은 사람 승인의 단순 대체가 아니라 별도 정책 계층이다"Anthropic auto mode의 classifier/trust-boundary 구조 + 고위험 작업 caveat
"장시간 agent runtime은 context window가 아니라 durable session log를 중심으로 설계해야 한다"Anthropic Managed Agents의 session/harness/sandbox 분리

챕터별 검증 결과

챕터확인 포인트결과
foundations프롬프트/컨텍스트/하네스 구분이상 없음
repo-readable-systemsOpenAI/Toss 기반 repo/doc/SSOT 해석이상 없음
five-elements환경, 역할, 기준, 루프, 정리의 5축 일관성이상 없음
engineering-mechanics입력/상태/도구/권한 경계를 엔지니어링 문제로 설명하는지이상 없음
evaluation-loopsplanner/evaluator/browser QA 분리 기준이상 없음
case-studies사례별 포인트가 서로 섞이지 않는지이상 없음
case-openairepo-readable/observability/cleanup 해석이상 없음
case-openaiAgents SDK, sandbox, MCP, hooks, Developers plugin 최신 흐름2026-05-23 보강
case-anthropicload-bearing scaffolding, retry budget, managed runtime, auto approval 해석2026-05-23 보강
case-tossexecutable SSOT, domain layer, HITL 해석이상 없음
case-gstacksprint, command, release gate, 다중 host, iOS/browser QA 해석2026-05-23 보강
case-revfactorydomain-first team architecture generation, validation caveat 해석2026-05-23 보강
domain-playbooks사례를 도메인 적용 모델과 domain template 패키징으로 연결하는지2026-05-23 보강
scenario-frontend-teambrowser QA, a11y, design rules의 load-bearing 포인트이상 없음
scenario-platform-teaminvariants, impact analysis, release gate 해석이상 없음
scenario-payments-teamapproval, reconciliation, audit trail 해석이상 없음
scenario-ai-product-teameval set, canary, telemetry 해석이상 없음
make-it-yours개인 노하우와 팀 운영체계의 구분이상 없음
team-rollout개인 루틴 -> 팀 workflow/plugin/domain template 확장 경로2026-05-23 보강
checklist바로 적용 가능한 질문으로 정리됐는지2026-05-23 보강
operations운영과 가비지 컬렉션 관점 반영2026-05-23 보강

교차 링크 확인

대상 책연결 방식상태
/books/llmops-agentops운영 체계 연결확인
/books/agent-orchestration-patterns멀티에이전트 설계 연결확인
/books/agentic-documentationAI-readable 문서 연결확인
/books/codex-advancedCodex 환경 설계 연결확인
/books/claude-code-advancedClaude Code 환경 설계 연결확인

검증 한계

범위 안내

이 리포트는 2026년 5월 23일 기준의 문서 구조와 해석을 검증합니다. 외부 자료는 빠르게 변할 수 있으므로, 실제 주장 변화가 생기면 updates.mdx에 해석 변경 로그를 먼저 남겨야 합니다.

관련 문서

업데이트 내역

하네스 엔지니어링 핸드북 변경 로그

외부 사례 비교

OpenAI, Anthropic, Toss, gstack, revfactory/harness를 입력·상태·검증·배포 기준으로 비교합니다.

업데이트 내역

Codex 고급 활용 · Codex 고급 활용 핸드북 변경 로그

검증 리포트

AI 에이전트 오케스트레이션 패턴 · AI 에이전트 오케스트레이션 패턴 핸드북 검증 결과

업데이트 내역

CRM의 정석 · CRM의 정석 핸드북의 변경 로그와 운영 기준 업데이트 기록

운영: 엔트로피와 가비지 컬렉션

하네스가 시간이 지나며 망가지는 이유와 이를 줄이는 운영 루틴을 설명합니다.

업데이트 내역

하네스 엔지니어링 핸드북 변경 로그

On this page

검증 범위검증 방법결과 요약핵심 근거 목록추론으로 정리한 구간챕터별 검증 결과교차 링크 확인검증 한계