본문으로 바로가기
리옵트 핸드북
리옵트 핸드북
LLMOps·AgentOps 프로덕션

아키텍처·릴리즈

Ch1. 시스템 아키텍처Ch2. 버저닝·릴리즈Ch3. 평가 프레임워크

운영 안정성

Ch4. 온라인 가드레일Ch5. 관측성·SLOCh6. 비용·지연시간 최적화

성장·대응

Ch7. 실험 운영 체계Ch8. 사고 관리 런북

검증

검증 리포트검증 아카이브업데이트 내역
핸드북›LLMOps AgentOps›검증 아카이브
한국어English

검증 아카이브

LLMOps·AgentOps 프로덕션 핸드북의 과거 검증 기록과 정정 이력

핵심 요약

  • 이 페이지는 LLMOps·AgentOps 핸드북의 과거 검증 기록 아카이브다. 최신 운영 기준은 별도의 검증 리포트에서 확인한다.
  • 2차 검증(2026-03-13)은 Langfuse v4.0.0·Phoenix v13.0.3·DeepEval v3.8.9 등 도구 버전과 Lakera→Check Point 인수, 프롬프트 캐싱 단가를 확인했다.
  • A2A는 2차 검증의 v0.3.0에서 4차 검증 기준 latest v1.0.0으로 정정되었고, MCP 스펙은 2025-11-25 기준으로 보강되었다.
  • 3차 검증(2026-03-26)의 GPT-5.4 nano·DeepSeek V3.2 가격, Anthropic 1M 서차지 등은 4차 검증에서 현재 기준 가격표로 대체되었다.
  • OWASP AOS 3축 구조, LangSmith Fleet 리브랜딩, Braintrust Loop AI, PagerDuty 에이전틱 운영 등 신규 콘텐츠는 외부 출처 200 응답으로 검증 통과했다.

아카이브 안내

이 페이지는 과거 검증 기록입니다. 최신 운영 기준은 검증 리포트를 기준으로 봅니다.

2차 검증 (2026-03-13)

도구·프레임워크 버전 검증

항목검증 내용결과
Langfuse v4.0.02026-03-10 릴리즈, MIT 오픈소스 확인통과
Arize Phoenix v13.0.32026-02-14 릴리즈, CLI v0.1.0+ 확인통과
DeepEval v3.8.92026-03-05 릴리즈, 13K+ 스타 확인통과
RAGAS v0.4.32026-01-13 릴리즈, PyPI 확인통과
Inspect AI v0.3.1862026-03-03 릴리즈, UK AISI 확인통과
NeMo Guardrails v0.20.0OTel 마이그레이션 확인통과
MCP 스펙 2025-11-252026-05-17 검증에서 authorization/security 요구사항 중심으로 보강보강됨
A2A v0.3.02026-05-17 검증에서 latest v1.0.0 기준으로 정정대체됨

비용 최적화 데이터 검증

항목검증 내용결과
Anthropic 프롬프트 캐싱2026-05-17 검증에서 모델별 캐싱 multiplier 기준으로 재정리보강됨
OpenAI 프롬프트 캐싱2026-05-17 검증에서 모델별 cached input 단가 기준으로 재정리보강됨
Lakera → Check Point 인수2025.09 인수 완료 (~$300M)통과

2차 검증 외부 출처

출처검증 항목상태
Langfuse Changelogv4.0.0 릴리즈200
Arize Phoenix GitHub Releasesv13.0.3 릴리즈200
DeepEval GitHubv3.8.9, 평가 메트릭200
OpenTelemetry GenAI DocsSemantic Conventions experimental (2차 당시 기준)200
Anthropic API Docs (Prompt Caching)캐싱 가격 정책200
Check Point 인수 보도Lakera Guard 인수200

3차 검증 (2026-03-26)

2026-05-17 정정

3차 검증의 모델 가격, DeepSeek 모델명, A2A 버전, 일부 벤더 링크는 4차 검증에서 현재 기준으로 대체했습니다. 아래 기록은 당시 변경 이력으로만 남깁니다.

신규 콘텐츠 검증

항목검증 내용결과
OWASP AOS3축 구조 (Instrumentable/Traceable/Inspectable) 확인통과
LangSmith Fleet 리브랜딩Agent Builder → LangSmith Fleet, 신규 기능 4종 확인통과
Braintrust Loop AI자연어 스코러 자동 생성, 4개 SDK 추가, OTel 네이티브 확인통과
GPT-5.4 nano 가격2026-05-17 검증에서 GPT-5.4 mini 가격표로 정정대체됨
DeepSeek V3.2 가격2026-05-17 검증에서 DeepSeek V4 Flash/Pro 가격표로 대체대체됨
Anthropic 1M 서차지 제거2026-05-17 검증에서 Claude 4.x 모델별 공식 가격표로 재정리대체됨
LLM API 가격 하락률 표현일반화된 하락률 표현은 제거하고 프로바이더별 단가·캐싱·배치 조건으로 대체정정됨
LiveCodeBench/AIME 2026벤치마크 존재·활용 사례 확인통과
TAU-bench Retail/JBDistill에이전트/안전성 벤치마크 확인통과
PagerDuty AI 에이전틱 운영에이전틱 클라우드 운영 모델, 자동 복구 기능 확인통과

3차 검증 외부 출처

출처검증 항목상태
OWASP 공식 프로젝트Agent Observability Standard200
LangChain 블로그LangSmith Fleet 리브랜딩 공지200
Braintrust 공식 문서Loop AI, 신규 SDK200
Anthropic 가격 페이지Claude 4.x 모델별 가격확인
OpenAI 가격 페이지GPT-5.4 mini/GPT-5.4/GPT-5.5 가격확인
DeepSeek API DocsV4 Flash/Pro 가격확인
PagerDuty 블로그Agentic Cloud Operations200

관련 문서

검증 리포트

B2B SaaS 세일즈·고객성공 · B2B SaaS 세일즈·고객성공 핸드북의 구조·용어·링크·논리 정합성 검증 결과

검증 리포트

LLMOps·AgentOps 프로덕션 핸드북의 구조·링크·지표·논리 정합성 검증

검증 리포트

SaaS 유료 플랜 설계 · 수치·사례 출처 검증, 기준일, 한계와 운영 원칙

검증 리포트

AI 보안·컴플라이언스 운영 · AI 보안·컴플라이언스 운영 핸드북의 구조·링크·논리 정합성 검증

업데이트 내역

LLMOps·AgentOps 프로덕션 핸드북 변경 로그

검증 리포트

LLMOps·AgentOps 프로덕션 핸드북의 구조·링크·지표·논리 정합성 검증

업데이트 내역

LLMOps·AgentOps 프로덕션 핸드북 변경 로그

On this page

2차 검증 (2026-03-13)도구·프레임워크 버전 검증비용 최적화 데이터 검증2차 검증 외부 출처3차 검증 (2026-03-26)신규 콘텐츠 검증3차 검증 외부 출처