← 탐색

태그된 포스트: harness-engineering

클로드코드 딥다이브 · ·5분 읽기

규칙이 많을수록 좋았던 시절은 끝났다 — CLAUDE.md 경량화의 실측 근거

Anthropic이 Claude Code 시스템 프롬프트의 80% 이상을 삭제하고도 코딩 평가에서 회귀가 전혀 없었다는 발표는, 그동안 저희가 CLAUDE.md에 쌓아왔던 규칙들의 가치에 대해 근본적인 질문을 던집니다.

claude-codecontext-engineeringclaude.md
클로드코드 딥다이브 · ·6분 읽기

프롬프트 캐시가 깨지는 순간, 깨지지 않는 순간

세션을 열고 작업하다 보면 응답이 유독 느린 턴이 있습니다. 같은 모델, 같은 프로젝트인데 갑자기 체감 속도가 달라지는 경험.

claude-codeprompt-cachecontext-engineering
클로드코드 딥다이브 · ·4분 읽기

"다시 확인해"라고 쓸수록 품질이 떨어진다 — 검증 지시문의 역설

CLAUDE.md에 "작업이 끝나면 반드시 코드를 다시 읽고 실수가 없는지 확인하세요"라는 줄을 추가한 뒤로 오히려 결과물이 나빠졌다면, 그건 우연이 아닙니다.

claude-codecontext-engineeringverification-trap
클로드코드 딥다이브 · ·5분 읽기

에이전트는 자기 결과를 평가할 수 없다 — 검증 분리 아키텍처의 설계

Anthropic 엔지니어링 팀이 장기 실행 에이전트 실험에서 반복적으로 마주친 현상이 있습니다. 에이전트가 기능 구현을 마치고 "모든 기능이 정상 작동합니다"라고 보고하는데, 실제로 브라우저를 열어 테스트해보면 핵심 기능이 깨져 있는 것입니다.

claude-codeharness-engineeringverification
클로드코드 딥다이브 · ·5분 읽기

설정 부패는 에러를 안 낸다

Claude Code 설정이 늘어나면 경고가 뜰 것 같지만, 실제로는 아무 증상 없이 컨텍스트만 소모됩니다. 토큰 윈도우가 200K에서 1M으로 넓어지면서 "공간이 부족합니다" 같은 직관적 신호가 사라졌습니다.

claude-codedoctorcontext-audit
클로드코드 딥다이브 · ·6분 읽기

오토 모드 분류기의 안쪽 — 어디까지 믿고, 어디서 잡아야 하는가

Claude Code를 처음 오토 모드로 전환한 날, 저는 20단계를 쉼 없이 실행하는 에이전트를 지켜보다가 갑자기 멈추는 장면을 목격했습니다. npm run build는 즉시 승인되었고, git push origin main은 차단되었습니다.

claude-codeauto-modeclassifier
클로드코드 딥다이브 · ·6분 읽기

커밋하기 전에 두 갈래를 동시에 걸어본다 — /fork, /branch, /subtask 분기 전략

하나의 Claude Code 세션에서 복잡한 아키텍처 결정을 내려야 할 때, 대부분의 개발자는 하나의 접근법을 선택하고 끝까지 밀어붙입니다. 30분 뒤에 그 선택이 막다른 골목으로 판명되면 /clear를 치거나 새 세션을 열어서 처음부터 다시 시작합니다.

claude-codeforkbranch
클로드코드 딥다이브 · ·6분 읽기

도구 58개를 다 올리면 정확도가 반 토막 난다 — ToolSearch 지연 로딩이 품질을 바꾸는 원리

GitHub, Slack, Sentry, Grafana, Splunk — MCP 서버 5개를 연결하면 도구 정의만으로 약 55,000 토큰이 컨텍스트 윈도우에서 증발합니다. 200K 윈도우의 27%가 아직 한 줄도 코드를 읽기 전에 사라지는 셈입니다.

claude-codetoolsearchdeferred-loading
클로드코드 딥다이브 · ·7분 읽기

훅 하나가 CLAUDE.md 열 줄보다 확실한 이유

CLAUDE.md에 "절대 rm -rf를 실행하지 마세요"라고 적어둔 팀이 있었습니다.

claude-codehookspretooluse
클로드코드 딥다이브 · ·5분 읽기

프롬프트를 그만 치고 루프를 짜라 — /goal과 /loop이 결과를 바꾸는 원리

Claude Code를 만든 Boris Cherny가 올해 6월 AI Engineer World's Fair에서 한 말이 있습니다. "나는 더 이상 Claude에게 프롬프트를 치지 않습니다.

claude-codeloop-engineeringgoal
클로드코드 딥다이브 · ·5분 읽기

규칙의 80%는 필요 없었다: CLAUDE.md 언호블링 가이드

지난 7월 24일, Opus 5 출시와 함께 흥미로운 사실이 하나 공개됐습니다.

claude-codeclaude.mdunhobbling
클로드코드 딥다이브 · ·5분 읽기

pipeline()은 기본값이다 — Dynamic Workflow에서 품질을 높이는 세 가지 패턴

Claude Code에서 ultracode를 입력하면 에이전트가 수십 개 뜹니다. /workflows를 열면 진행 상황이 쏟아지고, 토큰 카운터가 올라가고, 결국 하나의 보고서가 돌아옵니다.

claude-codedynamic-workflowpipeline
클로드코드 딥다이브 · ·5분 읽기

동시 20, 중첩 0, 출력 8000 — 서브에이전트 기본값 세 개가 결과를 바꾼다

7월 셋째 주, Claude Code v2.1.

claude-codesubagent환경변수
클로드코드 딥다이브 · ·5분 읽기

Claude Code가 파일에 생각을 쓰면 결과가 달라지는 이유

Claude Code를 오래 쓰다 보면 묘한 경험을 합니다. 같은 질문인데 세션 초반에는 정교하게 풀던 문제를 세션 후반에는 엉뚱하게 접근하는 것입니다.

claude-codescratchpadcontext-engineering
클로드코드 딥다이브 · ·5분 읽기

세션이 느려진 건 컨텍스트가 아니라 프로세스였다

Claude Code 세션을 두세 시간 이어가다 보면 터미널 응답이 눈에 띄게 느려지거나, 키 입력이 반박자씩 밀리는 경험을 해본 분이 있을 겁니다.

claude-codememory-leakmcp
클로드코드 딥다이브 · ·5분 읽기

compact가 삼키는 건 코드가 아니라 판단 근거다

두 시간짜리 리팩토링 세션 중간에 Claude Code가 "이 함수를 이렇게 바꾸면 어떨까요?"라고 제안합니다.

claude-codecompactioncompact
클로드코드 딥다이브 · ·4분 읽기

문서를 복사하지 말고 열어라 — Desktop 브라우저 패널이 바꾸는 컨텍스트 품질

API 문서를 스크린샷으로 찍어서 프롬프트에 붙이는 순간, 정보의 상당 부분은 이미 손실됩니다. 테이블 레이아웃이 뭉개지고, 하이퍼링크는 죽은 텍스트가 되며, 페이지 하단의 주의사항은 프레임 밖으로 잘려 나갑니다.

claude-codedesktopbrowser-panel
클로드코드 딥다이브 · ·5분 읽기

시스템 프롬프트를 뜯어봤더니 CLAUDE.md 예산이 보였다

Claude Code를 쓰면서 CLAUDE.md에 온갖 규칙을 욱여넣는 분들이 많습니다.

claude-codesystem-promptclaude.md
1 / 3 Next →