AI가 쓴 티 없애기: 지적 한 번이 영구 규칙이 되는 교정 스킬 만들기
AI 초안의 어색한 문장을 매번 손으로 고치는 대신, 지적 한 번이 영구 규칙이 되는 교정 루프를 만들었습니다. Claude Code 스킬 구조, 규칙이 태어난 실제 과정, 커뮤니티 스킬과 겹쳐 쓰는 법, 10분 만에 시작하는 시드 파일까지.
AI 초안의 어색한 문장을 매번 손으로 고치는 대신, 지적 한 번이 영구 규칙이 되는 교정 루프를 만들었습니다. Claude Code 스킬 구조, 규칙이 태어난 실제 과정, 커뮤니티 스킬과 겹쳐 쓰는 법, 10분 만에 시작하는 시드 파일까지.
반지의 제왕 첫 문단과 100만 토큰, 2시간의 자율 실행으로 나온 3D 영상. 데모 감상이 아니라 위임의 단위가 어떻게 바뀌는지, 빌더의 일이 어디로 이동하는지 정리했습니다.
에이전트 메모리 플랫폼을 만들다가 이번 주 방향을 뒤집었습니다. 전부 저장하는 메모리가 왜 실패하는지, 상태·사실·원칙을 트래커·코드·메모리 세 갈래로 나누는 기준을 정리했습니다.
CLAUDE.md는 더할수록 좋아지지 않습니다. 규칙이 쌓이면 왜 에이전트가 나빠지는지, 무엇을 남기고 무엇을 스킬·훅·메모리로 보낼지 기준과 유지 루틴을 정리했습니다.
어제 합의한 컨벤션을 오늘 잊는 에이전트를 고치려고 Monet을 만들었습니다. 스스로 기록하고, 유용한 것부터 읽고, 쌓일수록 똑똑해지는 에이전트 메모리 이야기입니다.
널리 쓰이는 LLM 벤치마크가 무엇을 측정하고 무엇을 놓치는지 뜯어보고, 지식 시험이 아닌 행동 벤치마크가 왜 필요한지 정리합니다.
입력 토큰이 비슷한 두 요청의 비용이 46배 차이 났습니다. 프롬프트 캐싱의 구조와, 트랜스크립트 대신 구조화된 상태로 에이전트를 설계해야 하는 이유를 정리합니다.
코딩 에이전트는 매일 같은 파일을 다시 읽고 같은 질문을 다시 합니다. 메모리가 실제로 무엇을 해주는지, 문서와 뭐가 다른지, 언제 유용한지 짚어봅니다.
더 큰 컨텍스트 윈도우가 더 나은 결과를 주지는 않았습니다. 실제 코딩 에이전트 세션에서 반복되는 컨텍스트 관리 문제를 기록합니다.