이 글에는 쿠팡 파트너스 링크가 있으며, 구매 시 일정액의 수수료를 받습니다.
클로드 코드 검증 루프, 네 줄 지시 틀과 CLAUDE.md 줄이기
클로드 코드 검증 루프는 AI에게 일을 맡길 때 결과를 스스로 확인할 방법까지 함께 주는 방식입니다. 이 글은 방구석컴퍼니 채널이 이 방식을 직접 실험한 결과(검사기 없이 75점대, 검사기를 주니 90점대)와 평소 일에 붙일 수 있는 네 줄 틀, 그리고 규칙 파일(CLAUDE.md)을 줄이는 순서를 14단계로 정리했습니다. 클로드 코드에 화면 확인 도구를 붙이는 방법과 개발 작업용 예시는 글 끝 편집자 정리에 따로 넣었습니다.
읽기 전에 알아 둘 것이 세 가지 있습니다.
- 점수(75점→90점 등), 걸린 시간, 요금은 모두 화자 주장입니다. 화자 스스로 조건마다 한 번씩만 돌린 실험이라 경향으로만 봐 달라고 했습니다.
- 영상에는 클릭 단위의 조작 안내가 없습니다. 화자는 실험 결과를 설명하고 작성 순서를 말로 알려 줍니다.
- 화자가 무료 키트로 묶었다는 지시문 전문은 발화에도 더보기란에도 없습니다. 오픈톡에서 나눠 준다고 안내하므로 이 글에는 틀의 항목과 화자의 예시만 있습니다.
클로드 코드 검증 루프가 필요한 이유
열어 보거나 비교하지 못했다는 보고
화자가 클로드에게 화면 하나를 똑같이 만들어 달라고 했습니다. 클로드는 다 만들고 이렇게 보고했다고 합니다. "브라우저에서 열어보거나 나란히 비교하지는 못했습니다."
화자 설명은 간단합니다. 브라우저 도구를 안 줬으니 확인할 방법 없이 끝냈다는 것입니다.
보리스 체르니가 강연에서 한 말
화자는 클로드 코드를 만든 보리스 체르니가 와이 콤비네이터 스타트업 스쿨 강연에서 한 얘기라고 소개합니다. 아래는 모두 화자가 전한 내용입니다.
- 흔한 실수는 일을 단계별로 하나하나 정해 주는 것이다. "이 파일 열고 여기 고치고" 같은 식.
- 대신 과제, 지켜야 할 선, 끝나는 조건만 적고 맡긴다. 가는 길은 클로드가 고르고 사람은 어디까지 가면 되는지만 정한다.
- 요즘 중요한 건 지시문(자막 표기 "지심")을 잘 쓰는 요령이 아니다. 조금 벅찬 일을 주고 스스로 확인할 방법을 같이 주는 것이다.
- 이 확인이 아마 제일 중요한데 사람들이 제일 못 한다.
오퍼스 5.5 공식 사용 안내서에도 같은 방향의 문장이 있다고 합니다. 글로만 끝난 보고는 일이 끝났다는 증거가 아니라 그냥 보고로 보라는 내용입니다.
그래서 화자의 틀은 네 줄입니다. 과제, 지켜야 할 선, 확인 방법, 끝나는 조건. 보리스가 말한 세 가지 사이에 확인 방법 한 줄을 끼운 모양입니다.
검사기를 준 실험 결과 (수치는 모두 화자 주장, 조건마다 1회)
실험 방법
- 과제: 흐름도 화면 한 장을 보고 5초짜리 움직이는 화면을 만든다.
- 한 번은 확인 도구 없이, 한 번은 화면을 찍어 원본과 비교하는 검사기를 주고 돌렸다.
- 점수는 원본과 얼마나 겹치는지를 100점 만점으로 잰 것이다.
75점에서 90점으로
- 검사기 없을 때: 오퍼스 5.5 75.2점, 소넷 5.5 75.4점
- 검사기를 줬을 때: 오퍼스 90.6점, 소넷(자막 표기 "손") 90.2점
- 오퍼스는 확인 세 번에 4분쯤, 소넷은 20분쯤 걸렸다고 합니다. 소넷의 확인 횟수는 자막에서 빠졌고, 더보기란에는 9번으로 적혀 있습니다.
- 요금은 "71c 77c쯤"으로 비슷했다고 합니다. 소넷은 토큰(AI가 글을 읽고 쓰는 양을 세는 단위)값이 오퍼스의 절반인데 그만큼 더 오래 돌아서 요금이 따라왔다는 설명입니다.
화자는 이 결과를 두고 조건마다 한 번씩만 돌렸으니 경향으로만 봐 달라고 했습니다(자막 표기 "조금마다").
이 점수가 뜻하는 것
사람 눈으로 매긴 점수가 아닙니다. 채널이 만든 점수입니다. 빈 화면은 0점, 원본을 그대로 놓으면 100점이고, 원본을 화면 폭의 3%쯤 옆으로 밀기만 해도 57점까지 떨어진다고 합니다. 화자는 75점을 큰 틀은 맞고 군데군데 어긋난 정도라고 풀이합니다.
점수는 올랐는데 남은 것
그런데 점수가 오른 이유가 묘합니다.
오퍼스 점수가 가장 크게 뛴 구간은 77.1점에서 90.6점으로 오를 때였습니다. 그 사이에 고친 것은 흐름도 상자가 아니라 배경의 모눈종이 줄(자막 표기 "모는 줄")이었다고 합니다. 줄 간격과 위치를 원본에 맞춰 다시 그린 것입니다.
화자는 자기들 채점 방식에 허점이 있었다고 밝힙니다. 배경색과 다른 점을 전부 내용으로 세는 방식이어서, 화면 가득 깔린 모눈 줄이 점수를 크게 흔들었다는 것입니다. 화자 표현으로는 오퍼스가 이 허점을 스스로 알아내고 점수를 끌어올렸습니다.
소넷도 90점을 넘겼습니다. 그런데 화면을 나란히 보면 손글씨 메모가 끝까지 컴퓨터 기본 글씨체로 남아 있었다고 합니다. 점수는 통과했는데 눈에 제일 띄는 차이는 그대로였던 셈입니다.
보리스도 같은 강연 뒷부분에서 화면의 작은 어긋남을 확인하는 일은 클로드가 아직 완벽하지 않다고 인정했다고 합니다. 그래서 확인 방법 옆에 한 줄을 더 적으라고 합니다. 검사가 안 재는 곳, 결국 사람 눈으로 봐야 하는 곳을 한두 개, 많아야 세 개쯤.
준비물
- AI에게 맡길 일 하나
- 비교할 원본 또는 참고 이미지. 화자는 검사기나 비교할 원본이 있어야 확인을 할 수 있다고 봅니다.
- 내가 쓰는 규칙 파일 CLAUDE.md(클로드 코드가 대화를 시작할 때마다 읽는 프로젝트 규칙 메모). 11~14단계에만 필요합니다.
1부. 네 줄 틀로 일 맡기기 (1~10단계)
화자의 예시 상황은 "참고 디자인에 맞춰 발표 자료를 만든다"입니다. 개발이 아니라 평소 일에 붙여 본 것입니다.
- AI에게 맡길 일 하나를 고릅니다.
- 확인: 맡길 일이 하나로 정해져 있습니다.
- 첫째 줄에 과제를 적습니다.
- 화자 예시: 참고 이미지와 같은 느낌의 표지 한 장
- 주의: 보리스의 말로는, 흔한 실수가 일을 단계별로 하나하나 정해 주는 것입니다.
- 확인: 무엇을 만들지 한 줄로 적혀 있고, "이 파일 열고 여기 고치고" 같은 단계 지시는 없습니다.
- 둘째 줄에 지켜야 할 선을 적습니다.
- 화자 예시: 회사 로고와 색은 그대로 두고, 없는 숫자는 넣지 않는다
- 확인: 건드리면 안 되는 것이 적혀 있습니다.
- 셋째 줄에 확인 방법을 적습니다.
- 화자 예시: 만든 표지를 참고 이미지와 나란히 놓고 비교한다
- 확인: AI가 결과를 무엇과 어떻게 비교할지 적혀 있습니다.
- 넷째 줄에 끝나는 조건을 적습니다.
- 화자 예시: 다 맞으면 끝. 세 번 고쳐도 안 맞으면 멈추고 어디서 막혔는지 보고한다
- 확인: 끝나는 경우와 멈추는 경우가 둘 다 적혀 있습니다.
- 확인 방법 옆에 눈으로 볼 곳을 적습니다.
- 화자 예시: 제목 글씨 모양과 크기, 로고 위치, 강조색
- 개수: 한두 개, 많아야 세 개쯤. 검사가 안 재는 곳을 고릅니다.
- 주의: 이걸 안 적으면 AI가 확인 방법이 크게 쳐 주는 곳에 힘을 쓴다는 것이 화자의 경고입니다.
- 확인: 글씨체나 강조색처럼 사람 눈으로 봐야 하는 곳이 1~3개 적혀 있습니다.
여기까지 적으면 화자의 예시는 아래 모양이 됩니다. 화자가 말한 내용을 항목별로 옮긴 것이고, 키트에 든 지시문 원문은 아닙니다.
과제: 참고 이미지와 같은 느낌의 표지 한 장
지켜야 할 선: 회사 로고와 색은 그대로 두고, 없는 숫자는 넣지 않는다
확인 방법: 만든 표지를 참고 이미지와 나란히 놓고 비교한다
눈으로 볼 곳: 제목 글씨 모양과 크기, 로고 위치, 강조색
끝나는 조건: 다 맞으면 끝. 세 번 고쳐도 안 맞으면 멈추고 어디서 막혔는지 보고한다
- 적은 확인 방법이 실제로 할 수 있는 것인지 봅니다.
- 순서: 화자는 "확인 방법은 적기 전에 실제로 할 수 있는 건지부터 봐야 해요"라고 했습니다. 영상에서는 여기서 말하지만, 실제로는 4단계보다 먼저 볼 일입니다.
- 대안: 화면을 직접 열어 볼 수 있는 클로드 코드라면 "직접 열어서 비교"까지 적습니다. 자막 표기는 "경험 연결을 켠 클로드 코드"인데 무엇을 켜는지는 [불명]입니다. 브라우저 확인 도구를 연결하는 일반적인 방법은 편집자 정리에 적었습니다.
- 확인: AI가 결과를 열어 볼 수단이 있습니다. 없으면 처음 보고처럼 확인 없이 끝난다고 합니다.
- (채팅창에서 맡기는 경우) 맞는 결과를 찍어서 채팅창에 붙여 놓습니다.
- 확인: 채팅창에 찍은 이미지가 올라가 있습니다.
- 붙인 결과를 참고 이미지와 비교하라고 시킵니다.
- 확인: AI의 보고에 비교한 결과가 들어 있습니다. 글로만 끝난 보고는 일이 끝났다는 증거가 아니라 그냥 보고로 봅니다.
- 점수나 검사가 통과해도, 6단계에 적은 눈으로 볼 곳을 직접 들여다봅니다.
- 주의: 화자 실험에서 소넷은 90점을 넘겼지만 손글씨 메모가 끝까지 컴퓨터 기본 글씨체로 남아 있었다고 합니다.
- 확인: 적어 둔 곳 각각이 참고 이미지와 맞는지 내 눈으로 봤습니다.
"시스템 프롬프트 80% 삭제"와 내 CLAUDE.md
규칙 파일을 줄이기 전에 화자가 먼저 짚는 오해가 있습니다. 지시문(자막 표기 "지심")을 80% 지웠다는 말을 듣고 내 규칙 파일도 지워야 하나 헷갈리는 경우입니다. 아래는 화자 설명입니다.
- 80%는 앤트로픽이 오퍼스 출시 날(자막 표기 "출신날") 올린 글에 나온 숫자라고 합니다.
- 지운 것은 클로드 코드 안에 기본으로 들어 있는 지시문입니다. 내가 쓴 규칙 파일은 뒤에 따로 붙어서 들어갑니다. 내 규칙 파일이 지워진 게 아닙니다.
- 화자는 5.5가 나온 뒤에 또 지웠다는 기록은 찾지 못했다고 합니다. 지시문 묶음 전체를 따로 잰 기록을 보면 오히려 늘었다고 하는데, 누가 잰 기록인지는 자막 표기가 "해자들이"여서 [불명]입니다.
- 공식 안내서에 지워도 된다는 문장이 나온다고 합니다. "스스로 확인해라" 같은 지시가 그 예입니다(이 대목의 모델명은 자막 표기 "오퍼스 보이", "오퍼스 웨이브"로 [불명]).
- 확인할 수단까지 치우라는 말은 아닙니다. 지시문을 줄이는 일과 확인 방법을 주는 일은 서로 다른 일이라는 점을 화자는 강조합니다.
- 클로드 코드 공식 문서에 따르면 규칙 파일은 새 대화를 열 때마다 통째로 실린다고 합니다. 문서가 권하는 길이는 자막에 "200로 쓰라고"만 남아 단위가 [불명]입니다. 그보다 길어지면 덜 지킨다고 적혀 있다고 합니다. 정확한 기준은 더보기란에 걸린 클로드 코드 메모리 문서에서 직접 확인할 수 있습니다.
2부. CLAUDE.md 줄이기 (11~14단계)
순서는 고정입니다. 화자가 무료 키트의 "규칙 다이어트 지시문"을 소개하며 말한 순서가 이렇습니다. "규칙 파일을 백업하고 규칙 없이 며칠 써 보고 두 번 이상 걸린 것만 되살리는 순서예요"
- 규칙 파일을 백업합니다.
- 확인: 원래 규칙 파일의 사본이 따로 남아 있습니다. 백업 명령 예시는 편집자 정리에 있습니다.
- 규칙 파일을 지웁니다.
- 보리스의 권고는 여섯 달마다 규칙 파일, 스킬, 자동 실행 설정(훅)까지 한번 다 지워 보라는 것입니다.
- 순서: 영상에서는 "지워 보라"는 말이 "백업" 언급보다 먼저 나옵니다. 여기서는 화자가 직접 말한 키트 순서(백업 먼저)를 따랐습니다.
- 확인: 규칙 없이 AI를 쓰는 상태입니다.
- 규칙 없이 며칠 써 봅니다.
- 며칠인지 구체 숫자는 발화에 없습니다. 평소 일을 몇 번 돌려 볼 만큼이면 됩니다.
- 확인: 같은 데서 걸린 실수가 있었는지, 몇 번이었는지 알고 있습니다. 메모장에 실수를 적어 두면 세기 쉽습니다.
- 두 번 이상 걸린 것만 규칙 파일에 한 줄씩 되살립니다.
- 화자는 클로드 코드 공식 문서에도 같은 실수를 두 번째 할 때 규칙 파일에 추가하라고 적혀 있다고 말합니다. 한 번 틀린 건 넘어갑니다.
- 확인: 되살린 줄마다 두 번 이상 되풀이된 실수가 하나씩 대응합니다.
규칙 파일을 켜고 끄고 해 본 결과
조건마다 1회, 화자 주장입니다.
- 규칙 파일을 켠 쪽과 끈 쪽으로 같은 쇼츠 대본을 써 봤습니다.
- 켠 쪽도 말투나 절차를 적어 둔 규칙 문서를 한 번도 열지 않았습니다.
- 채널의 대본 검사기로 잰 품질은 두 쪽이 사실상 같았습니다.
- 켠 쪽은 클로드를 부를 때마다 규칙 묶음이 토큰을 먼저 싣고 시작했습니다. 자막은 "토큰 약천개"로 숫자가 불완전하고, 더보기란에는 약 1만 3천 토큰으로 적혀 있습니다.
화자는 단서를 답니다. 규칙이 쓸모없다는 게 아니라, 이 일에선 읽히지도 않고 토큰만 먼저 먹었다는 것입니다.
스위스 취리히 연방공대(자막 표기 "스위스 7리 연방공대") 연구진 논문도 방향이 같다고 합니다. 안내 파일을 넣어 줘도 일을 해내는 비율은 대체로 오르지 않았고, AI를 돌리는 비용만 평균 20% 넘게 늘었다는 내용입니다.
검증 루프에서 자주 막히는 곳
AI가 열어 보거나 비교하지 못했다고 보고하고 끝낸다
- 원인(화자 설명): 확인할 도구를 안 줬다.
- 해결: 확인 방법을 같이 준다. 적기 전에 실제로 할 수 있는지부터 본다.
점수는 통과했는데 눈에 띄는 차이가 그대로 남는다
- 원인(화자 설명): AI가 검사기가 크게 쳐 주는 곳을 맞췄다.
- 해결: 확인 방법 옆에 눈으로 볼 곳을 한두 개, 많아야 세 개쯤 적는다.
세 번 고쳐도 안 맞는다
- 해결: 멈추고 어디서 막혔는지 보고하게 끝나는 조건에 적어 둔다.
규칙 파일을 넣었는데 결과가 달라지지 않는다
- 원인(화자 설명): 화자 실험에서는 규칙 문서가 한 번도 열리지 않고 토큰만 먼저 실렸다(조건마다 1회).
- 해결: 지워 보고, 같은 데서 자꾸 걸릴 때만 한 줄씩 되살린다.
다 하고 나서 볼 것
- 맡기는 글에 과제, 지켜야 할 선, 확인 방법, 끝나는 조건 네 줄이 있다
- 확인 방법 옆에 눈으로 볼 곳이 1~3개 적혀 있다
- AI가 실제로 쓸 수 있는 확인 수단이 있다
- 통과 보고를 받은 뒤에도 눈으로 볼 곳을 직접 봤다
- 규칙 파일에는 두 번 이상 되풀이된 실수만 적혀 있다
더보기란에서 확인한 것
아래는 발화가 아니라 영상 설명란에 적힌 글입니다. 수치와 평가는 모두 채널 주장입니다. 수집된 고정 댓글은 없었습니다.
자막에서 빠지거나 흐린 수치
- (더보기란) "같은 90점까지 오퍼스는 확인 3번·약 4분, 소넷은 확인 9번·약 20분, 요금은 약 71센트·77센트로 비슷"
- (더보기란) "실측: 규칙을 켜도 품질은 같고 매번 약 1만 3천 토큰을 먼저 싣는다"
- (더보기란) "검사기 없이 75.2·
75.4점 → 검사기를 주니 오퍼스 5.5 90.6점, 소넷 5.5 90.2점 (조건마다 1회)"
채널이 적은 핵심 문장과 한계
- (더보기란) 오늘의 핵심 한 문장: "AI는 확인할 방법을 주면 나아지지만, 그 방법이 재는 곳부터 맞춘다. 그래서 눈으로 볼 곳을 같이 적는다." (원문의 줄표는 마침표로 바꿨습니다)
- (더보기란) "한계도 솔직하게: 실험은 조건마다 1회씩이라 경향으로만 봐 주세요. 점수는 저희가 만든 채점 방식(원본과 내용 자리가 겹치는 정도)이고 사람 눈 판정이 아닙니다."
- (더보기란) 네 줄 틀 표기: "과제 · 지켜야 할 선 · 확인 방법 · 끝나는 조건"
질문과 답
- (더보기란) "Q. 클로드 코드가 시스템 프롬프트를 80% 지웠다면 내 CLAUDE.md도 지워야 하나요?"
- (더보기란) "A. 80%는 클로드 코드에 기본으로 들어 있는 지시문 이야기예요. 내 CLAUDE.md는 따로 붙는 파일이라, 지워 보고 같은 실수가 두 번 나올 때만 한 줄씩 되살리는 쪽을 권합니다."
원본 강연·문서·논문
- (더보기란) 원본 강연: Boris Cherny, "We Cut 80% of Claude Code's Prompt", Y Combinator (2026-07-27) youtube.com/…
- (더보기란) 채널이 적은 강연 인용 구간: 4분 29초 시스템 프롬프트 80% 삭제, 6분 57초 CLAUDE.md·스킬·훅 지워 보기, 7분 39초 반복해서 걸릴 때만 되살리기, 14분 52초 과제·지켜야 할 선·끝나는 조건, 20분 13초 확인이 가장 중요, 30분 40초 화면 확인의 한계
- (더보기란) Anthropic 모델 단가: platform.claude.com/…
- (더보기란) 클로드 코드 메모리 문서: code.claude.com/…
- (더보기란) ETH 취리히 연방공대 논문 Evaluating AGENTS.md: arxiv.org/…
- (더보기란) "클로드 요금·정책·한도는 2026-09-29 기준이며 자주 바뀝니다. 영상 속 요금은 공시 단가로 환산한 값이에요."
지시문 전문과 이해관계
- (더보기란) 네 줄 틀의 항목 이름만 있고, 눈으로 볼 곳 지시문·규칙 다이어트 지시문·화면 비교 검사기의 실제 내용은 적혀 있지 않습니다.
- (더보기란) 이 자료들은 카카오톡 오픈톡에서 무료로 받으라고 안내합니다. 채널 커뮤니티로 사람을 모으는 통로이기도 하니 이해관계가 있는 안내입니다. 오픈채팅 링크는 옮기지 않았습니다.
- 발화에서는 받는 곳이 고정 댓글이라고 했지만, 안내는 더보기란에만 있었습니다.
영상에 없는 배경 (편집자 정리)
여기부터는 영상에서 다루지 않은 내용입니다. 실제로 따라 해 보려면 알아야 하는 것들을 따로 정리했습니다. 아래 명령과 예시는 편집자가 덧붙인 것이고, 화자의 키트 내용과는 다릅니다.
클로드 코드에 화면을 열어 볼 도구 붙이기
7단계의 "직접 열어서 비교"를 하려면 클로드 코드가 브라우저를 열고 화면을 찍을 수 있어야 합니다. 흔히 쓰는 방법은 마이크로소프트가 만든 Playwright MCP(클로드 코드가 브라우저를 직접 조작하게 해 주는 연결 도구)를 붙이는 것입니다. Playwright MCP 공식 안내에 실린 클로드 코드 연결 명령은 아래와 같습니다. 터미널에서 실행합니다.
claude mcp add playwright npx @playwright/mcp@latest
- 이 명령을 쓰려면 Node.js(npx 명령이 들어 있는 실행 환경)가 설치돼 있어야 합니다.
- 연결한 뒤 클로드 코드를 다시 열고
/mcp를 치면 연결된 도구 목록에서 playwright가 보이는지 확인할 수 있습니다. - 명령 형식은 바뀔 수 있으니 Playwright MCP 공식 저장소의 최신 안내를 함께 확인합니다.
개발 작업에 붙인 네 줄 틀 예시
화자의 예시는 발표 자료였습니다. 웹 화면을 만드는 일이라면 이렇게 쓸 수 있습니다. 편집자가 만든 예시입니다.
과제: reference.png와 같은 모양의 로그인 화면을 index.html로 만든다
지켜야 할 선: 기존 style.css의 색 변수는 바꾸지 않고, 외부 라이브러리는 추가하지 않는다
확인 방법: 브라우저로 index.html을 열어 화면을 찍고 reference.png와 나란히 비교한다
눈으로 볼 곳: 버튼 글씨체, 입력칸 사이 간격, 로고 크기
끝나는 조건: 비교해서 다 맞으면 끝. 세 번 고쳐도 안 맞으면 멈추고 다른 점을 목록으로 보고한다
11단계, CLAUDE.md 백업 명령
프로젝트 폴더에서 터미널을 열고 아래처럼 사본을 만듭니다. 맥·리눅스 기준이고, 윈도우 PowerShell에서도 cp가 같은 뜻으로 동작합니다.
cp CLAUDE.md CLAUDE.md.backup
사본을 만든 뒤 원래 CLAUDE.md를 지우거나 다른 폴더로 옮기면 12단계가 됩니다. 클로드 코드 안에서 /memory를 치면 지금 어떤 메모리 파일이 불러와지는지 확인하고 열어 볼 수 있습니다. 전역 규칙 파일(~/.claude/CLAUDE.md)도 쓰고 있다면 같은 방식으로 백업합니다.
14단계에서 되살릴 한 줄 쓰는 법
되살리는 규칙은 실수 하나에 한 줄로 짧게 씁니다. "코드를 깔끔하게" 같은 막연한 말보다 "테스트는 npm test로 돌린다", "날짜 형식은 YYYY-MM-DD로 쓴다"처럼 확인할 수 있는 문장이 지키기 쉽습니다.
용어 풀이
- 시스템 프롬프트: 클로드 코드 같은 도구가 사용자가 말하기 전에 AI에게 미리 넣어 두는 기본 지시문.
- 검사기: 결과물을 원본과 자동으로 비교해 점수를 내는 프로그램. 이 영상에서는 채널이 직접 만든 것입니다.
- 훅(hook): 클로드 코드가 특정 시점에 자동으로 실행하게 걸어 두는 명령.
자주 묻는 질문
클로드 코드 검증 루프는 어떻게 시작하나요?
맡기는 글에 과제, 지켜야 할 선, 확인 방법, 끝나는 조건 네 줄을 적으면 됩니다. 확인 방법 옆에는 검사가 못 재는 곳, 곧 사람 눈으로 볼 곳을 한두 개 더 적습니다. AI가 실제로 결과를 열어 볼 수단이 있는지도 먼저 확인합니다.
시스템 프롬프트를 80% 지웠다면 내 CLAUDE.md도 지워야 하나요?
꼭 그렇지는 않습니다. 화자 설명으로 80%는 클로드 코드에 기본으로 든 지시문 이야기이고, 내 CLAUDE.md는 따로 붙는 파일입니다. 백업한 뒤 지워 보고, 같은 실수가 두 번 나올 때만 한 줄씩 되살리는 순서를 권합니다.
검사기 점수가 높으면 결과를 믿어도 되나요?
점수만 믿으면 안 됩니다. 화자 실험에서 소넷은 90점을 넘겼지만 손글씨 메모가 기본 글씨체로 남아 있었다고 합니다. 검사가 재지 않는 곳은 사람이 직접 봐야 합니다.
오퍼스와 소넷 중 어느 쪽이 검증 작업에 유리한가요?
화자 실험에서는 둘 다 90점대에 도달했고 요금도 비슷했습니다. 오퍼스는 확인 횟수와 시간이 적었다고 하지만 조건마다 한 번 돌린 결과라 경향으로만 봐야 합니다. 내 작업으로 직접 비교해 보는 편이 정확합니다.
이 글은 유튜브 자동 자막을 바탕으로 정리했으며 화면은 대조하지 못했습니다. 원 영상은 방구석컴퍼니 채널의 9분 14초 분량 영상이고, 점수·시간·요금은 모두 채널의 1회 실험 결과로 화자 주장입니다. 자막에 "보퍼스 5.5", "지심", "스위스 7리 연방공대"로 잡힌 표기는 각각 오퍼스 5.5, 지시문, 스위스 취리히 연방공대(ETH 취리히)로 옮겼습니다.
출처: youtu.be/…