Karpathy의 Claude 코딩 몇 주간 사용 후기 정리
A few random notes from Claude coding quite a bit last few weeks
TL;DR Highlight
Andrej Karpathy는 Claude로 몇 주간 코딩하며 AI 코딩의 생산성 향상과 동시에 두뇌 퇴화, slopacolypse, 엔지니어 분화 등 부작용과 구조적 변화를 발견하고 공유했다.
Who Should Read
AI 코딩 도구(Cursor, Claude Code, Copilot 등)를 일상적으로 쓰고 있거나 도입을 고민하는 개발자. 특히 AI 코딩이 자신의 역량과 팀 문화에 어떤 영향을 미칠지 고민하는 시니어 엔지니어.
Core Mechanics
- Karpathy는 AI 코딩으로 인한 '두뇌 퇴화(Atrophy)'를 직접 체감했다고 밝혔다. 코드를 직접 작성하는 능력이 점점 약해지지만, 코드 리뷰 능력은 유지되므로 역할이 '작성자'에서 '검토자'로 바뀌고 있다는 관찰이다.
- AI 에이전트의 '끈기(Tenacity)'가 인상적이라고 했다. 사람이라면 진작 포기했을 문제를 30분 넘게 끈질기게 시도해서 결국 해결하는 모습에서 'AGI를 느끼는 순간'이라고 표현했다. 스태미나가 작업의 핵심 병목인데 LLM이 이걸 극적으로 늘려준다는 것.
- LLM 코딩이 엔지니어를 '코딩 자체를 좋아하는 사람'과 '만드는 것을 좋아하는 사람(빌더)'으로 나눌 거라고 봤다. 빌더 성향의 사람들은 AI 코딩에 열광하고, 코드 장인(craft) 성향의 사람들은 불편해하는 양상이 이미 나타나고 있다.
- 10X 엔지니어의 생산성 격차가 AI로 인해 더 벌어질 수 있다고 봤다. 평균적인 엔지니어와 최상위 엔지니어의 생산성 비율이 AI 도구 활용 능력에 따라 훨씬 커질 가능성을 언급했다.
- 2026년을 'slopacolypse(슬롭 대재앙)의 해'로 예측했다. GitHub, Substack, arXiv, SNS 등 모든 디지털 미디어에 AI가 생성한 저품질 콘텐츠가 넘쳐날 것이라는 경고다.
- IDE는 여전히 필요하다고 봤다. 터미널만으로 코딩하는 게 아니라, AI가 제안한 변경사항을 diff로 확인하고 수락/거절하는 워크플로우에서 IDE의 역할이 중요하다는 입장이다.
- GPT-5 계열 모델이 GPT-4 대비 확실한 도약(phase change)이 있다고 평가했다. 특히 복잡한 도구 호출(tool calling)이 필수인 에이전트 루프에서 차이가 극명하게 드러난다.
Evidence
- 여러 댓글에서 '두뇌 퇴화'를 넘어 '안주(complacency)'가 더 큰 문제라는 공감이 나왔다. AI가 자기 방식대로 코드를 밀어붙이면 처음엔 싸우다가 결국 포기하고 AI 방식을 수용하게 되는데, 이게 반복되면 프로젝트 자체에 대한 흥미를 잃게 된다는 경험담이 있었다. LLM은 학습 데이터 쪽으로 중력처럼 끌리기 때문에 새로운 접근법을 실험하기 어렵다는 지적도.
- AI의 '끈기'에 대해 반론도 있었다. Sonnet 모델이 타입 에러를 잡겠다고 코드베이스 전체 파일을 수정하는 등 삽질에 빠지는 경우가 많고, 심지어 '다른 거 먼저 하고 이거 나중에 하면 안 될까요?'라고 포기 선언을 하는 경우도 목격했다고. Opus는 이런 문제가 훨씬 적다는 비교도 나왔다.
- 한 은퇴 개발자는 Intel 8096 기반 펌웨어 리버스 엔지니어링 프로젝트에 Claude를 2주간 써봤더니 디스어셈블러, 어셈블러, 에뮬레이터까지 만들 수 있었다며 소규모 유틸리티 벤더들이 위험해질 수 있다고 우려했다.
- DevOps 운동과의 유사성을 지적하는 댓글이 있었다. AI 코딩으로 10X 성과를 내려면 워크플로우, 설계 방식, 팀 문화를 모두 바꿔야 하는데, DevOps도 같은 이유로 널리 퍼지지 못했다며 교육과 문화 변화 없이는 AI 코딩도 마찬가지일 거라는 의견.
- 'AI가 모든 걸 바꾸고 있다'는 얘기를 1년째 듣고 있는데 10X 품질이나 산출물은 어디에도 안 보인다며, 구체적 결과물 없는 AI 코딩 경험담은 HN에서 금지해야 한다는 냉소적 반응도 있었다.
How to Apply
- AI 에이전트가 자기 방식으로 코드를 밀어붙이는 문제를 줄이려면, CLAUDE.md나 프로젝트 규칙 파일에 설계 원칙과 코딩 컨벤션을 명시해두고 매 세션마다 참조하도록 설정하라. 컨텍스트가 길어지면 AI가 초기 지시를 '잊으므로' 핵심 규칙은 시스템 프롬프트 레벨에 배치.
- Sonnet이 삽질에 빠지는 것을 방지하려면 복잡한 디버깅은 Opus 모델을 쓰고, 중간중간 'are you on track?' 같은 체크포인트 프롬프트를 넣어라. 또는 변경 파일 수가 3개를 넘으면 자동으로 멈추게 하는 hook을 설정하는 것도 방법이다.
- AI 코딩으로 생산성을 높이되 역량 퇴화를 막으려면, 핵심 알고리즘이나 아키텍처 설계는 직접 작성하고 AI에게는 보일러플레이트, 테스트 코드, 반복 작업을 맡기는 식으로 역할을 분리하라.
- GPT-5의 tool calling 성능 향상이 유의미하다는 보고가 있으므로, 복잡한 multi-tool 에이전트 루프를 만들고 있다면 GPT-4 대신 GPT-5(reasoning=minimal)로 전환 테스트를 해볼 만하다.
Terminology
관련 논문
프로덕션 AI 에이전트를 GPT-5.6으로 마이그레이션: 2.2배 빠르고 27% 저렴
마케팅 웹사이트를 자동 생성하는 프로덕션 AI 에이전트를 Claude Opus 4.8에서 GPT-5.6 Sol로 전환한 실전 경험담으로, 단순 모델 교체가 아니라 eval 하네스, 툴 스키마, 캐싱, 추론 리플레이까지 손봐야 했던 과정을 구체적인 수치와 함께 정리했다.
xAI Grok Build CLI가 xAI 서버로 전송하는 데이터: 네트워크 레벨 분석
xAI의 공식 코딩 CLI 도구 Grok Build가 사용자 동의 없이 전체 Git 저장소와 .env 시크릿 파일을 xAI 서버로 업로드한다는 사실이 네트워크 트래픽 분석으로 밝혀졌다.
중요할 때 기억하라: Long-Horizon 에이전트를 위한 Proactive Memory Agent
LLM 에이전트가 긴 작업 중 중요한 정보를 잊어버리는 문제를 별도의 메모리 에이전트가 '적절한 타이밍에' 끼어들어 해결하는 방법
WebSwarm: 깊고 넓은 웹 검색을 위한 재귀적 Multi-Agent Orchestration
복잡한 웹 검색을 재귀적으로 분해하고 각 노드에 적합한 검색 모드를 동적으로 할당하는 멀티에이전트 프레임워크
웹 앱을 리버스 엔지니어링해서 AI Agent 도구로 자동 변환하기
로그인된 웹 앱의 API 호출을 브라우저에서 감시해 자동으로 MCP 도구로 변환하는 에이전트를 만들었다. 소스 코드나 공식 API 문서 없이도 Jira, Spotify 같은 서비스에 AI 어시스턴트를 붙일 수 있다.
FableCut – AI 에이전트가 조작할 수 있는 브라우저 기반 비디오 에디터 (zero deps)
타임라인 전체를 JSON 파일 하나로 표현하고 MCP/REST로 AI 에이전트가 직접 편집할 수 있는 브라우저 비디오 에디터로, Claude 같은 AI가 프롬프트 하나로 영상을 자동 컷편집하고 결과를 실시간으로 UI에 반영해준다.