Claude Code 매일 2시간 낭비를 없애주는 cron job 설정법
I wrote a cron job that saves me ~2 hours of dead time on Claude Code every day
TL;DR Highlight
Claude Code Max의 5시간 사용 윈도우를 매일 아침 'hi' 메시지 자동 전송으로 업무 시간에 앵커링한다.
Who Should Read
Claude Code Max 플랜을 매일 heavy하게 쓰는 개발자. 특히 오전 중에 사용량 한도에 걸려 대기 시간이 생기는 상황을 겪어본 사람.
Core Mechanics
- Claude Code Max 플랜의 사용 윈도우는 5시간이며, 당일 첫 메시지를 보낸 시각(시 단위 내림)을 기준으로 시작된다. 예를 들어 8:30에 첫 메시지를 보내면 윈도우는 8AM~1PM이 된다.
- 이 타이밍을 이용해 업무 시작 전인 6AM에 짧은 메시지('hi' 한 마디)를 보내두면, 윈도우가 6AM~11AM으로 앵커링되어 11AM에 이미 새 윈도우가 열린다.
- GitHub Actions cron job을 이용하면 매일 아침 자동으로 워밍업 메시지를 보낼 수 있다. 관련 레포는 https://github.com/vdsmos/claude-warmup 에 공개되어 있다.
- 더 간단한 방법으로는 Claude Code 웹의 네이티브 스케줄 기능(https://claude.ai/code/scheduled)을 사용하면 별도 인프라 없이 동일한 효과를 낼 수 있다. 작성자가 직접 확인한 결과 정상 동작했다.
- 이 개념을 오전 윈도우뿐 아니라 하루 중 다른 시간대에도 적용하면 여러 윈도우의 타이밍을 원하는 업무 흐름에 맞게 최적화할 수 있다.
- 이 방법은 사용량을 늘리거나 제한을 우회하는 것이 아니라, 고정된 윈도우가 시작되는 타이밍만 조정하는 것이다. 추가 사용량이 생기지 않는다.
Evidence
- 이 방법이 TOS 위반 아니냐는 우려에 대해, '사용량을 늘리는 게 아니라 윈도우 시작 타이밍만 조정하는 것이므로 문제없다'는 의견이 다수였다. 오히려 롤링 리셋 방식으로 설계됐어야 했다는 비판도 나왔다.
- GitHub Actions 대신 Claude Code 웹의 네이티브 스케줄 기능(https://claude.ai/code/scheduled)을 쓰면 훨씬 간단하다는 팁이 댓글에서 먼저 제안됐고, 작성자가 직접 테스트 후 '완벽하게 동작한다'고 확인해 본문 EDIT에 반영했다.
- 수개월째 수동으로 매일 아침 'hi'를 치고 샤워하러 간다는 사용자들의 경험 공유가 있었다. 이미 많은 heavy 사용자들이 같은 패턴을 쓰고 있었던 셈이다.
- Mac 환경에서는 cron 대신 launchd를 사용하는 게 안정적이었다는 실사용 경험도 공유됐다. cron 관련 이슈가 있어 결국 launchd로 전환했다는 사례.
- 댓글에서 Claude Code 워크플로우 관련 추가 팁도 공유됐다: CLAUDE.md를 프로젝트 컨벤션 저장소로 활용하기, 세션당 하나의 작업만 집중하기, 코드 수정 전 파일 요약 먼저 요청하기 등이 효과적이라는 경험담이 있었다.
- 원격으로 세션을 모니터링하다가 agent가 permission prompt에서 멈추는 문제는 이 방법으로도 해결되지 않는 미해결 pain point로 언급됐다. 자리를 비운 사이 agent가 멈춰 있는 상황은 여전히 불편하다는 의견.
How to Apply
- Claude Code 웹(https://claude.ai/code/scheduled)에서 매일 아침 업무 시작 2시간 전(예: 6AM)에 'hi'를 보내는 스케줄을 등록해두면, 별도 인프라 없이 윈도우를 원하는 시간에 앵커링할 수 있다.
- GitHub Actions이나 Mac launchd를 선호한다면 https://github.com/vdsmos/claude-warmup 레포를 참고해 cron job을 설정한다. Mac에서는 cron보다 launchd가 더 안정적이라는 커뮤니티 경험이 있으니 참고할 것.
- 오전 외에도 오후 집중 업무 시간이 있다면, 같은 방식으로 두 번째 윈도우 시작 타이밍도 조정해 하루 전체 Claude Code 사용 가능 시간을 업무 스케줄에 맞게 배치할 수 있다.
Terminology
관련 논문
Claude Code는 프롬프트 읽기 전에 33k 토큰을 전송한다; OpenCode는 7k
동일한 모델과 작업 환경에서 Claude Code와 OpenCode의 실제 토큰 사용량을 API 레벨에서 측정한 결과, Claude Code가 시스템 프롬프트 오버헤드만으로 OpenCode 대비 4.7배 더 많은 토큰을 소비한다는 것을 확인했다.
Mesh LLM: iroh 기반 분산 AI 컴퓨팅
사무실, 집, 클라우드에 흩어진 GPU들을 하나의 OpenAI 호환 API로 묶어주는 분산 LLM 실행 시스템으로, 비싼 API 비용 없이 큰 모델을 직접 운영할 수 있다.
Frugon – LLM API 호출 로그를 분석해서 더 싼 모델로 대체 가능한 구간을 찾아주는 로컬 도구
내 LLM API 비용이 어디서 새는지 로컬에서 분석해주는 오픈소스 CLI 도구로, 비싼 모델 대신 저렴한 모델로 전환 가능한 호출을 골라낸다.
로컬에서 SOTA LLM 실행하기 완전 가이드 (하드웨어부터 설정까지)
2천 달러짜리 RTX 3090 한 장부터 4만 달러짜리 RTX PRO 6000 4장 셋업까지, 로컬에서 최신 LLM을 직접 돌리는 방법을 하드웨어 선택·구성·실행 설정까지 통째로 정리한 실전 가이드다.
Manticore Search에서 ONNX 경로를 재설계해 임베딩 속도를 14배 높인 방법
Manticore Search가 기존 SentenceTransformers/Candle 백엔드를 ONNX Runtime으로 교체해 텍스트 임베딩 생성 속도를 평균 14배 향상시켰다. 별도 모델 서비스 없이 DB 내부에서 직접 임베딩을 처리하는 구조에서 INSERT 속도가 곧 임베딩 속도이기 때문에 이 개선은 실질적인 ingest 처리량 향상으로 직결된다.
Asymmetric Quantization: 97% 스토리지 절감으로 Late Interaction 검색 품질 유지하기
멀티벡터 검색 모델의 문서 벡터를 1비트 이진값으로 압축하고 쿼리 벡터만 int8로 유지하는 비대칭 양자화 기법으로, 스토리지를 97% 줄이면서 검색 품질 손실을 0.61점(NDCG@10 기준)에 그치게 만든 실제 프로덕션 적용 사례다.