깔끔한 프롬프트보다 지저분한 컨텍스트 덩어리를 주는 게 ChatGPT 성능을 더 높인다
chatgpt is way better when you give it a wall of messy context instead of a clean prompt
TL;DR Highlight
지저분하고 상세한 컨텍스트 덩어리 입력이 정제된 bullet point보다 AI 출력을 훨씬 높은 품질로 개선한다.
Who Should Read
AI를 업무 글쓰기·문서 작성에 활용하는 직장인
Core Mechanics
- 깔끔한 프롬프트보다 messy하고 풍부한 컨텍스트가 더 좋은 결과를 냄
- 팀 업데이트 등 반복 업무에서 뇌에서 나오는 그대로를 dump하면 generic 출력이 사라짐
- 음성 받아쓰기(dictation)가 특히 효과적
Evidence
- 깔끔한 bullet point보다 messy한 컨텍스트가 더 좋은 AI 출력을 냄
- 팀 업데이트 등 반복 업무에서 뇌에서 나오는 그대로 dump가 효과적
- 음성 받아쓰기(dictation)가 특히 유용하다는 커뮤니티 검증
How to Apply
- 프롬프트를 정제하려 하지 말고 배경·맥락·고민을 모두 쏟아붓기
- 음성으로 상황을 설명하고 그 텍스트를 그대로 사용
Terminology
관련 논문
claude-real-video: 어떤 LLM이든 영상을 실제로 '볼 수' 있게 해주는 도구
YouTube URL이나 로컬 영상 파일에서 장면 변화 기반으로 핵심 프레임만 추출하고 음성 전사까지 해서 LLM에게 넘겨주는 오픈소스 도구. Claude는 영상 파일을 못 받고, ChatGPT는 자막만 읽고, Gemini는 고정 1fps 샘플링이라는 한계를 모두 우회한다.
ReContext: 재귀적 Evidence Replay로 LLM의 Long-Context 추론 개선
128K 토큰 컨텍스트에서 모델 내부 attention 신호로 핵심 증거만 추출해 재주입하면 추론 정확도가 24.6% 오른다.
LLM을 활용한 Single/Multi Truth Data Fusion
여러 소스의 충돌하는 데이터를 GPT-4o-mini 프롬프트로 병합하면 기존 비지도 방법보다 일관되게 F1 점수가 높다.
다국어 Reasoning Cascade는 더 많은 Context가 필요하다
번역 cascade 파이프라인에서 원본 질문을 마지막까지 유지하면 추가 학습 없이 다국어 성능이 크게 오른다.
Back-and-Forth를 줄여라: Structured Prompting 비교 연구
체크리스트 형식으로 프롬프트를 구조화하면 LLM 답변 품질도 높아지고 토큰도 적게 쓴다.
Training-Free Cultural Alignment: Persona 불일치를 활용한 LLM 문화적 정렬
재학습 없이 각 나라의 도덕적 가치관에 맞게 LLM 출력을 조정하는 추론 시점 기법 DISCA 제안
Claude Code에서 HTML을 출력 포맷으로 쓰는 이유: Markdown보다 나은 점들
Claude Code 팀이 Markdown 대신 HTML을 LLM 출력 포맷으로 선호하기 시작한 이유와 그 실용적 장점을 정리한 글로, AI와 함께 문서/스펙/대시보드를 만드는 워크플로우에 직접적인 영향을 준다.