Claude Code 데일리 브리핑 - 2026-08-03
최신 릴리스 요약
| 버전 | 날짜 | 핵심 변경 |
|---|---|---|
| v2.1.220 | 7/25 | 안정성·버그 수정 전용 릴리스(세부 항목 비공개) |
2026-08-03 기준 신규 릴리스 없음 — 최신 버전은 v2.1.220(2026-07-25)입니다. CLI는 열흘째 조용합니다.
대신 오늘은 MCP 2026-07-28 스펙 확정(신규 기능)과, 생성은 스케일되는데 검증은 그렇지 않다는 걸 서로 다른 각도에서 보여준 두 건의 실측(워크플로우)이 무게중심입니다.
주요 신규 기능 & 실전 활용
MCP 2026-07-28 스펙 확정 — 상태 비저장 코어와 프로덕션 OAuth·OIDC (7/28 발표)
MCP 2026-07-28 스펙이 확정됐고, Anthropic이 Claude 제품 적용을 예고했습니다. 스펙 이름의 날짜는 MCP의 버전 표기 방식입니다.
바뀐 것 세 가지
- 상태 비저장 코어: 기존의 양방향 상태 유지(stateful) 설계를 상태 비저장 요청·응답 구조로 교체했습니다. 세션 관리 부담이 사라지면서 MCP 서버를 서버리스·엣지 인프라에 그대로 배포할 수 있고, 발표 글의 표현대로 MCP가 일급 HTTP 워크로드가 됩니다.
- 확장의 표준화: MCP Apps와 Tasks 같은 확장을 버전 관리 프레임워크 아래로 공식화했습니다.
- 인증 강화: 프로덕션 수준의 OAuth 2.0·OIDC 배포를 지원해, Entra·Okta 같은 기존 ID 시스템과 우회 방법 없이 통합됩니다.
이미 채택한 곳: Figma, Intuit, Netlify, PostHog, Xero, Zoom.
중요한 단서 — 오늘 켤 수 있는 설정이 아닙니다. 발표 글은 Claude 제품 전반에 곧(soon) 적용된다고만 밝혔고 구체적인 일정은 없으며, Claude Code를 따로 지목하지도 않았습니다. 즉 지금 시점에서 이 변화는 Claude Code 사용자가 켜는 기능이 아니라, MCP 서버를 만드는 쪽이 준비할 수 있는 변화입니다.
그 관점에서 지금 해볼 만한 점검은 두 가지입니다.
- 자체 MCP 서버를 운영 중이라면, 세션 유지에 의존하는 설계가 남아 있는지 확인하세요. 상태 비저장 코어는 서버를 상시 프로세스로 띄워 둘 필요를 없애므로, 배포 형태와 비용 구조 자체가 바뀔 수 있습니다.
- 사내 SSO 뒤에 MCP 서버를 두려고 우회 방법을 쓰고 있었다면, 표준 OAuth·OIDC 경로가 생겼습니다. 지금부터 설계하는 서버라면 우회 인증을 새로 만들 이유가 줄었습니다.
7/22 릴리스(v2.1.218)가 claude mcp list와 /mcp에 HTTP 상태 코드와 에러 문구를 노출하도록 바꾼 것과 함께 보면, MCP를 다루는 층이 평범한 HTTP 서비스처럼 진단·배포·인증되는 방향으로 정리되고 있다는 흐름이 보입니다. Anthropic
개발자 워크플로우 팁
Karpathy가 Opus 5에 100만 토큰을 쥐여준 결과 — 만드는 건 되는데, 검증이 안 됩니다 (8/3)
LLM 평가가 자전거를 탄 펠리컨 SVG 만들기 같은 단일 결과물에서 벗어나, 세계와 게임을 절차적으로 구현하는 장시간 작업으로 확장되기 시작했다는 관찰입니다. Andrej Karpathy가 Opus 5에 《반지의 제왕》 첫 문단과 100만 토큰 예산을 주고 Three.js 렌더링을 요청한 실험이 그 사례입니다.
- 결과물: 약 2시간 동안 5,500줄의 코드가 생성됐고, 여러 3D 폴리곤 에셋이 절차적으로 배치·애니메이션된 동작하는 세계가 나왔습니다. 비용은 약 10달러입니다.
- 드러난 한계가 더 중요합니다: 모델은 자기 결과물을 스스로 검증하지 못했습니다. 생성된 영상을 인식하거나 만들어진 게임을 직접 플레이할 수 없어 스크린샷에 의존했고, 그 스크린샷에서 여러 오류와 품질 문제가 드러났습니다.
사흘 연속 같은 자리를 가리키는 결과입니다 — 8/1의 Claude가 리팩터링 기회를 스스로 찾아내지 못했다, 8/2의 AI가 만든 프로토타입과 프로덕션 사이에 남는 것들, 그리고 오늘입니다. 세 사례 모두 생성 능력은 예산에 비례해 늘어나는데, 결과를 판정하는 능력은 함께 늘지 않는다는 같은 비대칭을 보여줍니다.
오늘의 습관: 에이전트에게 큰 토큰 예산을 주는 장시간 작업을 돌린다면, 예산과 함께 결과를 자동으로 판정할 경로를 같이 쥐여주세요 — 통과/실패가 명확한 테스트, 실행 결과를 파싱하는 스크립트, 린트·타입체크 게이트처럼 모델이 스스로 볼 수 있는 형태의 신호여야 합니다. 스크린샷 한 장으로 자기 작업을 판정하게 두면, 위 실험과 같은 지점에서 멈춥니다. GeekNews
같은 모델·같은 과제인데 질문 표현이 결과를 갈랐다 — MIT Sloan 연구 (8/2)
22~89세의 재무 결정을 시뮬레이션해 LLM 조언의 실제 효과를 측정한 연구입니다(Swiss Finance Institute Outstanding Paper Award 2026). 성인 1,000명이 직접 프롬프트를 작성하게 한 뒤 GPT-5.2·GPT-5.6·Gemini 3 Flash에 넣고, 비구조적인 사용자 질문 / 구조화된 학술 프롬프트 / AI 없는 기준선 세 가지 결과를 비교했습니다.
- 조언 자체는 대체로 유익했습니다: 30세 이상 거의 모든 사람에게 저축 완충 자금 마련, 저축·주식시장 참여·분산투자 확대, 45세 이후 위험 축소를 권했습니다.
- 핵심 발견: 여성·금융이해력이 낮은 사용자는 60세 시점 자산이 약 5만 달러(4%) 적었고, AI 사용 경험이 적은 사용자는 약 10만 달러(6%) 적었습니다. 그리고 이 성별 격차의 3분의 2는 질문을 어떻게 표현했는지에서 나왔고, 모델 응답의 편차에서 나온 것은 3분의 1뿐이었습니다.
- 부수적으로 눈에 띄는 수치: 사용자가 언급한 비율이 0.4% 미만인 Vanguard가 LLM 응답의 **6%**에, iShares가 **3.4%**에 등장했습니다 — 모델이 제품 발견 경로 자체를 재편한다는 뜻입니다.
- 한계: 모델은 단순한 규칙을 적용하는 경향이 있었고, 실직 같은 충격에 취약했으며, 포트폴리오 리밸런싱 안내와 상황 변화 반영이 부족했습니다.
주의해서 읽어야 할 지점: 이 연구에는 Claude가 포함되지 않았고, 도메인도 코딩이 아니라 개인 재무입니다. 다만 결과 격차의 3분의 2가 모델이 아니라 질문 쪽에서 나왔다는 구조는 팀 단위로 에이전트를 쓰는 상황에도 시사점이 있다고 봅니다 — 같은 모델과 같은 CLAUDE.md를 쓰는데 사람마다 산출물 품질이 크게 다르다면, 모델 설정이나 컨텍스트보다 프롬프트 작성 습관의 차이를 먼저 의심해 볼 근거가 됩니다. 다만 이 확장은 측정된 결과가 아니라 이 브리핑의 해석입니다. GeekNews
보안/제한 이슈
Claude Opus 4.1 API 은퇴가 이틀 뒤 — 8/5 이후 요청은 실패합니다
claude-opus-4-1-20250805가 2026년 8월 5일에 Claude API에서 은퇴합니다 — 이틀 남았습니다. 은퇴일 이후 이 모델로 보낸 요청은 실패하며, 권장 대체 모델은 **claude-opus-4-8**입니다.
- 이 날짜는 Anthropic이 직접 운영하는 플랫폼(Claude API, Claude Platform on AWS, Microsoft Foundry)에 적용됩니다. Amazon Bedrock·Google Cloud는 자체 은퇴 일정을 따로 정하므로 날짜가 다를 수 있습니다.
- 아직 확인하지 않았다면 오늘이 사실상 마지막 여유입니다. Claude Console Usage 페이지의 Export로 API 키별·모델별 사용 내역 CSV를 받아, 어디서 아직 Opus 4.1을 호출하는지 확인하세요.
- 전형적인 실패 모드는 오래된 CI 잡이나 사이드 프로젝트처럼 평소 안 보는 곳에 모델 ID가 하드코딩돼 있다가 조용히 깨지는 것입니다. Claude Platform Docs
캐나다, 유엔 사이버범죄협약에 조용히 서명 — 보안 연구 범죄화 우려 (7월)
과거 국가 감시 권한 확대를 우려해 반대했던 캐나다가 별도의 공개 협의나 우려 해소 없이 유엔 사이버범죄협약에 서명했습니다. 아직 비준 전이라 법적 구속력은 없습니다.
- 입장이 뒤집힌 경위: 2019년 협약 협상에 반대 → 2025년 10월 하노이 서명식에서는 서명 거부 → 2026년 7월 조용히 서명입니다. 정부는 이 전환에 대해 아무런 설명을 내놓지 않았습니다.
- 무엇이 문제인가: 절차적 수사 권한은 모든 범죄의 전자 증거에 적용되고, 국제 공조는 자국법상 징역 4년 이상인 범죄까지 확대되는데 — 나라에 따라 여기에 정치적 표현·언론 활동·성소수자 관련 활동이 포함될 수 있습니다. 협약은 공조 요청에 대한 비밀 유지 명령을 허용하며, 정치범 예외 조항이 없습니다.
- 개발자에게 직접 걸리는 대목: 보안 연구자와 인권 단체가 지적하는 세 가지 위험 중 하나가 광범위한 범죄 정의로 인한 보안 연구의 범죄화입니다. 나머지 둘은 디아스포라 공동체를 겨냥한 초국가적 탄압과, 일관된 사법적 통제 없는 실시간 감청·데이터 수집 확대입니다.
취약점을 찾아 보고하는 일이 업무의 일부인 사람이라면, 어느 관할권에서 무엇을 하고 있는지가 예전보다 중요해지는 방향입니다. 최근 브리핑이 계속 다뤄 온 사건들 — 에이전트의 샌드박스 탈출(7/31), Anthropic 평가 인프라의 실제 조직 침해(8/2) — 이 기술적 통제의 실패였다면, 이번 건은 같은 영역에서 법적 지형이 함께 움직이고 있다는 신호입니다. GeekNews
8/2 신규 인시던트 없음 — 사용자 신고도 24시간 4건으로 급감
StatusGator 추적 기준, 8/2 22:18 UTC 확인 시점에 서비스는 정상(operational) 상태였고, 8/2에 신규 인시던트는 집계되지 않았습니다. 직전 인시던트는 8/1 브리핑이 다룬 7/31 Sonnet 5 성능 저하(50분, Warn 등급)로 이미 해소된 상태입니다.
눈에 띄는 건 사용자 자체 신고 건수입니다 — 지난 24시간 4건으로, 7/30 브리핑 시점의 1만2,241건에서 사실상 바닥까지 내려왔습니다. 7월 말 며칠간 이어지던 불안정이 실제로 가라앉았다는 신호로 읽을 만합니다.
단, 위 수치는 8/2까지만 반영합니다 — 8/3에 대한 데이터는 생성 시점까지 확인되지 않았습니다. StatusGator · Claude Status
리마인더 — Sonnet 5 도입가 8/31 종료 (변동 없음)
Sonnet 5의 도입가는 8/31에 종료되고, 9/1부터 입력 3·출력 15달러(+50%)로 오릅니다 — 상세는 7/13 브리핑을 참조하세요.
커뮤니티 뉴스
- ByteDance Seedance 2.5 — 음성 포함 30초 원테이크 생성 (8/2): ByteDance Seed 팀이 단편 생성에서 완성된 창작물 제작으로 범위를 넓힌 차세대 영상 모델 Seedance 2.5를 출시했습니다. 음성과 영상을 포함한 최대 30초 분량을 한 번에 생성하고 여러 차례 연장해, 인물·환경·서사 속도를 유지한 수 분 길이 콘텐츠를 만들 수 있습니다. 참조 입력이 특히 넓어서 이미지 30장·영상 10개·오디오 10개까지 받고, 클레이 렌더 참조로 공간 구조와 카메라 앵글을 미리 지정하거나 타임스탬프 단위로 서사·카메라 이동·동작을 지정할 수 있습니다. 오늘 다룬 Karpathy 실험과 나란히 두면 방향이 대조적입니다 — 한쪽은 모델에게 자유롭게 만들게 하고 검증에서 막혔다면, 이쪽은 참조와 타임스탬프로 사람이 제어점을 촘촘히 심는 쪽으로 제품을 설계했습니다. 남은 한계는 복잡한 동작의 물리적 타당성과 다중 인물 상호작용 안정성입니다. GeekNews
- Wikimedia Foundation, 노조 인정 거부하고 노조 저지 전문 로펌 선임 (8/3): **직원 압도적 다수가 가입 카드에 서명한 Wiki Workers United U.S.**의 자발적 노조 인정을 Wikimedia Foundation이 거부하고 NLRB 비밀투표를 요구했습니다. 노조 측은 재단이 중립을 표방하면서 노조 저지로 알려진 Littler Mendelson을 법률대리인으로 선임해 투표를 지연시키고 있다고 지적합니다. AI 학습 데이터의 핵심 원천이자 공개 지식 인프라를 운영하는 조직의 거버넌스 문제라는 점에서, 8/2 브리핑이 다룬 Ruby Central이 남긴 파괴적 유산과 같은 질문을 던집니다 — 매일 의존하는 공공 인프라가 실제로는 누구의 판단에 달려 있는가입니다. GeekNews
- BMW, 이미 판매한 차량 화면에 전체 화면 영화 광고 배포 (8/3): BMW가 고객이 이미 구매한 차량의 Control Display에 Spider-Man 전체 화면 광고를 배포하면서, 차량 소유권과 화면 사용 권한을 둘러싼 논란이 커지고 있습니다. 시동 시 배너가 나타나고, 선택하면 음악과 실내 무드 조명까지 연동됩니다. 소프트웨어가 사후에 밀어 넣어지는 기기를 샀다고 해서 통제권을 가진 것은 아니라는 사례로, 벤더 대시보드에서 비용 지표가 예고 없이 사라진 어제의 Cursor 건과 같은 구조입니다 — 내 것이라고 여긴 표면이 실은 공급자가 언제든 바꿀 수 있는 영역이었다는 것입니다. GeekNews
알아두면 좋은 소소한 변경사항
- ripgrep musl 바이너리의 간헐적 SIGSEGV — 실은 리눅스 커널 버그입니다: ripgrep 15.2.0의
x86_64-unknown-linux-musl바이너리가 대규모 파일 트리를 높은 동시성으로 검색할 때 간헐적으로 SIGSEGV로 종료됩니다. 충돌은opendir가 호출한calloc내부, musl mallocng의 힙 메타데이터 검사 지점에서 발생하지만 원인은 ripgrep이 아니라 리눅스 커널입니다 — 익명 페이지 폴트 빠른 경로의 VMA 수준 락과 동시munmap의 TLB shootdown 사이 경쟁 조건으로 있어서는 안 될 zero-page PTE가 나타나는 문제입니다. 재현 조건은 약 20GB·180만 파일 트리를 24코어에서 검색하는 수준이고, 회피책은 glibc 빌드를 쓰거나 jemalloc·mimalloc으로 할당자를 바꾸는 것입니다. 이론적으로는 다른 애플리케이션도 영향을 받을 수 있어, 대형 저장소에서 musl 빌드 도구를 CI에 물려 쓰는 팀이라면 알아둘 만합니다. GeekNews - 8월 마감 캘린더 4종: 8/5 Claude Opus 4.1(
claude-opus-4-1-20250805) API 은퇴 →claude-opus-4-8/ 8/17 레거시 Workbench + 실험적 prompt tools API 3종 은퇴 / 8/19 Claude Code 주간 사용량 50% 부스트 종료 예정 / 8/31 Sonnet 5 도입가 종료(9/1부터 +50%). - AI for Science 희귀질환 그랜트 신청은 마감됐습니다: 6개월간 최대 5만 달러 상당의 Claude 크레딧을 제공하는 프로그램의 신청이 어제(8/2) 23:59 PST로 종료됐습니다. 신청자는 개별 통보를 확인하세요.
- CLI는 조용하지만 채널이 멈춘 건 아닙니다: CLI 체인지로그는 7/25 이후 열흘째 새 항목이 없지만, 오늘 다룬 MCP 스펙 발표는 claude.com 블로그로, 7/30 사이버보안 평가 인시던트 조사 결과는 Anthropic 뉴스룸으로 나왔습니다. 릴리스 노트만 보고 있으면 놓치는 소식이 있다는 뜻입니다.
- Claude Science 크레딧 선정 결과 — 여전히 공개 확인 안 됨: 7/31로 예고됐던 선정 발표는 생성 시점까지도 공개적으로 확인되는 내용이 없습니다.
추천 칼럼 & 읽을거리
- ‘실리콘밸리의 창업자 고기 분쇄기’: 개발 부트캠프에서 출발한 Jim이 인맥을 발판으로 스타트업 취업과 인수, YC 합격, 연쇄 창업까지 빠르게 올라섰다가 몇 년 만에 돈과 관계를 모두 잃고 자취를 감춘 과정을 지켜본 기록입니다. 저자가 짚는 결정적 지점은 실패한 창업이 아니라 첫 고액 연봉 직후의 생활 수준 인플레이션입니다 — 부를 굳히는 대신 소비를 늘리면서 이후의 모든 시도가 여유 없는 도박이 됐습니다. 더 큰 진단은 개인이 아니라 구조에 있습니다: 실리콘밸리에는 유망한 사람을 표준화된 경로로 빠르게 밀어 올리는 장치가 있지만 실제로 살아남는 비율은 극히 낮고, 대부분은 소진된다는 것입니다. 저자 본인의 눈에 띄지 않는 꾸준한 경로와 대비하며 내리는 결론이 반직관적입니다 — 99.9%의 경우, 결국 꾸준한 전진이 더 빠른 길이라는 것입니다. GeekNews
- ‘Matrix에서의 일주일’: 실제 커뮤니티를 Matrix로 운영하며 하루에 하나씩 고장을 만난 일주일을 날짜별로 기록한 글입니다. Spaces가 내부적으로 일반 룸으로 구현돼 있어 원치 않는 메시지가 들어오고, 도메인 차단 하나를 추적하는 데 40분이 걸려 HTML 내보내기와 grep까지 동원해야 했으며, 추천 룸이 신규 사용자에게만 사라졌다가 직접 참여하면 다시 나타나고, Draupnir 봇은 Dendrite의 기본 IPv6 차단 설정 때문에 한 달 넘게 조용히 망가져 있었습니다. 저자의 결론이 날카롭습니다 — Matrix는 matrix.org에서 Synapse와 Element 조합을 쓸 때만 제대로 동작하며, 이를 Discord 대안으로 홍보하는 것은 실제 개발 우선순위와 어긋난다는 것입니다. 페더레이션·상호운용성을 표방하는 시스템을 직접 운영하기로 결정하기 전에 읽어볼 만한, 마케팅과 운영 현실의 간극에 대한 구체적인 기록입니다. GeekNews
- ‘Google은 Google News를 방치했나?’: 관심 주제의 뉴스를 찾는 데 쓰던 Google News 검색이 지정한 조건과 무관한 결과를 내놓으면서 신뢰하기 어려워졌다는 관찰입니다. Tools 메뉴에서 발행 기간·언어·지역을 지정할 수 있지만 이 필터들이 차례로 작동을 멈췄고, 지난주로 설정해도 몇 주·몇 달·몇 년 전 글이 섞여 나오며, 뉴스 매체 대신 인스타그램 같은 소셜 미디어가 결과를 채웁니다. 저자는 이를 포레스트 검프 비유로 정리합니다 — Google이 AI(댄 중위)를 쫓느라 새우잡이 배(Google News)를 방치해 부두에 처박히게 뒀다는 것입니다. 다만 댓글에서는 글이 Google News 자체가 아니라 Google 검색의 뉴스 모드를 다룬 것이라는 반론과, 재현되지 않는다는 증언도 함께 나옵니다. AI 기능에 자원이 쏠릴 때 기존 도구의 조용한 품질 저하를 누가 알아채는가라는 질문으로 읽으면, 어느 쪽 반론을 택하든 남는 게 있는 글입니다. GeekNews
흥미로운 프로젝트 & 도구
- Show GN: cc-explorer — 흩어진 Claude Code 세션을 한곳에 모아 검색하기: 여러 프로젝트를 오가다 보면 세션이 디렉토리별로 흩어져, 예전 대화에서 필요한 내용을 못 찾고 같은 질문을 반복하게 된다는 문제에서 출발한 도구입니다.
claude --resume의 인터랙티브 피커는 현재 디렉토리로 탐색 범위가 묶인다는 게 출발점입니다. 세 가지가 실용적입니다 — ① 인코딩된 폴더명이 아니라 실제 작업 디렉토리 구조로 세션을 보여주고 키워드 검색을 지원합니다. ②/branch로 만든 세션을 부모 아래 들여쓴 트리에⑂ branch태그로 표시해, 부모가 다른 브랜치에 있어도 계보가 보입니다. ③ Claude Code가cleanupPeriodDays(기본 30일) 이 지난 세션 파일을 지우기 때문에, 남은 일수를 배지로 표시하고 개별 연장이나 임계값 조정을 할 수 있게 했습니다. 의존성은 파이썬 표준 라이브러리뿐이고 빌드 단계가 없으며, 127.0.0.1에만 바인딩하고 외부 네트워크 호출이 없으며 대화 기록을 수정하지 않습니다. 최근 나흘간 UFO(7/31)·FlowCraft(8/1)·qm(8/2)에 이어 네 번째 세션 관리 도구인데, 앞의 셋이 실행 중인 세션을 제어하는 쪽이었다면 cc-explorer는 이미 끝난 세션을 다시 찾는 쪽이라는 점이 다릅니다. GeekNews - wiff — 사람은 TUI로, 에이전트는 CLI로 같은 리뷰 세션을 공유하는 코드 리뷰 도구: diff를 캡처해 구문 강조로 탐색하고 인라인 주석을 남길 수 있는 터미널 코드 리뷰 도구입니다. 설계의 핵심은 로컬 우선입니다 — 리뷰가 로컬 세션에 저장되고 네트워크가 필요 없어, 코드가 컴퓨터를 떠나지 않는 상태로 리뷰할 수 있습니다. 작업 트리·인덱스·히스토리의 변경사항은 물론 GitHub PR을 로컬로 가져와 리뷰한 뒤 결과를 다시 GitHub에 올리는 것도 됩니다. 에이전트를 쓰는 입장에서 가장 눈여겨볼 대목은 사람과 에이전트가 같은 리뷰 세션을 공유한다는 점입니다 — 사람은 TUI로, 에이전트는 CLI와 스킬로 같은 세션을 읽고 씁니다. v2.1.218이
/code-review를 백그라운드 서브에이전트로 바꾼 것과 같은 방향인데, wiff 쪽은 리뷰 상태 자체를 사람과 에이전트가 공유하는 로컬 자료로 만든다는 점에서 한 걸음 더 나갑니다. GeekNews