가성비로 돌아온 프런티어 경쟁, 그리고 하네스라는 청구서
OpenAI가 GPT-5.6으로 토큰당 지능과 달러당 성능을 앞세운 가성비 공세를 걸었고, Claude Sonnet 5가 맞섰다. 그러나 토큰 오버헤드와 에이전트 안전성 사고는 실제 비용과 위험이 모델보다 그것을 감싼 하네스에서 청구됨을 드러냈다.
OpenAI가 GPT-5.6으로 토큰당 지능과 달러당 성능을 앞세운 가성비 공세를 걸었고, Claude Sonnet 5가 맞섰다. 그러나 토큰 오버헤드와 에이전트 안전성 사고는 실제 비용과 위험이 모델보다 그것을 감싼 하네스에서 청구됨을 드러냈다.
Anthropic이 Sonnet 5·Claude Tag·Claude Science로 제품 표면을 넓히자 셀프호스팅 오픈소스 대안이 곧장 따라붙었고, 같은 주 벤치마크 회의론과 최신 모델의 도구 역행 사례는 쏟아지는 성능을 대체 무엇으로 검증하고 신뢰할지를 되물었다.
화요일 이후 Microsoft MAI-Code-1-Flash와 OpenAI Codex가 코드 너머 모든 직무로 확장됐다. 같은 48시간에 AI가 법대 교수를 75% 이겼다는 Stanford 연구와 10명 중 6명이 AI에 심리지원을 의지한다는 AXA 보고가 함께 나왔다.
비동기 풀로 옮겨간 코딩 에이전트와 같은 주간에 일어난 AI 보안의 공격·방어 양면을 정리한다. Claude Code의 agent view·/goal 도입, Mythos curl 결과, TanStack npm 공급망 사고가 한 줄로 묶이는 흐름을 본인의 시선으로 짚는다.
이번 주 AI 코딩 어시스턴트 생태계의 화두는 Claude Code다. 6개월간 매일 사용한 개발자가 정리한 실전 치트시트가 573점이라는 압도적 호응을 얻었고, Anthropic은 최근 응답 품질 저하 현상의 원인을 직접 공개했다. 함께 추린 마지막 픽은 AI 도구를 매개로 미완성 사이드 프로젝트를 부활시키자는 마인드셋 에세이.