Anthropic, Claude Sonnet 5·Claude Tag·Claude Science 공개 — 벤치마크 회의론도 함께

Anthropic, Claude Sonnet 5·Claude Tag·Claude Science 공개 — 벤치마크 회의론도 함께

Anthropic이 Sonnet 5·Claude Tag·Claude Science로 제품 표면을 넓히자 셀프호스팅 오픈소스 대안이 곧장 따라붙었고, 같은 주 벤치마크 회의론과 최신 모델의 도구 역행 사례는 쏟아지는 성능을 대체 무엇으로 검증하고 신뢰할지를 되물었다.

Microsoft MAI-Code-1-Flash·Codex Sites 확장 — Stanford 연구 ‘AI가 법대 교수 75% 이겼다’

Microsoft MAI-Code-1-Flash·Codex Sites 확장 — Stanford 연구 ‘AI가 법대 교수 75% 이겼다’

화요일 이후 Microsoft MAI-Code-1-Flash와 OpenAI Codex가 코드 너머 모든 직무로 확장됐다. 같은 48시간에 AI가 법대 교수를 75% 이겼다는 Stanford 연구와 10명 중 6명이 AI에 심리지원을 의지한다는 AXA 보고가 함께 나왔다.

Claude Code Agent View·/goal 도입, TanStack npm 공급망 사고 — 비동기 에이전트와 AI 보안

Claude Code Agent View·/goal 도입, TanStack npm 공급망 사고 — 비동기 에이전트와 AI 보안

비동기 풀로 옮겨간 코딩 에이전트와 같은 주간에 일어난 AI 보안의 공격·방어 양면을 정리한다. Claude Code의 agent view·/goal 도입, Mythos curl 결과, TanStack npm 공급망 사고가 한 줄로 묶이는 흐름을 본인의 시선으로 짚는다.

Claude Code 6개월 사용기 — 실전 치트시트와 응답 품질 저하의 원인

Claude Code 6개월 사용기 — 실전 치트시트와 응답 품질 저하의 원인

이번 주 AI 코딩 어시스턴트 생태계의 화두는 Claude Code다. 6개월간 매일 사용한 개발자가 정리한 실전 치트시트가 573점이라는 압도적 호응을 얻었고, Anthropic은 최근 응답 품질 저하 현상의 원인을 직접 공개했다. 함께 추린 마지막 픽은 AI 도구를 매개로 미완성 사이드 프로젝트를 부활시키자는 마인드셋 에세이.