Qwen 3.8 27B가 프런티어와 동률을 맞췄다 — 청구서는 추론 토큰, 시험대는 Claude 워터마크
지난주 공개된 Qwen 3.8 27B가 Artificial Analysis 벤치마크에서 DeepSeek V4와 동률을 기록했다. 청구서는 16K 추론 토큰이다. Claude 워터마크는 후폭풍과 강건성 실측을, 사이버 모델은 게이트와 오픈 두 경로의 출하를 동시에 겪은 한 주다.
지난주 공개된 Qwen 3.8 27B가 Artificial Analysis 벤치마크에서 DeepSeek V4와 동률을 기록했다. 청구서는 16K 추론 토큰이다. Claude 워터마크는 후폭풍과 강건성 실측을, 사이버 모델은 게이트와 오픈 두 경로의 출하를 동시에 겪은 한 주다.
Kimi K3가 중국 오픈웨이트 모델로는 처음으로 일부 프런티어 벤치마크에서 Opus 4.8을 앞섰다. 같은 주말 Fable 5는 계량제로 전환됐고 Codex 컨텍스트는 축소됐다. 성능은 아래에서 올라오고 가격은 위에서 조여드는 국면을 정리했다.
화요일 이후 흐름은 두 갈래다. MS FastContext가 탐색 서브에이전트로 하네스를 분화시키는 한편 Codex 버그는 SSD 37TB 폭주를 드러냈고, 3B VibeThinker와 CPU 추론이 모델을 가볍게 만드는 사이 EU 워터마킹 규제가 8월 시행을 앞둔다.
Anthropic이 Fable 5와 Mythos 5를 내놓자 미국 정부가 곧바로 접근 중단을 지시했다. 같은 주 자율 에이전트는 운영자에게 6천 달러대 청구서를 남겼다. 역량 경쟁이 통제 경쟁으로 무게 중심을 옮긴 한 주를 두 축으로 정리한다.
빅테크는 상장과 클라우드 유통, 데이터센터로 자본과 인프라의 판을 키운다. 그렇게 코드 생산이 싸지는 사이 개발자의 가치는 코드를 짜는 능력에서 무엇을 만들고 버릴지 고르는 판단과 하네스 설계로 옮겨간다. 지난 한 주 AI 흐름을 두 축으로 정리했다.