제품은 쏟아지고, 신뢰는 검증을 기다린다
Anthropic이 Sonnet 5·Claude Tag·Claude Science로 제품 표면을 넓히자 셀프호스팅 오픈소스 대안이 곧장 따라붙었고, 같은 주 벤치마크 회의론과 최신 모델의 도구 역행 사례는 쏟아지는 성능을 대체 무엇으로 검증하고 신뢰할지를 되물었다.
Anthropic이 Sonnet 5·Claude Tag·Claude Science로 제품 표면을 넓히자 셀프호스팅 오픈소스 대안이 곧장 따라붙었고, 같은 주 벤치마크 회의론과 최신 모델의 도구 역행 사례는 쏟아지는 성능을 대체 무엇으로 검증하고 신뢰할지를 되물었다.
빅테크가 Opus 4.8·Fable 5·GPT-5.6 Sol을 한 주에 쏟아내는 사이, GLM 5.2가 사이버보안 벤치마크에서 Claude를 앞서고 로컬 모델이 빠르게 따라붙는다. 모델 우열보다 하네스가 승부를 가르는 국면을 짚는다.
빅테크가 또 한 번 라인업을 통째로 갈아엎은 주, Anthropic은 Opus 4.8과 Fable 5·Mythos 5를 동시에 내놨고 OpenAI는 GPT-5.5를 보안·헬스로 밀었다. 그러나 GLM-5.2와 Apertus가 보여주듯 무게 중심은 오픈·로컬로 빠르게 새고 있다.
GLM-5.2가 오픈웨이트 모델 1위에 오르고 로컬 추론이 실용 단계에 든 같은 주, SpaceX는 Cursor를 600억 달러에 인수했다. 모델의 해자가 얕아지는 사이 자본은 모델을 감싸는 도구와 하네스 쪽으로 무게중심을 빠르게 옮기고 있다.
Anthropic이 Fable 5와 Mythos 5를 내놓자 미국 정부가 곧바로 접근 중단을 지시했다. 같은 주 자율 에이전트는 운영자에게 6천 달러대 청구서를 남겼다. 역량 경쟁이 통제 경쟁으로 무게 중심을 옮긴 한 주를 두 축으로 정리한다.