오늘의 흐름 정리
화요일 이후 이틀 사이, 오픈 웨이트 진영의 굵직한 공개 두 건이 하루에 몰렸다. 지난 회차에서 정체 추정만 남겨 뒀던 익명 모델 Ox Alpha가 Z.ai의 GLM-5.3-Flash로 확인되며 가중치까지 풀렸고, 같은 날 알리바바는 차세대 Qwen4 아키텍처를 미리 담은 Qwen3.8-Flash-Next를 내놨다. 본인은 이를 우연으로 보지 않는다 – 프런티어 근접 지능을 소수 활성 파라미터로 내는 flash급이 오픈 웨이트 경쟁의 주전장이 됐다는 신호다.
Ox Alpha의 가면이 벗겨졌다 – GLM-5.3-Flash
Z.ai가 Ox Alpha는 자사 GLM 계열의 새 모델이라고 확인했다. 익명 기간 동안 무료 제공을 앞세워 OpenRouter 사용량 1위에 올랐고, DeepSeek 사용량의 두 배 이상을 기록한 뒤의 실명 공개다. 지난 회차에서 본인이 “이름값의 프리미엄이 녹고 있다”고 적었던 바로 그 모델이다.
실명 공개는 곧장 정식 출시로 이어졌다. GLM-5 시리즈 최초의 네이티브 멀티모달 모델로 총 320B 파라미터 중 18B만 활성화하며, GLM-5.2보다 성능이 낫지만 가격은 10분의 1 수준이고 코딩·에이전트 벤치마크에서는 Claude Opus 4.8에 근접한다는 것이 Z.ai의 소개다. 가중치는 Hugging Face에 올라왔고, Artificial Analysis의 지능·가격 분석도 같은 날 붙었다.
같은 날 도착한 Qwen3.8-Flash-Next – Qwen4 설계의 선공개
경쟁자도 같은 날을 골랐다. 알리바바가 Qwen3.8-Flash-Next를 공개했다. 125B 본체와 51B N-gram 임베딩 가운데 토큰당 6B 파라미터만 활성화하는 멀티모달 MoE로, 차세대 Qwen4 아키텍처를 미리 공개한 성격이며 GDN과 QSA로 1M 토큰 컨텍스트의 처리 효율을 겨냥했다. 세부 설계는 기술 리포트로 함께 풀렸다.
아래 체급에서는 FPQA Diamond·IFBench·Terminal-Bench-2.1 세 벤치마크로 앞서 풀려 있던 Qwen3.8-27B의 양자화 수준별 성능을 실측한 결과도 나왔다 – 4비트(Q4_K_M)까지는 성능이 유지되고 1비트에서 무너진다. 이번 두 모델의 가중치도 곧 같은 검증대에 오른다.
한 줄 정리
익명 가면이 벗겨진 날, flash급 오픈 웨이트 두 종이 나란히 도착했다 – 프런티어 근접 지능의 가격 하한선을 끌어내리는 경쟁은 이제 실명으로 진행된다.
조회수: 1