GLM-5.3-Flash·Qwen3.8-Flash-Next 동시 공개 – Ox Alpha 정체는 GLM이었다
익명 모델 Ox Alpha가 Z.ai의 GLM-5.3-Flash로 확인되며 가중치까지 풀렸고, 같은 날 알리바바는 Qwen4 아키텍처를 선공개한 Qwen3.8-Flash-Next를 내놨다. 하루에 도착한 두 flash급 오픈 웨이트가 프런티어 단가의 하한선을 다시 끌어내리고 있다.
익명 모델 Ox Alpha가 Z.ai의 GLM-5.3-Flash로 확인되며 가중치까지 풀렸고, 같은 날 알리바바는 Qwen4 아키텍처를 선공개한 Qwen3.8-Flash-Next를 내놨다. 하루에 도착한 두 flash급 오픈 웨이트가 프런티어 단가의 하한선을 다시 끌어내리고 있다.
GPT-5.6 Sol 50% 인하와 Devin 70% 할인, Replit 무료 모드까지 가격 인하전이 벌어졌다. 벤치마크 동률의 Qwen 3.8 27B는 실전 평가가 갈렸고, Unsloth와 Ornith-1.5 등 로컬 생태계는 속도전에 들어갔다.
지난주 공개된 Qwen 3.8 27B가 Artificial Analysis 벤치마크에서 DeepSeek V4와 동률을 기록했다. 청구서는 16K 추론 토큰이다. Claude 워터마크는 후폭풍과 강건성 실측을, 사이버 모델은 게이트와 오픈 두 경로의 출하를 동시에 겪은 한 주다.
Meta의 30B Muse Glimmer부터 14MB Needle 2, 한국 Motif-3까지 로컬 상주 에이전트용 오픈 웨이트 라인업이 채워진 나흘, Docker 샌드박스 제품화와 OpenAI의 Astra 출시 보류로 에이전트 실행의 격벽도 함께 올라갔다.
Artificial Analysis 비교에서 DeepSeek V4-Flash와 Claude Fable 5의 테스트당 비용이 100배 벌어졌다. 같은 이틀 사이 304B 모델이 단일 GPU와 휴대폰까지 내려왔고, 프런티어는 값이 아니라 체감 품질로 심판받기 시작했다.