Claude Cowork 통합·Gemini 3.8 Live 공개, ChatGPT에는 Sponsored Agents가 붙었다

Claude Cowork 통합·Gemini 3.8 Live 공개, ChatGPT에는 Sponsored Agents가 붙었다

화요일 이후 이틀 사이 Claude는 Cowork와 채팅을 하나로 합쳤고, 구글은 음성으로 추론하는 Gemini 3.8 Live를 내놨다. OpenAI는 ChatGPT 광고를 에이전트로 바꾸는 실험에 들어갔다. 에이전트가 들어앉는 자리가 옮겨가고 있다.

Claude Fable 5.1·Gemini 3.8 Flash Cyber – 사이버 역량이 임계를 넘자 모델이 접근 등급으로 갈렸다

Claude Fable 5.1·Gemini 3.8 Flash Cyber – 사이버 역량이 임계를 넘자 모델이 접근 등급으로 갈렸다

Claude Fable 5.1·Mythos 5.1과 Gemini 3.8 Flash·Flash Cyber가 나왔다. 둘 다 일반판과 검증 조직 전용 사이버판을 한 쌍으로 묶었고 OpenAI Astra도 같은 문법이다. Aisle의 curl CVE 6건이 던진 반문까지 짚는다.

Ox Alpha 익명 등판·GLM-5.3 5분의 1 비용 – 오픈 웨이트가 프런티어 단가를 흔든다

Ox Alpha 익명 등판·GLM-5.3 5분의 1 비용 – 오픈 웨이트가 프런티어 단가를 흔든다

익명 모델 Ox Alpha가 1M 컨텍스트로 무료 등판하고, GLM-5.3 오픈 웨이트는 5분의 1 비용으로 프런티어를 제쳤다. ARC-AGI-3에서 하네스만 바꿔 13%에서 100%로 뛴 실측까지 – 점수와 단가의 주인이 바뀌고 있다.

Qwen 3.8 27B가 프런티어와 동률을 맞췄다 – 청구서는 추론 토큰, 시험대는 Claude 워터마크

Qwen 3.8 27B가 프런티어와 동률을 맞췄다 – 청구서는 추론 토큰, 시험대는 Claude 워터마크

지난주 공개된 Qwen 3.8 27B가 Artificial Analysis 벤치마크에서 DeepSeek V4와 동률을 기록했다. 청구서는 16K 추론 토큰이다. Claude 워터마크는 후폭풍과 강건성 실측을, 사이버 모델은 게이트와 오픈 두 경로의 출하를 동시에 겪은 한 주다.

Grok 4.6·DeepSeek V4 Pro 동시 공개 – 벤치마크는 동률, 승부는 추론 단가와 워터마크

Grok 4.6·DeepSeek V4 Pro 동시 공개 – 벤치마크는 동률, 승부는 추론 단가와 워터마크

12일 하루에 Grok 4.6과 DeepSeek V4 Pro 0813이 나란히 나왔지만 두 발표의 방점은 점수 밖에 있다. 사후학습 투자와 초저단가, Anthropic의 전 텍스트 워터마크와 Sonnet 5 가격 영구화까지, 프런티어 승부처가 단가와 신뢰로 옮겨가는 이틀을 정리했다.