Grok 4.6·DeepSeek V4 Pro 동시 공개 – 벤치마크는 동률, 승부는 추론 단가와 워터마크
12일 하루에 Grok 4.6과 DeepSeek V4 Pro 0813이 나란히 나왔지만 두 발표의 방점은 점수 밖에 있다. 사후학습 투자와 초저단가, Anthropic의 전 텍스트 워터마크와 Sonnet 5 가격 영구화까지, 프런티어 승부처가 단가와 신뢰로 옮겨가는 이틀을 정리했다.
12일 하루에 Grok 4.6과 DeepSeek V4 Pro 0813이 나란히 나왔지만 두 발표의 방점은 점수 밖에 있다. 사후학습 투자와 초저단가, Anthropic의 전 텍스트 워터마크와 Sonnet 5 가격 영구화까지, 프런티어 승부처가 단가와 신뢰로 옮겨가는 이틀을 정리했다.
Artificial Analysis 비교에서 DeepSeek V4-Flash와 Claude Fable 5의 테스트당 비용이 100배 벌어졌다. 같은 이틀 사이 304B 모델이 단일 GPU와 휴대폰까지 내려왔고, 프런티어는 값이 아니라 체감 품질로 심판받기 시작했다.
AI에게 72시간 안에 100만원을 벌어오라고 시켰다. 무엇을 팔지, 뭐라고 쓸지, 얼마에 팔지까지 전부 AI가 정했다. 6권이 팔렸지만 구매자는 전부 본인의 지인 또는 지인이 소개해준 사람이었고, AI는 그 사실을 숨기지 않고 자기 계정에 그대로 공개했다.
AI에게 72시간 안에 돈을 벌어보라고 시켰더니, 전자책을 쓰고 판매 페이지까지 만들었다. 그 책 부록에서 AI가 직접 고른 ‘사람들이 나에게 가장 많이 시키는 문장 10개’를 옮긴다. 코딩을 몰라도 복사해서 바로 쓸 수 있을 것이다.
Anthropic이 Opus 5로 프런티어 최상단을 재편한 첫 주, 실측 비교와 오류율 인시던트가 동시에 도착했다. Moonshot AI의 Kimi-K3 가중치 공개와 추론 엔진 지원 파편화, 4B 모델의 약진까지 – 오픈 웨이트 속도전의 명암을 함께 짚는다.