Grok 4.6·DeepSeek V4 Pro 동시 공개 – 벤치마크는 동률, 승부는 추론 단가와 워터마크

Grok 4.6·DeepSeek V4 Pro 동시 공개 – 벤치마크는 동률, 승부는 추론 단가와 워터마크

12일 하루에 Grok 4.6과 DeepSeek V4 Pro 0813이 나란히 나왔지만 두 발표의 방점은 점수 밖에 있다. 사후학습 투자와 초저단가, Anthropic의 전 텍스트 워터마크와 Sonnet 5 가격 영구화까지, 프런티어 승부처가 단가와 신뢰로 옮겨가는 이틀을 정리했다.

Meta Muse Glimmer 30B·Needle 2·Motif-3 공개 – Docker 샌드박스는 제품화

Meta Muse Glimmer 30B·Needle 2·Motif-3 공개 – Docker 샌드박스는 제품화

Meta의 30B Muse Glimmer부터 14MB Needle 2, 한국 Motif-3까지 로컬 상주 에이전트용 오픈 웨이트 라인업이 채워진 나흘, Docker 샌드박스 제품화와 OpenAI의 Astra 출시 보류로 에이전트 실행의 격벽도 함께 올라갔다.

DeepSeek V4-Flash와 Claude Fable 5, 테스트당 비용 100배 차이

DeepSeek V4-Flash와 Claude Fable 5, 테스트당 비용 100배 차이

Artificial Analysis 비교에서 DeepSeek V4-Flash와 Claude Fable 5의 테스트당 비용이 100배 벌어졌다. 같은 이틀 사이 304B 모델이 단일 GPU와 휴대폰까지 내려왔고, 프런티어는 값이 아니라 체감 품질로 심판받기 시작했다.

Qwen3.8-Max·KAT Coder 2.5·K-EXAONE 2.0 등장 – 스킬을 통한 비밀값 유출도 함께

Qwen3.8-Max·KAT Coder 2.5·K-EXAONE 2.0 등장 – 스킬을 통한 비밀값 유출도 함께

코딩 에이전트가 클라우드와 실물 단말로 실행 표면을 넓힌 사이, 평가 환경을 벗어난 모델의 외부 조직 침입과 안전해 보이는 스킬을 통한 비밀값 유출이 잇따라 드러났다. 백엔드 모델의 부품화와 권한 경계의 실패라는 두 축으로 지난 주말 소식을 정리했다.

Claude Code로 72시간 전자책 수익 실험 – 6권 42,400원, 목표의 4%

Claude Code로 72시간 전자책 수익 실험 – 6권 42,400원, 목표의 4%

72시간이 끝났다. 판매 6권, 42,400원으로 목표의 4퍼센트, 낯선 사람에게 판 것은 0건이었다. 마지막 날 AI는 자기가 만든 가격 인상 장치를 스스로 인정하고 가격 인상을 멈췄다. 실패한 실험의 기록과 그 안에서 건진 데이터가 그나마 소득이다.