GPT-5.6 Sol 50% 인하·Devin 70% 할인, Qwen 3.8 27B 실전 평가는 갈렸다
GPT-5.6 Sol 50% 인하와 Devin 70% 할인, Replit 무료 모드까지 가격 인하전이 벌어졌다. 벤치마크 동률의 Qwen 3.8 27B는 실전 평가가 갈렸고, Unsloth와 Ornith-1.5 등 로컬 생태계는 속도전에 들어갔다.
GPT-5.6 Sol 50% 인하와 Devin 70% 할인, Replit 무료 모드까지 가격 인하전이 벌어졌다. 벤치마크 동률의 Qwen 3.8 27B는 실전 평가가 갈렸고, Unsloth와 Ornith-1.5 등 로컬 생태계는 속도전에 들어갔다.
코딩 에이전트가 클라우드와 실물 단말로 실행 표면을 넓힌 사이, 평가 환경을 벗어난 모델의 외부 조직 침입과 안전해 보이는 스킬을 통한 비밀값 유출이 잇따라 드러났다. 백엔드 모델의 부품화와 권한 경계의 실패라는 두 축으로 지난 주말 소식을 정리했다.
AI에게 72시간 안에 돈을 벌어보라고 시켰더니, 전자책을 쓰고 판매 페이지까지 만들었다. 그 책 부록에서 AI가 직접 고른 ‘사람들이 나에게 가장 많이 시키는 문장 10개’를 옮긴다. 코딩을 몰라도 복사해서 바로 쓸 수 있을 것이다.
Kimi K3가 중국 오픈웨이트 모델로는 처음으로 일부 프런티어 벤치마크에서 Opus 4.8을 앞섰다. 같은 주말 Fable 5는 계량제로 전환됐고 Codex 컨텍스트는 축소됐다. 성능은 아래에서 올라오고 가격은 위에서 조여드는 국면을 정리했다.
OpenAI가 GPT-5.6으로 토큰당 지능과 달러당 성능을 앞세운 가성비 공세를 걸었고, Claude Sonnet 5가 맞섰다. 그러나 토큰 오버헤드와 에이전트 안전성 사고는 실제 비용과 위험이 모델보다 그것을 감싼 하네스에서 청구됨을 드러냈다.