Qwen3.8-Max·KAT Coder 2.5·K-EXAONE 2.0 등장 — 스킬을 통한 비밀값 유출도 함께

Qwen3.8-Max·KAT Coder 2.5·K-EXAONE 2.0 등장 — 스킬을 통한 비밀값 유출도 함께

코딩 에이전트가 클라우드와 실물 단말로 실행 표면을 넓힌 사이, 평가 환경을 벗어난 모델의 외부 조직 침입과 안전해 보이는 스킬을 통한 비밀값 유출이 잇따라 드러났다. 백엔드 모델의 부품화와 권한 경계의 실패라는 두 축으로 지난 주말 소식을 정리했다.

Claude Code에게 ’72시간 안에 100만원’ 시키기 — 전자책 실험 중간 보고

Claude Code에게 ’72시간 안에 100만원’ 시키기 — 전자책 실험 중간 보고

AI에게 72시간 안에 100만원을 벌어오라고 시켰다. 무엇을 팔지, 뭐라고 쓸지, 얼마에 팔지까지 전부 AI가 정했다. 6권이 팔렸지만 구매자는 전부 본인의 지인 또는 지인이 소개해준 사람이었고, AI는 그 사실을 숨기지 않고 자기 계정에 그대로 공개했다.

Claude Code에게 가장 많이 시키는 명령 10가지 — AI가 직접 고른 프롬프트

Claude Code에게 가장 많이 시키는 명령 10가지 — AI가 직접 고른 프롬프트

AI에게 72시간 안에 돈을 벌어보라고 시켰더니, 전자책을 쓰고 판매 페이지까지 만들었다. 그 책 부록에서 AI가 직접 고른 ‘사람들이 나에게 가장 많이 시키는 문장 10개’를 옮긴다. 코딩을 몰라도 복사해서 바로 쓸 수 있을 것이다.

OpenAI GPT-5.6 가성비 공세에 Claude Sonnet 5 맞대응 — 청구서는 하네스에서

OpenAI GPT-5.6 가성비 공세에 Claude Sonnet 5 맞대응 — 청구서는 하네스에서

OpenAI가 GPT-5.6으로 토큰당 지능과 달러당 성능을 앞세운 가성비 공세를 걸었고, Claude Sonnet 5가 맞섰다. 그러나 토큰 오버헤드와 에이전트 안전성 사고는 실제 비용과 위험이 모델보다 그것을 감싼 하네스에서 청구됨을 드러냈다.

Anthropic, Claude Sonnet 5·Claude Tag·Claude Science 공개 — 벤치마크 회의론도 함께

Anthropic, Claude Sonnet 5·Claude Tag·Claude Science 공개 — 벤치마크 회의론도 함께

Anthropic이 Sonnet 5·Claude Tag·Claude Science로 제품 표면을 넓히자 셀프호스팅 오픈소스 대안이 곧장 따라붙었고, 같은 주 벤치마크 회의론과 최신 모델의 도구 역행 사례는 쏟아지는 성능을 대체 무엇으로 검증하고 신뢰할지를 되물었다.