GPT-6 Astra·GPT-5.6 Luna 코드 리뷰 대조 – 비용 3.6%로 버그 75%, 하네스 우위는 사라졌다
GPT-6 Astra는 실제 PR 50건에서 확인 버그 92개, GPT-5.6 Luna는 69개를 잡았지만 비용은 3.6%였다. 벤더 네이티브 하네스의 평균 우위는 대조 실험에서 사라졌고, 오픈 웨이트 Occamy-1.0은 비용-성능 파레토의 저비용 무릎을 노린다.
GPT-6 Astra는 실제 PR 50건에서 확인 버그 92개, GPT-5.6 Luna는 69개를 잡았지만 비용은 3.6%였다. 벤더 네이티브 하네스의 평균 우위는 대조 실험에서 사라졌고, 오픈 웨이트 Occamy-1.0은 비용-성능 파레토의 저비용 무릎을 노린다.
Anthropic이 Opus 5로 프런티어 최상단을 재편한 첫 주, 실측 비교와 오류율 인시던트가 동시에 도착했다. Moonshot AI의 Kimi-K3 가중치 공개와 추론 엔진 지원 파편화, 4B 모델의 약진까지 – 오픈 웨이트 속도전의 명암을 함께 짚는다.