GPT-6.1 Sol과 Gemini 4 Argon, 2달러·10달러 한 가격표에서 만난 두 보급형 프런티어
OpenAI가 DevDay에서 GPT-6.1 Sol을 입력 2달러·출력 10달러에 내놓은 다음 날 구글이 Gemini 4 Argon을 같은 가격표로 공개했다. 상시 작동 에이전트 Dots, Opus 5.5 하향을 매일 재는 Livenerf, 로컬 추론 엔진 Magnitude도 정리한다.
OpenAI가 DevDay에서 GPT-6.1 Sol을 입력 2달러·출력 10달러에 내놓은 다음 날 구글이 Gemini 4 Argon을 같은 가격표로 공개했다. 상시 작동 에이전트 Dots, Opus 5.5 하향을 매일 재는 Livenerf, 로컬 추론 엔진 Magnitude도 정리한다.
Anthropic의 Sonnet 5.5와 Fireworks의 Ember-1이 단가 대신 작업당 토큰 수를 줄였다. 같은 주말 Plugin4Shell 취약점과 SkillCascade 논문이 코딩 에이전트의 스킬 생태계를 공격면으로 확인했고, ScopeBench는 범위 준수율을 쟀다.
Anthropic의 Opus 5.5와 OpenAI의 GPT-6 Sol·Luna가 같은 날 나왔다. 두 회사가 앞세운 숫자는 점수가 아니라 값과 속도다. 950개 에이전트가 21시간 돌아 새 효소 체계를 찾은 사례와 AGENTS.md를 건너뛰던 Claude Code 버그를 함께 짚는다.
GPT-6 Astra는 실제 PR 50건에서 확인 버그 92개, GPT-5.6 Luna는 69개를 잡았지만 비용은 3.6%였다. 벤더 네이티브 하네스의 평균 우위는 대조 실험에서 사라졌고, 오픈 웨이트 Occamy-1.0은 비용-성능 파레토의 저비용 무릎을 노린다.
GPT-6 Astra가 나왔다. 로봇 팔·수능·코드 리뷰 실측이 사흘 만에 쌓였지만, 같은 모델이 하네스에 따라 ARC-AGI-3 54.8%와 99.9%로 갈렸다. Harbor-Index·멀티 하네스 RL·grep 대 LSP 실험까지 하네스가 제품이 된 한 주를 정리한다.