GPT-6.1 Sol과 Gemini 4 Argon, 2달러·10달러 한 가격표에서 만난 두 보급형 프런티어

오늘의 흐름 정리

화요일 이후 이틀 사이에 보급형 프런티어 두 개가 같은 가격표를 달고 나왔다. OpenAI는 DevDay에서 GPT-6.1 Sol을 입력 100만 토큰당 2달러, 출력 10달러에 공개했고, 하루 뒤 구글은 Gemini 4 Argon을 같은 2달러·10달러 도입가로 발표했다. 지난주 목요일 회차에서 Opus 5.5와 GPT-6 Sol이 같은 날 값을 내린 것을 다뤘는데, 그 Sol이 일주일 만에 다시 교체됐다. 뒤이어 상시 작동 에이전트 Dots, Opus 5.5 하향 여부를 매일 재는 Livenerf, 로컬 추론 엔진 Magnitude를 정리한다.

일주일 만에 Sol을 갈아 끼운 GPT-6.1 Sol, 같은 가격표로 따라붙은 Gemini 4 Argon

GPT-6.1 Sol은 코딩·컴퓨터 사용·전문 업무에서 GPT-6 Astra에 근접한 성능을 Astra 표준 단가의 5분의 1에 제공한다. DeepSWE v1.1에서 GPT-6 Sol 최고 점수보다 6.4%p 높고, OSWorld 2.0에서는 Astra와의 차이가 2.1%p인데 작업당 비용은 Astra의 약 7분의 1이다. 평균 작업당 비용은 GPT-6.1 Sol 5.47달러, Opus 5.5 23.21달러, GPT-6 Astra 23.80달러로 집계됐다. Artificial Analysis는 GPT-6.1 Sol이 GPT-6 Sol을 7일 만에 대체했고, 지능 지수에서 Sol보다 4점 올라 Astra에 1점 뒤진다고 썼다. 같은 글에 따르면 출력 토큰은 GPT-6 Sol보다 10~30% 더 쓴다.

구글은 9월 30일 Gemini 4 Argon을 발표하고 Fairwind Program을 통해 사이버 방어 담당자들에게 먼저 제공하기 시작했다. 출력 토큰 한도를 64K에서 100만 토큰으로 늘렸고, DeepSWE v1.1 77.9%, CWE-bench v1 68%, AutomationBench 51.3%를 제시했다. 도입가는 입력 2달러·출력 10달러이고 캐시 입력은 95% 할인이며, 도입 기간이 끝나면 4달러·20달러로 오른다. 본인은 두 회사가 서로의 가격표를 보고 썼다고 본다.

자기 클라우드 컴퓨터를 가진 Dots와 월 500달러 Pro 500

OpenAI는 DevDay 2026에서 20개가 넘는 발표를 했다. 중심은 Dots다. Dots는 GPT-6 Astra 기반으로 자체 클라우드 컴퓨터와 브라우저에서 여러 프로젝트를 동시에 진행하는 상시 작동 에이전트이고, 4,000개 이상의 앱에 플러그인으로 연결된다. 첫 번째 dot은 Pro·Business Premium 요금제에 추가 비용 없이 포함되고, Custom Rules로 특정 행동을 허용·승인 요구·차단할 수 있으며 선제적 조사는 읽기 전용으로 묶인다. BBC는 에이전트를 dots로 다시 이름 붙인 배경에 내부 테스트에서 드러난 예상 밖 행동과 안전 우려가 있고, 새 모델 출시가 그 때문에 늦어졌다고 전했다.

나머지 발표는 속도와 요금제다. Ultrafast는 Codex에서 초당 300토큰, 최대 8배 빠른 생성을 제공하고 Astra Ultrafast 단가는 입력 60달러·출력 300달러다. Pro 500은 월 500달러에 Plus의 25배 사용량과 Ultrafast 접근을 묶었고, Luna 기반 Decisions API는 입력 0.10달러·출력 0.50달러로 정해진 질문에 짧은 판단만 돌려준다.

구독 환경에서 Opus 5.5 하향을 매일 재는 Livenerf, 기기별로 커널을 다시 짜는 Magnitude

Livenerf는 Opus 5.5가 출시 뒤 조용히 나빠지는지를 매일 측정하는 오픈소스 벤치마크로, HN에서 859포인트를 받았다. 원시 API가 아니라 Claude Code 구독으로 쓰는 Opus 5.5를 재서 실제 구독 환경의 변화를 추적한다. GPQA Diamond·MMLU-Pro·AIME 문제 78개를 하루 한 번 30일간 돌리고, 1~10일을 기준선으로 삼아 20일째부터 판정한다. 첫 판정은 10월 24일 전후다.

Magnitude는 에이전트용 오픈소스 추론 엔진으로, 사용자 기기에서 커널을 컴파일·튜닝해 오픈 웨이트 모델을 llama.cpp보다 최대 2배 빠르게 돌린다. Apple Silicon에서 디코드가 92%, CUDA에서 19% 빨라졌고 에이전트당 메모리는 27% 줄었으며, Claude Code·Codex·Pi·Cline에 바로 붙는다. 같은 날 Pi를 만드는 Earendil은 MCP를 넣지 않겠다던 입장을 뒤집고, 하네스 쪽 JavaScript 샌드박스 Codemode로 MCP 도구 호출을 조합하는 구조를 공개했다.

한 줄 정리

GPT-6.1 Sol과 Gemini 4 Argon이 2달러·10달러 한 가격표에서 만났고, Dots와 Pro 500은 그 위에 상시 에이전트와 300달러 고속 단가를 얹었다. Livenerf와 Magnitude는 구독과 로컬에서 그 약속을 검증하는 도구다.

조회수: 0

댓글 남기기