오늘의 흐름 정리
화요일 이후 이틀 사이의 소식은 한 문장으로 줄여진다. 프런티어가 같은 날 두 곳에서 갱신됐는데, 두 회사가 앞세운 숫자는 점수가 아니라 값과 속도였다. Anthropic은 Opus 5.5를 Opus 5보다 40% 싸고 30% 빠른 모델로 소개했고, OpenAI는 GPT-6 Sol과 Luna를 내놓으며 API 값을 GPT-5.6 대비 절반으로 내렸다. 본인은 이 동시 인하를 우연으로 보지 않는다. 에이전트가 한 작업에 수억 토큰을 태우는 시대에는 단가가 곧 채택 조건이다. 뒤따라 나온 효소 발견 사례와 지침 파일 누락 버그가 이 판단을 양쪽에서 받친다.
같은 날 값부터 내린 두 프런티어, Opus 5.5와 GPT-6 Sol·Luna
Anthropic은 Claude 5.5 제품군의 첫 모델로 Opus 5.5를 공개했다. 회사가 앞세운 것은 벤치마크 신기록이 아니라 Opus 5 대비 40% 낮은 값과 30% 빨라진 출력이다. 같은 날 OpenAI는 GPT-6 Sol과 Luna를 내놨다. Astra의 코딩·업무·컴퓨터 사용 능력을 더 빠르고 싼 모델로 넓힌 것이고, API 가격은 GPT-5.6 프로모션 가격의 절반 수준이다. 개발자들의 반응이 먼저 향한 곳도 비용 계산기였다. Opus 5.5의 캐시 읽기 단가가 100만 토큰당 0.20달러로 60% 내려가자 Text-to-SQL 구조의 비용을 다시 계산한 글이 하루 만에 나왔고, 장기 실행 에이전트가 프롬프트 캐시를 깨뜨리던 문제를 Sol·Luna의 인하와 함께 짚은 글도 같은 날 올라왔다. 본인이 주목하는 지점은 두 회사 모두 최고 모델이 아니라 매일 쓰는 모델의 값을 건드렸다는 사실이다. 최상위 자리는 Astra와 Fable이 지키고, 실제 트래픽이 흐르는 자리는 이 둘이 가져간다.
에이전트 950개가 21시간 돌아간 자리와 지침 파일이 조용히 빠진 자리
Anthropic은 Claude가 CRISPR 유사 반복 서열을 가진 새 효소 체계를 찾아냈다고 발표했다. 약 950개의 Claude 에이전트가 21시간 동안 2억 1,000만 토큰을 쓰며 역전사효소 20만 개 이상을 훑어 ART라는 체계를 찾아냈다. 이 규모에서는 인하 폭이 곧 실험을 할 수 있느냐 없느냐를 가른다. 다만 같은 이틀 사이에 그 에이전트의 발밑이 얼마나 얇은지도 드러났다. Claude Code가 텔레메트리가 켜져 있을 때만 AGENTS.md를 읽던 버그가 보고됐고 수정됐다. 로컬 지침 파일을 읽는 기능이 서버에서 받아오는 플래그에 묶여 있어, 사용 정보 전송을 끄면 지침도 경고 없이 함께 꺼지는 구조였다. 본인은 지난 화요일 글에서 AGENTS.md가 벤더 공용 규격으로 굳고 있다고 썼다. 규격이 됐다는 것과 그 규격이 실제로 읽혔는지 확인할 수 있다는 것은 다른 문제다. 값이 내려갈수록 이런 확인 장치가 값보다 중요해진다.
한 줄 정리
Opus 5.5와 GPT-6 Sol·Luna가 같은 날 값을 내려 에이전트를 대량으로 굴리는 비용을 낮췄고, 950개 에이전트의 효소 발견과 AGENTS.md 누락 버그가 그 규모의 가능성과 취약함을 함께 보여줬다.
조회수: 0