가격 반값 경쟁 뒤, 진짜 비용은 캐시가 정한다
GPT-6 반값 공세가 오늘의 헤드라인이지만, 같은 날 Anthropic이 공개한 자체 비용 데이터는 진짜 절감이 정가 인하율이 아니라 캐시 적중률에 달려 있다는 걸 보여준다.
한눈에
- OpenAI가 GPT-6 Sol·Luna를 GPT-5.6 프로모션가의 절반 값에 냈다. 같은 날 Anthropic은 실제 작업 비용이 캐시 적중률에 좌우된다는 자체 데이터를 공개했다.
- OpenAI가 22개국 전문가 80여 명과 만든 정신건강 대화 벤치마크를 열었다. 자체 측정에서 Claude Opus 5.5는 52.4점을 받았다.
- Anthropic이 플러그인·파트너 제품·컨설팅을 Claude Marketplace 하나로 묶었다. 기존 계약 금액을 파트너 제품 구매에 그대로 쓸 수 있다.
- 엔비디아 주가배수가 10년 내 최저권으로 떨어졌다. 실적 전망은 여전히 강하지만 밸류에이션엔 회의가 반영됐다.
프런티어 실무
Opus 5.5, 작업 하나당 실제 비용을 Anthropic이 공개했다
Anthropic이 9월 22일 자체 블로그에서 전형적인 작업 하나의 실제 토큰 사용량을 공개했다. 출력 토큰 6만 개(생각 과정 포함)만으로 1.20달러가 들고, 이는 캐시(한 번 계산한 값을 저장해뒀다가 재사용해 비용을 아끼는 방식)에서 600만 토큰을 읽는 비용과 같다. 같은 입력 280만 토큰이 캐시 없이 11.20달러, 적중률 90%에서 1.62달러, 96%에서 0.99달러로 갈렸다. 대화를 25턴 이어가면 이전 내용을 매번 다시 보내는 구조 때문에 총 175만 토큰, 입력비만 약 1.02달러가 나간다.
모델·제품
OpenAI, GPT-6 Sol·Luna 출시. API 가격 반으로
OpenAI가 9월 22일 GPT-6 Astra 출시 19일 만에 중간·경량 모델 GPT-6 Sol과 Luna를 냈다. 가격은 GPT-5.6 프로모션가 대비 50% 내려 Sol은 백만 토큰당 입력 2달러·출력 10달러, Luna는 입력 0.10달러·출력 0.50달러다. OpenAI는 이 가격이 프로모션이 아니라 정식 가격이라고 밝혔다. Sol은 코드 작성·리뷰처럼 반복되는 복잡한 작업을, Luna는 요약·추출 같은 대량·단순 작업을 겨냥한다.
연구·벤치마크
OpenAI, 정신건강 대화 벤치마크 공개. Claude도 나란히 채점
OpenAI가 9월 23일 22개국 정신건강 전문가 80명 이상과 함께 만든 MentalHealthBench를 공개했다. 일상 대화(53.5%)부터 고위험 상황(18.2%), 응급 상황(28.3%)까지 다루며 안전성·맥락 파악·사용자 자율성 존중을 평가한다. 자체 측정에서 GPT-6 Astra는 57.3점, GPT-6 Sol은 53.9점, Claude Opus 5.5는 52.4점을 받았다. OpenAI가 만들고 OpenAI가 채점한 결과라 경쟁사 모델 점수는 독립 검증 전까지 확인 필요다.
기업·전략
Anthropic, 플러그인·에이전트·컨설팅을 한 장터로 묶었다
Anthropic이 9월 23일 기존 플러그인·유료 파트너 제품·컨설팅 파트너를 하나의 Claude Marketplace로 통합했다고 밝혔다. 3월 GitLab·Snowflake 등 6개사로 시작했던 것이 Cursor·CrowdStrike·Vercel·Accenture 등을 포함한 2,000개 이상의 커넥터·제품 카탈로그로 늘었다. 기업 고객은 이미 약정한 Anthropic 계약 금액의 일부를 파트너 제품 구매에 그대로 돌려 쓸 수 있어, 별도 예산 승인 없이 도입 범위를 넓힐 수 있다고 소개 사례(Power Digital·ThoughtSpot·CodeRabbit)를 들었다.
반도체·인프라
AI 데이터센터 부품주, 수요 랠리 재확인
마벨이 9월 20일부터 스페인에서 열리는 ECOC 2026에서 2나노 광통신 기술 시연 세 종(400G PAM4, 800G ZR/ZR+, 1.6T ZR)을 업계 최초로 공개했다. 데이터센터 간 연결 대역폭을 늘리면서 전력 소모를 줄이는 게 목표다. 9월 23일 기준 아스테라랩스는 1주일 새 44% 올랐고, 업계는 HBM(여러 D램을 수직으로 쌓아 대역폭을 높인 고성능 메모리) 물량 선점으로 범용 D램 공급 부족이 2027년까지 이어질 것으로 본다.
투자·시장
엔비디아 주가배수, 10년 내 최저권으로 떨어졌다
엔비디아의 예상 이익 대비 주가수익비율(PER(주가를 주당순이익으로 나눈 값. 낮을수록 이익 대비 주가가 싸다는 뜻))이 9월 23일 기준 17배 미만으로, 5월의 25배·작년 동시기 34배에서 크게 낮아졌다. TCW의 한 포트폴리오 매니저는 이를 이익 창출력의 지속 가능성에 대한 시장의 회의로 풀이했다. 다만 2027 회계연도 매출·순이익 전망치는 각각 90%·99% 급증으로 여전히 견조해, 밸류에이션과 실적 전망이 엇갈리는 모습이다.
정책·규제
Anthropic 저작권 합의금 3차 분할 지급 마감이 이틀 앞
도서 무단 학습에 대한 배상으로 확정된 15억 달러 규모 Bartz v. Anthropic 합의의 3차 분할금 4억5천만 달러 지급 기한이 9월 25일이다. 저자당 배상액은 평균 약 3천 달러로 책정됐고, 9월 4일 정산 담당자가 청구인들에게 개별 청구 현황을 통지했다. 학습 데이터 출처를 둘러싼 배상 부담이 실제 현금 흐름으로 이어지는 사례라, 다른 벤더의 유사 소송도 비슷한 일정표를 밟을 가능성이 있다.
오늘 헤드라인은 가격이다. OpenAI가 GPT-6 Sol·Luna를 GPT-5.6 프로모션가의 절반에 냈고, 같은 날 Anthropic은 자체 블로그로 작업 하나의 실제 토큰 비용을 공개했다. 그런데 그 데이터가 말하는 건 정가표가 아니라 캐시 적중률이다. 같은 입력 280만 토큰이 캐시 없이 11.20달러, 90% 적중에서 1.62달러, 96%에서 0.99달러로 갈렸다. 정가 인하율(20~60%)보다 훨씬 큰 격차다. 예산 담당이 볼 숫자는 벤더가 부른 할인율이 아니라 자기 트래픽의 캐시 적중률이다.
실무 쪽 할 일도 이 구조에서 나온다. Sol은 반복되는 복잡한 작업, Luna는 대량·단순 작업으로 나눠 쓰는 모델 라우팅이 다음 주 바로 해볼 수 있는 변화다. 대화를 25턴 넘게 끌면 이전 내용을 매번 다시 보내는 구조 때문에 턴당 비용이 토큰 수보다 빨리 는다. 세션을 길게 끌기보다 필요할 때 새로 시작하는 편이 싸다. Anthropic이 파트너·플러그인·컨설팅을 하나로 묶은 Claude Marketplace도 같은 방향이다. 새 예산 승인 없이 기존 계약 금액으로 CodeRabbit·Vercel 같은 도구를 바로 늘려 쓸 수 있다.
돈 얘기는 자본시장에서도 갈렸다. 엔비디아 주가배수가 10년 내 최저권으로 떨어진 건 이익 창출력의 지속 가능성에 대한 회의로 읽히지만, 같은 기사의 실적 전망(매출 90%·순이익 99% 증가)은 정반대를 가리킨다. 여기에 Anthropic이 저작권 합의금 4억5천만 달러를 9월 25일까지 내야 한다는 일정까지 겹쳤다. 벤더를 고를 때 이제 모델 성능표만큼 재무 건전성과 계약 조건도 같이 봐야 하는 시점이다.
- MentalHealthBench 점수를 도입 판단이나 규제 참고 지표로 쓸 수 있는지는 갈렸다. 규제·컴플라이언스 관점은 업계 최초의 정신건강 전용 벤치마크라는 데 의미를 뒀지만, OpenAI가 만들고 OpenAI가 채점한 결과라 경쟁사 점수의 공정성은 독립 검증 전까지 확인 불가라 해석에서는 뺐다.
- 엔비디아 밸류에이션 하락을 AI 인프라 지출 둔화의 신호로 볼지는 확정하지 못했다. 예산 담당 관점은 회의적 신호로 읽었지만, 같은 기사의 매출·순이익 전망치는 오히려 견조해 두 숫자가 정반대를 가리킨다. 어느 쪽이 시장을 더 잘 설명하는지는 다음 실적 발표 전까지 알 수 없다.
- GPT-6 Sol·Luna의 '50% 인하'가 실질적 가격 인하인지는 기준점 문제로 이견이 있다. 현업 PM 관점은 즉시 도입 이득이 있다고 봤지만, 예산 담당 관점은 비교 기준이 GPT-5.6의 프로모션가(원래도 한시적으로 낮았던 가격)라 정가 대비 실제 인하 폭은 이 발표만으로 알 수 없다고 지적해 본문에서는 보수적으로 다뤘다.
- Claude Marketplace의 예산 재할당 기능이 벤더 락인을 심화시키는지도 패널이 갈렸다. 인프라 엔지니어와 규제 관점은 하나의 계약에 조달을 몰아주는 구조가 이후 벤더 교체 비용을 키울 수 있다고 봤고, 현업 PM과 예산 담당은 조달 절차 단축이 더 급한 이득이라고 봤다. 락인 비용을 계량할 자료가 아직 없어 해석에서는 다루지 않았다.