← AI 기술 레이더
업데이트 소식AI타임스

Claude 새 모델 출시, 캐시 비용 75% 인하

앤트로픽이 코딩과 복잡한 지식 작업에 특화된 Claude Fable 5.1과 사이버 보안·생명과학 분야 전용 Claude Mythos 5.1을 출시했습니다. 입력 캐시 읽기 가격을 75% 인하하여 반복되는 작업의 비용을 크게 낮췄습니다.

배경부터 차근차근 살펴보기

Claude는 현재 많은 사용자가 연구, 글쓰기, 업무 자동화에 활용하는 AI 모델입니다. 앤트로픽은 지속적으로 모델 성능을 개선하고 사용 비용을 낮춰 더 많은 사람이 접근할 수 있도록 노력하고 있습니다.

9월 1일 앤트로픽은 두 개의 새로운 모델군을 공개했습니다. Claude Fable 5.1은 코딩과 복잡한 지식 작업(예: 논문 분석, 전략 수립)에 최적화되었으며, Claude Mythos 5.1은 동일한 기반 위에 사이버 보안 및 생명과학 연구을 위해 추가로 고도화되었습니다.

가장 주목할 변화는 입력 캐시 읽기 비용을 75% 인하한 것입니다. 캐시란 같은 문서, 코드, 지시문을 반복적으로 사용할 때 이전 읽음을 다시 처리하지 않는 기능으로, 한 번 캐시되면 이후 요청에서는 새로운 부분만 비용이 발생합니다.

이 기능의 영향은 매우 광범위합니다. 학술 논문을 여러 각도로 분석할 때, 같은 코드베이스를 반복적으로 리뷰할 때, 데이터 처리 지시문으로 수백 개 파일을 순차적으로 처리할 때 비용이 급격히 줄어듭니다.

새로운 모델의 추론 능력 강화는 이전 버전이 다루기 어려웠던 복잡한 질문을 더 정확하게 처리할 수 있다는 뜻입니다. Claude를 사용하는 모든 사용자에게 성능과 비용 측면에서 직접 영향을 주는 변화입니다.

구체적으로 무엇이 달라졌나

  1. 01

    Claude Fable 5.1 출시: 코딩과 복잡한 지식 작업에 최적화된 프론티어 모델로, 기존 모델보다 강화된 추론 능력 제공

  2. 02

    Claude Mythos 5.1 출시: Fable을 기반으로 사이버 보안 및 생명과학 연구에 특화되도록 추가 고도화

  3. 03

    입력 캐시 읽기 비용 75% 인하: 반복되는 문맥을 다시 처리하지 않아 월간 누적 비용 절감

  4. 04

    기존 사용 패턴의 비용 재구조화: 장문서·큰 코드베이스·복잡한 지시문을 활용하는 작업에서 효과 극대화

  5. 05

    AI 에이전트 운영 경제성 개선: 자동화된 반복 업무의 월간 운영 비용 대폭 절감

누구에게 어떤 의미가 있나

Claude API 사용 중인 사람들(개발자, 자동화 담당)

반복 작업의 API 호출 비용이 크게 감소하여 중단했던 프로젝트 재개, 더 높은 빈도의 자동화, 더 긴 컨텍스트 사용이 경제적으로 가능해집니다. 현재 월간 비용 계획을 다시 계산하고 중지 중인 작업을 검토해야 합니다.

Claude 웹 인터페이스 사용자(연구자, 글쓰기 하는 사람)

새 Fable 5.1 모델에서 강화된 추론 능력을 이용하여 더 정확한 논문 요약, 글 구성 검토, 데이터 해석이 가능합니다. 현재 사용 중인 질문을 새 모델에서 다시 시도하여 결과 개선을 확인할 수 있습니다.

소규모 팀의 AI 프로젝트 운영자

예산 제약으로 포기했던 AI 활용(빈번한 분석, 긴 문맥 사용, 다양한 시험)이 새로운 가격에서는 실행 가능한지 재평가할 수 있습니다. 연간 AI 투자 계획에 새 모델과 캐시 활용 전략을 포함할 시점입니다.

다중 AI 모델을 비교 중인 조직

Claude의 가격-성능 비율이 크게 개선되어 다른 모델과의 비용 비교를 새로 할 필요가 있습니다. 현재 선택한 도구의 지속성을 재검토하고 필요시 전환 타당성을 검토합니다.

어디에 어떻게 써볼 수 있나

같은 학술 논문을 여러 관점에서 분석

100페이지 분량의 논문을 업로드한 후 방법론, 실험 결과, 한계, 응용 방안을 순차적으로 묻는 경우, 첫 요청만 전체 논문을 처리하고 이후 질문들은 캐시된 논문 텍스트를 재사용하여 토큰 비용이 크게 줄어듭니다.

예를 들면
입력: '이 논문의 주요 실험 방법은?' → '이 논문에서 제시한 한계는?' → '이 결과를 우리 분야에 적용하려면?' 3개 질문을 연속으로 요청할 때, 매번 논문 전체를 읽지 않고 캐시를 재사용합니다.
확인할 결과
같은 3개 질문을 각각 따로 요청했을 때의 총 토큰 비용 vs 캐시 활용 비용을 계산하여 절감액을 기록합니다. 긴 논문일수록, 질문이 많을수록 절감 효과가 커집니다.

프로젝트 코드베이스의 보안 리뷰 자동화

프로젝트 구조 문서와 보안 체크리스트를 한 번 캐시한 후, 여러 파일의 코드를 순차적으로 검토할 때마다 컨텍스트를 다시 읽지 않습니다. 같은 기준으로 일관된 리뷰가 가능하면서 비용은 최소화됩니다.

예를 들면
입력: [프로젝트 구조(2,000토큰) + 보안 가이드(1,000토큰) 캐시 후] '이 파일의 보안 문제는?' → '다음 파일 검토:...' → '3번째 파일 검토:...' 10개 파일을 순차 검토할 때, 컨텍스트는 첫 요청만 비용을 내고 나머지 9개는 캐시 활용입니다.
확인할 결과
파일당 처리 비용과 전체 리뷰 비용을 기록합니다. 같은 프로젝트를 매주 리뷰한다면 주간 절감액을, 월간 누적 절감액을 계산하여 현재 자동화 비용 타당성을 재평가합니다.

반복적인 데이터 처리 파이프라인 운영

복잡한 처리 지시문(데이터 정제, 포맷 변환, 분류 규칙)을 한 번 캐시하고, 수백 개의 데이터셋을 하나씩 처리할 때 지시문 비용은 한 번만 부담하고 각 데이터의 비용만 반복적으로 발생합니다.

예를 들면
입력: [상세한 데이터 처리 지시문 3,000토큰 캐시] → '첫 번째 데이터셋 처리:...' → '두 번째 데이터셋:...' → '세 번째~100번째:...' 각 데이터(평균 200토큰)만 새로 읽으므로 지시문 반복 비용이 없습니다.
확인할 결과
100개 데이터셋 처리의 총 토큰 비용을 계산합니다. 캐시 없이 매 요청마다 지시문을 포함했을 때의 비용(3,000×100 = 300,000토큰)과 비교하여 절감액을 기록하고, 월간 처리 규모에 따른 연간 절감액을 추정합니다.

처음부터 무리하지 말고, 이 순서로 확인하세요

  1. 1단계: 현재 Claude 사용 패턴 파악

    자신의 Claude 사용 방식을 정리합니다. (1) 웹 인터페이스인지 API인지 (2) 반복되는 작업이 있는지(같은 문서 다시 분석, 같은 코드 반복 리뷰, 데이터 배치 처리 등) (3) 월간 비용 규모는 어느 정도인지 확인합니다.

    확인: Claude 계정에 로그인하여 지난 30일 사용 내역(사용한 모델, 토큰 수, 요청 수)을 조회하고, 같은 문맥을 여러 번 사용한 사례를 메모합니다.

  2. 2단계: 새 Fable 5.1 모델 직접 시험

    현재 수행하는 작업 중 하나를 선택하여 새 Fable 5.1 모델로 수행해봅니다(예: 문서 분석, 코드 리뷰, 글쓰기 검토). 이전 Claude 모델의 결과와 나란히 비교하여 정확도, 속도, 유용성의 변화를 기록합니다.

    확인: 같은 입력 질문에 대해 이전 모델과 Fable 5.1의 출력을 나란히 저장하고, 개선된 부분(더 정확한 분석, 더 나은 코드 제안 등)과 변화가 없는 부분을 표시합니다.

  3. 3단계: 캐시 활용 시 실제 비용 절감 계산

    반복적인 작업 1개를 선택하여 (1) 캐시 없이 각 요청을 따로 했을 때의 예상 토큰 비용 (2) 캐시를 사용했을 때의 비용을 계산합니다. 앤트로픽 공식 문서나 가격 페이지에서 새로운 캐시 가격(기존 대비 75% 인하)을 확인한 후 계산합니다.

    확인: 토큰 수를 정확히 세고(예: 논문 3,000토큰, 질문 5개 각 100토큰), 캐시 없음과 캐시 사용 시 비용을 명시하여 비교 테이블을 만듭니다. 절감 비율과 월간·연간 예상 절감액을 계산하고 기록합니다.

  4. 4단계: 새 모델과 캐시 전략을 실제 업무에 적용 결정

    테스트 결과(성능, 비용)를 바탕으로 (1) Fable 5.1로 전환할지 (2) 어떤 작업부터 캐시를 활용할지 (3) 팀이 있다면 공유 방식과 가이드라인을 결정합니다. 점진적 적용(작은 프로젝트부터)과 병렬 운영(이전 모델과 비교하며 모니터링)을 계획합니다.

    확인: 팀원이나 이해관계자와 새 모델 테스트 결과를 공유하고 피드백을 받습니다. 첫 적용 대상(어떤 프로젝트, 어떤 작업), 시작 날짜, 1개월 후 비용 재평가 일정을 캘린더에 표시합니다.

확인된 범위와 아직 모르는 내용을 구분하세요

공식 발표로 확인된 사실: Claude Fable 5.1과 Mythos 5.1 출시, Fable 5.1은 코딩과 복잡한 지식 작업 특화, Mythos 5.1은 사이버 보안과 생명과학 연구 전용 고도화, 입력 캐시 읽기 비용 75% 인하, 강화된 추론 능력 제공. 아직 공개되지 않은 내용: 정확한 모델별 성능 벤치마크 수치, 지역별·요금제별 구체적 가격, 모든 플랫폼의 정식 출시 타이밍, 기존 사용자의 자동 업데이트 정책, 캐시 기능의 기술적 세부 사항(최소 크기, 보유 기간 등).

  • 공식 발표는 구체적인 성능 벤치마크(예: 추론 정확도 개선 수치, 특정 작업 속도 비교)를 제시하지 않습니다. 새 모델이 실제 업무에서 얼마나 개선되었는지는 직접 테스트로만 알 수 있습니다.
  • 가격책정 세부사항이 불명확합니다. 지역별 가격 차이, 구독 요금제별 적용 시기, API 사용자와 웹 인터페이스 사용자 간 차이가 있을 수 있으므로 공식 문서나 지원팀에 확인이 필요합니다.
  • 새 모델의 가용성 타이밍이 명시되지 않았습니다. 웹 사용자는 즉시 접근 가능할 수 있지만, API 사용자의 정식 출시 일정과 지역별 출시 일정을 별도로 확인해야 합니다.
  • 기존 Claude 사용자의 자동 업데이트 정책이 불명확합니다. 현재 API에서 'claude-3-5-sonnet' 같은 이름으로 사용 중인 모델이 자동으로 Fable 5.1로 업그레이드되는지, 아니면 명시적으로 모델명을 변경해야 하는지 확인이 필요합니다.
  • 캐시 기능의 기술적 요구사항(최소 캐시 크기, 캐시 보유 기간, 사용 제한 여부)이 원문에 없으므로 공식 기술 문서를 별도로 확인해야 합니다.

원문에서 다시 확인하기

이 글은 AI타임스의 공식 발표를 바탕으로 정리했습니다. 기능 범위와 제공 조건은 바뀔 수 있으므로 실제로 적용하기 전에는 원문을 다시 확인해 주세요.

마지막 확인
2026-09-01
다음 검토
2026-10-01

이어 볼 실전 가이드

같은 활용 분야의 소식