Anthropic이 2026년 9월 28일 Claude Sonnet 5.5를 공개했습니다. 5.5 패밀리의 두 번째 모델이며, 가격은 대체하는 Sonnet 5와 동일하게 100만 입력 토큰당 $2, 100만 출력 토큰당 $10입니다. 같은 가격에 얻는 것은 출력 속도 30% 이상 향상이고, 같은 답에 도달하는 데 쓰는 토큰이 더 적어 작업당 비용이 최대 30% 낮아집니다. Glarity 연결은 네 단계입니다. OpenAI API 키를 선택하고(Anthropic의 OpenAI SDK 호환 레이어를 통해 Anthropic에도 쓸 수 있는 항목입니다), sk-ant- 키를 붙여넣고, 커스텀 모델에 claude-sonnet-5-5를 입력하고, 호스트는 https://api.anthropic.com/v1로 두면 됩니다. 다만 이전 Claude 가이드를 그대로 따라 하면 실패하는 지점이 하나 있습니다. 온도 항목은 채우지 마세요. Anthropic의 Sonnet 5.5 모델 페이지에는 기본값이 아닌 temperature가 오류를 반환한다고 명시되어 있습니다. 자세한 내용은 아래에서 다룹니다.
Claude Sonnet 5.5 사양 한눈에 보기
항목 | 값 |
|---|---|
모델 ID |
|
출시 | 2026년 9월 28일 — 지원 종료는 2027년 9월 28일 이전이 아님 |
컨텍스트 윈도우 | 100만 토큰 — 현재 토크나이저 기준 약 55.5만 영단어 |
최대 출력 | 12.8만 토큰(배치 API에서 베타 헤더 사용 시 30만) |
지식 컷오프 | 2026년 6월 |
입력 → 출력 | 텍스트와 이미지 → 텍스트 |
사고 | 적응형 사고가 기본 활성화, effort로 조절(Claude API 기본값 |
가격 | 입력 $2 / 출력 $10(100만 토큰당). 캐시 쓰기 $2.50(5분)·$4(1시간), 캐시 읽기 $0.20 |
속도 | Claude Sonnet 5보다 30% 이상 빠른 출력, 토큰 단가는 동일 |
사양은 Anthropic의 모델 페이지와 발표문을 따릅니다. 업그레이드를 정당화하는 것은 발표문에 실린 숫자입니다. Terminal-Bench 4.0에서 Sonnet 5.5는 70.6%를 기록해 Sonnet 5의 10.3%, Claude Opus 5.5의 66.4%와 나란히 섰습니다. 44개 직군의 실제 업무를 측정하는 GDPval-AA v2.1에서는 1844로 Opus 5.5의 1846에 약 2점 차까지 따라붙었고, Sonnet 5의 1449보다 약 400점 앞섭니다. 그 밖에 OSWorld 2.1에서 80.1%, Humanity's Last Exam(도구 사용)에서 64.5%, CursorBench 4.0에서 55.5%를 기록했으며, 스크린샷만 보고 포켓몬 레드를 클리어한 첫 Sonnet 모델이기도 합니다. 다만 이는 Anthropic의 내부 평가이지 제3자의 판정이 아닙니다. 그리고 Anthropic은 지속적인 판단이 필요한 복잡한 개방형 작업에서는 Opus 5.5가 여전히 확실히 더 강하다고 솔직하게 밝힙니다. Sonnet 5.5는 Opus의 5분의 1 가격으로 그 격차의 대부분을 메우지만, 없애지는 않습니다.
이 모델이 Glarity에 맞는 이유
Glarity가 매일 하는 일은 '읽기' 작업입니다. 페이지를 요약하고, 페이지를 번역하고, 한 시간짜리 유튜브 영상을 노트로 바꾸고, 보고 있는 문서에 대해 질문합니다. Sonnet 5.5의 세 가지 성질이 여기에 바로 작동합니다.
- 빠릅니다. 요약 도구의 평가는 패널이 비어 있는 시간으로 갈립니다. 30% 이상 빠른 생성은 "기다리는 요약"과 "이미 떠 있는 요약"의 차이입니다.
- 토큰 효율이 좋습니다. Glarity는 OpenAI 호환 레이어를 통해 Anthropic에 연결하고, 그 레이어는 프롬프트 캐싱을 지원하지 않습니다. 즉 매 턴마다 전체 입력이 다시 과금됩니다. 더 적은 토큰으로 같은 답에 도달하는 모델은 여기서 한계적 절약이 아니라 비용 구조 그 자체입니다.
- 윈도우가 문서보다 큽니다. 100만 토큰이면 300페이지 책을 한 번의 요청에 담아 처음과 끝을 동시에 보면서 요약할 수 있습니다. 장별 메모를 이어 붙일 필요가 없습니다.
Sonnet 5.5는 이미지 입력도 지원합니다. 차트나 스캔한 페이지, 스크린샷을 탭을 벗어나지 않고 번역하거나 해석할 수 있다는 점은 브라우저 확장 프로그램에 실질적인 이점입니다.
Sonnet 5 가이드에서 달라진 점
이미 Claude Sonnet 5 설정 가이드로 연결해 두었다면 알아야 할 변화가 세 가지이고, Glarity 사용자에게 직접 영향을 주는 것은 첫 번째뿐입니다.
1. 기본값이 아닌 샘플링 파라미터는 오류를 반환합니다. Anthropic의 Sonnet 5.5 모델 페이지는 "Good to know" 항목에서 temperature, top_p, top_k를 기본값이 아닌 값으로 설정하면 오류가 반환된다고 적고 있습니다. 이는 이 블로그의 이전 Claude 가이드(온도를 0.5, 엄격한 직역이면 0.2로 설정하라고 안내했습니다)를 뒤집습니다. Sonnet 5.5에서는 온도 항목을 그대로 두세요. 이미 Sonnet 5로 동작하는 설정이 있다면 모델 ID만 바꾸는 것이 정답입니다. 모델 ID를 바꾸고 0.5를 다시 입력하면 오류 화면을 만나게 됩니다.
2. 사고 끄기 지정 방식이 바뀌었습니다. Sonnet 5에서는 thinking: disabled를 보낼 수 있었지만, Sonnet 5.5에서는 오류가 반환되며 대신 between_tools를 가리킵니다. Glarity는 사고 파라미터를 노출하지 않으므로 확장 프로그램을 통해 둘 중 무엇도 보내지 않습니다. 자체 Claude 연동을 유지하는 경우에만 해당합니다. Glarity를 통해서는 적응형 사고가 기본 high effort로 동작하며 설정할 것이 없습니다.
3. Sonnet 최초로 안전 레이어가 들어갔습니다. Sonnet 5.5는 Opus급에 준하는 사이버 안전장치와 폴백을 탑재한 첫 Sonnet이며, 추론 추출을 차단하는 분류기를 갖춘 첫 Sonnet입니다. 실제로는 사이버 피해를 가능하게 하는 요청이 거부될 수 있고, Anthropic의 서버 측 폴백이 해당 범주의 요청을 Claude Sonnet 5로 재시도합니다. 요약 용도에서는 거의 체감할 일이 없지만, 보안 연구나 공격 도구 관련 자료를 Glarity로 다룬다면 예전 Claude 모델이라면 그냥 답했을 상황에서 Sonnet 5 쪽 답변이나 거부를 만날 수 있습니다.
네 단계로 연결하기
Glarity를 열고 설정 → 일반으로 이동해 "빠른 Glarity 요약 및 번역을 위한 AI 연결"까지 스크롤합니다.
- "OpenAI API 키"를 선택합니다. Anthropic은 OpenAI 형식 요청을 받는 OpenAI SDK 호환 레이어를 제공하므로 이 항목이 Anthropic에도 쓰입니다.
- API 키 항목에 Anthropic API 키를 붙여넣습니다. 키는
sk-ant-로 시작하며 Claude Console에서 발급합니다. OpenAI 키는 여기서 동작하지 않습니다. - 모델에서 커스텀 모델을 선택하고
claude-sonnet-5-5를 정확히 입력합니다. 드롭다운에 Claude Sonnet 5.5가 이미 있으면 그것을 골라도 됩니다. 어느 쪽이든 ID가 기준입니다. - 온도는 기본값으로 두고 테스트를 누른 뒤 저장합니다.
두 항목은 기본값으로 두지만 한 번 확인하세요. API 호스트는 https://api.anthropic.com/v1(Anthropic 자체 호환 레이어 퀵스타트에 나오는 베이스 URL)이고, API 경로는 /chat/completions입니다. 이전 설정에 다른 업체의 호스트가 남아 있다면 되돌리세요. 테스트가 모델 오류가 아니라 연결 오류로 실패할 때의 해결책입니다. 모델 컨텍스트 윈도우는 가장 큰 프리셋을 선택합니다. 실제 한도는 모델의 100만 토큰이고 프리셋은 안전 상한일 뿐입니다.
한 세션의 실제 비용
입력 100만 토큰당 $2라는 것은 Claude Fable 5.1의 토큰 단가의 5분의 1입니다. Fable 5.1에 사용했던 것과 같은 세션 표를 Sonnet 5.5 요율로 계산했습니다. 개략적인 추정이며 실제 토큰 수는 언어와 페이지 복잡도에 따라 달라집니다.
입력하는 것 | 입력 토큰 | 출력 토큰 | 예상 비용 |
|---|---|---|---|
1시간 유튜브 영상 → 요약 | 약 12,000 | 약 800 | 약 $0.03 |
30페이지 보고서 → 요약 + 대화 | 약 40,000 | 약 1,500 | 약 $0.10 |
300페이지 책 → 전체 요약 | 약 230,000 | 약 3,000 | 약 $0.49 |
대규모 리서치 자료(입력 약 50만) | 약 500,000 | 약 8,000 | 약 $1.08 |
같은 자료를 Claude Fable 5.1로 | 약 500,000 | 약 8,000 | 약 $5.40 |
이 표에서 읽을 것은 두 가지입니다. 첫째, 일상적인 행은 거의 반올림 오차 수준입니다. 영상 하나 요약이 3센트이고, 이 모델로 일주일을 무겁게 읽어도 샌드위치보다 쌉니다. 둘째, Sonnet 5.5와 Sonnet 5의 가격 차이는 이 표에 아예 나타나지 않습니다. 공개 요율이 같기 때문입니다. 차이는 Sonnet 5.5가 같은 작업을 더 적은 토큰으로 끝낸다는 점(Anthropic 기준 최대 30% 감소)이고, 호환 레이어가 매 턴 전체 입력을 다시 과금하는 이상 그 효율이 곧 지출입니다.
주의할 점은 Fable 5.1 가이드와 같습니다. 호환 레이어는 프롬프트 캐싱을 지원하지 않습니다. 광고된 $0.20 캐시 읽기 요율은 Anthropic 네이티브 API를 쓰는 애플리케이션에 해당합니다. Glarity를 통해서는 23만 토큰짜리 책에 대한 여러 턴의 대화가 이어지는 질문마다 책 전체를 다시 과금합니다. 묻고 싶은 것을 하나의 잘 정리된 요청에 담으면 $0.49는 한 번짜리 숫자로 남습니다.
언제 쓰고, 언제 건너뛸까
Claude의 기본 레인으로 쓰세요. 이것은 트레이드오프가 없는 드문 업그레이드입니다. Sonnet 5와 같은 가격에 더 빠르고, 작업당 토큰이 더 적고, Anthropic이 공개한 모든 평가에서 앞섭니다. 지금 claude-sonnet-5에 연결되어 있다면 그 항목을 claude-sonnet-5-5로 바꾸는 것이 이 글에서 가장 값싼 5초입니다.
다음 상황에서 적극적으로 쓰세요. 긴 문서, 몇 시간짜리 대화록, 어조와 전문용어를 지켜야 하는 번역, 그리고 종이로 인쇄해 읽고 싶어지는 세션입니다.
두 가지 상황에서는 건너뛰세요. 짧고 가벼운 사용이라면 — 몇 문단 확인이나 페이지 훑어보기 — Flash급 모델이 훨씬 저렴하고 품질 차이도 느껴지지 않습니다. 그리고 개방형 문제에서 지속적인 판단이 정말로 필요한 작업에는 Claude Fable 5.1을 남겨 두세요. 100만 토큰당 $10 / $50으로 다섯 배 가격이며, Anthropic 스스로 더 저렴한 모델의 결과가 부족할 때 한 단계 올리라고 안내합니다. Glarity의 거의 모든 용도에서 그 선은 이제 Sonnet 5.5에 있습니다.
Claude 모델 간 전환은 항목 하나를 바꾸는 일입니다. Glarity의 "AI 연결"은 한 번에 하나의 설정만 실행하므로 Sonnet 5.5에서 Fable 5.1로 갈 때는 모델 이름만 고치면 됩니다.
문제가 생겼을 때
증상 | 가능한 원인 | 해결 |
|---|---|---|
온도를 설정한 직후 테스트가 400 반환 | Sonnet 5.5는 기본값이 아닌 샘플링 파라미터를 거부 | 온도 항목을 기본값으로 되돌리고 다시 테스트 |
테스트가 401 반환 | 키가 잘못되었거나 OpenAI 키를 입력 | Claude Console에서 키 발급( |
"모델을 찾을 수 없음" | 입력한 ID가 정확하지 않음 |
|
529 또는 "Overloaded" | Anthropic 자체의 과부하 오류 | 잠시 후 재시도. 호환 레이어는 Anthropic 상태 코드를 그대로 전달합니다 |
테스트에서 연결 오류 | 이전 설정의 호스트가 남아 있음 | API 호스트를 |
429 또는 속도 제한 | 키 사용 등급의 RPM/TPM 한도 | 잠시 기다린 뒤 Console에서 한도 상향 요청 |
긴 요청이 거부됨 | 100만 토큰 윈도우 초과 | 문서를 나눕니다. 100만 토큰은 현재 토크나이저 기준 약 55.5만 영단어입니다 |
자주 묻는 질문
Claude Sonnet 5.5는 무료인가요? 무료가 아닙니다. 호출마다 토큰 단위로 과금됩니다. Anthropic의 가격 FAQ에 따르면 신규 계정에는 테스트용 소액 크레딧이 지급되지만 몇 세션 분에 불과합니다. 실제로 읽는 분량에 맞춰 예산을 잡으세요. 이 모델에서는 그 예산이 작습니다.
일부 모델 목록에는 왜 `anthropic/claude-sonnet-5.5`로 표시되나요? 모델 디렉터리가 쓰는 공급자 접두어 표시 이름입니다. Claude API 자체가 받는 ID는 claude-sonnet-5-5로, 슬래시도 점도 없습니다. 커스텀 모델에는 이 값을 입력하세요.
Claude Sonnet 5에 만족하고 있는데 바꿔야 하나요? 그렇습니다. 가격은 동일하고 출력은 더 빠르며, 토큰 효율 덕분에 같은 세션의 비용은 더 낮습니다. Sonnet 5에 머무는 것이 이득인 상황은 없습니다. 모델 업그레이드에서 흔한 모양이 아니니 그대로 활용하세요.
보안 관련 요약이 거부될 수 있나요? 가능합니다. Sonnet 5.5는 최전선급 사이버 안전장치를 갖춘 첫 Sonnet이라 사이버 피해를 가능하게 하는 요청은 거부되거나, Anthropic의 서버 측 폴백으로 Claude Sonnet 5에서 처리될 수 있습니다. 일반적인 보안 읽기 — 권고문, 사고 보고서, 정책 문서 — 는 영향을 받지 않습니다.
Fable 5.1 설정을 대체하나요? 대부분의 세션에서는 그렇습니다. Fable 5.1은 그 위 등급이므로 두 자격 증명을 모두 보관하고, Sonnet 5.5가 감당하지 못하는 지속적 판단이 정말 필요한 작업에서 모델 항목만 바꿔 전환하세요.
번역할 때 온도는 얼마로 설정해야 하나요? Glarity의 기본값을 그대로 두세요. 이전 Claude 가이드의 0.2는 Sonnet 5.5의 파라미터 변경 이전 값이며, 테스트 단계에서 실패할 가능성이 큽니다.
Glarity 편집팀은 AI 검색, 영상 요약, 브라우저 활용 팁을 다룹니다.
Glarity는 AI 검색과 YouTube 요약을 지원하는 무료 브라우저 확장 프로그램입니다(glarity.app에서 사용 가능).



