OpenAI 호환 모델 가격은 바뀌는 속도가 빠르고, 업체마다 정산 방식도 다릅니다. 프로모션 기간, 캐시 티어, 피크·오프피크 요금까지요. 이 글은 2026년 8월 현재의 메뉴입니다: Glarity 같은 브라우저 확장에 바로 꽂아 쓸 수 있는 OpenAI 호환 엔드포인트를 가진 모델 6개(키 하나, API 호스트, 경로). 핵심부터: Claude Opus 5(백만 토큰당 $5/$25)와 GPT-5.6 Sol($4/$20)은 프리미엄 티어. Gemini 3.7 Flash, GLM-5.3-Flash, DeepSeek V4 Flash는 플래시 티어. Qwen3.6-Plus($0.50/$3.00)는 그 중간에 있고 100만 토큰 입력 창을 지원합니다.
6개 모델 가격 나란히 비교
가격은 2026년 8월 28일 기준 각 업체 공식 요금 페이지의 요율입니다. 출처: Anthropic, OpenAI, Google, Zhipu, Alibaba Cloud, DeepSeek:
모델 | 입력 / 출력(백만 토큰당) | 컨텍스트 / 최대 출력 | 비고 |
|---|---|---|---|
Claude Opus 5 | $5.00 / $25.00 | 1M / 128K | Opus 4.8과 동일 가격;추론 기본 켜짐 |
GPT-5.6 Sol | $4.00 / $20.00(단문)· $8.00 / $30.00(장문) | — | 캐시 입력 $0.40;프로모션 최소 2026-11-21까지 |
Gemini 3.7 Flash | $0.75 / $3.75(프로모션) | — | 2026-12-31까지, 이후 $1.50 / $7.50;캐시 $0.075;무료 티어 있음 |
GLM-5.3-Flash | GLM-5.3의 1/10(프로모션 1/20) | 1M / 128K | Zhipu 공식:같은 지능에서 Claude Opus 4.8의 약 1/40;MIT 오픈 웨이트 |
Qwen3.6-Plus | $0.50 / $3.00(입력 256K 이하)· $2.00 / $6.00(256K–1M) | 1M / — | 인터내셔널(Singapore) 요율 |
DeepSeek V4 Flash | $0.22 / $0.66(오프피크)· $0.44 / $1.32(피크) | 1M / 384K | 캐시 히트 입력 $0.007부터;피크는 UTC 월~금 01:00–04:00 및 06:00–10:00 |
월 1억 토큰이면 얼마?
현실적인 요약 작업 부하: 입력 1억 토큰(페이지, 전사, 문서)+ 출력 1000만 토큰(요약, 답변):
모델 | 1억 입력 + 1000만 출력 |
|---|---|
Claude Opus 5 | $750 |
GPT-5.6 Sol | $600(단문 표준) |
Gemini 3.7 Flash | $112.50(프로모션;2026-12-31 이후 $225) |
Qwen3.6-Plus | $80(요청 ≤256K 입력;대부분 초과 시 $260) |
DeepSeek V4 Flash | $28.60(오프피크;피크 $57.20,캐시 히트 입력이면 더 낮아짐) |
GLM-5.3-Flash | 공식 가격은 상대 비교만 — Zhipu 공표:GLM-5.3의 1/10, 프로모션 1/20, 같은 지능에서 Opus 4.8의 약 1/40 |
입력 중심 작업(번역, 같은 원문 재독)은 입력이 싸거나 캐시가 싼 모델이 유리하고, 출력 중심 작업(재작성, 긴 요약)은 출력 단가가 싼 모델이 유리합니다.
용도별 선택: 어떤 작업에 어떤 모델
작업 | 추천 | 이유 |
|---|---|---|
장문 연구, 엄밀한 검증 | Claude Opus 5 | 100만 컨텍스트, 추론 기본 켜짐. 정확성이 최우선이면 이 $5/$25가 값어치 |
거대 파일 추출 | GPT-5.6 Sol | 장문 티어가 강함. 프로모션 중 단문 표준 $4/$20 |
전체 페이지 / 문서 번역 | DeepSeek V4 Flash | 오프피크 $0.22 입력, 캐시 히트 $0.007 — 같은 원문 재독은 거의 공짜 |
일상 페이지·YouTube 요약 | Gemini 3.7 Flash 또는 GLM-5.3-Flash | 프로모션 입력 $1 미만;GLM-5.3-Flash는 MIT 오픈 웨이트·1/10 가격 |
잦은 가벼운 Q&A, 초안 | Qwen3.6-Plus | 입력 256K 이하 $0.50 / $3.00 |
상시 전사 작업 | DeepSeek V4 Flash(오프피크) | 출력 $0.66 — 6개 공식 표 중 가장 낮은 출력 단가 |
브라우저 확장에서 OpenAI 호환이 중요한 이유
Glarity의 설정 → 일반 → Connect to AI는 OpenAI API 키, 모델명, 컨텍스트 창 프리셋, API 호스트, API 경로만 받습니다. 즉 OpenAI 스타일 /chat/completions 엔드포인트를 제공하는 업체라면 뭐든 연결됩니다. 위 6개 모두 지원합니다: Anthropic은 OpenAI SDK 호환 레이어를 공개해 https://api.anthropic.com/v1/로 연결 가능(테스트·비교 용도로 명시 — 확장의 모델 전환이 바로 그 용도). Google Gemini API는 OpenAI 호환 모드를 제공하고, Zhipu는 GLM 계열에 OpenAI 호환 베이스를 제공하며, Alibaba Cloud Model Studio와 DeepSeek는 처음부터 OpenAI 호환, OpenAI는 말할 것도 없습니다.
모델을 바꿔도 Glarity의 작업(요약, 번역, Q&A)은 그대로이고, 바뀌는 건 호스트와 키, 그리고 토큰당 단가뿐입니다. 단계별 설정은 Glarity에서 Qwen3.6-Plus 사용하기와 Glarity에서 GLM-5.3-Flash 사용하기를 참고하세요.
FAQ
6개 중 뭐가 가장 싼가요? 트래픽 형태에 따라 다릅니다. 입력 중심이면 DeepSeek V4 Flash가 공식 요율 최저(오프피크 $0.22, 캐시 히트 $0.007). 일상적인 혼합 요약이면 Gemini 3.7 Flash 프로모션($0.75/$3.75)과 Qwen3.6-Plus($0.50/$3.00, 입력 256K 이하)가 시간 제한 없이 가장 합리적입니다.
가격이 바뀔 수도 있나요? 네, 여럿이 프로모션 가격입니다. GPT-5.6 Sol은 최소 2026-11-21까지. Gemini 3.7 Flash는 2027-01-01부터 두 배. DeepSeek V4 Flash는 피크 시간대 밖이 쌉니다. 확정 전에는 각 사 공식 페이지를 확인하세요.
오픈소스인 모델은? GLM-5.3-Flash입니다. Zhipu가 MIT 라이선스로 웨이트를 공개해 API 밖(자체 호스팅)에서도 돌릴 수 있습니다. 나머지는 공식 페이지 기준 API만 제공합니다.
Glarity에서 쓸 수 있나요? 네. 설정 → 일반 → Connect to AI를 OpenAI API key로 두고, 해당 업체 키를 붙여넣고, Custom Model을 골라 모델 코드를 입력한 뒤, 컨텍스트 창 프리셋을 그 모델의 입력 상한에 맞추고 API 호스트와 경로를 호환 문서의 값으로 채우면 됩니다. Test 후 Save.
입력 가격과 출력 가격 중 뭘 봐야 하나요? 둘 다지만 작업 형태가 좌우합니다: YouTube 요약은 긴 전사를 읽고 짧은 요약을 쓰므로 입력이 주도하고, 전체 번역·재작성은 출력 토큰이 많으므로 출력 단가가 주도합니다.
Glarity 편집팀은 AI 검색, 영상 요약, 브라우저 생산성 팁을 다룹니다.
Glarity는 AI 검색과 YouTube 요약을 지원하는 무료 브라우저 확장 프로그램입니다(glarity.app에서 사용 가능).



