지금 DeepSeek에서 가장 빠른 모델은 가장 수명이 짧은 모델이기도 합니다. DeepSeek V4.1 Flash는 2026년 9월 8일 deepseek-v4.1-flash-expires-on-0910이라는 ID로 DeepSeek API에 조용히 등장했습니다. 이름 뒤에 자신의 만료일(0910=9월 10일)을 그대로 새긴 내부 베타입니다. Glarity에서 이미 DeepSeek 키를 쓰고 있다면 연결은 필드 하나만 바꾸는 일:키와 API 호스트는 그대로 두고 Custom Model에 베타 ID를 입력하면 끝입니다. 새 엔드포인트도, 대기자 명단도, 새 콘솔도 필요 없고 요금은 deepseek-v4-flash와 동일합니다. 베타는 9월 10일경 오프라인으로 전환될 예정이므로, 써볼 생각이라면 오늘이 바로 그날입니다.
DeepSeek가 공개한 것(그리고 공개하지 않은 것)
9월 8일 DeepSeek 팀은 공식 커뮤니티 그룹에 이 베타 소식을 올렸고, 같은 날 오전 Hacker News에 전재된 아래 공지가 현재까지의 공식 기록 전부입니다.
DeepSeek V4.1 Flash is now available for internal beta testing. It uses a new model architecture, with native multimodal support, stronger capabilities, faster speed, and lower cost. Keep thebase_urlunchanged and set the model name todeepseek-v4.1-flash-expires-on-0910to use it. Pricing is currently the same asdeepseek-v4-flash, with an account-level rate limit of 20 concurrent requests.
모델 카드도, 기술 보고서도, 체인지로그 항목도 아직 없습니다.오늘 기준 DeepSeek 공식 모델·요금 페이지에는 여전히 deepseek-v4-flash, deepseek-v4-pro, deepseek-v4-flash-vision-exp 세 모델만 올라와 있습니다. 그러니 아래 내용도 DeepSeek과 같은 자세로 읽으세요. 공식 주장은 저 공지에서, 속도 수치는 첫날 개발자들의 측정에서 왔고, 전부 여러분의 이틀짜리 테스트로 직접 검증할 대상입니다.
팩트 시트
항목 | 값 |
|---|---|
모델 ID |
|
상태 | 내부 베타 — 최종 버전에 앞선 '중간 버전' 체크포인트 |
공개 시점 | 2026년 9월 8일, DeepSeek 공식 커뮤니티 그룹 |
만료 | 2026년 9월 10일 — ID에 새겨져 있으며 종료 예정 |
아키텍처 | 새로운 모델 구조(공식 표현). 사후 학습 업데이트가 아니라 재사전학습으로 읽히는 문구 |
멀티모달 | 베이스 모델 자체가 이미지+텍스트 입력 네이티브 지원(8월 21일 vision 모델은 텍스트 모델에 비전 인코더를 덧댄 방식) |
컨텍스트 창 | 미공개. 수치가 나오지 않아 Glarity 설정은 보수적으로 |
요금 |
|
동시 처리 한도 | 계정당 동시 요청 20개( |
실행 위치 | DeepSeek 자체 API — base URL과 키 변경 불필요 |
4단계로 연결하기
필요한 것은 DeepSeek 계정 하나뿐입니다. platform.deepseek.com(공식 플랫폼)에서 API 키를 새로 만들거나 기존 키를 재사용하세요. 사용량은 해당 계정에 직접 청구됩니다.
- Glarity → 설정 → 일반을 열어 Connect to AI for quick Glarity summaries and translations로 스크롤합니다. "OpenAI API key"(모든 AI 벤더의 커스텀 키를 받는 항목)를 선택하세요.
- DeepSeek API 키를 API Key 필드에 붙여넣습니다.
- Model — 드롭다운에서 Custom Model을 고르고
deepseek-v4.1-flash-expires-on-0910을 마침표 두 개까지 정확히 입력합니다. 이 ID는 드롭다운에 절대 나오지 않습니다:숨은 베타라서 Hacker News의 첫날 테스터들도 전부 수동 입력이었습니다. - 그대로 두는 세 필드를 확인합니다 — API Host
https://api.deepseek.com, API Path/v1/chat/completions, Model Context Window204800tokens — Temperature는 0.5(단어 단위 직역은 0.2)로 두고, Test로 확인한 뒤 Save합니다.
DeepSeek이 "base_url은 그대로"라고 공지했으므로, 이 베타는 deepseek-v4-flash와 완전히 같은 배선을 재사용합니다. 이미 저희 DeepSeek V4 Flash 설정 가이드로 설정했다면 지금 바꿀 것은 3단계뿐이고, 나중에 deepseek-v4-flash로 되돌리는 것도 같은 한 필드의 작업입니다.
요금:V4 Flash 요금표가 그대로 적용
베타 과금은 DeepSeek 공식 요금 페이지의 deepseek-v4-flash 현재 요율 그대로입니다. DeepSeek은 2026년 8월 16일부터 시간대별 차등 과금을 시행해, 나머지 시간대는 피크의 절반인 오프피크 요율이 적용됩니다(피크:월~금 UTC 01:00–04:00, 06:00–10:00).
1M 토큰당 | 오프피크 | 피크 |
|---|---|---|
입력(캐시 히트) | $0.007 | $0.014 |
입력(캐시 미스) | $0.22 | $0.44 |
출력 | $0.66 | $1.32 |
Glarity의 실제 시나리오로 계산하면(오프피크 기준):
작업 | 입력 토큰 | 출력 토큰 | V4.1 Flash(V4 Flash 요율) | 같은 작업을 V4 Pro로 |
|---|---|---|---|---|
1시간 YouTube 영상 → 요약+후속 질문 | 약 12,000 | 약 1,000 | 약 $0.003 | 약 $0.010 |
30쪽 보고서 → 전체 요약 | 약 40,000 | 약 1,500 | 약 $0.010 | 약 $0.029 |
책 한 권 분량 문서 → 챕터별 노트 | 약 200,000 | 약 3,000 | 약 $0.046 | 약 $0.138 |
충전하기 전에 한 가지 솔직한 경고를 드립니다. "저비용"은 효율 주장이지 요금 인하가 아닙니다.토큰 단가는 그대로고, 모델이 훨씬 빠르게 생성하도록 바뀐 것뿐입니다. 첫날 테스터들은 V4 Flash에서 같은 시간을 보낼 때보다 잔고가 눈에 띄게 빨리 줄어드는 걸 목격했는데, 이 베타가 토큰을 더 빠르게 소모하기 때문입니다. 작업당 실제 비용이 정말 내려가는지는 더 적은 토큰과 더 적은 재시도로 작업을 끝내느냐에 달려 있고, 그것을 측정할 사람은 바로 여러분입니다.
오늘 테스트할 것(그리고 첫날 나온 숫자들)
속도가 주인공이지만, 지금 돌고 있는 속도 주장은 전부 커뮤니티 측정입니다.베타와 함께 퍼진 연구자의 X 게시물은 평균 디코딩 약 350 토큰/초를, 첫날 개발자들은 긴 생성에서 약 420 토큰/초, 피크 500 초과를 보고했습니다. 널리 퍼진 한 테스트는 3분도 안 되어 71,000토큰 넘게 생성했습니다. 비교 기준으로, Artificial Analysis가 공개된 DeepSeek V4 Flash 0731 엔드포인트를 측정한 값은 약 128 토큰/초 — 첫날 보고만 보면 처리량이 최소 3배 이상 뛴 셈입니다. 8월 21일 vision 모델과의 동일 작업 비교는 격차가 더 큽니다. SVG 코드 생성 작업 약 6배, 49K 토큰 장문 검색 약 5.2배, 대형 SQL 생성·최적화 작업 약 5배. 다만 이 숫자들은 전부 공식 수치가 아닙니다. 조건이 통제되지 않은 개인 측정이고, DeepSeek은 자체 속도 벤치마크를 발표한 바 없으며, 초기 테스트에서 가장 빠른 후보가 곧 출시되는 빌드라고 보장도 없습니다.
품질에 대해서는 공개 벤치마크가 하나도 없습니다.다만 흥미로운 디테일이 하나 있습니다. DeepSeek이 베타에 첨부한 피드백 설문이 테스터들에게 V4.1 Flash가 "온라인 DeepSeek V4 Pro를 완전히 대체할 수 있는지"를 직접 물었습니다. 이는 DeepSeek이 스스로 사용자에게 던진 질문이지 모델 성능에 대한 공식 주장이 아닙니다. 답 안 나온 질문으로 다뤄야 할 사안입니다.
여러분의 48시간으로 직접 테스트하세요.Glarity에서 이 베타는 저위험 실험입니다. 한 시간짜리 강의 자막을 요약하고, 긴 기사를 번역하고, 후속 질문을 던져 보세요. 그다음 같은 작업을 deepseek-v4-flash로 다시 돌려 비교합니다. Glarity의 커스텀 연결이 모델에 보내는 것은 페이지와 자막의 텍스트입니다. V4.1의 네이티브 이미지 입력은 파일을 첨부해 API를 직접 호출할 때 쓸 수 있는 것이고, 확장 프로그램의 웹페이지 처리 흐름은 그 경로를 쓰지 않습니다.
의존하기 전에 알아둘 것
- 만기가 옵니다.ID가
expires-on-0910이라고 말해줍니다. 9월 8일 등장 기준 약 이틀의 창이고, 9월 10일경 종료 예정입니다. - 계정당 동시 요청 20개.혼자 브라우징하기엔 충분하지만, 팀 공유 워크플로우에는 부적합합니다.
- 스펙 미공개.파라미터 수, 컨텍스트 길이, 전체 입력 모달리티 목록 모두 미발표입니다.
- 프로덕션 연결 금지.응답이 끊길 예정인 모델 ID에 고정 워크플로우를 걸면 안 됩니다. 베타는 테스트용으로, 일상은 계속
deepseek-v4-flash에 두세요. - 정식 출시가 '곧' 올 것—관계자들의 예상과 이틀짜리 베타 창이 모두 이를 가리키지만, 아직 확인되지 않았습니다. 정식 버전이 나오면 이 설정은 똑같이 동작합니다:모델 ID만 바꾸면(또는 드롭다운에 나타나면 선택하면) 됩니다.
연결이 안 될 때
증상 | 가능한 원인 | 해결 |
|---|---|---|
Test가 401 반환 | 키 오류, 또는 끝에 공백이 붙은 채 붙여넣음 | platform.deepseek.com에서 키를 재발급해 필드에 덮어쓰기 |
"Model not found" / 모델 없음 오류 | ID 오타 — 또는 베타 만료 |
|
9월 10일 전인데도 같은 오류 | 드롭다운에 원래 안 나옴 — 수동 입력 전용 | 3단계대로 Custom Model + 수동 입력 |
429 / 속도 제한 | 계정당 동시 요청 20개 한도 | 몇 초 대기. 요약과 번역을 동시에 돌리지 말 것 |
Test에서 연결 오류 | 다른 벤더 설정이 호스트·경로에 남아 있음 | API Host |
잔고가 평소보다 훨씬 빨리 줄어듦 | 높은 토큰 처리량 — 3배 이상 빨라졌을 뿐 단가는 그대로 | 오프피크에 테스트하고, 완료 작업당 소비 토큰으로 V4 Flash와 비교 |
FAQ
DeepSeek V4.1 Flash는 무료인가요? 아니요. 베타는 deepseek-v4-flash 요율로 과금됩니다. 오프피크 기준 입력(캐시 미스) 1M당 $0.22, 출력 1M당 $0.66이며 피크는 두 배입니다. 무료 기간은 없습니다.
9월 10일 이후에도 베타를 계속 쓸 수 있나요? 공지와 ID가 말해주듯:아니요 — 테스트 버전은 9월 10일경 자동 만료·종료될 예정입니다. 모델 필드를 deepseek-v4-flash로 되돌리고 정식 출시를 기다리세요.
새 DeepSeek 계정이나 새 키가 필요한가요? 아니요. 같은 API, 같은 키, 같은 플랫폼 계정에서 작동합니다. 바뀌는 것은 모델 이름뿐입니다.
Glarity 모델 드롭다운에 왜 없나요? 숨은 내부 테스트라 공개 모델 목록에 추가된 적이 없기 때문입니다. Custom Model에 정확한 ID를 수동 입력하는 것이 유일한 방법입니다.
일상적인 Glarity 사용을 이 모델로 옮겨야 하나요? 상시 워크플로우에는 부적합합니다. 이틀짜리 창에서 품질과 작업당 실제 비용을 deepseek-v4-flash와 비교하는 용도로 쓰세요. 동시 20개 제한과 내장 만료가 있는 이상 테스트용이지 일상용이 아닙니다.
Glarity 확장에서 V4.1 Flash가 이미지를 읽나요? DeepSeek은 이미지+텍스트 입력을 네이티브 지원한다고 밝혔으므로, 파일을 첨부해 API를 직접 호출하면 가능합니다. 다만 Glarity의 커스텀 연결이 요약·번역하는 것은 웹페이지와 자막의 텍스트입니다. 비전 쪽을 시험하려면 API를 직접 호출해 이미지 파일을 첨부하세요.
안정적인 DeepSeek 모델로 되돌리려면? 필드 하나만 바꾸면 됩니다. Model을 deepseek-v4-flash로 되돌리면 키·호스트·경로는 그대로입니다. 엔드포인트, 온도, 컨텍스트 창은 모두 유효한 상태로 유지됩니다.
Glarity 편집팀. Glarity 편집팀은 AI 검색, 영상 요약, 브라우저 활용 팁을 다룹니다.
Glarity는 AI 검색과 YouTube 요약을 지원하는 무료 브라우저 확장 프로그램입니다(glarity.app에서 사용 가능).



