いま DeepSeek で一番速いモデルは、一番短命でもあります。DeepSeek V4.1 Flash は 2026 年 9 月 8 日、deepseek-v4.1-flash-expires-on-0910 という ID で DeepSeek の API にひっそりと登場しました。名前の末尾に自分の期限(0910=9 月 10 日)が刻まれた社内ベータです。すでに Glarity で DeepSeek のキーを使っているなら、接続は欄を 1 つ変えるだけ:キーと API ホストはそのまま、Custom Model にベータの ID を打ち込む。新しいエンドポイントも待ちリストもコンソールも不要で、料金は deepseek-v4-flash と同じ。ベータは 9 月 10 日頃にオフラインになる予定なので、試すなら今日がその日です。
DeepSeek が発表したこと(と発表しなかったこと)
DeepSeek チームは 9 月 8 日、公式コミュニティグループにこのベータを投稿しました。同じ朝に Hacker News に転載された告知文が、現時点での公式記録のすべてです。
DeepSeek V4.1 Flash is now available for internal beta testing. It uses a new model architecture, with native multimodal support, stronger capabilities, faster speed, and lower cost. Keep thebase_urlunchanged and set the model name todeepseek-v4.1-flash-expires-on-0910to use it. Pricing is currently the same asdeepseek-v4-flash, with an account-level rate limit of 20 concurrent requests.
モデルカードも技術レポートも変更ログの記載もまだありません。今日時点で DeepSeek 公式のModels & Pricing ページに載っているのは deepseek-v4-flash、deepseek-v4-pro、deepseek-v4-flash-vision-exp の 3 つだけ。だから以下の記述も DeepSeek と同じ姿勢で読んでください。公式の主張は上の告知から、速度の数字は初日の開発者計測から。そして全部、あなた自身の 2 日間のテストで検証する材料です。
ファクトシート
項目 | 値 |
|---|---|
モデル ID |
|
状態 | 社内ベータ——最終版に先立つ「中間バージョン(中間版本)」のチェックポイント |
発表 | 2026 年 9 月 8 日、DeepSeek 公式コミュニティグループにて |
期限 | 2026 年 9 月 10 日——ID が刻んでおり、オフライン予定 |
アーキテクチャ | 新しいモデル構造(公式表明)。事後学習の更新ではなく再事前学習と読める表現 |
マルチモーダル | ベースモデル自体が画像+テキスト入力にネイティブ対応(8 月 21 日の vision モデルはテキストモデルに視覚エンコーダを後付けだった) |
コンテキスト窓 | 非公開。数値が出ていないため Glarity の設定は控えめに |
料金 |
|
レート制限 | アカウントあたり同時 20 リクエスト( |
動作場所 | DeepSeek 自身の API——base URL とキーは変更不要 |
4 ステップで接続する
必要なのは DeepSeek アカウントだけ。platform.deepseek.com(公式プラットフォーム)で API キーを発行または再利用します。利用料はこのアカウントに請求されます。
- Glarity → 設定 → 一般設定を開き、「Connect to AI for quick Glarity summaries and translations」へスクロール。「OpenAI API key」(他社製キーにも対応の項目)を選びます。
- DeepSeek の API キーを API Key 欄に貼り付けます。
- Model——ドロップダウンから Custom Model を選び、
deepseek-v4.1-flash-expires-on-0910をドットも含めて正確に入力します。この ID はドロップダウンに出ません:隠しベータなので、Hacker News の初日テスターたちも手入力でした。 - 固定の 3 欄を確認——API Host
https://api.deepseek.com、API Path/v1/chat/completions、Model Context Window204800tokens——Temperature は 0.5(逐語訳なら 0.2 に)。Test を押してから Save。
DeepSeek は「base_url は変更せずそのまま」と明言しているので、ベータは意図的に deepseek-v4-flash と同じ配線を再利用します。すでに当ブログのDeepSeek V4 Flash 設定ガイドを済ませているなら、今変えるのは手順 3 だけ。後で deepseek-v4-flash に戻すのも同じ 1 欄の操作です。
料金:V4 Flash の料金表がそのまま適用
ベータの課金はDeepSeek 公式の料金ページにある deepseek-v4-flash の正式料金そのものです。DeepSeek は 2026 年 8 月 16 日からピーク/オフピーク制に移っており、その他の時間帯はオフピークでピークの半額(ピーク:月〜金の 01:00–04:00 と 06:00–10:00 UTC)。
1M トークンあたり | オフピーク | ピーク |
|---|---|---|
入力(キャッシュヒット) | $0.007 | $0.014 |
入力(キャッシュミス) | $0.22 | $0.44 |
出力 | $0.66 | $1.32 |
Glarity の実際のセッションでの概算(オフピーク):
ジョブ | 入力トークン | 出力トークン | V4.1 Flash(V4 Flash 料金) | 同じ仕事を V4 Pro で |
|---|---|---|---|---|
1 時間の YouTube 動画 → 要約+Q&A | 約 12,000 | 約 1,000 | 約 $0.003 | 約 $0.010 |
30 ページの報告書 → 全体要約 | 約 40,000 | 約 1,500 | 約 $0.010 | 約 $0.029 |
書籍 1 冊分 → 章ごとのノート | 約 200,000 | 約 3,000 | 約 $0.046 | 約 $0.138 |
チャージする前に一つ正直な警告を。「低コスト」は効率の主張であって値下げではありません。トークン単価は変わっておらず、モデルが速く生成するようになっただけです。初日のテスターたちは、V4 Flash で同じ時間過ごすより残高が目に見えて速く減るのを目撃しています。タスクあたりの実コストが本当に下がるかどうかは、少ないトークンと少ないリトライで終えられるかにかかっていて、それを測るのはあなた自身です。
今日テストすべきこと(と初日の数字)
速度が主役ですが、今出回っている速度主張はすべてコミュニティ計測です。ベータと一緒に拡散した研究者の X 投稿では平均デコード速度 約 350 トークン/秒、初日の開発者からは長文生成で約 420 トークン/秒、ピークは 500 超え——ある拡散されたテストでは 3 分足らずで 71,000 トークン超を生成しました。比較として、Artificial Analysis が公開中の DeepSeek V4 Flash 0731 エンドポイントを測ったのは約 128 t/s。初日の報告だけ見ればスループットは 3 倍以上の跳ね上がりです。8 月 21 日の vision モデルとの同一タスク比較はさらに開いていて、SVG 生成タスクで約 6 倍、49K トークンの長文検索で約 5.2 倍、大型 SQL 生成タスクで約 5 倍。ただしどれも公式の数字ではありません。条件が制御されていない個人計測であり、DeepSeek は速度ベンチマークを発表していませんし、初期テストで最速だった候補がそのまま出荷されるとは限りません。
品質の公開ベンチマークはまだありません。ただ一つ興味深い詳細があります。DeepSeek がベータに添えたフィードバックフォームは、テスターに V4.1 Flash が「オンラインの DeepSeek V4 Pro を完全に置き換えられるか」と直接尋ねています。これは DeepSeek 自らがユーザーに投げた質問であって、モデル性能の主張ではありません。未回答の問いとして扱うべきものです。
自分の 48 時間で試す。Glarity でこのベータは低リスクの実験です。1 時間分の講義の文字起こしを要約し、長い記事を翻訳し、フォローアップ質問を投げる。そのうえで同じジョブを deepseek-v4-flash で再実行して比べます。Glarity のカスタム接続がモデルへ送るのはページや字幕のテキストです。V4.1 のネイティブな画像入力は、ファイル付きで API を直接叩くときに使えるもので、拡張のページ処理フロー経由ではありません。
頼る前に知っておくべき注意点
- 期限が来ます。ID は
expires-on-0910。9 月 8 日の登場から約 2 日間の稼働で、9 月 10 日頃にオフラインになる予定です。 - アカウントあたり同時 20 リクエスト。一人でブラウジングする分には十分。チーム共有のワークフローには不向きです。
- スペック未公開。パラメータ数、コンテキスト長、入力モダリティの一覧はすべて未発表です。
- 本番配線はしない。応答を止める予定のあるモデル ID に恒久ワークフローを向けるべきではありません。ベータはテスト用と割り切り、日常は
deepseek-v4-flashのままに。 - 正式版は「もうすぐ」の見込み——関係者の予測と短いベータ期間がそれを示しますが、未確認です。正式版が出ればこの設定は同じやり方で動きます:モデル ID を差し替える(またはドロップダウンに現れれば選ぶ)だけです。
うまく繋がらないとき
症状 | 原因の見当 | 対処 |
|---|---|---|
Test が 401 を返す | キーの誤り、または末尾に空白が付いたまま貼付 | platform.deepseek.com でキーを再生成し、欄に上書き貼付 |
「Model not found」/モデル不存在エラー | ID の打ち間違い——またはベータが期限切れ |
|
9 月 10 日前なのに同じエラー | ドロップダウンに出ないのは仕様——手入力専用 | 手順 3 のとおり Custom Model + 手入力 |
429/レート制限 | アカウントあたり同時 20 リクエスト | 数秒待つ。要約と翻訳を同時に走らせない |
Test で接続エラー | 別ベンダーの設定がホストやパスに残存 | API Host |
残高の減りがいつもより速い | 高いトークン スループット——3 倍以上速いだけでトークン単価は下がっていない | オフピークにテストし、完了タスクあたりのトークンを V4 Flash と比較 |
FAQ
DeepSeek V4.1 Flash は無料ですか?いいえ。ベータは deepseek-v4-flash と同じ料金で課金されます。オフピークで入力(キャッシュミス)1M $0.22、出力 1M $0.66。ピークはその 2 倍。無料期間はありません。
9 月 10 日以降もベータは動き続けますか?告知と ID の両方によれば、いいえ——テスト版は 9 月 10 日頃に自動的に失効してオフラインになる予定です。モデル欄を deepseek-v4-flash に戻し、正式版の発表を待ちましょう。
新しい DeepSeek アカウントやキーは要りますか?いいえ。同じ API、同じキー、同じプラットフォームアカウントで動きます。変わるのはモデル名だけです。
なぜ Glarity のモデル ドロップダウンに出ないのですか?隠し社内ベータで、公開モデルリストに追加されたことがないからです。Custom Model に正確な ID を手入力するのが唯一の方法です。
日常の Glarity 利用をこのモデルに切り替えるべきですか?恒常的なワークフローには向きません。2 日間の窓で品質とタスクあたりの実コストを deepseek-v4-flash と比較するのに使いましょう。同時 20 リクエスト制限と組み込みの期限がある以上、これはテスト用であり、日常用ではありません。
Glarity 拡張内で V4.1 Flash は画像を読めますか? DeepSeek はネイティブな画像+テキスト入力をうたっているので、ファイル付きの API 呼び出しでは機能します。ただし Glarity のカスタム接続が要約・翻訳するのはページや字幕のテキストです。画像処理を試すなら API を直接使ってください。
安定版の DeepSeek モデルへ戻すには?欄は 1 つだけ。Model を deepseek-v4-flash に戻せば、キーもホストもパスもそのままで済みます。エンドポイント、温度、コンテキスト窓はすべて有効のままです。
Glarity 編集部。Glarity 編集部が、AI 検索・動画要約・ブラウザ活用の最新情報をお届けします。
Glarity は AI 検索と YouTube 要約の無料ブラウザ拡張機能です(glarity.app で入手できます)。



