Ollama の DeepSeek-V4 モデルにおける新しい料金体系の概要
Ollama のクラウドサービスにおいて、DeepSeek-V4 モデルの利用料金に関する新しい仕組みが導入されました。特定の時間帯(オフピーク時間帯)に利用することで、トークン料金を 50%低減できる内容となっています。
オフピーク料金の詳細な適用条件と価格
新しい割引価格は、平日の 12:00 より前 または 18:00 以降(UTC)、および週末の全時間帯に適用されます。具体的な 100 万トークンあたりの料金は以下の通りです。
- DeepSeek-V4-Flash: 入力 $0.22、キャッシュされた入力 $0.007、出力 $0.66
- DeepSeek-V4-Pro: 入力 $0.66、キャッシュされた入力 $0.022、出力 $1.98
これらのモデルは米国および欧州のサーバーで提供されており、データを保持しない「Zero Data Retention (ZDR)」が採用されています。この料金体系は、無料プランを含むすべてのプランで利用可能です。詳細は 公式の料金ページ をご確認ください。
コストを最適化したいユーザーにとってのメリット
この新しい料金体系により、以下のようなユーザーが恩恵を受けられます。
- 大量のデータ処理を時間帯を調整して実行することで、API 利用コストを大幅に抑えたい開発者
- データのプライバシーを重視しつつ、低価格なモデルを利用したいプロジェクトの運営者
- 無料プランのクレジット内で、より効率的に DeepSeek-V4 モデルを活用したいユーザー
なお、今後他のモデルについても、同様のオフピーク料金が導入される予定です。
※ 本記事は、Ollama から届くメールをトリガーとして、n8n とローカル LLM(Ollama / gemma4:26b)を連携させ、Mac mini M4(32GB)上で記事生成を自動化した実験の記録です。生成プロセス〜公開において人間による確認と微調整は行っていますが、内容に誤りを含む可能性があるため、正確な情報は必ず公式情報をご確認ください。
源勝よりひとこと
.png)
Ollama クラウドモデルを使う時の話。
オフピーク時間の基準は UTC 。JST(UTC+9)で計算するとどうなるんだ?と Gemini と ChatGPT の両方に尋ねてたら訳がかからなくなりました 😅
僕の結論!基本は高い金額でコスト計算しておいて、50%オフ(オフピーク適用になったら)Ollama ありがとう!と考えることにしました(気が楽)。
そして、今後、DeepSeek-V4-Flash / DeepSeek-V4-Pro 以外のモデルにもオフピーク価格が発表されるようなので、それはそれで楽しみです!





























