DXを推進するAIポータルメディア「AIsmiley」| AI製品・サービスの比較・検索サイト
03-6452-4750 10:00〜18:00 年末年始除く

DeepSeek、新モデル「DeepSeek-V4.1-Flash」提供開始。推論の高速化とコスト削減を実現

最終更新日:2026/09/15

DeepSeek 新モデル提供開始

DeepSeekは、新モデル「DeepSeek-V4.1-Flash」の提供を開始しました。新たなアーキテクチャや事前学習・強化学習による事後学習により、主力モデルを上回る性能を達成しながら、推論の高速化と大幅なコスト削減を実現しています。

このニュースのポイント

  • DeepSeek、新モデル「DeepSeek-V4.1-Flash」提供開始
  • 新アーキテクチャにより推論を高速化し、KVキャッシュの圧縮でHBMを4分の1、SSDストレージを8分の1に削減
  • 今後はオープンソースコミュニティと推論サポートを進め、導入オプション拡大を検討

DeepSeekは、新アーキテクチャファミリーの最小モデルとなる「DeepSeek-V4.1-Flash」を発表しました。ネイティブな視覚理解を備えており、より高い能力と高速な推論、スループットの向上、大規模モデルへの拡張性などを実現する設計となっています。

本モデルは、552BパラメータのMoEを採用し、新たなCausal Encoder–Decoderアーキテクチャにより、入力時8B、出力時16Bのアクティブパラメータで動作します。

新しい事前学習手法と、大規模な強化学習による事後学習を組み合わせることで「DeepSeek-V4-Pro」を含む主力モデルを上回るベンチマーク結果を記録したとしています。

また、前世代と比較してKVキャッシュを大幅に圧縮しました。KVキャッシュに必要なHBMを4分の1、SSDストレージを8分の1に抑え、エージェント利用時に大きな割合を占めるキャッシュヒットのコストを大幅に削減します。

「DeepSeek-V4.1-Flash」は現在、DeepSeek APIで利用可能です。従来の「V4-Flash」および「V4-Flash-Vision-Exp」は終了し、互換性維持のため、旧モデル名へのリクエストは一時的に「V4.1-Flash」へルーティングされます。

また、複数の機関によるテストで「V4.1-Flash」が性能、コスト、速度、総実行時間の面で「V4-Pro」を上回ったとしています。これを受けて「V4-Pro」は段階的に廃止される方針です。

APIの提供価格も引き下げられました。ピーク時とオフピーク時の料金体系を継続し、オフピーク料金はピーク時の50%に設定されています。

DeepSeekは今後、オープンソースコミュニティと連携して「V4.1-Flash」の推論対応を進めるとともに、より多くの導入オプションを検討するとしています。

出典:DeepSeek

AIsmiley編集部

株式会社アイスマイリーが運営するAIポータルメディア「AIsmiley」は、AIの専門家によるコンテンツ配信とプロダクト紹介を行うWebメディアです。AI資格を保有した編集部がDX推進の事例や人工知能ソリューションの活用方法、ニュース、トレンド情報を発信しています。

・Facebookでも発信しています @AIsmiley.inc
・Xもフォローください @AIsmiley_inc
・Youtubeのチャンネル登録もお願いいたします@aismiley
メルマガに登録する

DXトレンドマガジン メールマガジン登録

業務の課題解決に繋がる最新DX・情報をお届けいたします。
メールマガジンの配信をご希望の方は、下記フォームよりご登録ください。登録無料です。

お名前 - 姓・名

お名前を入力してください

メールアドレス

メールアドレスを入力してください

AI・人工知能記事カテゴリ一覧

今注目のカテゴリー

生成AI

チャットボット

AI-OCR

フィジカルAI

生成AI

チャットボット

AI-OCR

フィジカルAI

AI活用のご相談したい企業様はこちら

03-6452-4750

AI製品・ソリューションの掲載を
希望される企業様はこちら