DeepSeek、V4.1 Flashモデルを発表

Judul asli: DeepSeek v4.1 Flash

Mengapa Ini Penting

552Bパラメータながらアクティブパラメータを削減し、KVキャッシュコストも大幅圧縮。エンタープライズ向けAI推論コスト削減に直結する技術的前進。

DeepSeekは2026年9月10日、新アーキテクチャファミリーの最小モデル「DeepSeek-V4.1-Flash」を発表。552Bパラメータ、入力8B・出力16Bのアクティブパラメータを持つ。

DeepSeekは2026年9月10日、最新モデル「DeepSeek-V4.1-Flash」をX上で発表した。同モデルは新しいCausal Encoder–Decoderアーキテクチャを採用し、552BパラメータのMoE構造を持つ。入力時のアクティブパラメータは8B、出力時は16Bに設計されており、効率性を高めている。ネイティブのマルチモーダル(視覚)理解機能を標準搭載し、DeepSeek APIにて「deepseek-flash」のモデル名で即日利用可能となった。

KVキャッシュの効率も大幅に改善され、前世代比でHBMは4分の1、SSDストレージは8分の1の容量で動作する。これによりエージェント利用時のキャッシュコストが大幅に削減される。APIの価格はオフピーク時にピーク時の50%となる料金体系が継続される。前世代モデルのV4-FlashおよびV4-Flash-Vision-Expは廃止となるが、互換性のため従来のモデル名は一時的にV4.1-Flashへルーティングされる。モデルの重みはHugging Face(deepseek-ai/DeepSeek-V4.1-Flash)で公開されており、オープンソースコミュニティとの連携も予定している。

Sumber

x.com — Baca artikel asli →