動察 Beating AI 速報、DeepSeek が V4.1 Flash を正式にリリース。新モデルの総パラメータ数は 552B(5520億)で、全新の Causal-Encoder-Decoder アーキテクチャを採用し、画像理解をネイティブサポート。これも DeepSeek のこの新アーキテクチャシリーズの中で現在最小のモデルです。
このアーキテクチャは入力と出力を分けて処理します。入力読み取り時は 8B(80億)パラメータのみを活性化し、回答生成時は 16B(160億)を活性化します。DeepSeek によると、これにより 552B の大規模モデルでも推論コストを抑えられるといいます。新しい事前学習とより大規模な強化学習を経て、V4.1 Flash は公式ベンチマークで既に V4 Pro を上回っています。
キャッシュも大幅に圧縮されました。前世代と比較して、V4.1 Flash の HBM メモリ需要は 1/4 に、SSD ストレージ需要は 1/8 に低減し、主に長コンテキストや Agent の反復呼び出し時のコストを削減するために用いられます。
V4.1 Flash は既に API にも同時公開されており、モデル名を deepseek-flash に変更するだけで呼び出せます。