DeepSeekショック再来?「DeepSeek V4 Flash」正式版が無償公開。公式版は167GB、Unsloth版は最小82GB台
2026年8月1日 05:10
🤖 AI Summary
### 概要
5月分のサイズの1分以下のAIモデル「DeepSeek V4 Flash」が、無償で公開されました。「DeepSeek V4 Flash 0731」はMITライセンスのもとHugging Faceで提供され、エージェント系のベンチマーク9項目すべてで、上位版「DeepSeek V4 Pro」を上回る実績を持っています。
- **モデルサイズ**: 正式版は約167GBだが、量子化版ではUnslothが82GB台から提供している。
- **特徴**:
- 性能:エージェント系のベンチマーク9項目すべてで上位版を上回る
- モデル構造:MoE型、総パラメータ数は2,840億、推論時アクティブパラメータ数は130億
- DSpark(投機的デコード)機能搭載
### 主要な仕様
- **リポジトリ**: Hugging Faceの「deepseek-ai/DeepSeek-V4-Flash-0731」、MITライセンスで商用利用が認められている。
- **コンテキスト長**: 100万トークン
- **最大出力長**: 推論強度が「high」「max」の場合は38万4,000トークン
### リリース後の展開
Unslothは8月1日に、GGUF形式での量子化版も公開しました。最小サイズの1bit版「UD-IQ1_S」は約82.5GBで動きます。
- **推奨設定**:
- 温度: 1.0
- top_p: エージェント用途は0.95、それ以外は1.0
- 最大出力長: 推論の強度が「high」「max」の場合は38万4,000トークン
このモデルは個人利用にも適しており、より実用的な量子化版が提供されたことで、AIモデルの入手がさらに容易になりました。
5月分のサイズの1分以下のAIモデル「DeepSeek V4 Flash」が、無償で公開されました。「DeepSeek V4 Flash 0731」はMITライセンスのもとHugging Faceで提供され、エージェント系のベンチマーク9項目すべてで、上位版「DeepSeek V4 Pro」を上回る実績を持っています。
- **モデルサイズ**: 正式版は約167GBだが、量子化版ではUnslothが82GB台から提供している。
- **特徴**:
- 性能:エージェント系のベンチマーク9項目すべてで上位版を上回る
- モデル構造:MoE型、総パラメータ数は2,840億、推論時アクティブパラメータ数は130億
- DSpark(投機的デコード)機能搭載
### 主要な仕様
- **リポジトリ**: Hugging Faceの「deepseek-ai/DeepSeek-V4-Flash-0731」、MITライセンスで商用利用が認められている。
- **コンテキスト長**: 100万トークン
- **最大出力長**: 推論強度が「high」「max」の場合は38万4,000トークン
### リリース後の展開
Unslothは8月1日に、GGUF形式での量子化版も公開しました。最小サイズの1bit版「UD-IQ1_S」は約82.5GBで動きます。
- **推奨設定**:
- 温度: 1.0
- top_p: エージェント用途は0.95、それ以外は1.0
- 最大出力長: 推論の強度が「high」「max」の場合は38万4,000トークン
このモデルは個人利用にも適しており、より実用的な量子化版が提供されたことで、AIモデルの入手がさらに容易になりました。