エントリーの編集
エントリーの編集は全ユーザーに共通の機能です。
必ずガイドラインを一読の上ご利用ください。
記事へのコメント4件
- 注目コメント
- 新着コメント
注目コメント算出アルゴリズムの一部にLINEヤフー株式会社の「建設的コメント順位付けモデルAPI」を使用しています
- バナー広告なし
- ミュート機能あり
- ダークモード搭載
関連記事
284B の DeepSeek V4 Flash-0731 を DGX Spark 2 台で動かしてみた | DevelopersIO
DeepSeek V4 Flash-0731 を DGX Spark 2 台で動かし、llama.cpp と vLLM の 2 つの構成を実測で比べまし... DeepSeek V4 Flash-0731 を DGX Spark 2 台で動かし、llama.cpp と vLLM の 2 つの構成を実測で比べました。284B のモデルがローカルで実用になり、vLLM なら decode 76 tok/s、90 万トークンのプロンプトも通ります。 はじめに こんにちは、クラスメソッド製造ビジネステクノロジー部の森茂です。 284B のモデルを手元で動かす、と聞いてどのくらいの速度を想像するでしょうか。8 月頭に DeepSeek V4 Flash-0731 を DGX Spark 1 台で動かす記事を書いたときは、2-bit まで落として 20 tok/s ほどでした。読める速さではありますが、待たされる感じは残ります。 同じモデルを 2 台に広げたらどうなるか、というのが今回の話です。1 台では載らなかった 4-bit の GGUF と、DeepS





2026/08/12 リンク