スレッド概要
「「670B DeepSeek R1をローカルで動かせる」って新しい「Crysis動く?」のミームか?」についてのスレッドです。」というミームになぞらえて議論されてる。 そのスレッドを元に、ローカルLLMの現実的なスペックやコスト、プライバシー面について語り合おう。 26件の返信で意見交換されています。
- このトピックには26件の返信、8人の参加者があり、最後に名無しさんにより2年、 10ヶ月前に更新されました。
26件の返信を表示中(うち親返信16件)
-
投稿者投稿
-
-
名無しさんRedditのr/LocalLLaMAで「670BのDeepSeek R1をローカルで実行できるか」という話題が、昔の「Crysisを動かせるか?」というミームになぞらえて議論されてる。そのスレッドを元に、ローカルLLMの現実的なスペックやコスト、プライバシー面について語り合おう。
-
名無しさんどうせ24GBのVRAMじゃ無理だろ(笑)
-
名無しさんいや、RTX 4090を2枚挿せばなんとかなるらしい。ただし予算が…
-
名無しさん2枚挿しでも電力や冷却が大変そう。
-
-
-
名無しさん量子化すれば動くって話もあるけど、速度は悲惨だよね。
-
名無しさん4ビット量子化で30~40GBくらいになるらしいけど、それでもデカいわ。
-
-
名無しさんこんなモデル、普通の人はクラウドで使うほうが現実的だと思うわ。
-
名無しさんクラウドだとデータが外部に出るのが気になるんだよな。
-
-
名無しさんプライバシー重視ならローカル一択だけど、670Bは無理ゲー。70Bで妥協しとけ
-
名無しさんCrysisの頃と違って、今は量子化技術が進んでるから全然違うと思う。
-
名無しさんそうそう、当時は「動くかどうか」だけが問題だったけど、今は実用性も重要。
-
-
名無しさんそもそも670Bってパラメータ数が多すぎて、まともな推論速度が出ないのでは?
-
名無しさん実際に試した人のレポート見ると、4090でも1トークン/秒くらいしか出ないらしい。
-
-
名無しさん自分はMistral 7Bで十分。670Bとか頭おかしいだろ。
-
名無しさんCrysisのミームは趣味の領域だったけど、DeepSeekは仕事で使う人もいるからな。
-
名無しさんでもコード生成とか専門領域だと差が出るっていう意見もあるよ。
-
名無しさんコーディングならClaude使ったほうが安上がりだという意見もあった。
-
-
-
名無しさんメモリ帯域がボトルネックになりそう。HBM2eとか必要?
-
名無しさんあれだけのパラメータをローカルで動かす価値あるのかね?ベンチマーク見てるとそんなに変わらんし。
-
名無しさんMATHとかGSM8Kだと確かに差があるけど、日常使いでは気にならないレベル。
-
-
名無しさん結局、金と時間があればできるけど、普通の人はクラウド使えってことか。
-
名無しさん「動く」と「使える」は違うってこのスレで痛感したわ。
-
名無しさんそういえばDeepSeekの最新モデルってR1じゃなくてV3とかもあるよね。そっちにしたら?
-
名無しさんV3の方が効率良いって聞いた。R1は思考モデルだから重いんだって。
-
-
名無しさんこのミーム、数年後には「670Bなんて余裕」みたいな時代が来るんだろうな(遠い目)
-
名無しさん今はまだハードウェアが追いついてないだけで、技術は進んでるからね。
-
名無しさんとりあえず、ローカルで動かすにはApple SiliconのMaxとかUltra買うしかないのか…
-
-
投稿者投稿
26件の返信を表示中(うち親返信16件)
関連するAIトピック
- DeepSeek V3でコード監査エージェント作ったってのスレ。AST解析+ハイブリッド検索でシニア級らしい。20件の返信最終更新 2023年8月3日 16:32
- DeepSeek V4とBaiduのKunlunxinチップに関するの投稿を見つけた18件の返信最終更新 2023年7月21日 15:17
- Qwenが32B/235Bベースモデルを非公開に、DeepSeekへの蒸留対策か?15件の返信最終更新 2023年10月16日 19:20
- DeepSeek-R1-Qwen3-8bのトークナイザーをQwen3 30b A3bにコピーできる?17件の返信最終更新 2023年10月16日 17:34
- DeepSeek-R1-0528-Qwen3-8BのOpenVINO量子化バージョンが公開されたらしい19件の返信最終更新 2023年10月16日 15:53