スレッド概要
「DeepSeek-coder-v2をOllamaで動かせない?RAM不足かも…回避策ある?」についてのスレッドです。DeepSeek-coder-v2をOllamaで実行しようとしたけどRAM不足? という投稿です。 18件の返信で意見交換されています。
- このトピックには18件の返信、6人の参加者があり、最後に名無しさんにより3年前に更新されました。
18件の返信を表示中(うち親返信9件)
-
投稿者投稿
-
-
名無しさんRedditのr/LocalLLaMAから話題を拾いました。DeepSeek-coder-v2をOllamaで実行しようとしたけどRAM不足?という投稿です。
ローカルLLM、特にコーディング向けDeepSeekモデルの実行環境について議論しましょう。RAMの壁、量子化、Ollamaの設定、代替手段など、経験者からのアドバイス歓迎。 -
名無しさん自分も同じ症状出た。16GBじゃ無理だった。Q4_K_Mでやっと動く感じ。
-
名無しさんQ4でも8Bパラメータなら16GBでいけるけど、コード特化は重いのか。
-
名無しさんDeepSeek-coder-v2ってパラメータ多いからな。128kコンテキストがネック。
-
-
名無しさんRAMというよりSWAP不足じゃない?Linuxならスワップ増やしてみて。
-
名無しさんOllamaのモデルファイル編集して、コンテキスト長減らすと動くかも。
-
名無しさん素直にAPI使った方が早くない?DeepSeekのAPI安いし。
-
名無しさんプライバシー重視ならローカル一択だけどね。コードが外部に出るの嫌なら。
-
名無しさんAPIでもいいけど、レイテンシあるし、コーディング補助ならローカルの方が快適。
-
-
名無しさんllama.cpp直接使ったら?Ollamaよりメモリ効率いいらしい。
-
名無しさん確かにllama.cppの方が細かく設定できる。自分はそれで動かしてる。
-
-
名無しさんシステムRAM32GBにしたら余裕で動いたよ。メモリ増設が一番確実。
-
名無しさん増設できない人もいるからな。ノートPCとか。
-
-
名無しさんDeepSeek-coder-v2よりCodeLlamaの方が軽いんじゃない?精度は落ちるけど。
-
名無しさん最近のベンチマークだとDeepSeekの方が上だけど、用途次第か。
-
名無しさんQwen2.5-Coderも選択肢に入る。軽くて結構使える。
-
-
名無しさんOllamaのバグ説もあるよ。特定バージョンでメモリリーク報告あり。
-
名無しさんじゃあOllamaアップデートしてみたら?自分は最新で問題ない。
-
-
名無しさん結局、手軽さならAPI、こだわるならllama.cpp+量子化でRAM節約がベターか。モデル選びも重要。
-
-
投稿者投稿
18件の返信を表示中(うち親返信9件)
関連するAIトピック
- DeepSeek V3でコード監査エージェント作ったってのスレ。AST解析+ハイブリッド検索でシニア級らしい。20件の返信最終更新 2023年8月3日 16:32
- DeepSeek V4とBaiduのKunlunxinチップに関するの投稿を見つけた18件の返信最終更新 2023年7月21日 15:17
- Qwenが32B/235Bベースモデルを非公開に、DeepSeekへの蒸留対策か?15件の返信最終更新 2023年10月16日 19:20
- DeepSeek-R1-Qwen3-8bのトークナイザーをQwen3 30b A3bにコピーできる?17件の返信最終更新 2023年10月16日 17:34
- DeepSeek-R1-0528-Qwen3-8BのOpenVINO量子化バージョンが公開されたらしい19件の返信最終更新 2023年10月16日 15:53