DeepSeek-coder-v2をOllamaで動かせない?RAM不足かも…回避策ある?

掲示板 フォーラム AI DeepSeek-coder-v2をOllamaで動かせない?RAM不足かも…回避策ある?

スレッド概要

「DeepSeek-coder-v2をOllamaで動かせない?RAM不足かも…回避策ある?」についてのスレッドです。DeepSeek-coder-v2をOllamaで実行しようとしたけどRAM不足? という投稿です。 18件の返信で意見交換されています。

  • このトピックには18件の返信、6人の参加者があり、最後に名無しさんにより3年前に更新されました。
18件の返信を表示中(うち親返信9件)
  • 投稿者
    投稿
    • #70976 返信
      名無しさん
      Redditのr/LocalLLaMAから話題を拾いました。DeepSeek-coder-v2をOllamaで実行しようとしたけどRAM不足?という投稿です。
      ローカルLLM、特にコーディング向けDeepSeekモデルの実行環境について議論しましょう。RAMの壁、量子化、Ollamaの設定、代替手段など、経験者からのアドバイス歓迎。

    • #70977 返信
      名無しさん
      自分も同じ症状出た。16GBじゃ無理だった。Q4_K_Mでやっと動く感じ。

      • #70980 返信
        名無しさん
        Q4でも8Bパラメータなら16GBでいけるけど、コード特化は重いのか。

      • #70981 返信
        名無しさん
        DeepSeek-coder-v2ってパラメータ多いからな。128kコンテキストがネック。

    • #70978 返信
      名無しさん
      RAMというよりSWAP不足じゃない?Linuxならスワップ増やしてみて。

    • #70979 返信
      名無しさん
      Ollamaのモデルファイル編集して、コンテキスト長減らすと動くかも。

    • #70982 返信
      名無しさん
      素直にAPI使った方が早くない?DeepSeekのAPI安いし。

      • #70983 返信
        名無しさん
        プライバシー重視ならローカル一択だけどね。コードが外部に出るの嫌なら。

      • #70984 返信
        名無しさん
        APIでもいいけど、レイテンシあるし、コーディング補助ならローカルの方が快適。

    • #70985 返信
      名無しさん
      llama.cpp直接使ったら?Ollamaよりメモリ効率いいらしい。

      • #70986 返信
        名無しさん
        確かにllama.cppの方が細かく設定できる。自分はそれで動かしてる。

    • #70987 返信
      名無しさん
      システムRAM32GBにしたら余裕で動いたよ。メモリ増設が一番確実。

      • #70988 返信
        名無しさん
        増設できない人もいるからな。ノートPCとか。

    • #70989 返信
      名無しさん
      DeepSeek-coder-v2よりCodeLlamaの方が軽いんじゃない?精度は落ちるけど。

      • #70990 返信
        名無しさん
        最近のベンチマークだとDeepSeekの方が上だけど、用途次第か。

      • #70991 返信
        名無しさん
        Qwen2.5-Coderも選択肢に入る。軽くて結構使える。

    • #70992 返信
      名無しさん
      Ollamaのバグ説もあるよ。特定バージョンでメモリリーク報告あり。

      • #70993 返信
        名無しさん
        じゃあOllamaアップデートしてみたら?自分は最新で問題ない。

    • #70994 返信
      名無しさん
      結局、手軽さならAPI、こだわるならllama.cpp+量子化でRAM節約がベターか。モデル選びも重要。

18件の返信を表示中(うち親返信9件)
返信先: DeepSeek-coder-v2をOllamaで動かせない?RAM不足かも…回避策ある?で#70981に返信
あなたの情報:




AA
tchmii
タイトルとURLをコピーしました