RTX 3060 12GBでDeepSeek 14B Q4_K_Mを動かした話

掲示板 フォーラム AI RTX 3060 12GBでDeepSeek 14B Q4_K_Mを動かした話

スレッド概要

「RTX 3060 12GBでDeepSeek 14B Q4_K_Mを動かした話」についてのスレッドです。RTX 3060 12GBでllama.cppを使い、DeepSeek-R1-Distill-Qwen-14BのQ4_K_M量子化モデルを動かしたという投稿です。 VRAM制限の中で大きなモデルを動かす工夫や、実際の使用感について話題になっています。 18件の返信で意見交換されています。

  • このトピックには18件の返信、6人の参加者があり、最後に名無しさんにより2年、 11ヶ月前に更新されました。
18件の返信を表示中(うち親返信14件)
  • 投稿者
    投稿
    • #76282 返信
      名無しさん
      RedditのLocalLLaMA板から。RTX 3060 12GBでllama.cppを使い、DeepSeek-R1-Distill-Qwen-14BのQ4_K_M量子化モデルを動かしたという投稿です。VRAM制限の中で大きなモデルを動かす工夫や、実際の使用感について話題になっています。

    • #76283 返信
      名無しさん
      すごい!12GBで14Bモデルが動くんですね。自分も試してみたいです。

    • #76284 返信
      名無しさん
      Q4_K_Mだと品質はどのくらい落ちるんでしょうか?通常のQ4と比べてどうですか?

      • #76285 返信
        名無しさん
        実際に使ってみた感じでは、コード生成や簡単な質問なら十分実用的です。Q4_K_Mは精度と速度のバランスが良いですね。

    • #76286 返信
      名無しさん
      自分はRTX 4060 8GBですが、似たような条件でいろいろ試してます。12GB羨ましい。

    • #76287 返信
      名無しさん
      llama.cppの設定を教えてください。特にコンテキスト長やバッチサイズはどのくらいにしてますか?

      • #76288 返信
        名無しさん
        自分はコンテキスト長を2048に減らして、バッチサイズは512でやってます。それでもVRAMぎりぎりですが動きますよ。

    • #76289 返信
      名無しさん
      VRAM足りなくて途中で落ちることがあります… 何か対策ありますか?

    • #76290 返信
      名無しさん
      DeepSeekって中国製ですよね?プライバシー面が心配なんですが、ローカルで動かすなら問題ないですか?

      • #76291 返信
        名無しさん
        ローカルで完結してるから外部にデータは送られないはず。モデル自体はオープンだし、安心して使ってます。

    • #76292 返信
      名無しさん
      性能比較のベンチマーク結果とかあると嬉しいです。他のモデルと比べてどうなんですかね。

    • #76293 返信
      名無しさん
      RTX 3060 12GBはコスパ良いですよね。中古でも安いし、AI遊びには最適だと思います。

    • #76294 返信
      名無しさん
      自分はRX 6600なんですが、ROCmでうまく動かせなくて… CUDA一択なんですかね。

      • #76295 返信
        名無しさん
        やっぱりローカルLLMはCUDAが安定してますね。AMDも最近は頑張ってるけど、まだまだ互換性に課題があります。

    • #76296 返信
      名無しさん
      14Bモデルなら3060 12GBで十分実用的だと思います。Q4_K_Mなら速度も悪くないし、初心者にもおすすめです。

    • #76297 返信
      名無しさん
      もっと小さい7Bや8Bモデルでも実用になるよ。特にCPU+GPU併用ならメモリ節約できる。

    • #76298 返信
      名無しさん
      DeepSeekは日本語もそこそこ使えます。たまに変な返答があるけど、趣味で使うなら問題ないレベル。

    • #76299 返信
      名無しさん
      ファインチューニングもしたいけど、VRAMが足りなくて断念してます。3060でファインチューニングできたらいいのに。

    • #76300 返信
      名無しさん
      とりあえずこの設定で試してみます。情報ありがとうございました!

18件の返信を表示中(うち親返信14件)
返信先: RTX 3060 12GBでDeepSeek 14B Q4_K_Mを動かした話で#76299に返信
あなたの情報:




AA
tchmii
タイトルとURLをコピーしました