llama.cpp b5576でDeepSeek-R1-0528-Qwen3-8BをVSCode+MCPで動かした話

掲示板 フォーラム AI llama.cpp b5576でDeepSeek-R1-0528-Qwen3-8BをVSCode+MCPで動かした話

スレッド概要

「llama.cpp b5576でDeepSeek-R1-0528-Qwen3-8BをVSCode+MCPで動かした話」についてのスレッドです。最新のllama.cpp(b5576)とDeepSeek-R1-0528-Qwen3-8B(Q8_0量子化)のGGUFモデルをVSCodeとMCP(Model Context Protocol)で正常に動作させたとのこと。 ローカルLLMでDeepSeekモデルを使い、コーディング支援やプライバシー面での利点が議論されていました。 25件の返信で意見交換されています。

  • このトピックには25件の返信、8人の参加者があり、最後に名無しさんにより2年、 10ヶ月前に更新されました。
25件の返信を表示中(うち親返信10件)
  • 投稿者
    投稿
    • #81074 返信
      名無しさん
      Redditのr/LocalLLaMAに投稿された話題です。最新のllama.cpp(b5576)とDeepSeek-R1-0528-Qwen3-8B(Q8_0量子化)のGGUFモデルをVSCodeとMCP(Model Context Protocol)で正常に動作させたとのこと。ローカルLLMでDeepSeekモデルを使い、コーディング支援やプライバシー面での利点が議論されていました。モデルの性能やコスト、ベンチマーク比較などについて、皆さんの経験や意見を聞かせてください。

    • #81075 返信
      名無しさん
      おお、DeepSeek-R1の8Bモデルをローカルで動かせるのか。Q8_0だと品質もそこそこ良さそうだな。

      • #81077 返信
        名無しさん
        Q8_0はほぼ無損失と言われてるから、実用レベルだね。でも8Bだとコンテキスト長が気になる。

    • #81076 返信
      名無しさん
      VSCodeとMCP連携って具体的にどうやるんだろう?プラグインとかあるのかな。

    • #81078 返信
      名無しさん
      DeepSeekって中国のモデルだよね。プライバシー大丈夫なのか?

      • #81079 返信
        名無しさん
        ローカルなら全部自分の管理下だから安心だよ。データ漏洩のリスクは低い。

        • #81080 返信
          名無しさん
          でもモデル自体に何か仕込まれてたらどうするんだ?そこは信頼の問題だな。

    • #81081 返信
      名無しさん
      llama.cppのb5576って何か新機能あるの?いつもアップデート速くて追いつけない。

      • #81082 返信
        名無しさん
        K-quantsの改善とか、推論速度向上らしいよ。でも細かい変更はリリースノート見ないと。

    • #81083 返信
      名無しさん
      MCP(Model Context Protocol)って初めて聞いた。どんな仕組み?

      • #81084 返信
        名無しさん
        簡単に言うと、LLMが外部ツールを呼び出すためのプロトコル。VSCode拡張と連携してコード補完とかできるらしい。

        • #81085 返信
          名無しさん
          なるほど。でもセットアップが面倒そうだな。

    • #81086 返信
      名無しさん
      DeepSeek-R1はコーディング向きって聞くけど、実際どうなの?

      • #81087 返信
        名無しさん
        自分はQwen2.5-Coder使ってるけど、DeepSeekはたまに変なコードを出すって評判も見る。

        • #81088 返信
          名無しさん
          モデルサイズが小さいから仕方ないかも。でも8Bでここまでできるのは驚き。

    • #81089 返信
      名無しさん
      GPUのVRAMどれくらい必要?

      • #81090 返信
        名無しさん
        Q8_0の8Bモデルなら8GBくらいあれば動くんじゃないかな。オフロード次第。

        • #81091 返信
          名無しさん
          自分の6GB VRAMじゃ厳しいか…CPUオンリーでも何とかならん?

          • #81092 返信
            名無しさん
            CPUオンリーだと遅すぎて実用にならないと思う。せめてGPU一部オフロード推奨。

    • #81093 返信
      名無しさん
      llama.cppのビルドが面倒で、プリビルドバイナリ使ってるわ。

      • #81094 返信
        名無しさん
        自分でビルドするとCUDA対応とかカスタマイズできるから便利だけど、初心者にはハードル高いよね。

    • #81095 返信
      名無しさん
      DeepSeek-R1よりQwen3の方がコーディング性能高いってベンチマーク結果を見た。

      • #81096 返信
        名無しさん
        でもR1は推論特化っぽいから、用途次第じゃない?

    • #81097 返信
      名無しさん
      MCPってセキュリティ的に大丈夫なのか?任意のコード実行できそうで怖い。

      • #81098 返信
        名無しさん
        サンドボックス内で動かせば問題ないはず。ちゃんと設定すればリスクは低いよ。

        • #81099 返信
          名無しさん
          とはいえ、信用できないモデルを使うのは注意した方がいい。特に中国系は情報管理に気をつけて。

25件の返信を表示中(うち親返信10件)
返信先: llama.cpp b5576でDeepSeek-R1-0528-Qwen3-8BをVSCode+MCPで動かした話
あなたの情報:




AA
tchmii
タイトルとURLをコピーしました