スレッド概要
「llama.cpp b5576でDeepSeek-R1-0528-Qwen3-8BをVSCode+MCPで動かした話」についてのスレッドです。最新のllama.cpp(b5576)とDeepSeek-R1-0528-Qwen3-8B(Q8_0量子化)のGGUFモデルをVSCodeとMCP(Model Context Protocol)で正常に動作させたとのこと。 ローカルLLMでDeepSeekモデルを使い、コーディング支援やプライバシー面での利点が議論されていました。 25件の返信で意見交換されています。
- このトピックには25件の返信、8人の参加者があり、最後に名無しさんにより2年、 10ヶ月前に更新されました。
25件の返信を表示中(うち親返信10件)
-
投稿者投稿
-
-
名無しさんRedditのr/LocalLLaMAに投稿された話題です。最新のllama.cpp(b5576)とDeepSeek-R1-0528-Qwen3-8B(Q8_0量子化)のGGUFモデルをVSCodeとMCP(Model Context Protocol)で正常に動作させたとのこと。ローカルLLMでDeepSeekモデルを使い、コーディング支援やプライバシー面での利点が議論されていました。モデルの性能やコスト、ベンチマーク比較などについて、皆さんの経験や意見を聞かせてください。
-
名無しさんおお、DeepSeek-R1の8Bモデルをローカルで動かせるのか。Q8_0だと品質もそこそこ良さそうだな。
-
名無しさんQ8_0はほぼ無損失と言われてるから、実用レベルだね。でも8Bだとコンテキスト長が気になる。
-
-
名無しさんVSCodeとMCP連携って具体的にどうやるんだろう?プラグインとかあるのかな。
-
名無しさんDeepSeekって中国のモデルだよね。プライバシー大丈夫なのか?
-
名無しさんローカルなら全部自分の管理下だから安心だよ。データ漏洩のリスクは低い。
-
名無しさんでもモデル自体に何か仕込まれてたらどうするんだ?そこは信頼の問題だな。
-
-
-
名無しさんllama.cppのb5576って何か新機能あるの?いつもアップデート速くて追いつけない。
-
名無しさんK-quantsの改善とか、推論速度向上らしいよ。でも細かい変更はリリースノート見ないと。
-
-
名無しさんMCP(Model Context Protocol)って初めて聞いた。どんな仕組み?
-
名無しさん簡単に言うと、LLMが外部ツールを呼び出すためのプロトコル。VSCode拡張と連携してコード補完とかできるらしい。
-
名無しさんなるほど。でもセットアップが面倒そうだな。
-
-
-
名無しさんDeepSeek-R1はコーディング向きって聞くけど、実際どうなの?
-
名無しさん自分はQwen2.5-Coder使ってるけど、DeepSeekはたまに変なコードを出すって評判も見る。
-
名無しさんモデルサイズが小さいから仕方ないかも。でも8Bでここまでできるのは驚き。
-
-
-
名無しさんGPUのVRAMどれくらい必要?
-
名無しさんQ8_0の8Bモデルなら8GBくらいあれば動くんじゃないかな。オフロード次第。
-
名無しさん自分の6GB VRAMじゃ厳しいか…CPUオンリーでも何とかならん?
-
名無しさんCPUオンリーだと遅すぎて実用にならないと思う。せめてGPU一部オフロード推奨。
-
-
-
-
名無しさんllama.cppのビルドが面倒で、プリビルドバイナリ使ってるわ。
-
名無しさん自分でビルドするとCUDA対応とかカスタマイズできるから便利だけど、初心者にはハードル高いよね。
-
-
名無しさんDeepSeek-R1よりQwen3の方がコーディング性能高いってベンチマーク結果を見た。
-
名無しさんでもR1は推論特化っぽいから、用途次第じゃない?
-
-
名無しさんMCPってセキュリティ的に大丈夫なのか?任意のコード実行できそうで怖い。
-
名無しさんサンドボックス内で動かせば問題ないはず。ちゃんと設定すればリスクは低いよ。
-
名無しさんとはいえ、信用できないモデルを使うのは注意した方がいい。特に中国系は情報管理に気をつけて。
-
-
-
-
投稿者投稿
25件の返信を表示中(うち親返信10件)
関連するAIトピック
- DeepSeek V3でコード監査エージェント作ったってのスレ。AST解析+ハイブリッド検索でシニア級らしい。20件の返信最終更新 2023年8月3日 16:32
- DeepSeek V4とBaiduのKunlunxinチップに関するの投稿を見つけた18件の返信最終更新 2023年7月21日 15:17
- Qwenが32B/235Bベースモデルを非公開に、DeepSeekへの蒸留対策か?15件の返信最終更新 2023年10月16日 19:20
- DeepSeek-R1-Qwen3-8bのトークナイザーをQwen3 30b A3bにコピーできる?17件の返信最終更新 2023年10月16日 17:34
- DeepSeek-R1-0528-Qwen3-8BのOpenVINO量子化バージョンが公開されたらしい19件の返信最終更新 2023年10月16日 15:53