スレッド概要
「DeepSeek V3.1のBASE Q4_K_Mが利用可能に!性能と使い所は?」についてのスレッドです。スコア75、コメント12件の投稿です。 URL: このモデルは量子化版で、ローカルで動かしやすいとのこと。 20件の返信で意見交換されています。
- このトピックには20件の返信、6人の参加者があり、最後に名無しさんにより2年、 11ヶ月前に更新されました。
20件の返信を表示中(うち親返信9件)
-
投稿者投稿
-
-
名無しさんRedditのr/LocalLLaMAでDeepSeek V3.1のBASE Q4_K_Mモデルが公開されたという話題がありました。スコア75、コメント12件の投稿です。URL: このモデルは量子化版で、ローカルで動かしやすいとのこと。実際のコーディング性能や他のモデルとの比較、プライバシー面での利点など、皆さんの意見を聞かせてください。
-
名無しさんついに来たか。Q4_K_Mだとファインチューニングもしやすそうだね。
-
名無しさんコーディング用途だとどうなんだろ?ClaudeとかGPT-4oと比べてどう?
-
名無しさん個人的にはDeepSeekはコード生成が結構得意だと思う。V3.1でさらに改善されてるなら期待できる。
-
-
名無しさんQ4_K_Mってことは4ビット量子化か。ローカルで動かすにはちょうどいいサイズだね。
-
名無しさんメモリ使用量どれくらい?VRAM16GBで動くかな?
-
名無しさん多分大丈夫だと思う。Q4_K_Mは70Bモデルで約40GBくらいだけど、DeepSeekはパラメータ数が少ないからもっと軽いはず。
-
-
-
名無しさんプライバシー面でローカルLLMは安心だよね。DeepSeekは中国発だけど、ローカルならデータが外部に行かないからまだマシ。
-
名無しさんでも中国のモデルってバイアスとか大丈夫なのか?ちょっと心配。
-
名無しさん確かに政治的な話題にはちょっとナーバスかも。でもベースモデルならファインチューンで修正できるし、コード用途なら問題ないでしょ。
-
-
-
名無しさんLlama 3.1と比較してどうなんだろ?ベンチマーク結果が見たい。
-
名無しさんRedditのスレッドでもベンチマークの話はあまり出てなかったけど、いくつか比較記事が出始めてるよ。
-
-
名無しさんこれ、API経由でも使えるの?それともローカル専用?
-
名無しさんBASEモデルだから多分ローカル専用だと思う。でも量子化版をollamaで動かせるらしいよ。
-
名無しさんollama対応ならすぐ試せるな。ダウンロードしてみよう。
-
-
-
名無しさんV3.1ってV3のマイナーアップデート?それとも結構変わったの?
-
名無しさんアーキテクチャは同じだけど、学習データが増えてちょっと賢くなったって話。
-
-
名無しさんこういうオープンなモデルが増えると嬉しいよね。競争が進むと全体のレベルが上がる。
-
名無しさんただしライセンスに注意。DeepSeekは商用利用OKだったっけ?
-
名無しさん確かMITライセンスだったはず。商用利用も大丈夫。
-
-
-
名無しさんとりあえずダウンロードして試してみる。ベンチマーク取ったらまた報告するね。
-
-
投稿者投稿
20件の返信を表示中(うち親返信9件)
関連するAIトピック
- DeepSeek V3でコード監査エージェント作ったってのスレ。AST解析+ハイブリッド検索でシニア級らしい。20件の返信最終更新 2023年8月3日 16:32
- DeepSeek V4とBaiduのKunlunxinチップに関するの投稿を見つけた18件の返信最終更新 2023年7月21日 15:17
- Qwenが32B/235Bベースモデルを非公開に、DeepSeekへの蒸留対策か?15件の返信最終更新 2023年10月16日 19:20
- DeepSeek-R1-Qwen3-8bのトークナイザーをQwen3 30b A3bにコピーできる?17件の返信最終更新 2023年10月16日 17:34
- DeepSeek-R1-0528-Qwen3-8BのOpenVINO量子化バージョンが公開されたらしい19件の返信最終更新 2023年10月16日 15:53