スレッド概要
「DeepSeek-V3.2登場!ローカルLLMの新境地?」についてのスレッドです。まだコメントは少ないけど、DeepSeekの新モデルってことで性能や使い勝手について語りたい。 特にローカルで動かせるサイズなのか、コーディングや日本語対応はどうか、ベンチマーク結果は? 25件の返信で意見交換されています。
- このトピックには25件の返信、8人の参加者があり、最後に名無しさんにより2年、 11ヶ月前に更新されました。
25件の返信を表示中(うち親返信12件)
-
投稿者投稿
-
-
名無しさんRedditのr/LocalLLaMAでDeepSeek-V3.2の話題が出てました。
まだコメントは少ないけど、DeepSeekの新モデルってことで性能や使い勝手について語りたい。特にローカルで動かせるサイズなのか、コーディングや日本語対応はどうか、ベンチマーク結果は?ってとこですね。評価や使用感をシェアしましょう。 -
名無しさんついに来たか。V3.1からどれくらい変わったんだろう。
-
名無しさんパラメータ数は同じくらいらしいけど、トレーニングデータが増えてるみたい。
-
-
名無しさんコーディング性能はどう?CodeLlamaよりいいかな。
-
名無しさんベンチマークだとHumanEvalで結構良いスコア出てるよ。でも実際使ってみないとわからん。
-
-
名無しさん日本語対応はまだ微妙なのかな。学習データに日本語少なそう。
-
名無しさん試したけど、日本語はたまに変な出力になる。でも英語よりはマシになった気がする。
-
-
名無しさんローカルで動かすなら量子化必須だよな。Q4_K_Mでどのくらいの速度か気になる。
-
名無しさん32BモデルだからVRAM12GBくらいあれば動くって聞いたけど、実際はもっと必要かも。
-
-
名無しさんDeepSeekってAPIも安いらしいけど、やっぱりプライバシーが気になる。
-
名無しさんローカルで完結できるのが理想だよね。その点V3.2はいい選択肢かもしれない。
-
-
名無しさん他のモデルと比較した人いる?Llama 3.1やQwen 2.5とどう違う?
-
名無しさん簡単な比較だと、DeepSeekは数学と推論が強いって印象。でもクリエイティブなタスクはLlamaの方が上かも。
-
名無しさん同意。コーディングと数式はDeepSeek、文章生成はLlamaって使い分けかな。
-
-
-
名無しさんMoE(Mixture of Experts)なのがいいね。推論速度はそんなに変わらないけど。
-
名無しさんMoEだとメモリ効率は良いけど、キャッシュ周りが微妙らしい。
-
-
名無しさん中国のモデルだからデータの偏りが心配。やっぱり特定の話題でバイアスあるよな。
-
名無しさんそこは気をつけて使わないとね。でもOSSで公開されてるのはありがたい。
-
-
名無しさん実際に動かした人いる?どんな環境でどのくらいの速度?
-
名無しさんRTX4090で16bitならそこそこ速い。でも4bit量子化なら30Bモデルと似た感じ。
-
名無しさんなるほど。自分は3090だからちょっと厳しいかな。
-
-
-
名無しさんライセンスはどうなってるの?商用利用できる?
-
名無しさんMITライセンスだったはず。結構自由度高いよ。
-
-
名無しさんベンチマークの数字だけ見るとすごいけど、実用でどこまで使えるかだな。
-
名無しさんそうそう。特に長文の要約とか会話の継続はまだ課題あり。
-
-
名無しさんとりあえずダウンロードしてみる。またレポートするわ。
-
-
投稿者投稿
25件の返信を表示中(うち親返信12件)
関連するAIトピック
- DeepSeek V3でコード監査エージェント作ったってのスレ。AST解析+ハイブリッド検索でシニア級らしい。20件の返信最終更新 2023年8月3日 16:32
- DeepSeek V4とBaiduのKunlunxinチップに関するの投稿を見つけた18件の返信最終更新 2023年7月21日 15:17
- Qwenが32B/235Bベースモデルを非公開に、DeepSeekへの蒸留対策か?15件の返信最終更新 2023年10月16日 19:20
- DeepSeek-R1-Qwen3-8bのトークナイザーをQwen3 30b A3bにコピーできる?17件の返信最終更新 2023年10月16日 17:34
- DeepSeek-R1-0528-Qwen3-8BのOpenVINO量子化バージョンが公開されたらしい19件の返信最終更新 2023年10月16日 15:53